
Benchmark AD-LLM: GPT-4o dosahuje 0,93+ AUROC Zero-Shot pri detekcii textových anomálií
AD-LLM zisťuje, že GPT-4o dosahuje 0,93–0,99 AUROC zero-shot pri detekcii textových anomálií, ale výber LLM modelu zostáva nespoľahlivý pre AI finančný audit.
#anomaly-detection
Odhaľovanie nezrovnalostí a duplicitných záznamov v plain-text účtovných dátach

AD-LLM zisťuje, že GPT-4o dosahuje 0,93–0,99 AUROC zero-shot pri detekcii textových anomálií, ale výber LLM modelu zostáva nespoľahlivý pre AI finančný audit.

CausalTAD preusporiada stĺpce tabuľky podľa kauzálnej závislosti pred serializáciou do LLM, čím zvýši priemerné AUC-ROC z 0,803 na 0,834 oproti AnoLLM.