
Benchmark AD-LLM: GPT-4o assoleix un AUROC de 0,93+ en detecció d'anomalies de text zero-shot
AD-LLM troba que GPT-4o assoleix 0,93–0,99 AUROC zero-shot en detecció d'anomalies de text, però la selecció de model LLM no és fiable per a auditoria financera.
