
Benchmark AD-LLM : GPT-4o atteint un AUROC de 0,93+ en Zero-Shot pour la détection d'anomalies textuelles
AD-LLM constate que GPT-4o atteint 0,93 à 0,99 d'AUROC en zero-shot pour les anomalies textuelles, mais le choix du modèle LLM reste peu fiable en audit financier.
