
AD-LLM-Benchmark: GPT-4o erreicht 0,93+ AUROC Zero-Shot bei der Text-Anomalieerkennung
AD-LLM zeigt, dass GPT-4o Zero-Shot 0,93–0,99 AUROC bei der Text-Anomalieerkennung erreicht, doch die LLM-Modellauswahl für KI-Finanzprüfung bleibt unzuverlässig.
#anomaly-detection
Erkennung von Unregelmäßigkeiten und Duplikaten in Klartext-Hauptbuchdaten

AD-LLM zeigt, dass GPT-4o Zero-Shot 0,93–0,99 AUROC bei der Text-Anomalieerkennung erreicht, doch die LLM-Modellauswahl für KI-Finanzprüfung bleibt unzuverlässig.

CausalTAD ordnet Tabellenspalten vor der LLM-Serialisierung nach kausaler Abhängigkeit um und hebt den mittleren AUC-ROC gegenüber AnoLLM von 0,803 auf 0,834.