
Benchmark AD-LLM: GPT-4o Alcança 0,93+ AUROC Zero-Shot para Detecção de Anomalias em Texto
O AD-LLM mostra o GPT-4o atingindo 0,93–0,99 de AUROC zero-shot em anomalias de texto, mas a seleção de modelo segue instável para auditoria.
#anomaly-detection
Deteção de irregularidades e entradas duplicadas em dados de livros de razão em texto simples

O AD-LLM mostra o GPT-4o atingindo 0,93–0,99 de AUROC zero-shot em anomalias de texto, mas a seleção de modelo segue instável para auditoria.

O CausalTAD reordena colunas de tabelas por dependência causal antes da serialização para o LLM, elevando o AUC-ROC médio de 0,803 para 0,834 em relação ao AnoLLM.