
AD-LLM Benchmark: GPT-4o alcanza un AUROC de 0,93+ en Zero-Shot para la detección de anomalías en texto
AD-LLM halla que GPT-4o alcanza 0.93–0.99 AUROC zero-shot en detección de anomalías de texto, pero la selección de modelo LLM sigue siendo poco fiable.
