
Бенчмарк AD-LLM: GPT-4o достигает 0,93+ AUROC в режиме Zero-Shot для обнаружения текстовых аномалий
AD-LLM обнаруживает, что GPT-4o достигает 0,93–0,99 AUROC в zero-shot для текстового обнаружения аномалий, но выбор модели LLM остаётся ненадёжным для ИИ финансового аудита.
