
Бенчмарк AD-LLM: GPT-4o досягає 0.93+ AUROC Zero-Shot для виявлення аномалій у тексті
AD-LLM виявляє, що GPT-4o досягає 0,93–0,99 AUROC у zero-shot для виявлення текстових аномалій, але вибір моделі LLM залишається ненадійним для ШІ фінансового аудиту.
