
LLM набирают 2,3% при генерации Beancount DSL: бенчмарк LLMFinLiteracy
LLMFinLiteracy выясняет, что пять моделей ~7B корректно пишут транзакции Beancount лишь в 2,3% случаев, ошибаясь в бухгалтерских рассуждениях, а не в синтаксисе.
#double-entry
Принципы двойной записи и их применение в бухгалтерии с ИИ

LLMFinLiteracy выясняет, что пять моделей ~7B корректно пишут транзакции Beancount лишь в 2,3% случаев, ошибаясь в бухгалтерских рассуждениях, а не в синтаксисе.

AuditCopilot снижает ложные срабатывания при выявлении мошенничества в проводках с 942 до 12, но абляция показывает, что LLM в основном синтезирует оценки Isolation Forest.