
LLM набирают 2,3% при генерации Beancount DSL: бенчмарк LLMFinLiteracy
LLMFinLiteracy выясняет, что пять моделей ~7B корректно пишут транзакции Beancount лишь в 2,3% случаев, ошибаясь в бухгалтерских рассуждениях, а не в синтаксисе.
#financial-literacy
Исследования представления финансовых знаний и компетентности LLM

LLMFinLiteracy выясняет, что пять моделей ~7B корректно пишут транзакции Beancount лишь в 2,3% случаев, ошибаясь в бухгалтерских рассуждениях, а не в синтаксисе.

FinMaster Benchmark: лучшие LLM достигают 96% в финансовой грамотности, но лишь 3% в генерации отчётов. Распространение ошибок стоит 21 пункт на консультационных задачах.