
LLMs pontuam 2,3% na Geração de DSL Beancount: O Benchmark LLMFinLiteracy
O LLMFinLiteracy constata que cinco modelos de ~7B escrevem transações Beancount corretas apenas 2,3% das vezes, falhando no raciocínio contábil, não na sintaxe.
#double-entry
Princípios de partidas dobradas e a sua aplicação na contabilidade assistida por IA

O LLMFinLiteracy constata que cinco modelos de ~7B escrevem transações Beancount corretas apenas 2,3% das vezes, falhando no raciocínio contábil, não na sintaxe.

O AuditCopilot reduz falsos positivos de fraude em lançamentos de 942 para 12, mas a ablação mostra que o LLM só sintetiza pontuações do Isolation Forest.