
LLM's scoren 2,3% op Beancount DSL-generatie: De LLMFinLiteracy-benchmark
LLMFinLiteracy vindt dat vijf ~7B-modellen slechts 2,3% van de tijd correcte Beancount-transacties schrijven, falend op boekhoudkundig redeneren, niet op syntaxis.
#double-entry
Principes van dubbel boekhouden en hun toepassing in AI-ondersteunde accounting

LLMFinLiteracy vindt dat vijf ~7B-modellen slechts 2,3% van de tijd correcte Beancount-transacties schrijven, falend op boekhoudkundig redeneren, niet op syntaxis.

AuditCopilot verlaagt false positives bij fraude met journaalposten van 942 naar 12, maar ablatie toont dat de LLM vooral Isolation Forest-scores synthetiseert.