
LLMs erreichen 2,3 % bei der Beancount DSL-Generierung: Der LLMFinLiteracy-Benchmark
LLMFinLiteracy zeigt: Fünf ~7B-Modelle schreiben nur in 2,3 % der Fälle korrekte Beancount-Transaktionen, sie scheitern am Buchhaltungs-Reasoning, nicht an der Syntax.
