
Els LLM obtenen un 2,3% en la generació de DSL de Beancount: El benchmark LLMFinLiteracy
LLMFinLiteracy troba que cinc models d'uns 7B escriuen transaccions Beancount correctes només un 2,3% de les vegades, fallant en raonament comptable més que en sintaxi.


