
LLM dosahujú 2,3 % v generovaní Beancount DSL: Benchmark LLMFinLiteracy
LLMFinLiteracy zisťuje, že päť modelov s ~7B parametrami napíše správne Beancount transakcie len v 2,3 % prípadov, pričom zlyhávajú na účtovnom uvažovaní, nie na syntaxi.
#financial-literacy
Výskum reprezentácie finančných znalostí a kompetencie LLM

LLMFinLiteracy zisťuje, že päť modelov s ~7B parametrami napíše správne Beancount transakcie len v 2,3 % prípadov, pričom zlyhávajú na účtovnom uvažovaní, nie na syntaxi.

FinMaster Benchmark: špičkové LLM dosahujú 96 % vo finančnej gramotnosti, ale len 3 % pri generovaní výkazov. Šírenie chýb stojí 21 bodov pri konzultačných úlohách.