2026년 6월 23일약 5분Beancount DSL 생성에서 LLM 점수 2.3%: LLMFinLiteracy 벤치마크LLMFinLiteracy는 약 7B 모델 5종이 올바른 Beancount 분개를 작성한 비율이 2.3%에 그치며, 문법이 아닌 회계 추론에서 실패한다고 밝힌다.Mike Thriftllmbeancountplain-text-accounting
2026년 4월 18일약 4분FinMaster 벤치마크: LLM이 금융 문해력에서 96%를 기록하면서도 재무제표 생성에서는 3%에 그치는 이유FinMaster 벤치마크: 최상위 LLM은 금융 리터러시에서 96%를 기록하지만 재무제표 생성에서는 3%에 그친다. 오류 전파는 컨설팅 과제에서 21점 손실을 초래한다.Mike Thriftllmaccountingai