Перейти до основного вмісту

#plain-text-accounting

Бухгалтерський облік у звичайному тексті

Дослідження на основі форматів і процесів текстової бухгалтерії

Передавання завдань з урахуванням невизначеності для агентів LLM: коли переходити від малих до великих моделей

ReDAct делегує від малої моделі до великої лише коли перплексія сигналізує про невизначеність, скорочуючи витрати на 64% за тієї ж точності для агентних робочих процесів.

OpenHands: Відкрита платформа для програмних агентів ШІ та що вона означає для автоматизації фінансів

Агент CodeAct від OpenHands набирає 26% на SWE-Bench Lite, показуючи, що AI-агенти надійно роблять сьогодні. Фінансову автоматизацію варто починати вузько, не з автономії.

τ²-bench: Вимірювання вартості подвійного керування в розмовних ШІ-агентах

τ²-bench показує: активні користувачі з власними інструментами знижують успішність розмовних агентів на 18–25 пунктів. Агенти Beancount зі спільним записом втрачають так само.