Към основното съдържание

#compliance

Съответствие

Изследвания на регулаторно съответствие, прилагане на политики и одиторски следи за финансови ИИ системи

FinToolBench: Оценка на LLM агенти при реален финансов инструментариум

FinToolBench съчетава 760 реални финансови API инструмента с 295 изпълними заявки, за да оцени LLM агенти върху реални финансови задачи — разкривайки, че консервативният процент на извикване от 22,7% на GPT-4o води до по-високо качество на отговорите (CSS 0,670) от агресивния TIR от 87,1% на Qwen3-8B, докато несъответствието на намеренията надхвърля 50% при всеки тестван модел.

Конституционен ИИ за счетоводни агенти: RLAIF, правила за политиките и рискове от Гудхартинг

Constitutional AI заменя ръчно етикетираните данни за вреди с AI обратна връзка, така че счетоводните агенти налагат правила без проверяващ за всяка транзакция.