Перейти к основному содержимому

#trust

Доверие

Надёжность, калибровка и галлюцинации в финансовых ИИ-системах

Учёт неопределенности при делегировании задач LLM-агентами: когда переходить от малых моделей к большим

ReDAct переходит от малой модели к большой только когда перплексия сигнализирует о неопределённости, снижая затраты на 64% при той же точности для рабочих процессов агентов.

Верифицируемо безопасное использование инструментов LLM-агентами: STPA встречает MCP

STPA вместе с расширенным MCP даёт формальные спецификации безопасности для инструментов LLM, а Alloy доказывает отсутствие небезопасных потоков в примере с календарём.