پرش به محتوای اصلی

#security

امنیت

پژوهش ایمنی، امنیت و حفاظ‌گذاری برای عامل‌های هوش مصنوعی در زمینه‌های مالی

استفاده تاییدپذیر و امن از ابزارها برای عامل‌های مدل زبانی بزرگ: تلاقی STPA و MCP

STPA به‌همراه MCP تقویت‌شده با قابلیت، مشخصات ایمنی رسمی برای استفاده از ابزار مدل زبانی بزرگ تولید می‌کند و Alloy در مطالعه موردی تقویم اثبات می‌کند جریان ناایمنی وجود ندارد.

AGrail: نرده‌های حفاظتی امنیتی تطبیقی برای عامل‌های مدل زبانی بزرگ (LLM) با قابلیت یادگیری در طول وظایف

محافظ دو مدل زبانی بزرگ AGrail موفقیت حمله تزریق پرامپت را به ۰٪ کاهش می‌دهد و در عین حال ۹۵.۶٪ اقدامات بی‌خطر عامل را در Safe-OS حفظ می‌کند.