2026년 7월 8일약 5분JSONSchemaBench: 실제 스키마 복잡성으로 인한 LLM 구조적 출력 보장 실패JSONSchemaBench는 커버리지가 단순 스키마의 86%에서 복잡 스키마의 3%로 급락하며, LLM 구조화 출력이 조용히 비준수 JSON을 낼 수 있음을 밝힌다.Mike Thriftllmaimachine-learning
2026년 5월 31일약 5분싱글 에이전트: 동일 토큰 예산에서 멀티 홉 추론 시 멀티 에이전트와 동등한 성능동일한 추론 토큰 예산에서 싱글 에이전트 LLM은 멀티 홉 추론에서 멀티 에이전트 시스템과 동등하거나 더 나은 성능을 보입니다—더 간단한 금융 에이전트 설계를 선호합니다.Mike Thriftaillmmachine-learning