2026年4月26日阅读需 1 分钟CRITIC:为什么大模型自我修正需要外部工具反馈CRITIC 通过外部工具而非模型自身来验证 LLM 修订,使开放域问答 F1 提升 7.7,毒性降低 79.2%。Mike Thriftaillmmachine-learning