OpenAI News·· 2026-03-05精选AI 评分64
OpenAI 研究指出推理模型难以控制思维链,有利于安全监控
Reasoning models struggle to control their chains of thought, and that’s good
AI 导读
OpenAI 推出 CoT-Control 评估框架,发现推理模型难以主动控制自身的链式推理过程。这一特性表明模型较难隐匿其思维轨迹,进一步巩固了思维链可监控性作为 AI 安全防线的有效性。
推荐理由
研究通过测试推理模型对思维链的控制能力,表明当前模型难以隐匿思维过程,为通过监控思维链保障模型安全提供了依据。
来源:OpenAI News · openai.com