跳到正文
OpenAI News·· 2026-03-05精选AI 评分64

OpenAI 研究指出推理模型难以控制思维链,有利于安全监控

Reasoning models struggle to control their chains of thought, and that’s good

AI 导读

OpenAI 推出 CoT-Control 评估框架,发现推理模型难以主动控制自身的链式推理过程。这一特性表明模型较难隐匿其思维轨迹,进一步巩固了思维链可监控性作为 AI 安全防线的有效性。

推荐理由

研究通过测试推理模型对思维链的控制能力,表明当前模型难以隐匿思维过程,为通过监控思维链保障模型安全提供了依据。

来源:OpenAI News · openai.com