跳到正文
OpenAI News·· 21 天前精选AI 评分68

OpenAI 公布模型不对齐报告框架与 6 份异常行为案例

Our framework for reporting model misalignment

AI 导读

OpenAI 公布了一套用于追踪、调查和披露模型不对齐的框架。该框架同步附带了 6 份关于模型非预期或令人担忧行为的具体报告。

推荐理由

该框架提供了跟踪与披露模型异常行为的标准化流程,读者可参考其在安全调查中的处理机制。

来源:OpenAI News · openai.com