跳到正文
原文
OpenAI News·· 2024-12-20AI 评分52

OpenAI 提出审议式对齐:推理让语言模型更安全

Deliberative alignment: reasoning enables safer language models

AI 导读

OpenAI 为 o1 模型提出名为审议式对齐(deliberative alignment)的新对齐策略,直接教模型安全规范以及如何对这些规范进行推理。

来源:OpenAI News · openai.com