OpenAI News·2024-12-20 18:00· 2024-12-20AI 评分52OpenAI 提出审议式对齐:推理让语言模型更安全Deliberative alignment: reasoning enables safer language modelsAI 导读OpenAI 为 o1 模型提出名为审议式对齐(deliberative alignment)的新对齐策略,直接教模型安全规范以及如何对这些规范进行推理。来源:OpenAI News · openai.com#论文/研究#安全/对齐#推理#OpenAI