OpenAI News·· 2025-08-27精选AI 评分62
OpenAI 与 Anthropic 公布联合安全评估结果
OpenAI and Anthropic share findings from a joint safety evaluation
AI 导读
OpenAI 与 Anthropic 公布首次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、幻觉、越狱等方面的表现。评估同时呈现了进展、挑战以及跨实验室合作的价值。
推荐理由
两家头部实验室首次联合开展安全评估,读者可了解跨实验室互测在失准、越狱等维度上的进展与挑战。
来源:OpenAI News · openai.com