OpenAI News·· 2025-12-22精选AI 评分60
OpenAI 持续加固 ChatGPT Atlas 抵御提示词注入
Continuously hardening ChatGPT Atlas against prompt injection
AI 导读
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示词注入攻击。这一发现与修补的循环能更早识别新型攻击手法,在 AI 智能体能力增强的同时强化浏览器智能体的防御。
推荐理由
OpenAI 披露用强化学习训练的自动化红队持续发现并修补 Atlas 的提示词注入漏洞,可了解浏览器智能体的安全加固思路。
来源:OpenAI News · openai.com