Codex Security 为何不提供 SAST 报告
OpenAI 详解 Codex Security 为何不依赖传统 SAST,而是用 AI 驱动的约束推理与验证来发现真实漏洞,并减少误报。
OpenAI 详解 Codex Security 为何不依赖传统 SAST,而是用 AI 驱动的约束推理与验证来发现真实漏洞,并减少误报。
OpenAI 介绍了 ChatGPT 在智能体工作流中抵御提示词注入与社会工程攻击的设计思路:通过限制高风险操作、保护敏感数据来降低风险。
OpenAI 介绍如何用 Responses API、shell 工具和托管容器构建智能体运行时,让智能体在安全、可扩展的环境中处理文件、工具和状态。
推荐理由:OpenAI 官方说明如何用 Responses API、shell 工具和托管容器搭建智能体运行时,可了解其安全与扩展思路。
Wayfair 借助 OpenAI 模型自动化工单分类,并大规模优化数百万条商品属性,以提升电商客服效率与商品目录准确率。
OpenAI 发布 IH-Challenge,用于训练模型优先执行可信指令,从而改进指令层级、安全可控性以及对提示词注入攻击的抵抗能力。
ChatGPT 推出面向数学和科学的交互式可视化讲解功能,帮助学生实时探索公式、变量和概念。
OpenAI 宣布收购 AI 安全平台 Promptfoo。Promptfoo 帮助企业在开发阶段识别并修复 AI 系统中的漏洞。
推荐理由:OpenAI 收购 AI 安全平台 Promptfoo,读者可了解其在 AI 系统开发期漏洞检测上的布局。
OpenAI 发布 AI 应用安全智能体 Codex Security,目前处于研究预览阶段。该智能体通过分析项目上下文来检测、验证并修补复杂漏洞,官方称其置信度更高、噪声更少。
推荐理由:OpenAI 官方给出 Codex Security 的定位与三项核心能力,可据此判断它在安全审计流程中的切入点。
Balyasny Asset Management 通过严格的模型评估、全平台使用 OpenAI 以及智能体工作流,重构了投资研究流程。该机构将模型评估、OpenAI 全平台能力与 agent 工作流结合,用于改造投资研究工作方式。
Descript 借助 OpenAI 推理模型实现大型内容库的自动本地化,在不丢失时间轴与语义的前提下完成多语言视频配音。该方案面向大规模视频内容库,支持自动化的多语言配音流程。
OpenAI 提出 CoT-Control,发现推理模型难以控制自己的思维链,这反而强化了可监控性作为 AI 安全防护手段的价值。
推荐理由:OpenAI 提出 CoT-Control 并观察到推理模型难以控制自身思维链,为可监控性作为安全手段提供了依据。
OpenAI 发布 GPT-5.4,称其为面向专业工作能力最强且高效的前沿模型,具备 SOTA 编码、计算机操作、工具搜索和 1M token 上下文。
推荐理由:OpenAI 官方发布 GPT-5.4,给出编码、计算机操作与 1M token 上下文等能力定位,便于判断其面向专业工作的边界。
OpenAI 发布面向学校的 AI 新工具、认证与评估资源,帮助中小学和高校缩小 AI 能力差距、扩大机会。这些资源旨在推动教育领域的 AI 应用真正转化为发展机遇。
德甲俱乐部 VfL Wolfsburg 将 ChatGPT 推广为全俱乐部层面的能力,重点放在人而非试点项目上。该俱乐部借此提升效率、创造力与知识共享,同时保留自身的足球身份。
OpenAI 推出 Adoption news channel,提供将 AI 进展转化为业务优势的实用洞察与框架。
OpenAI 提出五种 AI 价值模型,帮助领导者按从员工熟练度到流程重塑的顺序推进 AI 落地,以构建持久的业务优势。
OpenAI 推出 ChatGPT for Excel 和新的金融应用集成,由 GPT-5.4 驱动,用于在受监管环境中加速建模、研究与分析。
推荐理由:官方给出 ChatGPT for Excel 与金融数据集成两项变化,读者可据此判断 GPT-5.4 在受监管场景中的落地方式。
OpenAI 发布新预印本,将单负振幅扩展至引力子,GPT-5.2 Pro 参与推导并验证了量子引力中非零的引力子树振幅。
OpenAI 推出 Learning Outcomes Measurement Suite,用于长期评估 AI 在不同教育环境中对学生学习的影响。该套件面向多样化的教学场景,追踪 AI 使用与学习成果之间的关系。
Axios COO Allison Murphy 介绍了公司如何用 AI 支持本地记者、简化新闻编辑室工作流程,并规模化产出高影响力的本地新闻。
OpenAI 发布 GPT-5.3 Instant 系统卡,正文内容未能获取。
OpenAI 公布其与美国国防部(Department of War)的合同细节,内容涵盖安全红线、法律保护条款,以及 AI 系统在涉密环境中的部署方式。
推荐理由:OpenAI 官方披露与国防部门合同的边界条款,可了解 AI 进入涉密环境的合规与安全约束。
OpenAI 宣布获得 1100 亿美元新投资,投前估值 7300 亿美元。其中软银出资 300 亿美元,NVIDIA 出资 300 亿美元,Amazon 出资 500 亿美元。
推荐理由:OpenAI 公布 1100 亿美元新融资与投前估值,读者可据此了解其资本结构和主要出资方。
OpenAI 与 Amazon 宣布战略合作,将 OpenAI 的 Frontier 平台引入 AWS,并扩展 AI 基础设施、定制模型和企业级 AI 智能体。
推荐理由:OpenAI 与 Amazon 达成战略合作,读者可据此了解前沿模型平台进入 AWS 生态后的企业落地路径。
OpenAI 与 Microsoft 发布联合声明,称双方将继续在研究、工程和产品开发领域紧密合作。声明表示,这一合作建立在多年深度协作与共同成果的基础之上。
OpenAI 在 Amazon Bedrock 推出面向智能体的有状态运行时环境(Stateful Runtime for Agents),为基于 OpenAI 的多步 AI 工作流提供持久编排、记忆和安全执行能力。
OpenAI 公布其心理健康安全工作的多项更新,包括家长控制、信任联系人、改进的痛苦识别能力,以及近期诉讼进展。
OpenAI 与 Pacific Northwest National Laboratory 联合推出 DraftNEPABench,用于评估 AI 编程智能体如何加速联邦许可审批。该基准显示,NEPA 草案撰写时间最多可缩短 15%,有望推动基础设施审查现代化。
OpenAI 与 Figma 推出 Codex 集成,打通代码与设计,让团队在实现与 Figma canvas 之间自由切换、加快迭代与交付。
OpenAI 最新威胁报告分析了恶意行为者如何将 AI 模型与网站、社交平台结合使用,并探讨这对检测与防御意味着什么。报告聚焦此类组合手法带来的识别与防护挑战。
OpenAI 任命 Arvind KC 为首席人才官,负责帮助公司规模化扩张、强化企业文化,并主导 AI 时代工作方式的演进。
OpenAI 宣布不再评估 SWE-bench Verified,原因是该基准日益受到污染,且无法准确衡量前沿编码能力。其分析指出该基准存在测试缺陷与训练数据泄漏问题,并建议改用 SWE-bench Pro。
OpenAI 宣布推出 Frontier Alliance Partners,帮助企业从 AI 试点走向生产环境,实现安全、可扩展的智能体部署。
OpenAI 公开了其 AI 模型针对 First Proof 数学挑战的证明尝试,该挑战旨在测试模型在专家级问题上的研究级推理能力。
OpenAI 承诺向 The Alignment Project 投入 750 万美元,用于资助独立的 AI 对齐研究,以加强全球应对 AGI 安全与安保风险的努力。
OpenAI 推出 OpenAI for India,在印度扩大 AI 接入,建设本地基础设施、赋能企业并提升劳动力技能。该计划面向印度全国,覆盖基础设施、企业应用与人才培养三个方向。
OpenAI 与 Paradigm 联合推出 EVMbench,用于评测 AI 智能体检测、修补和利用高危智能合约漏洞的能力。该基准聚焦高严重性漏洞,覆盖发现、修复与攻击三类任务。
OpenAI 发布新预印本,显示 GPT-5.2 为胶子振幅提出了一个新公式,随后由 OpenAI 与学术合作者完成形式化证明与验证。
推荐理由:OpenAI 与学术合作者披露 GPT-5.2 提出胶子振幅新公式并被形式化证明,可观察大模型参与理论物理推导的边界。
OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。
推荐理由:OpenAI 为 ChatGPT 加入面向企业的提示词注入与数据外泄防护选项,读者可了解其安全边界的新变化。
OpenAI 开源新工具包 GABRIEL,借助 GPT 把定性文本和图像转化为定量数据,帮助社会科学家大规模分析研究。该工具面向社会科学研究场景,可扩展处理规模。