OpenAI 为美国临床医生免费提供 ChatGPT for Clinicians
OpenAI 宣布 ChatGPT for Clinicians 面向经认证的美国医生、执业护士和药剂师免费开放,用于支持临床诊疗、文书记录和研究工作。
推荐理由:OpenAI 面向美国临床人员免费开放 ChatGPT,读者可了解其覆盖的执业人群与使用场景。
OpenAI 宣布 ChatGPT for Clinicians 面向经认证的美国医生、执业护士和药剂师免费开放,用于支持临床诊疗、文书记录和研究工作。
推荐理由:OpenAI 面向美国临床人员免费开放 ChatGPT,读者可了解其覆盖的执业人群与使用场景。
Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构,把大规模训练拆分为解耦的计算“岛屿”,岛屿间异步传输数据,从而隔离局部硬件故障。
推荐理由:原文给出分布式训练新架构的带宽、容错与跨代硬件实测数据,可据此判断大规模预训练基础设施的演进方向。
OpenAI 详解 Codex 智能体循环,通过 WebSockets 与连接级缓存降低 API 开销并改善模型延迟。
ChatGPT 推出工作区智能体(Workspace agents),可自动执行重复性工作流、连接工具并简化团队协作。该功能面向团队运营场景,帮助用户在 ChatGPT 内构建并使用这类智能体。
OpenAI 在 ChatGPT 中推出工作区智能体(workspace agents),由 Codex 驱动,可自动化复杂工作流并在云端运行。官方称其能帮助团队跨工具安全地扩展工作。
推荐理由:官方给出 ChatGPT 工作区智能体的定位与云端运行方式,可据此判断团队自动化流程的形态。
OpenAI 发布 Privacy Filter,一个用于检测和脱敏文本中个人身份信息(PII)的开放权重模型,官方称其准确率达到 state-of-the-art。目前公开信息仅有这一句摘要,未披露模型规模、许可协议或具体评测数据。
推荐理由:OpenAI 开源 PII 检测模型,读者可了解其在文本脱敏场景的定位与开放权重形态。
Google Research 在 ICLR 论文中提出 ReasoningBank,一个从成功和失败经验中提炼高层结构化记忆的智能体记忆框架,代码已开源。
Google DeepMind 宣布与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 五家咨询公司合作,推动前沿 AI 在企业规模化落地。
OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。原文同时提到可查看 Images 2.5 的新变化。
推荐理由:官方给出图像生成在文字渲染、多语言与视觉推理上的改进方向,可据此判断图像能力升级重点。
Hugging Face 发布 QIMMA قِمّة,一个在评测模型前先验证基准质量的阿拉伯语 LLM 排行榜,整合 14 个来源基准的 109 个子集、超 52,000 条样本,覆盖 7 大领域且 99% 为原生阿拉伯语内容。
OpenAI 推出 Codex Labs,并与埃森哲、普华永道、Infosys 等合作,帮助企业在软件开发生命周期中部署和扩展 Codex。OpenAI 同时公布 Codex 周活跃用户达到 4M。
推荐理由:OpenAI 公布 Codex 企业侧落地动作与 4M 周活数据,可观察编码智能体的企业采用节奏。
Hugging Face 发文讨论 Mythos 与 Project Glasswing 发布后的 AI 网络安全格局,指出 Mythos 的漏洞发现与修补能力来自模型、算力、软件数据与自主性组成的系统配方,而非单一模型。文章认为开源代码与工具能通过分布式检测、验证、协调与补丁传播缩小攻防能力差距,并主张采用半自主 AI 智能体在人类控制下进行防御。
伯克利 AI 研究团队提出 GRASP,一种面向学习型世界模型的梯度规划器,通过将轨迹提升到虚拟状态实现跨时间并行优化、在状态迭代上直接注入随机性以探索、并重塑梯度让动作获得清晰信号,同时避开高维视觉模型中脆弱的“状态-输入”梯度。该方法针对长时程规划中优化病态、非贪心结构导致的局部极小值以及高维潜空间失效模式等问题,使基于梯度的规划更稳健。
凯悦(Hyatt)在全球员工队伍中部署 ChatGPT Enterprise,使用 GPT-5.4 和 Codex 提升生产力、运营效率与宾客体验。OpenAI 为凯悦推进 AI 在员工中的应用提供支持。
Google 提出推理优先的合成数据框架 Simula,无需种子数据,将生成过程拆解为全局多样化、局部多样化、复杂化和质量检查四个可控步骤。该框架用 Gemini 2.5 Flash 作教师模型、Gemma-3 4B 作学生模型,在网络安全、法律推理、GSM8k 和 Global MMLU 五个领域各生成最多 512K 数据点,完整系统在所有领域均优于简单基线。
Google Research 提出神经元形态生成模型 MoGen,通过 PointInfinity 点云流匹配生成合成神经元形状,为 PATHFINDER 重建模型补充训练数据,使小鼠轴突重建误差降低 4.4%,主要来自合并错误的减少。在完整小鼠脑规模下,这相当于节省 157 人年的手动校对工作。MoGen 已开源,相关论文将在 ICLR 2026 展示。
OpenAI 更新 macOS 和 Windows 版 Codex 应用,新增计算机操作、应用内浏览、图像生成、记忆和插件功能,用于加速开发者工作流。
推荐理由:Codex 桌面端一次补齐计算机操作、应用内浏览与图像生成等能力,可据此判断编码智能体的功能边界。
OpenAI 发布前沿推理模型 GPT-Rosalind,面向生命科学研究。该模型用于加速药物发现、基因组分析、蛋白质推理和科研工作流。
推荐理由:OpenAI 面向生命科学推出前沿推理模型,读者可了解其瞄准的药物发现与基因组分析场景。
Hugging Face 发布一个 Skill 和配套测试工具,帮助贡献者把 transformers 中的语言模型移植到 mlx-lm,使模型加入 transformers 后能较快在 MLX 上可用。
推荐理由:Hugging Face 公开了把 transformers 模型移植到 mlx-lm 的 Skill 与测试工具,读者可了解其流程与对评审者的减负设计。
Hugging Face 将 RLVE 框架从单轮推理题扩展到多轮、工具增强的电商对话,推出 EcomRLVE-GYM,包含商品发现、替代品、购物车搭建、退货、订单跟踪、政策问答、组合规划、多意图旅程 8 个可验证环境,每个环境配有程序化出题、12 轴难度课程和算法可验证奖励。团队用 DAPO 训练 Qwen 3 8B 模型 300 步,早期结果显示环境扩展与自适应难度可迁移到真实智能体任务。
OpenAI 面向领先安全公司与企业开放 Trusted Access for Cyber,提供 GPT-5.4-Cyber 模型及 1000 万美元 API 资助,用于强化全球网络防御。
Sentence Transformers 现已支持训练和微调多模态嵌入与重排序模型,作者以微调 Qwen/Qwen3-VL-Embedding-2B 做视觉文档检索(VDR)为例演示流程。
Google DeepMind 发布 Gemini 3.1 Flash TTS,称其在可控性、表现力和语音质量上均有提升,在 Artificial Analysis TTS 榜单上取得 1,211 Elo 分数。
推荐理由:官方给出 Elo 1211 与音频标签等具体能力,读者可据此判断语音生成的可控性进展。
Hugging Face 推出 VAKRA,一个面向企业级环境的工具调用可执行基准,用完整执行轨迹评估 AI 智能体的组合式推理能力。VAKRA 提供 8,000+ 本地托管 API、覆盖 62 个领域,任务需 3-7 步推理链,包含 API 链式调用、工具选择、多跳推理等四类任务,模型整体表现不佳。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件与工具之间构建安全、长时间运行的智能体。
推荐理由:官方给出 Agents SDK 的两项能力变化,读者可据此判断长时运行智能体的构建方式。
HCompany 发布 Chrome 扩展 HoloTab,把其 3 月 31 日推出的计算机操作模型 Holo3 直接接入浏览器,用户描述需求后由智能体在网页内导航界面、填写字段并做决策,无需配置或技术背景。HoloTab 支持例程功能:开始录制后实时捕捉用户在标签页中的点击与口述,录制结束即生成可重复运行或定时调度的例程。该扩展目前免费开放使用。
推荐理由:HCompany 把自家 Holo3 计算机操作模型封装成浏览器扩展,读者可了解录制即生成例程的交互方式。
OpenAI 扩展 Trusted Access for Cyber 计划,向通过审核的防御方开放 GPT-5.4-Cyber,并同步加强安全防护措施。此举正值 AI 网络安全能力持续提升之际。
Google 在 Google Labs 上线研究实验 Vantage,用生成式 AI 构建模拟对话环境,评估高中与大学生的问题解决、协作等未来技能,目前提供英文版并可注册。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其推理优先机器人模型的升级版,强化了空间推理与多视角理解,并新增仪表读数能力,可读取压力表、液位计和数字读数。
推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并说明仪表读数等新能力如何落地机器人巡检。
Cloudflare 将 OpenAI 的 GPT-5.4 和 Codex 引入 Agent Cloud,让企业能够构建、部署并规模化运行面向真实任务的 AI 智能体,兼顾速度与安全。
OpenAI 介绍管理者如何用 ChatGPT 准备沟通、撰写清晰反馈、保持条理并提升团队效能。内容面向管理者日常场景,未披露新模型版本、参数或价格信息。
OpenAI 展示了 ChatGPT、Codex 和 API 等产品在真实场景中的应用方式,覆盖工作、开发与日常任务。内容围绕这些产品如何把 AI 带入实际使用展开,未披露具体版本号、参数规模或性能数据。
OpenAI 介绍客户成功团队如何使用 ChatGPT 管理客户账户、改善沟通、降低流失率,并推动产品采用与续约。
OpenAI 发布面向销售团队的 ChatGPT 实用工作流指南,覆盖客户调研、会议准备、外联触达、销售管道复盘与销售执行等环节。
OpenAI 发布面向财务团队的 ChatGPT 工作流学习内容,覆盖财务分析、报告、规划与决策沟通等实用场景。
OpenAI 介绍营销团队如何使用 ChatGPT 规划营销活动、创作内容、分析效果,并把洞察转化为行动。文章围绕实际 AI 工作流展开,未披露具体模型版本、参数或价格信息。
OpenAI 就 Axios 供应链攻击作出回应,轮换了 macOS 代码签名证书并更新了应用,同时确认没有用户数据遭到泄露。
OpenAI 发布面向初学者的 AI 基础科普内容,讲解 AI 是什么、如何运作,以及 ChatGPT 这类工具如何使用大语言模型。内容定位为清晰易懂的入门指南,帮助读者理解人工智能的基本概念。
OpenAI 发布提示词基础指南,讲解如何写出清晰有效的提示词,从而让 ChatGPT 给出更好、更有用的回答。
OpenAI 介绍如何用 ChatGPT 辅助写作,覆盖起草、修改和润色内容,并强调结构、语气与意图的清晰表达。