Google 将 ERA 科研编码工具开放使用,并推出 Computational Discovery
Google 宣布把基于 Gemini 的科研工具 Empirical Research Assistance(ERA)开放给科学家使用,相关论文当天发表于 Nature。
推荐理由:Google 把 ERA 从 Nature 论文推进到可申请使用的工具,并给出八个跨学科应用案例,读者可据此判断科研编码自动化的落地边界。
Google 宣布把基于 Gemini 的科研工具 Empirical Research Assistance(ERA)开放给科学家使用,相关论文当天发表于 Nature。
推荐理由:Google 把 ERA 从 Nature 论文推进到可申请使用的工具,并给出八个跨学科应用案例,读者可据此判断科研编码自动化的落地边界。
PaddleOCR 3.5 发布,支持通过设置 engine="transformers" 将 Hugging Face Transformers 作为推理后端运行 PP-OCRv5、PaddleOCR-VL 1.5 等模型。
Google DeepMind 在实验性原型 Project Genie 中上线 Street View 接地能力,可基于美国真实地点影像生成可交互世界,并支持沙漠、海洋世界、黑白电影等风格。
推荐理由:原文给出 Genie 接入 Street View 真实影像后的世界生成方式与开放范围,读者可据此判断世界模型落地路径。
Google DeepMind 推出 Gemini for Science,包含 Google Labs 上三个实验性工具:基于 Co-Scientist 的 Hypothesis Generation。
推荐理由:Google 把 Co-Scientist、AlphaEvolve 等研究原型打包成科研工具集,读者可据此判断通用智能体在科研流程中的落地边界。
Google 宣布扩展内容透明度与验证工具,把 SynthID 的图像、视频和音频验证从 Gemini 应用扩展到 Search,并将在未来几周进入 Chrome;该验证功能已在全球被使用 5000 万次。
推荐理由:Google 把 SynthID 与 C2PA 验证铺到 Search、Gemini、Chrome 和 Pixel,读者可了解内容溯源工具的实际覆盖范围。
剑桥大学教授 Clare Bryant 使用 Google Co-Scientist 研究流感等病原体跨物种传播时引发败血症的分子开关,该工具生成并排序了一批假说,其中优先关注到一个她此前未留意的蛋白质。随着她持续补充未发表数据,假说从候选蛋白质逐步收敛到具体氨基酸,团队正据此构建含氨基酸突变的细胞系进行验证。Bryant 称,原本需要两到三年的精确氨基酸识别工作,如今有望在六个月内完成。
Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于衰老生物学研究,帮助整合分散发现并生成可验证假设。在整合应激反应(ISR)研究中,Calico 团队借助 Co-Scientist 提出 ISR 受代谢调控的新假设,并优化实验设计、随结果迭代输入信息,实验已产生对 ISR 在健康与疾病中作用有重要意义的新发现,团队计划发表结果。
OpenAI 在 ChatGPT 中推出个人财务功能,用户可连接账户、追踪支出与投资、管理订阅、制定预算并规划财务目标。
推荐理由:OpenAI 官方给出 ChatGPT 个人财务功能的账户连接与预算管理能力,可据此判断其向个人财务场景的延伸。
Databricks 将 GPT-5.5 用于企业智能体工作流,该模型在 OfficeQA Pro 基准上刷新了 SOTA。
Sea Limited 首席产品官解释了公司为何在工程团队中全面部署 Codex,以加速亚洲地区的 AI 原生软件开发。
OpenAI 宣布 Codex 可在 ChatGPT 移动应用中使用,用户能跨设备和远程环境实时监控、引导并审批编码任务。
推荐理由:Codex 任务可跨设备实时监控与审批,读者可据此判断远程编码协作方式的变化。
OpenAI 为 ChatGPT 推出安全更新,提升其在敏感对话中的上下文感知能力,可随时间推移识别风险并更安全地回应。该更新针对敏感话题场景,帮助模型结合对话历史判断潜在风险。
OpenAI 为在 Windows 上启用 Codex 构建了安全有效的沙箱,通过受控的文件访问和网络限制来隔离其运行。该方案旨在让 Codex 在 Windows 环境下安全执行任务。
NVIDIA 工程师与研究员使用 Codex 搭配 GPT-5.5 交付生产系统,并将研究想法转化为可运行的实验。
AutoScout24 Group 借助 Codex 和 ChatGPT 加速开发周期、提升代码质量并扩大 AI 采用范围。该案例展示了这家汽车交易平台如何将 AI 驱动的编码工作流落地到工程团队中。
OpenAI 开放 Campus Network 学生社团意向表,邀请全球学生社团加入。加入后可连接各地学生社团、使用 AI 工具、举办活动,共建 AI 校园社区。
Parloa 基于 OpenAI 模型构建可扩展的语音驱动 AI 客服智能体,让企业能够设计、模拟并部署可靠的实时交互。
OpenAI 在 ChatGPT 中推出可选安全功能 Trusted Contact,当检测到严重的自伤相关担忧时,会通知用户指定的可信任联系人。
推荐理由:OpenAI 为 ChatGPT 增加可选安全功能,读者可了解其在自伤风险场景中的通知机制。
Simplex 借助 ChatGPT Enterprise 和 Codex 加速软件开发,缩短了设计、构建与测试时间,并扩展了 AI 驱动的工作流。
Google DeepMind 汇总了 Gemini 驱动的编码智能体 AlphaEvolve 发布一年来的应用成果,覆盖数学、量子物理、电网优化和 AI 基础设施等领域。
推荐理由:官方汇总 AlphaEvolve 一年落地案例,涵盖基因组、电网、TPU 与多家企业应用,可据此判断算法智能体的实际边界。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家每天在会议准备、投资组合分析和后续跟进上节省 60–90 分钟。
Uber 正用 OpenAI 驱动其 AI 助手与语音功能,帮助司机更聪明地赚钱、乘客更快叫车,服务覆盖全球实时交易市场。
OpenAI 扩展 ChatGPT 广告业务,推出测试版自助式 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些功能在设计上保护隐私,并将对话内容与广告保持分离。
OpenAI 重建了其 WebRTC 技术栈,以支撑实时语音 AI 的低延迟、全球规模与流畅的对话轮次切换。
DeepInfra 正式成为 Hugging Face Hub 支持的推理服务商,首批上线对话与文本生成任务,可访问 DeepSeek V4、Kimi-K2.6、GLM-5.1 等开源权重模型。
OpenAI 的 GPT 模型、Codex 和 Managed Agents 现已在 AWS 上提供,企业可在自己的 AWS 环境中构建安全的 AI 应用。
推荐理由:OpenAI 把模型、Codex 和托管智能体接入 AWS,读者可据此判断企业现有云环境能否直接落地。
Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,基于 Temporal 持久执行引擎,提供持久化执行、可观测性和人工介入审批能力。
推荐理由:Mistral 把企业级 AI 编排的持久化执行、可观测与人工审批打包进 Studio,读者可据此判断生产化落地的门槛变化。
Choco 利用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化,以提升生产力并推动业务增长。这是 OpenAI 发布的一则客户案例,展示 AI 在真实场景中的落地效果。
OpenAI 发布开源规范 Symphony,用于 Codex 编排,可把 issue tracker 变成常驻运行的智能体系统。该规范旨在提升工程产出并减少上下文切换。
Google Research 宣布在 Google Photos 的 Auto frame 功能中上线一种新方法,用机器学习理解场景的空间布局,再用生成式 AI 想象出新视角下的画面。
推荐理由:Google Photos 把 3D 场景估计与生成式补全结合,读者可了解拍照后调整视角的技术路径。
OpenAI 宣布 ChatGPT for Clinicians 面向经认证的美国医生、执业护士和药剂师免费开放,用于支持临床诊疗、文书记录和研究工作。
推荐理由:OpenAI 面向美国临床人员免费开放 ChatGPT,读者可了解其覆盖的执业人群与使用场景。
OpenAI 详解 Codex 智能体循环,通过 WebSockets 与连接级缓存降低 API 开销并改善模型延迟。
ChatGPT 推出工作区智能体(Workspace agents),可自动执行重复性工作流、连接工具并简化团队协作。该功能面向团队运营场景,帮助用户在 ChatGPT 内构建并使用这类智能体。
OpenAI 在 ChatGPT 中推出工作区智能体(workspace agents),由 Codex 驱动,可自动化复杂工作流并在云端运行。官方称其能帮助团队跨工具安全地扩展工作。
推荐理由:官方给出 ChatGPT 工作区智能体的定位与云端运行方式,可据此判断团队自动化流程的形态。
OpenAI 发布 ChatGPT Images 2.0,改进了文字渲染、多语言支持和视觉推理能力。原文同时提到可查看 Images 2.5 的新变化。
推荐理由:官方给出图像生成在文字渲染、多语言与视觉推理上的改进方向,可据此判断图像能力升级重点。
OpenAI 推出 Codex Labs,并与埃森哲、普华永道、Infosys 等合作,帮助企业在软件开发生命周期中部署和扩展 Codex。OpenAI 同时公布 Codex 周活跃用户达到 4M。
推荐理由:OpenAI 公布 Codex 企业侧落地动作与 4M 周活数据,可观察编码智能体的企业采用节奏。
OpenAI 更新 macOS 和 Windows 版 Codex 应用,新增计算机操作、应用内浏览、图像生成、记忆和插件功能,用于加速开发者工作流。
推荐理由:Codex 桌面端一次补齐计算机操作、应用内浏览与图像生成等能力,可据此判断编码智能体的功能边界。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件与工具之间构建安全、长时间运行的智能体。
推荐理由:官方给出 Agents SDK 的两项能力变化,读者可据此判断长时运行智能体的构建方式。
HCompany 发布 Chrome 扩展 HoloTab,把其 3 月 31 日推出的计算机操作模型 Holo3 直接接入浏览器,用户描述需求后由智能体在网页内导航界面、填写字段并做决策,无需配置或技术背景。HoloTab 支持例程功能:开始录制后实时捕捉用户在标签页中的点击与口述,录制结束即生成可重复运行或定时调度的例程。该扩展目前免费开放使用。
推荐理由:HCompany 把自家 Holo3 计算机操作模型封装成浏览器扩展,读者可了解录制即生成例程的交互方式。
OpenAI 扩展 Trusted Access for Cyber 计划,向通过审核的防御方开放 GPT-5.4-Cyber,并同步加强安全防护措施。此举正值 AI 网络安全能力持续提升之际。