OpenAI 发布《智能时代的生物防御》行动计划
OpenAI 发布《智能时代的生物防御》行动计划,提出面向 AI 驱动的生物韧性建设方案。该计划聚焦利用 AI 能力应对生物安全风险,具体措施与实施细节尚未在文中展开。
OpenAI 发布《智能时代的生物防御》行动计划,提出面向 AI 驱动的生物韧性建设方案。该计划聚焦利用 AI 能力应对生物安全风险,具体措施与实施细节尚未在文中展开。
Hugging Face 重构官方命令行工具 hf CLI,使其同时适配人类用户和 Claude Code、Codex、Cursor 等编码智能体。CLI 通过环境变量自动识别智能体并切换输出格式,在复杂多步任务上,用 curl 或 Python SDK 的基线消耗的 token 最多是 hf CLI 的 6 倍。官方还提供可安装的 hf-cli skill,让智能体减少约 30% 的工具调用。
推荐理由:官方给出 hf CLI 面向智能体重构的细节与基准数据,可据此判断智能体操作 Hub 的 token 成本差异。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,让各国气象与水文机构用与 Google Flood Hub 相同的架构和相近训练数据训练 AI 洪水预报模型。
推荐理由:Google 把驱动 Flood Hub 的水文模型架构与训练流程开源,读者可据此判断本地洪水预报如何接入自有数据。
OpenAI 为 GPT-Rosalind 引入新能力,用于推进生命科学研究。该模型增强了生物推理、药物化学专业知识、基因组分析和实验工作流能力。
推荐理由:OpenAI 为 GPT-Rosalind 增加生命科学能力,读者可了解该模型在生物推理与基因组分析上的定位。
DharmaOCR 团队把 Direct Preference Optimization(DPO)用于结构化 OCR 而非聊天对齐,用模型自身失败输出构建偏好对,在全部测试的模型家族中都将文本退化率降低,平均降幅 59.4%,最高 87.6%(Nanonets-OCR2–3B 从 1.61% 降至 0.20%)。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 至 20x,交付周期从数月缩短至数周。
OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型和全球标准,以确保 AI 惠及社会。
OpenAI 公布了一份针对美国前沿 AI 治理的蓝图,提议建立覆盖安全、韧性与国家安全的联邦框架。该方案主张以联邦层面的统一治理来应对前沿 AI 带来的风险。
Reachy Mini 对话应用现已支持通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用户只需执行 `reachy-mini-conversation-app tool-spaces add` 命令即可为机器人添加天气查询、网页搜索等能力,无需修改应用代码。
H Company 发布 Holo3.1 计算机使用智能体模型家族,基于 Qwen 系列,覆盖 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化权重用于本地推理。
推荐理由:原文给出 Holo3.1 在移动端、跨框架与量化本地部署上的具体提升,可据此判断计算机使用智能体的落地边界。
Travelers 基于 OpenAI 构建了 AI 理赔助手 Claim Assistant,用于引导客户完成理赔申报、提供 24/7 支持,并在理赔高峰期扩展运营能力。该助手已在全国范围内部署。
OpenAI 发布 ChatGPT Sites,用户可借助 Codex 创建轻量级网站或应用。目前官方仅给出这一句说明,未披露具体功能细节、可用范围或上线时间。
OpenAI 为 Codex 推出新插件、站点(sites)和批注(annotations)功能,面向分析师、营销人员、设计师、投资者等团队。这些能力旨在让不同角色和工具链的用户借助 AI 完成更多工作。
OpenAI 呼吁就青少年 AI 安全采取全球行动,并提出设立一个国际机构,以加强针对青少年的防护措施、标准与机会。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作提升生产力。
OpenAI 阐述了其在 AI 政策与政治倡导上的做法,强调透明度、支持审慎监管与 AI 安全,并明确表示任何外部政治团体都无权代表公司发声。
JetBrains 发布 Mellum2,一个从零训练的 12B 参数 Mixture-of-Experts 模型,覆盖自然语言与代码,每个 token 仅激活 2.5B 参数,采用 Apache 2.0 许可。官方称其相比同规模模型推理速度超过 2 倍,可用于路由、RAG、摘要、子智能体和高吞吐编码场景,模型已在 Hugging Face 开放下载。
推荐理由:JetBrains 给出 Mellum2 的参数量、激活规模与推理速度,读者可据此判断它在多模型系统中的定位。
Hugging Face 博客指出,企业级 AI 规模化落地的关键不在 LLM 本身,而在 agentic layer 中的 agent logic——知识图谱、算法、程序分析库等软件原语,可引导 LLM 聚焦企业工作流、压缩上下文空间。
OpenAI 在密歇根破土动工一个 1GW 数据中心项目,属于 Stargate 计划的一部分。该项目建设 AI 基础设施,目标是扩大接入、创造就业并支持当地社区。
推荐理由:OpenAI 在密歇根动工 1GW 数据中心,读者可了解 Stargate 的落地规模与选址进展。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过已有的 AWS 环境、控制机制和采购流程接入 OpenAI。客户可借此从评估阶段更快推进到生产部署。
推荐理由:OpenAI 前沿模型与 Codex 上线 AWS,企业可在既有云环境与采购流程中直接接入。
OpenAI 封禁了一批疑似源自中国的账号,这些账号使用 AI 生成关于美国科技政策、关税和贸易限制的评论与漫画。该活动被命名为 Tech and Tariffs,目标是影响美国科技政策。
OpenAI 封禁了一个疑似源自中国的账号集群,该集群利用 AI 生成社交媒体内容,批评美国数据中心和 AI 基础设施。这一行动被 OpenAI 称为“Data Center Bandwagon”行动,目标指向美国。
Boston Children’s Hospital 使用 OpenAI 技术改善患者护理、减轻运营负担,并帮助诊断出 40 多例罕见病病例。
Braintrust 工程师借助 Codex 搭配 GPT-5.5 加快实验与编码速度,将客户请求转化为代码。
OpenAI 推出 Rosalind Biodefense,向经过审核的开发者及美国政府合作伙伴扩大开放 GPT-Rosalind 的可信访问。该计划面向生物防御、公共卫生与大流行病防范领域,借助前沿 AI 推进相关工作。
Hugging Face 发布 PyTorch 性能分析系列第一篇,讲解如何用 torch.profiler 分析矩阵乘法加偏置这一基础算子。
OpenAI 分享第三方 AI 评估指南,覆盖前沿系统的模型能力、防护措施与有效性评估方法。
Google Research 在 I/O 2026 上发布 Gemini for Science 实验工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 栈,与 Airbus、BMW、ASML 合作优化设计、仿真与生产,并强调对专有数据和 IP 的完全控制。其智能体工具 Vibe 升级为统一智能体,可处理收件箱与日历、深度研究、交付物撰写,并完成从需求到合并变更的编码工作。位于法国 Les Ulis 的 10 MW 推理数据中心计划于 2026 年 Q3 开放。
推荐理由:Mistral 一次性公布工业 AI 栈、Vibe 智能体与自建数据中心,可据此观察其企业级全栈布局。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,覆盖工作与编码两类场景,原有对话、设置和订阅方案全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作与编码两种模式的能力边界和定价。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,加速软件交付。
Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架,开源并可在云端、本地和边缘运行。它把摄取、检索和评测统一到共享接口下,内置 BM25 稀疏检索、稠密向量检索与混合配置,并提供 recall、precision、MRR、NDCG 等评测指标。
推荐理由:Mistral 把检索管线的摄取、检索与评测收进同一框架,读者可据此判断自建 RAG 的集成成本是否被压缩。
OpenAI 发布前沿治理框架(Frontier Governance Framework),说明其 AI 安全、安保与风险管理实践如何对齐欧盟和加州正在出台的监管要求。该框架聚焦前沿模型的治理与合规衔接。
Google 为隐私分析服务提出零信任聚合方案,将新型单次消息密码学聚合协议与 TEE 结合,设备无需多轮在线即可提交数据。该设计使原始数据在任何服务器内存中都不会被暴露或重建,仅在最终阶段处理已聚合匿名的数据,并通过 TEE 远程认证向参与者证明协议按公开代码正确执行。
Mistral 宣布将 Emmi AI 并入公司,推出面向工业工程的物理 AI 能力,作为其企业解决方案中的新基础能力。该能力从几何与边界条件直接预测物理场,单次前向推理在单张 GPU 上以秒级完成,用于加速产品设计、工装工艺设计和实时数字孪生,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。
推荐理由:Mistral 把物理仿真 AI 纳入企业平台,读者可了解其定位、适用场景与合作伙伴。
Mistral 收购 Emmi AI,并加倍投入面向航空航天、汽车、半导体和能源等行业的物理 AI 基础模型研究。其已发布成果包括 AB-UPT,可在单张 GPU 上处理 9M 表面和 140M 体积网格的原始几何数据,无需重新划分网格;以及首个大规模多物理场端到端深度学习代理模型 NeuralDEM。
Cisco 与 OpenAI 正用 Codex 重塑企业工程,帮助 Cisco 规模化 AI 原生开发、加速 AI Defense 工作并自动化缺陷修复。
OpenAI、Thrive 与 Crete 用 Codex 构建了一个可自我改进的税务智能体,实现自动报税、提升准确率并加速工作流。该方案将报税流程自动化,并借助自我改进机制持续优化准确性与效率。
Warp 正基于 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调多个编码智能体。该方案将 GPT-5.5 用于跨环境的编码智能体调度,是 Warp 在开源方向上的重要押注。
Hugging Face 发布教程,介绍如何让 Reachy Mini 机器人完全本地运行语音对话,无需云端和 API key。