Mistral Studio 上线 Prompts 与 Skills 管理系统
Mistral AI 在 Studio 中推出 Prompts 和 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯的单一记录。每个版本不可变,支持对比、回滚、分类标签和审计日志,非开发者也能编辑并即时测试,发布仍走企业已有的 CI/CD 流程。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产,该功能现已向 Studio 客户开放。
Mistral AI 在 Studio 中推出 Prompts 和 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯的单一记录。每个版本不可变,支持对比、回滚、分类标签和审计日志,非开发者也能编辑并即时测试,发布仍走企业已有的 CI/CD 流程。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产,该功能现已向 Studio 客户开放。
Hugging Face 宣布 vLLM 的 transformers 建模后端现已达到甚至超过 vLLM 手写原生实现的吞吐,覆盖 Qwen3-4B 单卡、Qwen3-32B 张量并行和 Qwen3-235B-A22B-FP8 MoE 三种配置。
推荐理由:原文给出 transformers 后端在 vLLM 中追平原生实现的具体机制与开关,读者可据此判断自家模型能否免移植提速。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者在支持的模型页点击 Customize on SageMaker AI 或 Deploy on SageMaker AI,即可一键进入 SageMaker Studio,模型已预加载、环境自动配置。
微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型以每周刷新的方式引入 Foundry 模型目录,可一键部署到托管 GPU 平台。
推荐理由:微软把 Hugging Face 开源模型的部署运维层接进 Foundry,读者可据此判断开源模型进入企业生产环境的门槛变化。
LeRobot v0.6.0 发布,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此判断开源机器人学习栈的当前能力边界。
Australian Payments Plus 使用 ChatGPT Enterprise 和 Codex 应对支付业务的复杂性,实现提速、提升质量,并保持人类判断在流程中的核心地位。
Hugging Face 与 SkyPilot 联合推出 store: hf 存储后端,用一条 hf:// URL 和已有的 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地环境中调度运行。
推荐理由:原文给出 hf:// 挂载方式与免出站流量费的具体机制,读者可据此判断跨云训练与推理的存储成本变化。
Hugging Face 为 Kernels 项目引入 Hub 上的 "kernel" 新仓库类型,并默认只加载可信发布者发布的 kernel,其他来源需显式传入 trust_remote_code=True。
Hugging Face 与 Cerebras 联合演示了一套实时语音到语音流水线,用 Cerebras 加速 Gemma 4 31B 的推理,以降低语音交互延迟。
推荐理由:原文给出了可复用的开源语音到语音流水线架构与各层组件,读者可据此搭建或替换自己的实时语音方案。
Google Research 将建筑级屋顶反射率(albedo)数据集从 2024 年试点的 14 座城市扩展至 9 个国家 50+ 城市,并通过新的 Heat Resilience Earth Engine App 开放访问。
Every Eval Ever(EEE)与 Hugging Face Community Evals 现已互通,EEE 结果可跨平台发布到 Hugging Face 模型页和基准排行榜,并带来源徽章回链到完整 EEE 记录。
推荐理由:原文给出 EEE 与 Community Evals 互通后的数据规模与转换流程,读者可据此判断评测结果如何被统一记录和溯源。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它仅作为独立的 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型,并给出企业级安全护栏,读者可据此判断智能体跨平台自动化的可用边界。
NVIDIA 发布开源库 NeMo AutoModel,构建在 HuggingFace Transformers v5 之上,为 MoE 模型微调带来 3.4-3.7 倍训练吞吐提升和 29-32% 的 GPU 显存下降。
推荐理由:原文给出 NeMo AutoModel 在 MoE 微调上的吞吐与显存对比数据,读者可据此判断是否值得替换现有训练栈。
Mistral 为 Connectors 推出多项新能力:按 workspace 或组织管理连接器访问权限并支持工具级开关,带 connector scope 的 API key 可防止自动化 AI 工作负载中的身份冒用,多账号连接器允许一个连接器绑定多个账号。
GPT-5 Pro 帮助免疫学家 Derya Unutmaz 解开了一个困扰三年的免疫学谜题,为 T 细胞行为提供了新见解。这一突破有望支持癌症与自身免疫疾病研究。
Omio 正借助 OpenAI 打造对话式旅行体验,并加速产品开发、转型为 AI 原生公司。
OpenAI 推出 Daybreak 系列新工具,包括 Codex Security 和 GPT-5.5-Cyber,用于帮助各类组织大规模发现、验证并修补漏洞。
推荐理由:OpenAI 官方发布面向漏洞发现与修复的安全工具,读者可了解其能力定位与适用场景。
OpenAI 为 ChatGPT Enterprise 新增支出控制与用量分析功能,帮助企业管理成本并规模化部署 AI。该功能面向企业客户,用于管控 ChatGPT Enterprise 的使用开销。
OpenAI 发布 GPT-5.5 Instant,用于改进 ChatGPT 在健康与养生问题上的回答,官方称其在推理、上下文理解、表达清晰度上有所增强。该版本还引入了由医生参与设计的评估方式。
推荐理由:官方披露 GPT-5.5 Instant 在健康问答上的能力变化,读者可据此判断 ChatGPT 医疗场景的可用性。
Hugging Face 发布 Agentic Resource Discovery(ARD)规范的参考实现 Discover Tool,为智能体提供跨注册表的自然语言能力搜索。
推荐理由:Hugging Face 给出 ARD 规范的参考实现与 CLI、REST、MCP 三种接入方式,读者可据此判断智能体能力发现如何落地。
Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 地方规划部门合作,开发一款基于 Gemini 的 AI 规划原型,目标是帮助审批人员将住户规划申请的决定时间缩短 50%。
推荐理由:原文给出英国规划审批原型的目标、试点范围与上线时间,读者可据此判断 AI 介入公共服务的落地路径。
OpenAI 推出三门 Academy 新课程,帮助人们建立实用 AI 技能、创建可复用的工作流,并在日常工作中应用智能体。课程面向下一阶段的工作方式,聚焦实际动手能力与可重复流程。
Preply 借助 OpenAI 推出 AI 生成的课程总结,为学习者提供个性化反馈和语言练习。该功能将 AI 与真人导师结合,用于个性化学习体验。
天体物理学家 Chi-kwan Chan 使用 Codex 构建黑洞模拟,帮助科学家研究极端物理并检验爱因斯坦的广义相对论。
OpenAI 模型与 Codex 现可通过 Oracle Cloud 访问,企业可使用既有云承诺额度来构建和部署 AI。该方式支持企业级安全与治理。
Notion 借助 Codex 一次性生成规格说明、为网页端构建 AI Voice Input,并在小团队中放大工程产能。
Hugging Face 宣布 OpenEnv 改由委员会协调,成员包括 Meta-PyTorch、Reflection、Unsloth、Modal、Prime Intellect、Nvidia、Mercor、Fleet AI、Microsoft、Hugging Face 和 RadixArk,项目迁至 huggingface/OpenEnv。
推荐理由:OpenEnv 从单一项目转为多方共管的协议层,读者可据此判断开源智能体 RL 环境标准化的走向。
Google 在 Gemini Enterprise Agent Platform 上以公开预览形式推出基于 Agentic RAG 的跨语料检索功能。
推荐理由:原文给出多智能体 RAG 的完整架构与跨语料评测数据,可据此判断复杂多跳查询的落地方式。
Endava 正利用 AI 智能体、ChatGPT Enterprise 和 Codex 加速软件交付、自动化工作流,并在全企业构建 AI 原生文化。
OpenAI 为 ChatGPT 推出名为 Dreaming 的新记忆系统,用于更好地记住用户偏好,并在多轮对话之间保持上下文的新鲜与相关。
推荐理由:ChatGPT 新增记忆系统,读者可了解它如何跨对话保留偏好并保持上下文新鲜。
Hugging Face 重构官方命令行工具 hf CLI,使其同时适配人类用户和 Claude Code、Codex、Cursor 等编码智能体。CLI 通过环境变量自动识别智能体并切换输出格式,在复杂多步任务上,用 curl 或 Python SDK 的基线消耗的 token 最多是 hf CLI 的 6 倍。官方还提供可安装的 hf-cli skill,让智能体减少约 30% 的工具调用。
推荐理由:官方给出 hf CLI 面向智能体重构的细节与基准数据,可据此判断智能体操作 Hub 的 token 成本差异。
Google Research 在 GitHub 上以 Apache 2.0 许可开源其水文建模框架,让各国气象与水文机构用与 Google Flood Hub 相同的架构和相近训练数据训练 AI 洪水预报模型。
推荐理由:Google 把驱动 Flood Hub 的水文模型架构与训练流程开源,读者可据此判断本地洪水预报如何接入自有数据。
Wasmer 借助 Codex 与 GPT-5.5 构建了面向边缘计算的 Node.js 运行时,开发速度提升 10x 至 20x,交付周期从数月缩短至数周。
Reachy Mini 对话应用现已支持通过 MCP 调用托管在公开 Hugging Face Spaces 上的工具,用户只需执行 `reachy-mini-conversation-app tool-spaces add` 命令即可为机器人添加天气查询、网页搜索等能力,无需修改应用代码。
Travelers 基于 OpenAI 构建了 AI 理赔助手 Claim Assistant,用于引导客户完成理赔申报、提供 24/7 支持,并在理赔高峰期扩展运营能力。该助手已在全国范围内部署。
OpenAI 发布 ChatGPT Sites,用户可借助 Codex 创建轻量级网站或应用。目前官方仅给出这一句说明,未披露具体功能细节、可用范围或上线时间。
OpenAI 为 Codex 推出新插件、站点(sites)和批注(annotations)功能,面向分析师、营销人员、设计师、投资者等团队。这些能力旨在让不同角色和工具链的用户借助 AI 完成更多工作。
OpenAI 发布《The Next Era of Knowledge Work》报告,探讨 Codex 如何通过 AI 驱动的研究、数据分析、工作流自动化和内容创作提升生产力。
OpenAI 前沿模型与 Codex 现已在 AWS 上正式可用,企业可通过已有的 AWS 环境、控制机制和采购流程接入 OpenAI。客户可借此从评估阶段更快推进到生产部署。
推荐理由:OpenAI 前沿模型与 Codex 上线 AWS,企业可在既有云环境与采购流程中直接接入。
Braintrust 工程师借助 Codex 搭配 GPT-5.5 加快实验与编码速度,将客户请求转化为代码。