Mistral 发布终端编码智能体 Mistral Vibe 2.0,由 Devstral 2 驱动
Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选澄清、斜杠命令技能、统一智能体模式和自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能等能力与定价入口,可据此判断终端编码智能体的工作流变化。
Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型系列驱动,新增自定义子智能体、多选澄清、斜杠命令技能、统一智能体模式和自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能等能力与定价入口,可据此判断终端编码智能体的工作流变化。
OpenAI 发起、开源 AI 社区共建、Hugging Face 生态支持的 Open Responses 开放推理标准发布,基于 Responses API,面向智能体场景设计。该标准默认无状态,支持加密推理,将流式输出建模为语义事件序列,并原生支持内部与外部工具及子智能体循环。开发者可通过 Hugging Face Inference Providers 试用早期访问版本。
推荐理由:OpenAI 发起、Hugging Face 生态支持的开放推理标准,读者可了解 Responses API 开源化后的关键变化与迁移路径。
NVIDIA 在 CES 2026 发布教程,演示如何用 DGX Spark 搭配 Reachy Mini 搭建桌面 AI 助手。
OpenAI 宣布开发者可向 ChatGPT 提交应用,经审核通过后会在产品内新设的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,帮助开发者构建把真实操作带入 ChatGPT 的聊天原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与目录入口,开发者可据此判断接入路径和审核门槛。
CUGA(Configurable Generalist Agent)在 Hugging Face Spaces 上线演示,这是一个 Apache 2.0 开源的可配置通用 AI 智能体,支持跨 Web 与 API 的多步任务。
推荐理由:CUGA 在 AppWorld 与 WebArena 上的成绩和可配置推理模式,为评估通用智能体框架提供了具体参照。
Hugging Face 发布教程,展示如何让 OpenAI Codex 借助 Hugging Face Skills 仓库完成端到端机器学习实验,包括数据集校验、硬件选择、提交训练任务、监控进度、评测与导出 GGUF。
推荐理由:原文给出 Codex 结合 HF Skills 完成端到端微调的完整流程与成本区间,可据此判断智能体托管训练实验的可行边界。
Hugging Face 发布 huggingface_hub v1.0,这是该库五年来的首个大版本,带来多项破坏性变更。主要变化包括后端从 requests 迁移到 httpx、全新的 hf CLI 取代已弃用的 huggingface-cli、以及 hf_xet 全面替代 hf_transfer 负责文件传输。
推荐理由:官方梳理了 huggingface_hub 五年演进与 v1.0 的破坏性变更,可据此判断升级影响与迁移成本。
Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区 Hub,开发者可构建、分享和探索兼容 OpenEnv 的环境,用于训练和部署。
推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并公开 0.1 规范草案,读者可了解开放智能体生态的协作方式。
OpenAI 在 ChatGPT 内推出新一代可直接对话的应用,开发者即日起可用预览版 Apps SDK 开始构建。
推荐理由:OpenAI 在 ChatGPT 内引入可对话应用并开放 Apps SDK 预览,读者可据此了解其应用生态的开放入口。
针对 vibe coding 游戏随项目增长而失控的问题,作者推出 VibeGame——一个基于 three.js、rapier 和 bitecs 构建的高层声明式游戏引擎,专为 AI 辅助游戏开发设计。
Meta 发布 GAIA 的后继智能体基准 Gaia2,并开源配套的 Agents Research Environments(ARE)框架,用于运行、调试和评估智能体。
推荐理由:GAIA 后继基准 Gaia2 转向读写与噪声环境,配套 ARE 框架可自定义场景并导出完整 trace,便于复现与调试。
Mistral 在 Le Chat 中发布 20 多个基于 MCP 的安全连接器(beta),覆盖数据、生产力、开发、自动化与支付等类别,可连接 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并支持添加自定义 MCP 连接器。
推荐理由:官方给出连接器目录、自定义 MCP 接入与 Memories 的边界,可据此判断企业工作流能落到哪些工具上。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并同步更新 Realtime API。新 API 能力包括 MCP server 支持、图像输入以及 SIP 电话呼叫支持。
推荐理由:OpenAI 发布新一代语音到语音模型并扩展 Realtime API,读者可了解语音智能体接入工具与电话通道的能力边界。
通过 Hugging Face MCP Server 将 Claude 连接至 Hugging Face Spaces,即可调用 FLUX.1 Krea [dev] 和 Qwen-Image 等模型生成图像。
Hugging Face 发布 Research Tracker MCP,让 AI 通过自然语言调用研究工具,自动完成论文、代码、模型与数据集的跨平台检索和交叉引用。
Hugging Face 博客介绍如何用 Gradio 的 MCP 集成在 Python 中实现 MCP 服务器,构建一个能浏览服装网站并调用 IDM-VTON 虚拟试穿模型的 AI 购物助手。
Gradio 5.38.0 为 MCP Servers 带来五项改进:新增 "File Upload" MCP server 让智能体直接上传本地文件,支持实时进度通知,并可通过 gr.load_openapi 一行代码将 OpenAPI 规范转为 MCP 工具。
在 Gradio Agents & MCP Hackathon 期间构建的多 LLM 平台 Consilium,让多个 AI 模型围绕复杂问题展开结构化辩论并达成共识,同时提供可视化 Gradio 界面和可接入 Cline 的 MCP server。
Hugging Face 发布 Python 库 ScreenEnv,可在 Docker 容器中创建隔离的 Ubuntu 桌面环境,用于测试和部署 GUI 智能体(Computer Use 智能体)。
推荐理由:Hugging Face 开源 ScreenEnv,给出 Docker 沙箱与 MCP 两种接入方式,可据此判断桌面智能体的部署路径。
Hugging Face 发布官方 MCP Server(hf.co/mcp),通过一个 URL 让 AI 助手访问 Hub 及 Spaces 上的数千个 AI 应用,并支持用户动态配置工具。生产环境采用 Streamable HTTP 传输的无状态 Direct Response 模式,开源代码同时支持 STDIO、SSE 和 Streamable HTTP 三种部署方式。
Hugging Face 博客介绍如何通过 Gradio MCP 服务器为 LLM 增加新能力。Gradio 5.28.0 起支持 MCP 协议,Hugging Face Spaces 上数千个 AI 应用因此可作为 MCP 服务器接入 Cursor、Claude Code、Cline 等客户端。
Mistral 发布 Agents API,将自家语言模型与代码执行、图像生成、文档库、web search 等内置连接器及 MCP 工具结合,并提供跨对话的持久记忆与智能体编排能力。
推荐理由:官方给出 Agents API 的连接器、记忆与多智能体编排能力,以及带 web search 的 SimpleQA 对比数据,可据此判断企业级智能体平台的落地方式。
Hugging Face 在 huggingface_hub 中新增 MCPClient,并基于它实现 Python 版 Tiny Agents,用约 70 行代码即可搭建连接 MCP 服务器的智能体。
推荐理由:原文给出约 70 行 Python 代码实现 MCP 智能体的完整方法,读者可据此复用并接入自有工具。
Dell 在 Dell Tech World 上发布新版 Dell Enterprise Hub,提供可直接部署的模型与应用目录,支持 Meta Llama 4 Maverick。
Mistral AI 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,包含企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内陆续上线。
Qwen-3 的 chat template 相比 Qwen-2.5 和 QwQ 有四处关键变化:通过 enable_thinking 标志可开关推理,设为 false 时模板插入空对以跳过逐步思考,而 QwQ 等旧模型强制每轮生成思维链。
Hugging Face 发布教程,介绍如何用 Gradio 在几行 Python 代码内把应用变成 MCP Server,供 LLM 作为工具调用。只需在 launch() 中设置 mcp_server=True,Gradio 就会自动把函数转成 MCP 工具,并用 docstring 生成工具描述和参数,MCP 端点位于 /gradio_api/mcp/sse。
推荐理由:原文给出用 Gradio 把 Python 函数变成 MCP 工具的完整步骤,读者可据此把自有应用接入 LLM 工具调用。
Hugging Face 发布 Tiny Agents 教程,展示如何用约 50 行 TypeScript 代码在 InferenceClient 之上实现 MCP 客户端和智能体。
推荐理由:作者用 50 行代码演示 MCP 客户端与智能体的最小实现,读者可据此理解工具调用如何接入推理客户端。
Cohere 正式接入 Hugging Face Inference Providers,成为首个直接在 HF Hub 上分享并托管自家模型的模型厂商。
Mistral AI 推出 TranscriptToPRDTicket 智能体工作流,由 Mistral Large 2 驱动的 PRDAgent 和 TicketCreationAgent 组成,可将会议转录自动生成 PRD 并转化为结构化开发工单,自动在 Linear / Jira 中创建。
Hugging Face 在 24 小时复现冲刺中开源了 DeepResearch 所需的智能体框架,在 GAIA 验证集上达到 55.15%,高于此前开源框架 Magentic-One 的约 46%。
推荐理由:Hugging Face 用 24 小时复现 OpenAI Deep Research,给出开源框架与 GAIA 实测对比,可看代码智能体相对 JSON 智能体的差距。
Hugging Face 在 Transformers 中推出统一的工具调用 API,同一套代码可在 Mistral、Cohere、NousResearch 和 Llama 等模型家族间通用,无需或只需极少模型专属改动。
推荐理由:Hugging Face 把工具调用统一进 chat template,读者可据此判断跨模型复用同一套代码的可行边界。
Stack Overflow 与 OpenAI 宣布达成 API 合作,将这一技术知识平台与 OpenAI 的大语言模型结合,为开发者提供支持。Stack Overflow 称其为全球领先的高技术内容知识平台,OpenAI 的模型则被称为最受欢迎的 AI 开发 LLM。
Mistral 发布开源模型 Mixtral 8x22B,采用稀疏 MoE 架构,141B 总参数中仅 39B 激活参数,以 Apache 2.0 许可开放。该模型支持英语、法语、意大利语、德语和西班牙语,具备数学与编码能力,原生支持函数调用,上下文窗口为 64K tokens。
推荐理由:官方给出 Mixtral 8x22B 的激活参数、上下文窗口与多语言、数学编码基准,便于判断其成本效率定位。
Mistral AI 发布最新旗舰文本生成模型 Mistral Large,可通过 la Plateforme 使用,并首次通过 Azure 分发。官方称其在常用基准上表现强劲,是继 GPT-4 之后第二个可通过 API 获得的顶级模型,具备 32K token 上下文窗口、原生函数调用与 JSON 格式输出,原生支持英语、法语、西班牙语、德语和意大利语。
推荐理由:官方给出 Mistral Large 的基准对比、32K 上下文与函数调用能力,可据此判断其与 GPT-4 的定位差异。
Hugging Face 在 huggingface.js 下发布 Agents.js,一个可在浏览器或服务端为 LLM 提供工具访问的 JavaScript 库,通过 npm install @huggingface/agents 安装。
推荐理由:原文给出库的安装方式、代码示例和自定义工具接口,读者可据此判断如何在 JS 项目中接入工具调用。
OpenAI 宣布一系列 API 更新,包括更易引导的模型、函数调用能力、更长的上下文以及更低的价格。
推荐理由:OpenAI 官方公布 API 多项更新,读者可据此了解模型可控性、函数调用与价格的变化方向。
OpenAI 宣布为 ChatGPT 实现插件的初步支持。插件是专为语言模型设计的工具,以安全为核心原则,可帮助 ChatGPT 获取最新信息、执行计算或使用第三方服务。
推荐理由:OpenAI 官方给出 ChatGPT 插件的最初支持范围,读者可据此了解模型接入外部工具与实时信息的早期形态。