跳到正文

#产品更新

今日 8 条
8月11日周二
  1. Hugging Face Blog62

    NVIDIA 发布 Magpie TTS 多语言版:364M 开源权重,新增阿拉伯语、韩语和巴西葡萄牙语

    NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持 12 种语言,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,并通过更新训练数据提升了多种既有语言的质量。

    推荐理由:原文给出 364M 开源权重模型的多语言扩展与 TTFA 实测数据,读者可据此判断自建语音链路的延迟与部署成本。

8月10日周一
8月7日周五
8月6日周四
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard:可扩展智能体 AI 框架

    微软研究院发布开源框架 Orchard,核心是 Orchard Env 这一可复用的 Kubernetes 环境服务,支持软件工程、网页导航和个人助理等任务,并可直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练智能体。

    推荐理由:微软研究院开源 Orchard 框架,公开环境服务、训练流程与数据,读者可据此了解小模型在真实 harness 中训练智能体的路径。

8月3日周一
7月31日周五
7月30日周四
7月29日周三
7月23日周四
  1. OpenAI News62

    OpenAI 在 ChatGPT 中推出 Health 功能

    OpenAI 在 ChatGPT 中推出 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察并更好地理解自身健康状况。

    推荐理由:OpenAI 把医疗记录与 Apple Health 接入 ChatGPT,读者可据此判断个人健康数据会怎样进入对话式助手。

  2. Hugging Face Blog62

    Diffusers 原生支持 Nunchaku 4-bit 扩散推理

    Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 4-bit 量化 checkpoint,无需自定义 pipeline 或本地 CUDA 编译。

    推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式与实测延迟、显存数据,可据此判断消费级 GPU 跑扩散模型的实际门槛。

7月22日周三
7月21日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Grabette:开源机器人操作数据采集系统

    Hugging Face 发布 Grabette,一套开源低成本的手持夹爪数据采集系统,无需机器人即可录制操作演示并自动转为 LeRobot 格式数据集。Grabette 配备广角鱼眼相机和 RGBD 相机,BOM 成本约 490€,配套的机器人端夹爪 Gripette 成本约 120€。

    推荐理由:原文给出了一套无需机器人即可采集操作数据的开源硬件与处理流程,读者可据此判断数据采集门槛的变化。

7月16日周四
7月13日周一
  1. Google DeepMind28

    Google DeepMind 推出 Gemini 驱动的 ATL Saathi,助力印度 Atal Tinkering Labs

    Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期覆盖 8 种语言,底层采用 Gemini 3.5 Flash 模型。首批试点覆盖印度 100 所学校。

7月9日周四
  1. Mistral AI52

    Mistral Studio 上线 Prompts 与 Skills 管理系统

    Mistral AI 在 Studio 中推出 Prompts 和 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯的单一记录。每个版本不可变,支持对比、回滚、分类标签和审计日志,非开发者也能编辑并即时测试,发布仍走企业已有的 CI/CD 流程。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产,该功能现已向 Studio 客户开放。

7月8日周三
  1. Hugging Face Blog62

    vLLM 的 transformers 建模后端实现原生推理速度

    Hugging Face 宣布 vLLM 的 transformers 建模后端现已达到甚至超过 vLLM 手写原生实现的吞吐,覆盖 Qwen3-4B 单卡、Qwen3-32B 张量并行和 Qwen3-235B-A22B-FP8 MoE 三种配置。

    推荐理由:原文给出 transformers 后端在 vLLM 中追平原生实现的具体机制与开关,读者可据此判断自家模型能否免移植提速。

7月7日周二
  1. Hugging Face Blog62

    微软在 Foundry Managed Compute 上线 Hugging Face 模型集合

    微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型以每周刷新的方式引入 Foundry 模型目录,可一键部署到托管 GPU 平台。

    推荐理由:微软把 Hugging Face 开源模型的部署运维层接进 Foundry,读者可据此判断开源模型进入企业生产环境的门槛变化。

  2. Hugging Face Blog75

    LeRobot v0.6.0 发布:世界模型策略、奖励模型与部署 CLI 闭环

    LeRobot v0.6.0 发布,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此判断开源机器人学习栈的当前能力边界。

  3. Hugging Face Blog62

    Hugging Face 与 SkyPilot 打通零出站流量存储,可在任意云上运行 AI 负载

    Hugging Face 与 SkyPilot 联合推出 store: hf 存储后端,用一条 hf:// URL 和已有的 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地环境中调度运行。

    推荐理由:原文给出 hf:// 挂载方式与免出站流量费的具体机制,读者可据此判断跨云训练与推理的存储成本变化。

7月6日周一
7月1日周三
6月30日周二
6月25日周四
  1. Google DeepMind78

    Google DeepMind 将 computer use 内置到 Gemini 3.5 Flash

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它仅作为独立的 Gemini 2.5 computer use 模型提供。

    推荐理由:原文说明 computer use 从独立模型并入 Gemini 3.5 Flash 主模型,并给出企业级安全护栏,读者可据此判断智能体跨平台自动化的可用边界。

6月24日周三
6月23日周二
6月22日周一