跳到正文

#产品更新

今日 2 条
9月3日周四
  1. Google DeepMind62

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber 网络防御能力

    Google 推出 Fairwind Program,面向政府机构、关键基础设施运营商和网络安全合作伙伴限量开放其最先进的网络防御能力,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:Google 把 Gemini 3.8 Flash Cyber 与 CodeMender 组合成受限访问项目,读者可了解前沿模型在漏洞修复上的落地方式与准入条件。

9月2日周三
9月1日周二
  1. OpenAI News62

    医疗机构可将 EHR 等行业数据接入 ChatGPT

    OpenAI 宣布医疗机构现在可以把 EHR 及其他行业数据接入 ChatGPT,让临床医生安全访问患者上下文、医学研究等信息。原文未披露具体接入方式、可用范围与上线时间。

    推荐理由:官方给出 ChatGPT 接入医疗数据的入口,读者可据此判断临床场景中数据接入方式的变化。

  2. Hugging Face Blog62

    Hugging Face 发布 @huggingface/kernels:207 个 WebGPU kernel 与 Fleet 基准工具

    Hugging Face 发布 @huggingface/kernels,一个从 Hugging Face Hub 加载并运行优化 WebGPU kernel 的 JavaScript 库,同时上线 207 个 kernel 的初始集合,均以 Apache-2.0 许可发布为独立仓库。

    推荐理由:Hugging Face 发布 207 个 WebGPU kernel 及配套加载库与浏览器基准工具,并给出与 ORT WebGPU 的实测对比数据。

8月25日周二
8月21日周五
  1. Hugging Face Blog62

    Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.2 倍

    Liquid AI 为 LFM2.5 家族的三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下提升解码速度,GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍。

    推荐理由:官方给出三款 LFM2.5 草稿模型的加速数据与 llama.cpp、SGLang 接入方式,可据此评估端侧推理提速的落地成本。

8月20日周四
  1. Mistral AI66

    Mistral 发布 Agentic Search 检索层

    Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、打开、导航、阅读和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries。

    推荐理由:原文给出多步检索循环在 FinanceBench 与 OfficeQA Pro 上的准确率、token 与延迟变化,可据此判断它相对一次性 RAG 的取舍。

8月19日周三
8月18日周二
  1. Hugging Face Blog62

    Sentence Transformers v6.0 新增 MultiVectorEncoder,支持 ColBERT 式晚交互检索

    Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索,PyLate 与 Stanford-NLP ColBERT 检查点可直接加载,colpali-engine 的视觉文档检索模型也可通过同一 API 使用。

    推荐理由:Sentence Transformers v6.0 新增多向量编码器,读者可据此判断晚交互检索的接入方式与索引成本。

8月13日周四
8月12日周三
8月11日周二
  1. Mistral AI60

    Mistral 推出区域推理端点与优先服务层级,并接入 GLM-5.2 等第三方开源模型

    Mistral 宣布三项推进 AI 主权的举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,为关键业务负载提供自定义速率限制和带 SLA 的正常运行时间承诺。

    推荐理由:Mistral 把区域推理、优先服务层级和第三方开源模型接入放进同一套基础设施,读者可据此判断主权 AI 的落地方式。

  2. Hugging Face Blog62

    NVIDIA 发布 Magpie TTS 多语言版:364M 开源权重,新增阿拉伯语、韩语和巴西葡萄牙语

    NVIDIA 发布 Magpie TTS Multilingual,一个 364M 参数的开源权重语音合成模型,支持 12 种语言,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,并通过更新训练数据提升了多种既有语言的质量。

    推荐理由:原文给出 364M 开源权重模型的多语言扩展与 TTFA 实测数据,读者可据此判断自建语音链路的延迟与部署成本。

8月10日周一
8月7日周五
8月6日周四
8月4日周二
  1. Microsoft Research71

    微软研究院开源 Orchard:可扩展智能体 AI 框架

    微软研究院发布开源框架 Orchard,核心是 Orchard Env 这一可复用的 Kubernetes 环境服务,支持软件工程、网页导航和个人助理等任务,并可直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练智能体。

    推荐理由:微软研究院开源 Orchard 框架,公开环境服务、训练流程与数据,读者可据此了解小模型在真实 harness 中训练智能体的路径。

8月3日周一
7月31日周五
7月30日周四
7月29日周三
7月23日周四
  1. OpenAI News62

    OpenAI 在 ChatGPT 中推出 Health 功能

    OpenAI 在 ChatGPT 中推出 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察并更好地理解自身健康状况。

    推荐理由:OpenAI 把医疗记录与 Apple Health 接入 ChatGPT,读者可据此判断个人健康数据会怎样进入对话式助手。

  2. Hugging Face Blog62

    Diffusers 原生支持 Nunchaku 4-bit 扩散推理

    Hugging Face 在 Diffusers 中引入 Nunchaku Lite,可直接用 from_pretrained() 加载 Nunchaku 风格的 4-bit 量化 checkpoint,无需自定义 pipeline 或本地 CUDA 编译。

    推荐理由:原文给出 Nunchaku Lite 在 Diffusers 中的加载方式与实测延迟、显存数据,可据此判断消费级 GPU 跑扩散模型的实际门槛。

7月22日周三
7月21日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Grabette:开源机器人操作数据采集系统

    Hugging Face 发布 Grabette,一套开源低成本的手持夹爪数据采集系统,无需机器人即可录制操作演示并自动转为 LeRobot 格式数据集。Grabette 配备广角鱼眼相机和 RGBD 相机,BOM 成本约 490€,配套的机器人端夹爪 Gripette 成本约 120€。

    推荐理由:原文给出了一套无需机器人即可采集操作数据的开源硬件与处理流程,读者可据此判断数据采集门槛的变化。

7月16日周四
7月13日周一
  1. Google DeepMind28

    Google DeepMind 推出 Gemini 驱动的 ATL Saathi,助力印度 Atal Tinkering Labs

    Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期覆盖 8 种语言,底层采用 Gemini 3.5 Flash 模型。首批试点覆盖印度 100 所学校。