跳到正文

全部动态

今日 29 条
7月14日周二
7月13日周一
  1. Google DeepMind28

    Google DeepMind 推出 Gemini 驱动的 ATL Saathi,助力印度 Atal Tinkering Labs

    Google DeepMind 在印度启动 ATL Saathi 试点,这是一款由 Gemini 驱动的 Web 应用,为 Atal Tinkering Labs 教育者提供 24/7 备课与培训助手。该工具基于 NotebookLM 整理 12 个核心模块内容,支持 10 个模块的项目生成,初期覆盖 8 种语言,底层采用 Gemini 3.5 Flash 模型。首批试点覆盖印度 100 所学校。

7月10日周五
7月9日周四
  1. Mistral AI52

    Mistral Studio 上线 Prompts 与 Skills 管理系统

    Mistral AI 在 Studio 中推出 Prompts 和 Skills 管理系统,为每个提示词和技能提供版本化、归属和可追溯的单一记录。每个版本不可变,支持对比、回滚、分类标签和审计日志,非开发者也能编辑并即时测试,发布仍走企业已有的 CI/CD 流程。技能可作为 MCP 服务器直接从 Studio 调用,确保生产执行的是同一受治理资产,该功能现已向 Studio 客户开放。

  2. Google Research62

    Google 发布 SensorFM:面向可穿戴健康数据的通用基础模型

    Google Research 发布 SensorFM,一个从无标注可穿戴数据中学习的大型传感器基础模型,预训练语料超过一万亿分钟多模态信号,来自 500 万名同意参与者、100 多个国家和 20 多款 Fitbit 与 Pixel Watch 设备。

    推荐理由:Google 用一万亿分钟可穿戴数据预训练通用生理表征,并给出跨 35 项健康任务的泛化与标签效率证据。

7月8日周三
  1. Mistral AI71

    Mistral AI 发布 Robostral Navigate 具身导航模型

    Mistral AI 发布首个具身导航模型 Robostral Navigate,这是一个 8B 模型,仅用单个普通 RGB 相机、无需 LiDAR 或深度传感器,在 R2R-CE validation unseen 上达到 76.6% 成功率,比最佳单相机方案高 9.7 个百分点,比使用深度或多相机的最佳系统高 4.5 个百分点。

    推荐理由:原文给出单目 RGB 相机在 R2R-CE 上的成绩与训练方法,读者可据此判断具身导航的能力边界。

  2. Hugging Face Blog62

    vLLM 的 transformers 建模后端实现原生推理速度

    Hugging Face 宣布 vLLM 的 transformers 建模后端现已达到甚至超过 vLLM 手写原生实现的吞吐,覆盖 Qwen3-4B 单卡、Qwen3-32B 张量并行和 Qwen3-235B-A22B-FP8 MoE 三种配置。

    推荐理由:原文给出 transformers 后端在 vLLM 中追平原生实现的具体机制与开关,读者可据此判断自家模型能否免移植提速。

  3. Google Research60

    Google Research 在 10 座美国城市实验用导航平台缓解交通拥堵

    Google Research 在 Nature Cities 发表研究,在 10 座美国城市开展为期六个月的实验,通过修改 Google Maps 算法将遇到预设拥堵路段的行程引导至耗时相近的替代路线,仅不到 2% 的行程收到改道建议。

    推荐理由:Google Research 在 10 座美国城市做了为期半年的真实路网实验,给出了协调少量出行即可提升全城车速与减排的量化结果。

7月7日周二
  1. Hugging Face Blog62

    微软在 Foundry Managed Compute 上线 Hugging Face 模型集合

    微软在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集合,将 Hugging Face 生态的开源权重模型以每周刷新的方式引入 Foundry 模型目录,可一键部署到托管 GPU 平台。

    推荐理由:微软把 Hugging Face 开源模型的部署运维层接进 Foundry,读者可据此判断开源模型进入企业生产环境的门槛变化。

  2. Hugging Face Blog75

    LeRobot v0.6.0 发布:世界模型策略、奖励模型与部署 CLI 闭环

    LeRobot v0.6.0 发布,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此判断开源机器人学习栈的当前能力边界。

  3. Hugging Face Blog62

    Hugging Face 与 SkyPilot 打通零出站流量存储,可在任意云上运行 AI 负载

    Hugging Face 与 SkyPilot 联合推出 store: hf 存储后端,用一条 hf:// URL 和已有的 HF_TOKEN 即可把 Hugging Face Bucket 或任意模型、数据集、Space 仓库挂载进 SkyPilot 任务,并在 20 多个云、Kubernetes、Slurm 和本地环境中调度运行。

    推荐理由:原文给出 hf:// 挂载方式与免出站流量费的具体机制,读者可据此判断跨云训练与推理的存储成本变化。

7月6日周一
  1. Hugging Face Blog28

    PRX Part 4:我们的数据策略

    Hugging Face 发布 PRX 系列第四篇,详解其数据策略:预训练数据由公开与内部数据集混合组成,用 VLM 重新生成图像描述,并转为可流式训练的语料。团队用 Lance 做数据构建与筛选、MDS 做流式训练,改用 Qwen3-VL 后在训练中实时计算文本 latent,7B 规模下吞吐仅损失约 3–4%(30 天训练多约 1 天)。图像统一编码为 quality 92 的 JPEG。

7月3日周五
7月2日周四
  1. Mistral AI66

    Mistral 发布 Leanstral 1.5:119B 总参数、6B 激活的形式化验证模型

    Mistral 发布 Leanstral 1.5,一个 Apache-2.0 许可的形式化验证模型,119B 总参数、6B 激活参数,在 miniF2F 上达到 100%,解出 PutnamBench 672 题中的 587 题,并在 FATE-H 取得 87%、FATE-X 取得 34%。

    推荐理由:原文给出模型规模、基准成绩与每道题成本对比,读者可据此判断形式化验证的实用门槛。

7月1日周三
  1. Berkeley AI Research12

    2026 BAIR 研究生展示:伯克利 AI 博士毕业生去向一览

    伯克利 BAIR 实验室展示 2026 届 AI 博士毕业生,研究覆盖机器人、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for science 等方向。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 等学术岗位,部分人正在创业或探索下一步。

  2. Hugging Face Blog38

    ScarfBench:面向企业级 Java 框架迁移的 AI 智能体基准测试

    Hugging Face 发布开源基准 ScarfBench,用于评估 AI 智能体在企业级 Java 跨框架迁移中的表现,涵盖 Spring、Jakarta EE、Quarkus 三大生态,包含 34 个应用、102 个框架实现和 204 个迁移任务。测试显示,即便最强智能体行为成功率也不足 10%,且 Claude Code 报告 30 个应用中 29 个构建成功,实际仅 22 个通过。

6月30日周二
  1. Google Research78

    Google 发布表格数据零样本基础模型 TabFM

    Google 发布面向表格数据分类与回归的基础模型 TabFM,将表格预测建模为上下文学习问题,无需手动训练、超参数调优和特征工程,单次前向传播即可对未见过的表格生成预测。

    推荐理由:Google 把零样本思路从时序预测搬到表格数据,读者可了解其架构设计与在 TabArena 上的对比结果。

6月29日周一
6月27日周六