Google 赞助的非洲健康数据科学 Ideathon 揭晓:Dawa Health 等六队用 MedGemma、MedSigLIP 构建医疗方案
Google 联合 SisonkeBiotik、Ro'ya、DS-I Africa 举办非洲健康数据科学 Ideathon,从 30 多份提交中选出六支决赛团队,使用 MedGemma、TxGemma、MedSigLIP 等开放健康 AI 模型开发医疗方案。
Google 联合 SisonkeBiotik、Ro'ya、DS-I Africa 举办非洲健康数据科学 Ideathon,从 30 多份提交中选出六支决赛团队,使用 MedGemma、TxGemma、MedSigLIP 等开放健康 AI 模型开发医疗方案。
OpenAI 借助 Codex 在 28 天内完成 Android 版 Sora 的交付,通过 AI 辅助规划、翻译和并行编码工作流,让小团队实现快速可靠的开发。
BBVA 扩大与 OpenAI 的合作,启动多年期 AI 转型计划,向全部 12 万名员工部署 ChatGPT Enterprise。双方将共同开发 AI 解决方案,用于改善客户交互、简化运营流程,并打造 AI 原生银行体验。
BNY 利用 OpenAI 在全企业范围扩大 AI 应用,通过 Eliza 平台让 20,000 多名员工构建 AI 智能体,以提升效率和客户成果。
llama.cpp server 新增 router 模式,可在不重启服务的情况下动态加载、卸载和切换多个模型。该模式采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型;支持从 llama.cpp 缓存或 --models-dir 目录自动发现 GGUF 文件,按需加载,并在达到 --models-max(默认 4)时按 LRU 策略卸载最久未用的模型。
推荐理由:llama.cpp server 新增 router 模式,读者可据此了解本地多模型动态切换与显存管理方式。
OpenAI 发布 GPT-5.2,称其为目前数学与科学能力最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上取得新的 SOTA 结果。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。
推荐理由:官方给出 GPT-5.2 在数学与科学基准上的新结果,并说明这些提升如何落到实际研究进展。
Google DeepMind 宣布与英国 AI Security Institute(AISI)签署新谅解备忘录,将合作从模型测试扩展到基础安全研究。双方将共享专有模型、数据与思路,并联合发布报告,重点研究 CoT 监控、社会情感错位及 AI 对经济系统的影响。Google DeepMind 称 Gemini 3 是其迄今最智能、最安全的模型。
Hugging Face 发布教程,展示如何让 OpenAI Codex 借助 Hugging Face Skills 仓库完成端到端机器学习实验,包括数据集校验、硬件选择、提交训练任务、监控进度、评测与导出 GGUF。
推荐理由:原文给出 Codex 结合 HF Skills 完成端到端微调的完整流程与成本区间,可据此判断智能体托管训练实验的可行边界。
Google Research 在 COLM 2025 论文中提出 Urania 框架,通过差分隐私(DP)聚类与 DP 关键词提取,从 LLM 聊天机器人对话中生成使用洞察,且不依赖 LLM 自行脱敏。该框架用隐私预算 ε 提供端到端数学保证,LLM 仅基于匿名关键词生成摘要,不接触原始对话。对比非隐私基线 Simple-CLIO,DP 摘要最高有 70% 的概率被 LLM 评估者偏好。
Google DeepMind 宣布深化与英国政府的合作,向英国科学家优先开放 AlphaEvolve、AlphaGenome、AI co-scientist 和 WeatherNext 等"AI for Science"模型,并将在 2026 年于英国建立其首个自动化材料科学实验室,该实验室将与 Gemini 全面集成。
Mistral AI 发布下一代编码模型系列 Devstral 2,含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,分别采用修改版 MIT 和 Apache 2.0 许可,均为开源。
推荐理由:官方给出两款开源编码模型的参数、SWE-bench 成绩与许可差异,并附独立人工评测对比,可据此判断开源编码模型与闭源模型的差距。
Google DeepMind 联合 Kaggle 发布 FACTS Benchmark Suite,在原有 FACTS Grounding 基础上新增 Parametric、Search、Multimodal 三项基准,并将 Grounding 升级至 v2,共 3,513 个公开样本。
Hugging Face 推出 swift-huggingface,一个面向 Hub 的完整 Swift 客户端,可独立使用并即将集成进 swift-transformers 替代现有 HubApi。它提供完整 Hub API 覆盖、支持断点续传的下载、与 Python 兼容的共享缓存,以及 TokenProvider 认证和 OAuth 2.0 支持,Xet 存储后端即将上线。
Google Research 发布 Titans 架构和 MIRAS 理论框架,将 RNN 的速度与 Transformer 的精度结合,实现测试时记忆。Titans 用深度神经网络作为长期记忆模块,通过 surprise 指标、动量和自适应权重衰减选择性存储信息;MIRAS 则统一了序列建模的四个设计选择,并衍生出 YAAD、MONETA、MEMORA 三个无注意力模型。
推荐理由:Google 提出 Titans 架构与 MIRAS 框架,用深度神经网络做长期记忆模块,在超长上下文任务上超过 GPT-4。
密歇根州立大学团队借助 AlphaFold 预测植物与嗜热藻类中甘油酸激酶(GLYK)的 3D 结构,发现植物版 GLYK 的三个柔性环在高温下变形失稳。研究人员用藻类 GLYK 中更刚性的环替换这些不稳定片段,构建的杂合酶中有一个在高达 65 °C 时仍保持稳定,为培育耐热作物提供了路径。
Intel AI Software Group 发布 DeepMath,一个基于 Qwen3-4B Thinking、用 GRPO 微调的轻量级数学推理 Agent,通过 smolagents 生成 Python 片段并在沙箱执行,将输出长度最多缩短 66%,同时在 MATH500、AIME、HMMT、HLE 等基准上提升准确率。
Hugging Face 推出 Hugging Face Skills,让 Claude Code、Codex、Gemini CLI 等编码智能体直接提交微调任务到云端 GPU、监控进度并把模型推送到 Hub。
推荐理由:Hugging Face 把微调流程封装成 Claude Code 可调用的 Skill,读者可据此了解对话式训练的实际操作与成本。
Google Research 在 NeurIPS 2025 发布大规模声音嵌入基准 MSEB,用统一框架评测检索、推理、分类、转录、分割、聚类、重排与重建八项听觉能力。
Mistral 发布 Mistral 3 系列,包含 Mistral Large 3 与 Ministral 3(3B、8B、14B),全部以 Apache 2.0 许可开源。
推荐理由:Mistral 3 同时给出 675B 稀疏 MoE 大模型与 3B 到 14B 端侧系列,并公开 Apache 2.0 权重与部署格式,读者可据此判断开源前沿模型与端侧路线的分工。
Hugging Face 发布 Transformers v5.0.0rc-0,距 v4 首个候选版已五年,如今该库每天通过 pip 安装超 300 万次,累计安装量突破 12 亿。
推荐理由:官方梳理了 v5 在简化模型定义、训练与推理上的改动,可据此判断生态工具链的兼容方向。
AlphaFold 2 自 2020 年在 CASP 14 上解决蛋白质结构预测难题以来,其免费开放的 AlphaFold Protein Database 已发布超 2 亿个蛋白质结构预测,被 190 多个国家的 300 多万名研究者使用。该数据库相关研究被引用超 3.5 万篇,另有逾 20 万篇论文在方法中融入了 AlphaFold 2,这项工作于 2024 年获得诺贝尔化学奖。
密苏里大学的研究者借助 AlphaFold 与冷冻电镜,解析了“坏胆固醇”低密度脂蛋白(LDL)关键蛋白 apoB100 的结构。研究者先用冷冻电镜拍摄 LDL 颗粒图像,但清晰度不足以达到原子级精度,随后用 AlphaFold 生成原子级结构预测,再与电镜数据比对修正。
推荐理由:AlphaFold 与冷冻电镜结合解析 apoB100 结构,展示了 AI 预测在结构生物学中的具体用法。
Hugging Face 发布博客,从 attention 机制与 KV caching 出发,通过优化吞吐量推导出 continuous batching。该技术通过并行处理多个对话、完成即换出,最大化高负载场景下的推理性能。文中指出 attention 是 token 间唯一交互之处,其计算量随序列长度呈平方增长。
Hugging Face Diffusers 官方博客宣布支持 FLUX.2,提供 Flux2Pipeline 与 Flux2Transformer2DModel 的调用示例,文本编码器使用 Mistral3ForConditionalGeneration。
推荐理由:Diffusers 集成 FLUX.2 并给出可直接运行的代码示例,读者可据此了解该模型的调用方式与显存门槛。
Tavily 分享了其构建 SOTA 深度研究智能体的经验,曾因第一版架构假设过时被迫推倒重建。其核心思路是简化编排逻辑、拥抱模型自主性,并借助 Tavily Advanced Search 在工具侧完成上下文工程,只返回最相关内容块以降低幻觉与延迟。团队还提出将工具输出蒸馏为反思、仅在生成最终结果时引入原始信息,以模拟人类研究方式。
OVHcloud 正式加入 Hugging Face Hub 的 Inference Provider 生态,用户可直接在模型页调用 gpt-oss、Qwen3、DeepSeek R1、Llama 等开源权重模型。
Google DeepMind 宣布支持美国白宫 Genesis Mission,并与美国能源部合作,向全部 17 个国家实验室提供前沿 AI for Science 模型和智能体工具的加速访问计划,首批上线的是基于 Gemini 的 AI co-scientist。
推荐理由:Google DeepMind 与美国能源部 17 个国家实验室的合作,给出了 AI for Science 从模型到落地路径的具体样本。
Google 推出一款轻量级 EV 充电桩可用性预测模型,用简单线性回归预测某站点在未来若干分钟内是否有空闲充电口。模型以一天中各小时为特征,在 30 至 60 分钟时间跨度、100 个随机站点上评测,性能超过"保持当前状态"这一强基线,主要优势在于识别高占用率变化的关键时刻。
Hugging Face TRL 官方集成 RapidFire AI,用户可用 RFSFTConfig、RFDPOConfig、RFGRPOConfig 近乎零代码替换原有 SFT/DPO/GRPO 配置,并发运行多个微调配置。
推荐理由:官方集成给出了并发配置对比的调度机制与实测加速数据,可据此判断微调实验流程能压缩多少时间。
Google 在 Gemini 应用中上线 AI 图片验证功能,用户上传图片并提问即可检查其中是否含有 SynthID 水印,从而判断图片是否由 Google AI 生成或编辑。
推荐理由:原文说明了 Gemini 应用内验证 AI 图片的具体操作方式,以及 SynthID 与 C2PA 后续扩展方向。
Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),一个基于 Gemini 3 Pro 的高保真图像生成与编辑模型,已在 Google AI Studio 和 Vertex AI 以付费预览形式通过 Gemini API 逐步开放。
推荐理由:官方给出 Gemini 3 Pro Image 的分辨率、文本渲染与搜索接地等能力细节,可据此判断图像生成与编辑的可用边界。
Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建,主打图像生成与编辑。
推荐理由:官方给出 Nano Banana Pro 的文本渲染、多图融合与分辨率等能力变化,以及各产品线的开放节奏。
AnyLanguageModel 是一个 Swift 包,作为 Apple Foundation Models 框架的替代方案,让开发者用同一套 API 调用多种模型。
Mistral AI 宣布与 SAP 建立多年合作伙伴关系,为其 AI Foundation 提供完全自主的 AI 技术栈,并联合开发面向欧洲复杂行业与政府机构的行业解决方案。Mistral AI 同时与 Helsing 合作加速面向国防与安全应用的视觉-语言-动作模型研发。该公司还计划在未来数月内于德国开设办公室,并大幅扩充本地团队。
Google Research 介绍一种端到端语音到语音翻译(S2ST)模型,可在保留原说话人音色的同时实现实时翻译,延迟仅 2 秒,而现有系统通常有 4–5 秒延迟且会累积误差。
推荐理由:Google 端到端语音翻译把延迟压到 2 秒并保留原说话人音色,读者可了解其数据管线与流式架构。
ServiceNow 将 15B 推理模型改造为 Mamba 混合架构,旗舰版 Apriel-H1-15b-Thinker-SFT 实现 2.1x 吞吐,MATH500 从 0.90 升至 0.92、MTBench 从 8.30 升至 8.58,GSM8k、GPQA、AIME24 略有下降,总训练 76.8B token。
Google 发布智能体开发平台 Antigravity,即日起公开预览且免费,支持 macOS、Linux 和 Windows。它保留 AI 驱动的 IDE 编辑器视图,同时新增面向智能体的 Manager 界面,可并行编排多个工作区中的智能体,并通过任务列表、实现方案、截图和浏览器录制等 Artifacts 呈现工作过程。
推荐理由:Google 把 IDE 拆成同步编辑器与异步 Agent Manager 两层,读者可据此判断智能体编程工具的产品形态走向。
Google DeepMind 与 Google Research 发布 WeatherNext 2,称其生成预报速度提升 8 倍,分辨率最高可达 1 小时。
推荐理由:原文给出生成速度、分辨率与可用入口,读者可据此判断该模型在天气预报工作流中的位置。
Hugging Face 的 kernels 库现已支持构建和共享 ROCm 兼容内核,可运行在 AMD GPU 上并集成进 PyTorch。指南以 RadeonFlow 的 FP8 GEMM 内核为例,该内核针对 AMD Instinct MI300X 优化,曾获 AMD Developer Challenge 2025 大奖。
AMD 联合 Hugging Face 和 Data Monsters 举办 AMD Open Robotics Hackathon,首站 12 月 5-7 日在东京,第二站 12 月 12-14 日在巴黎。