跳到正文

#Google

今日 0 条
1月14日周三
  1. Google Research62

    Google 发布 MedGemma 1.5 4B 与医疗语音识别模型 MedASR

    Google 发布 MedGemma 1.5 4B,新增对 CT、MRI 和全切片病理等高维医学影像的支持,并保留 2D 图像与文本能力。官方称其在 CT 病变分类上绝对准确率较 MedGemma 1 提升 3%(61% vs. 58%),MRI 提升 14%(65% vs. 51%),MedQA 提升 5%(69% vs. 64%)。

    推荐理由:官方给出 MedGemma 1.5 与 MedASR 的基准对比和开源入口,可据此判断医疗多模态模型的可用边界。

  2. Google DeepMind71

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,新增竖屏输出与 1080p/4K 放大

    Google DeepMind 更新 Veo 3.1 Ingredients to Video,让基于参考图生成的视频在简单提示词下更富表现力,并提升角色身份、背景与物体的一致性。

    推荐理由:原文列出 Veo 3.1 Ingredients to Video 在角色一致性、竖屏输出和 1080p/4K 上的具体变化,可据此判断视频生成工作流能怎么调整。

1月13日周二
  1. Google Research62

    NeuralGCM 用 AI 改进全球长期降水模拟

    Google Research 在 Science Advances 发表论文,介绍混合模型 NeuralGCM 直接使用 NASA 2001 至 2018 年卫星降水观测训练其机器学习部分,而非依赖再分析数据。

    推荐理由:NeuralGCM 改用卫星降水观测训练后,在 15 天预报与数十年气候模拟上均优于传统模型,读者可了解混合建模路线的具体收益。

12月24日周三
12月19日周五
12月17日周三
  1. Google DeepMind87

    Google DeepMind 发布 Gemini 3 Flash

    Google DeepMind 发布 Gemini 3 Flash,主打前沿智能与速度兼顾,在 GPQA Diamond 得 90.4%、Humanity's Last Exam 无工具得 33.7%、MMMU Pro 得 81.2%、SWE-bench Verified 得 78%。

    推荐理由:官方给出 Gemini 3 Flash 的基准分数、定价与上线渠道,可据此判断速度与成本之间的取舍。

12月16日周二
  1. Google Research60

    Google 为 STOC 2026 推出 Gemini 论文助手 Paper Assistant Tool

    Google Research 在 STOC 2026 试验了基于 Gemini 2.5 Deep Think 的 Paper Assistant Tool(PAT),在投稿后 24 小时内为作者提供自动预审反馈,包括论文贡献摘要、潜在错误与改进建议以及笔误清单。

    推荐理由:Google 在 STOC 2026 试用的论文预审工具给出了真实采纳率与作者反馈,可据此判断 AI 辅助数学证明审阅的边界。

12月13日周六
12月12日周五
12月11日周四
  1. Google Research34

    Google 提出 Urania:用差分隐私框架洞察 AI 聊天机器人使用情况

    Google Research 在 COLM 2025 论文中提出 Urania 框架,通过差分隐私(DP)聚类与 DP 关键词提取,从 LLM 聊天机器人对话中生成使用洞察,且不依赖 LLM 自行脱敏。该框架用隐私预算 ε 提供端到端数学保证,LLM 仅基于匿名关键词生成摘要,不接触原始对话。对比非隐私基线 Simple-CLIO,DP 摘要最高有 70% 的概率被 LLM 评估者偏好。

12月10日周三
12月9日周二
12月5日周五
  1. Google Research62

    Google 发布 Titans 与 MIRAS:让 AI 拥有长期记忆

    Google Research 发布 Titans 架构和 MIRAS 理论框架,将 RNN 的速度与 Transformer 的精度结合,实现测试时记忆。Titans 用深度神经网络作为长期记忆模块,通过 surprise 指标、动量和自适应权重衰减选择性存储信息;MIRAS 则统一了序列建模的四个设计选择,并衍生出 YAAD、MONETA、MEMORA 三个无注意力模型。

    推荐理由:Google 提出 Titans 架构与 MIRAS 框架,用深度神经网络做长期记忆模块,在超长上下文任务上超过 GPT-4。

  2. Google DeepMind38

    科学家用 AlphaFold 改造光合作用关键酶,培育耐热作物

    密歇根州立大学团队借助 AlphaFold 预测植物与嗜热藻类中甘油酸激酶(GLYK)的 3D 结构,发现植物版 GLYK 的三个柔性环在高温下变形失稳。研究人员用藻类 GLYK 中更刚性的环替换这些不稳定片段,构建的杂合酶中有一个在高达 65 °C 时仍保持稳定,为培育耐热作物提供了路径。

12月4日周四
11月26日周三
  1. Google DeepMind34

    AlphaFold 五年影响:从蛋白质结构预测到全球科研基础设施

    AlphaFold 2 自 2020 年在 CASP 14 上解决蛋白质结构预测难题以来,其免费开放的 AlphaFold Protein Database 已发布超 2 亿个蛋白质结构预测,被 190 多个国家的 300 多万名研究者使用。该数据库相关研究被引用超 3.5 万篇,另有逾 20 万篇论文在方法中融入了 AlphaFold 2,这项工作于 2024 年获得诺贝尔化学奖。

11月25日周二
  1. Google DeepMind62

    AlphaFold 助力解析导致心血管疾病的关键蛋白 apoB100 结构

    密苏里大学的研究者借助 AlphaFold 与冷冻电镜,解析了“坏胆固醇”低密度脂蛋白(LDL)关键蛋白 apoB100 的结构。研究者先用冷冻电镜拍摄 LDL 颗粒图像,但清晰度不足以达到原子级精度,随后用 AlphaFold 生成原子级结构预测,再与电镜数据比对修正。

    推荐理由:AlphaFold 与冷冻电镜结合解析 apoB100 结构,展示了 AI 预测在结构生物学中的具体用法。

11月24日周一
  1. Google DeepMind62

    Google DeepMind 支持美国能源部 Genesis 计划,向 17 个国家实验室开放 AI 科研工具

    Google DeepMind 宣布支持美国白宫 Genesis Mission,并与美国能源部合作,向全部 17 个国家实验室提供前沿 AI for Science 模型和智能体工具的加速访问计划,首批上线的是基于 Gemini 的 AI co-scientist。

    推荐理由:Google DeepMind 与美国能源部 17 个国家实验室的合作,给出了 AI for Science 从模型到落地路径的具体样本。

11月22日周六
  1. Google Research22

    Google 如何用简单线性回归模型预测 EV 充电桩可用性

    Google 推出一款轻量级 EV 充电桩可用性预测模型,用简单线性回归预测某站点在未来若干分钟内是否有空闲充电口。模型以一天中各小时为特征,在 30 至 60 分钟时间跨度、100 个随机站点上评测,性能超过"保持当前状态"这一强基线,主要优势在于识别高占用率变化的关键时刻。

11月20日周四
  1. Google DeepMind78

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),一个基于 Gemini 3 Pro 的高保真图像生成与编辑模型,已在 Google AI Studio 和 Vertex AI 以付费预览形式通过 Gemini API 逐步开放。

    推荐理由:官方给出 Gemini 3 Pro Image 的分辨率、文本渲染与搜索接地等能力细节,可据此判断图像生成与编辑的可用边界。

11月19日周三
  1. Google DeepMind87

    Google DeepMind 发布 Gemini 3 Pro 并推出 Antigravity 开发平台

    Google DeepMind 发布 Gemini 3,其中 Gemini 3 Pro 在编码、智能体工作流和复杂零样本任务上超过 2.5 Pro,已在 Google AI Studio 和 Vertex AI 以预览形式开放,200k token 以内输入每百万 token 收费 2 美元、输出 12 美元。

    推荐理由:官方给出 Gemini 3 Pro 的基准成绩、API 定价与配套开发平台,便于判断它在智能体编码工作流中的位置。

  2. Google DeepMind82

    Google 发布智能体开发平台 Antigravity

    Google 发布智能体开发平台 Antigravity,即日起公开预览且免费,支持 macOS、Linux 和 Windows。它保留 AI 驱动的 IDE 编辑器视图,同时新增面向智能体的 Manager 界面,可并行编排多个工作区中的智能体,并通过任务列表、实现方案、截图和浏览器录制等 Artifacts 呈现工作过程。

    推荐理由:Google 把 IDE 拆成同步编辑器与异步 Agent Manager 两层,读者可据此判断智能体编程工具的产品形态走向。

11月17日周一
11月14日周五
11月13日周四
  1. Google Research62

    Google Quantum AI 提出量子优化工具包 DQI

    Google Quantum AI 与 Stanford、MIT、Caltech 合作者在 Nature 论文中提出量子算法 Decoded Quantum Interferometry(DQI),利用量子干涉把优化问题转化为解码问题。

    推荐理由:Google Quantum AI 提出把优化问题转成解码问题的量子算法,并给出 OPI 上量子与经典运算量的对比。

11月12日周三
  1. Google Research42

    Google 发布 JAX-Privacy 1.0:面向大规模机器学习的差分隐私工具库

    Google 发布 JAX-Privacy 1.0,这是基于 JAX 构建的差分隐私工具库,支持 DP-SGD、DP-FTRL 及 DP matrix factorization 等算法,并可与 JAX 原生并行能力配合实现数据与模型并行。新版本重新设计以提升模块化,内置微批处理与 padding 以处理大规模变长批次,并基于 Google 的 DP 核算库提供噪声校准与审计工具。

11月11日周二
  1. Google DeepMind38

    Google DeepMind 研究:让 AI 像人类一样“看”世界

    Google DeepMind 在 Nature 发表新研究,提出三步对齐方法,用 THINGS 数据集训练 SigLIP-SO400M 上的适配器生成百万级图像的 AligNet 数据集,再微调其他视觉模型,使其内部表征按人类概念层级重新组织。该方法改善了模型在“odd-one-out”任务上与人类判断的一致性,并提升了鲁棒性与泛化能力。

  2. Google DeepMind22

    Google DeepMind:Gemini 如何为北爱尔兰教师每周省下 10 小时

    北爱尔兰 C2k 与 Google for Education 合作的六个月试点中,参与教师借助 Gemini 平均每周节省 10 小时,并沉淀出 600 多个使用场景。教师用 Gemini 起草家长信、制作风险评估,用 NotebookLM 将课程材料转为播客和 MindMap 可视化,并生成爱尔兰语课程与个性化学习内容。试点成功后,C2k 计划向北爱尔兰更多教师推广 Gemini 培训。

11月8日周六
  1. Google Research50

    Google 提出 Nested Learning:面向持续学习的新 ML 范式

    Google Research 在 NeurIPS 2025 论文中提出 Nested Learning,将模型架构与优化算法统一为多层嵌套的优化问题,并给出概念验证架构 Hope。Hope 是 Titans 架构的变体,在语言建模上表现更优,长上下文记忆管理优于现有 SOTA 模型。该范式还衍生出深度优化器和连续记忆系统(CMS)等改进方向。

11月7日周五