跳到正文

全部动态

今日 29 条
11月13日周四
11月11日周二
  1. Google DeepMind38

    Google DeepMind 研究:让 AI 像人类一样“看”世界

    Google DeepMind 在 Nature 发表新研究,提出三步对齐方法,用 THINGS 数据集训练 SigLIP-SO400M 上的适配器生成百万级图像的 AligNet 数据集,再微调其他视觉模型,使其内部表征按人类概念层级重新组织。该方法改善了模型在“odd-one-out”任务上与人类判断的一致性,并提升了鲁棒性与泛化能力。

  2. Google DeepMind22

    Google DeepMind:Gemini 如何为北爱尔兰教师每周省下 10 小时

    北爱尔兰 C2k 与 Google for Education 合作的六个月试点中,参与教师借助 Gemini 平均每周节省 10 小时,并沉淀出 600 多个使用场景。教师用 Gemini 起草家长信、制作风险评估,用 NotebookLM 将课程材料转为播客和 MindMap 可视化,并生成爱尔兰语课程与个性化学习内容。试点成功后,C2k 计划向北爱尔兰更多教师推广 Gemini 培训。

11月7日周五
11月6日周四
11月5日周三
  1. Google Research38

    Google 发布 ForestCast:用深度学习预测森林砍伐风险

    Google 发布 ForestCast,基于纯卫星数据与 vision transformers 预测森林砍伐风险,并公开首个面向该任务的基准数据集。模型仅用 Landsat 和 Sentinel 2 卫星数据及"变化历史"输入,精度可匹配或超过依赖道路、人口密度等专用地图的传统方法,且可在全球任意区域一致应用。团队同时公开全部输入、训练与评估数据,供社区复现并改进模型。

  2. Google Research62

    Google 发布 Project Suncatcher 预印本,探索太空 AI 基础设施设计

    Google 公布研究项目 Project Suncatcher,设想由太阳能卫星星座搭载 TPU 并通过自由空间光链路互联,以在太空扩展 AI 算力。配套预印本论文《Towards a future space-based, highly scalable AI infrastructure system design》讨论了卫星间高带宽通信、轨道动力学和辐射对计算的影响。

    推荐理由:Google 公开了太空 AI 基础设施的预印本,给出卫星互联、轨道与 TPU 抗辐射的早期实测数据。

11月1日周六
  1. Berkeley AI Research31

    无需 TD 学习的强化学习:分治法如何扩展到长时程任务

    一篇博文提出用"分治"范式替代时序差分(TD)学习来做 off-policy 强化学习,通过将轨迹一分为二并组合子段价值,理论上把 Bellman 递归次数从线性降到对数级。作者称与 Aditya 合作的最新工作首次将分治价值学习扩展到目标条件强化学习这类高复杂度任务,且无需像 n-step TD 那样调节 n 超参数。

10月31日周五
10月30日周四
  1. Hugging Face Blog38

    MiniMax M2 如何重新思考智能体泛化:对齐基准还是对齐用户?

    MiniMax M2 在智能体后训练中提出"交错思考"(Interleaved Thinking),让模型在任务任意阶段都能思考,以应对工具输出带来的外部扰动。团队发现单纯扩展工具数量无法带来真正泛化,转而构建覆盖工具信息、系统提示词、用户提示词、环境与工具响应全轨迹的数据管线。内部测试中,M2 在陌生"冷启动"框架下工具调用与指令遵循表现均超出预期。

10月29日周三
  1. Hugging Face Blog65

    Hugging Face 博客:全球算力格局正在如何变化

    Hugging Face 发布博客《On the Shifting Global Compute Landscape》,梳理中国开源权重模型与国产芯片互相牵引的现状:过去几个月,华为昇腾、寒武纪等芯片已开始承载部分高性能开源模型的推理,部分模型开始用国产芯片训练。

    推荐理由:梳理中国开源模型与国产芯片互相牵引的路径,帮助读者理解算力受限如何影响模型架构与部署选择。

10月28日周二
  1. Hugging Face Blog38

    Hugging Face 提出“语音同意门”:让声音克隆必须先获得本人明确同意

    Hugging Face 发布博客提出“语音同意门”(voice consent gate),让模型只有在说话人明确说出同意语句并被 ASR 识别后才启动语音克隆。该方案由三部分组成:生成约 20 词、含同意短语与模型名的独特句子,ASR 识别该句,以及 TTS 语音克隆系统;同一句录音也可直接用作克隆素材。配套示例 Space 与代码已公开,用于探索把同意原则嵌入 AI 系统流程。

10月27日周一
  1. Hugging Face Blog62

    Hugging Face 改进 datasets 流式加载,请求量减少 100 倍

    Hugging Face 发布 datasets 库流式加载的性能改进,保持 streaming=True 的原有 API 不变,数据文件解析速度提升 10 倍、启动请求最多减少 100 倍、流式速度最多提升 2 倍。

    推荐理由:Hugging Face 官方给出流式加载的性能改进细节与配置方式,读者可据此判断大规模训练的数据读取成本。

  2. Hugging Face Blog62

    huggingface_hub v1.0 发布:五年后迎来首个大版本

    Hugging Face 发布 huggingface_hub v1.0,这是该库五年来的首个大版本,带来多项破坏性变更。主要变化包括后端从 requests 迁移到 httpx、全新的 hf CLI 取代已弃用的 huggingface-cli、以及 hf_xet 全面替代 hf_transfer 负责文件传输。

    推荐理由:官方梳理了 huggingface_hub 五年演进与 v1.0 的破坏性变更,可据此判断升级影响与迁移成本。

10月24日周五
  1. Mistral AI62

    Mistral AI 发布 AI Studio 生产平台

    Mistral AI 发布 Mistral AI Studio,一个面向企业团队的生产级 AI 平台,由 Observability、Agent Runtime 和 AI Registry 三大支柱组成。

    推荐理由:Mistral 把自家大规模系统的可观测、执行与治理能力打包成企业平台,读者可据此判断生产级 AI 基础设施的构成。

  2. Hugging Face Blog62

    LeRobot v0.4.0 发布:数据集 v3.0、PI0.5 与 GR00T N1.5 及硬件插件系统

    LeRobot 发布 v0.4.0,带来 LeRobotDataset v3.0 分块 episode 格式与流式加载,可支持 OXE 级别(>400GB)数据集,并提供 lerobot-edit-dataset CLI 用于删除、拆分、合并数据集。

    推荐理由:LeRobot v0.4.0 把数据集、VLA 模型与硬件插件整合进同一开源栈,可据此判断机器人学习工具链的成熟度。

10月23日周四
  1. Google Research62

    Google Earth AI 发布新影像与人口基础模型及地理空间推理智能体

    Google 发布 Earth AI 新进展,包括新的影像与人口基础模型,以及由 Gemini 驱动的地理空间推理智能体,并给出技术细节与评测。影像模型支持自然语言查询和开放词汇目标检测,在文本图像搜索任务上平均提升超过 16%,零样本新目标检测准确率翻倍以上。

    推荐理由:Google 公布 Earth AI 新基础模型与地理空间推理智能体的评测数据,可了解多模型协同在灾害预测中的实际增益。

  2. Hugging Face Blog65

    Meta 与 Hugging Face 联合推出 OpenEnv Hub,并发布 OpenEnv 0.1 规范草案

    Meta 与 Hugging Face 合作推出 OpenEnv Hub,一个面向智能体环境的开放共享社区 Hub,开发者可构建、分享和探索兼容 OpenEnv 的环境,用于训练和部署。

    推荐理由:Meta 与 Hugging Face 联合推出智能体环境共享 Hub,并公开 0.1 规范草案,读者可了解开放智能体生态的协作方式。

10月22日周三
  1. Hugging Face Blog55

    Hugging Face 与 VirusTotal 合作,为 Hub 上 220 万+ 公开仓库提供持续扫描

    Hugging Face 宣布与威胁情报与恶意软件分析平台 VirusTotal 合作,即日起对 Hub 上 220 万+ 公开模型和数据集仓库进行持续扫描。用户访问仓库或文件页面时,Hub 会自动用文件哈希比对 VirusTotal 威胁情报库,返回干净或恶意状态及检测计数等元数据,不共享原始文件内容。

10月21日周二
  1. Hugging Face Blog62

    Hugging Face AI Sheets 新增视觉支持,可在表格中处理图像

    Hugging Face 为开源工具 AI Sheets 发布重大更新,新增视觉支持,可在表格中查看、分析图像并提取信息,也能从文本生成图像和编辑图像,全部由 Inference Providers 上的开放模型驱动。

    推荐理由:官方给出视觉能力在表格工作流中的具体用法与模型对比,可据此判断图像数据整理是否值得迁移。

10月17日周五
10月16日周四
10月15日周三
10月14日周二
10月11日周六
10月9日周四
10月8日周三
10月7日周二
  1. Hugging Face Blog60

    BigCode 发布 BigCodeArena:通过代码执行端到端评判代码生成

    BigCode 项目发布 BigCodeArena,这是首个通过实际执行代码来评估代码生成模型的人类参与平台,用户提交编程任务后可对比两个模型的生成结果、运行程序并投票,结果汇总为排行榜。

    推荐理由:平台把代码执行结果纳入人类投票,并公开 5 个月社区数据与两个新基准,可据此了解代码模型评测的新做法。

10月6日周一
  1. OpenAI News72

    OpenAI Codex 正式可用,新增 Slack 集成、SDK 与管理工具

    OpenAI Codex 现已正式可用(generally available),面向开发者新增多项功能:Slack 集成、Codex SDK,以及用量看板和工作区管理等管理工具。官方称这些更新让 Codex 更易使用,也更容易在规模化场景下管理。

    推荐理由:Codex 从预览转为正式可用,并给出 Slack 集成、SDK 与管理工具,读者可据此判断团队规模化使用的门槛变化。