PyTorch 性能分析入门指南(一):torch.profiler 使用教程
Hugging Face 发布 PyTorch 性能分析系列第一篇,讲解如何用 torch.profiler 分析矩阵乘法加偏置这一基础算子。
Hugging Face 发布 PyTorch 性能分析系列第一篇,讲解如何用 torch.profiler 分析矩阵乘法加偏置这一基础算子。
OpenAI 分享第三方 AI 评估指南,覆盖前沿系统的模型能力、防护措施与有效性评估方法。
Google Research 在 I/O 2026 上发布 Gemini for Science 实验工具套件,包含基于 ERA 与 AlphaEvolve 的 Computational Discovery、基于 Co-Scientist 的 Hypothesis Generation 以及基于 NotebookLM 的 Literature Insights。
Mistral 在 AI Now Summit 2026 上发布面向工业工程的 AI 栈,与 Airbus、BMW、ASML 合作优化设计、仿真与生产,并强调对专有数据和 IP 的完全控制。其智能体工具 Vibe 升级为统一智能体,可处理收件箱与日历、深度研究、交付物撰写,并完成从需求到合并变更的编码工作。位于法国 Les Ulis 的 10 MW 推理数据中心计划于 2026 年 Q3 开放。
推荐理由:Mistral 一次性公布工业 AI 栈、Vibe 智能体与自建数据中心,可据此观察其企业级全栈布局。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,覆盖工作与编码两类场景,原有对话、设置和订阅方案全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,读者可据此了解其工作与编码两种模式的能力边界和定价。
Endava 借助 Codex 构建智能体组织,将需求分析周期从数周缩短至数小时,加速软件交付。
Mistral AI 发布 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架,开源并可在云端、本地和边缘运行。它把摄取、检索和评测统一到共享接口下,内置 BM25 稀疏检索、稠密向量检索与混合配置,并提供 recall、precision、MRR、NDCG 等评测指标。
推荐理由:Mistral 把检索管线的摄取、检索与评测收进同一框架,读者可据此判断自建 RAG 的集成成本是否被压缩。
OpenAI 发布前沿治理框架(Frontier Governance Framework),说明其 AI 安全、安保与风险管理实践如何对齐欧盟和加州正在出台的监管要求。该框架聚焦前沿模型的治理与合规衔接。
Google 为隐私分析服务提出零信任聚合方案,将新型单次消息密码学聚合协议与 TEE 结合,设备无需多轮在线即可提交数据。该设计使原始数据在任何服务器内存中都不会被暴露或重建,仅在最终阶段处理已聚合匿名的数据,并通过 TEE 远程认证向参与者证明协议按公开代码正确执行。
Mistral 宣布将 Emmi AI 并入公司,推出面向工业工程的物理 AI 能力,作为其企业解决方案中的新基础能力。该能力从几何与边界条件直接预测物理场,单次前向推理在单张 GPU 上以秒级完成,用于加速产品设计、工装工艺设计和实时数字孪生,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。
推荐理由:Mistral 把物理仿真 AI 纳入企业平台,读者可了解其定位、适用场景与合作伙伴。
Mistral 收购 Emmi AI,并加倍投入面向航空航天、汽车、半导体和能源等行业的物理 AI 基础模型研究。其已发布成果包括 AB-UPT,可在单张 GPU 上处理 9M 表面和 140M 体积网格的原始几何数据,无需重新划分网格;以及首个大规模多物理场端到端深度学习代理模型 NeuralDEM。
Cisco 与 OpenAI 正用 Codex 重塑企业工程,帮助 Cisco 规模化 AI 原生开发、加速 AI Defense 工作并自动化缺陷修复。
OpenAI、Thrive 与 Crete 用 Codex 构建了一个可自我改进的税务智能体,实现自动报税、提升准确率并加速工作流。该方案将报税流程自动化,并借助自我改进机制持续优化准确性与效率。
Warp 正基于 GPT-5.5 及 OpenAI 模型,在本地、云端和开源开发工作流中协调多个编码智能体。该方案将 GPT-5.5 用于跨环境的编码智能体调度,是 Warp 在开源方向上的重要押注。
Hugging Face 发布教程,介绍如何让 Reachy Mini 机器人完全本地运行语音对话,无需云端和 API key。
Hugging Face 在 TRL 中落地增量权重同步(Delta Weight Sync):只把 RL 优化步之间发生变化的 bf16 权重编码成稀疏 safetensors 文件,上传到 Hugging Face Bucket,再由 vLLM 拉取应用。
推荐理由:TRL 把稀疏增量权重同步做成了可 pip 安装的实现,读者可据此判断跨机房异步 RL 训练的部署成本。
OpenAI 公布 2026 年选举支持方案,涵盖可靠信息、网络防御、AI 透明度、滥用防护与偏见监测五个方面。该方案旨在为选举提供信息与安全保障。
Import AI 第 458 期收录一篇基于 2026 年 Cosmos HAI Lab 演讲的长文和一个设想"正向奇点"的虚构故事。演讲提出面对 AI 持续进步,人类只有两种选择:探索未来,或从当下退缩;退缩会让人和社会陷入被动反应。
Hugging Face 发布 AI Agent 术语表,重点厘清常被混用的 harness 与 scaffold:scaffold 指系统提示词、工具描述、输出解析与上下文管理等行为定义层,harness 则是调用模型、处理工具调用并决定何时停止的执行层,社区常概括为 Agent = Model + Harness。
OpenAI 新研究显示,400 万美国人正使用 ChatGPT 创办、运营和扩展小企业,AI 正在降低创业成本。该研究称 AI 正成为小企业的"首位员工"。
OpenAI 与 Grupo Folha 和 Grupo UOL 宣布战略内容合作,把可信的巴西新闻内容引入 ChatGPT,并附带来源标注与透明度信息。
Mistral AI 本周签署最终协议收购 Physics AI 先驱 Emmi AI,以强化其作为工业企业 AI 转型伙伴的定位。Emmi AI 成立于奥地利,专注 Physics AI 与大型工程模型,可实时仿真替代多日计算并构建数字孪生,其 30 多名研究人员与工程师将于 5 月加入 Mistral 的 Science 与 Applied AI 团队。
推荐理由:Mistral 通过收购 Physics AI 公司 Emmi 补强工业仿真能力,读者可了解其 Science 路线与工业 AI 布局。
Mistral 发布 Mistral Medium 3.5,一个 128B 稠密模型,以修改版 MIT 许可开放权重,成为 Mistral Vibe 和 Le Chat 的默认模型。
推荐理由:Mistral 把编码智能体搬到云端并同步开源 128B 模型,读者可据此判断自托管与异步编码的可行边界。
Mistral 在 Studio 发布 Connectors(公开预览),内置连接器和自定义 MCP 均可通过 API/SDK 用于所有模型与 Agent 调用。
推荐理由:Mistral 把 MCP 连接器做成平台级注册实体,读者可据此判断企业 Agent 集成层会如何被收敛。
Virgin Atlantic 借助 Codex 在固定的假日出行截止期限前完成移动应用改版,实现接近全覆盖的单元测试和零 P1 缺陷。
OpenAI 在 2026 年 Gartner 企业级 AI 编程智能体魔力象限中获评领导者,旗下 Codex 因创新能力和企业级规模化部署获得认可。
Google DeepMind 在亚太区推出首届 Accelerator 加速器计划,聚焦“AI for the Planet”,面向该地区初创公司、研究团队和非营利组织,为期三个月。入选机构将获得专家指导,以及 Google AI 专家协助把前沿 AI 与科学 AI 模型集成进其项目或产品,覆盖自然、气候、农业、能源等领域。计划以在新加坡举办的线下 bootcamp 开营,现已开放意向登记。
AdventHealth 正在使用 ChatGPT for Healthcare 简化工作流程、减轻行政负担,将更多时间还给患者护理。
OpenAI 推进 Education for Countries 计划,通过新增合作、教师培训和工具扩大 AI 在学校中的应用,以改善全球学习成果。
Ramp 工程师使用 Codex 搭配 GPT-5.5 进行代码审查并提交改进,将实质性反馈的获取时间从数小时缩短到几分钟。
OpenAI 称其模型解决了有 80 年历史的单位距离问题,推翻了离散几何中的一个重要猜想,被视为 AI 驱动数学研究的一个里程碑。
推荐理由:OpenAI 模型推翻离散几何中悬置 80 年的核心猜想,可观察 AI 在数学证明上的实际进展。
OpenAI 宣布推出 OpenAI for Singapore,这是一项多年期 AI 合作计划,旨在扩大 AI 部署、培养本地人才,并支持企业及公共服务应用 AI。
Hugging Face 发布 OlmoEarth v1.1 地球观测模型系列,在保持 v1 性能的同时将计算成本最高降低 3 倍。该系列通过将 Sentinel-2 各分辨率合并为单一 token 缩短序列长度,并修改预训练方案以避免性能下降,提供 Base、Tiny、Nano 三种规模权重及训练代码。
Google 宣布把基于 Gemini 的科研工具 Empirical Research Assistance(ERA)开放给科学家使用,相关论文当天发表于 Nature。
推荐理由:Google 把 ERA 从 Nature 论文推进到可申请使用的工具,并给出八个跨学科应用案例,读者可据此判断科研编码自动化的落地边界。
OpenAI 推进 AI 内容溯源,采用 Content Credentials 和 SynthID,并推出验证工具,帮助人们识别和信任 AI 生成媒体。
Hugging Face 发布 Ettin Reranker 系列六款 Sentence Transformers CrossEncoder 重排序模型,参数量覆盖 17m、32m、68m、150m、400m 到 1b,均基于 Ettin ModernBERT 编码器,在同尺寸下达到 SOTA。
Google DeepMind 介绍生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 使用 Co-Scientist 辅助衰老研究。Co-Scientist 扫描数万篇论文后提出 20 多个新的候选基因因子,实验室测试验证了其中几个假设,其推荐因子成功让细胞进入更年轻状态并改善整体功能。此外,Co-Scientist 将原本需要长达六个月的筛选数据分析缩短到几天。
PaddleOCR 3.5 发布,支持通过设置 engine="transformers" 将 Hugging Face Transformers 作为推理后端运行 PP-OCRv5、PaddleOCR-VL 1.5 等模型。
Import AI 457 聚焦三项研究:SentinelOne 拆解出约 20 多年前的病毒 fast16.sys,它通过篡改内存中高精度计算软件(如 LS-DYNA 970、PKPM、MOHID)的结果来破坏科研与工程计算。
OpenAI 与 Dell 达成合作,将 Codex 引入混合云和本地部署环境,帮助企业在数据与工作流中安全部署 AI 编程智能体。