DeepSeek 联合华为发布昇腾芯片开源编程工具
DeepSeek 与华为合作,为华为昇腾芯片打造开源编程工具,核心是 TileLang 语言,DeepSeek 称其编程模型比 CUDA 更简单。发布内容还包括计算库和芯片间数据传输库,双方还优化了由 128 颗昇腾 950 芯片组成的超级节点。TileLang 最初由北京大学研究人员开发,DeepSeek 已使用约一年,目前是其 AGI 工作的主要工具。
DeepSeek 与华为合作,为华为昇腾芯片打造开源编程工具,核心是 TileLang 语言,DeepSeek 称其编程模型比 CUDA 更简单。发布内容还包括计算库和芯片间数据传输库,双方还优化了由 128 颗昇腾 950 芯片组成的超级节点。TileLang 最初由北京大学研究人员开发,DeepSeek 已使用约一年,目前是其 AGI 工作的主要工具。
柏林初创公司 Restate 完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参投。Restate 提供持久化工作流执行引擎,自建存储、复制与冗余层,已签下多个六位数和七位数客户合同,客户包括 vibe-coding 平台 Replit。新资金将用于组建市场团队、扩充工程师并扩展旧金山湾区办公室。
Cerebras Systems CEO 兼联合创始人 Andrew Feldman 将在 TechCrunch Disrupt 2026 的 Disrupt Stage 发表“Can AI Keep Scaling?
Destro 结束隐身模式并获得 800 万美元种子轮融资,其 AI 智能体层让机器人在物流场景中作业,同时指挥人类工人,而非自研机器人本体。
NVIDIA 提出 AI 工厂投资回报取决于三个要素:每兆瓦产出能力、硬件使用寿命和 token 需求。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 倍。
由前 Google 云业务、SpaceX Starlink 工程师 Rama Afullo 联合创办的 Satlyt 完成 800 万美元种子轮,由休斯顿 Non Sibi Ventures 领投,用于为卫星打造可在轨运行 AI 模型的软件。
硬件设计 AI 工具公司 Flow Engineering 完成 5000 万美元 B 轮融资,估值达 7.5 亿美元,由 Valor Equity Partners 的 Antonio Gracias 与 Atreides Management 的 Gavin Baker 联合领投,红杉资本参投。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 上可用,Cognition 成为首个在生产负载上运行该系统的客户。
推荐理由:材料给出 Vera Rubin NVL72 上线 CoreWeave 云及 Devin 实测吞吐数据,可据此判断智能体编码负载的算力供给变化。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将与 BMW 合作碰撞仿真与工程 AI、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)合作利用风洞设施开发汽车空气动力学数字孪生。Mistral 强调其开放权重架构让模型可在客户自有基础设施上运行,数据不出组织。
Google Private AI Compute 团队公布为 Private AI Compute 平台引入私密的服务端持久记忆,让 AI 助手在跨设备场景下保留上下文,同时维持接近端侧的隐私标准。
推荐理由:Google 公开了云端持久记忆的隐私架构,读者可了解跨设备 AI 记忆如何在加密隔离环境中实现。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 发文阐述物理 AI 规模化部署的安全要求,指出安全必须覆盖硬件、软件、AI、运行环境与部署全生命周期,而非部署前的一次性检查。ABI Research 预计到 2035 年 L3-L5 自动驾驶汽车保有量达 4900 万辆,Omdia 估计 2026 至 2035 年间约 6000 万台工业机器人将部署。
NVIDIA 在埃及大埃及博物馆举办活动,展示其 AI 生态已进入生产规模阶段,NVIDIA Deep Learning Institute 在埃及的学习者一年内增长超过十倍。
NVIDIA 在纽约气候周介绍了 5 家用 AI 推进清洁能源的公司。ThinkLabs AI 用 NVIDIA CUDA 平台打造数字孪生与智能体,帮助南加州爱迪生将每份电网并网申请评估时间从 30-45 天缩短到 2 分钟。
NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
推荐理由:MLPerf v6.1 成绩给出了 Vera Rubin 与 GB300 的吞吐对比和 99% 扩展效率,可据此判断推理基础设施的性价比走向。
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态管理用电。
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,在英国国家 AI 超算 Isambard-AI 上训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,单节点八 GPU 训练仅耗时两天。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练定制模型,数据与由此产生的智能均归企业所有。Cloudera 平台承载 30 exabytes 客户自管数据。
Mistral 与 HUMAIN 宣布达成战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,合作规模达数亿欧元。双方将优先聚焦网络安全与语音领域,并计划开发阿拉伯语表现强劲的前沿模型,Mistral 还将探索使用 HUMAIN 的数据中心基础设施。双方计划在沙特制定联合市场策略,面向受监管行业提供 AI 解决方案。
OpenAI 宣布在佐治亚州 Effingham County 启动 Project Camellia,承诺负责任能源、社区投资与就业,并提供 Codex 使用渠道。
Samsung Electronics 在全球员工中部署 ChatGPT Enterprise 和 Codex,这是 OpenAI 规模最大的企业级 AI 落地之一。
OpenAI 推出 Partner Network,投入 1.5 亿美元帮助全球合作伙伴加速企业 AI 的采用、部署与转型。
加州大学圣地亚哥分校在 Google 支持下,正用 2000 台退役 Pixel 智能手机的主板搭建数据中心,为数百名研究人员和学生提供低成本、低碳的云计算。SPEC 基准显示 25-50 台手机约等于一台现代服务器,这些手机以 25-50 台为单位组成由 Kubernetes 管理的自管理集群。该系统预计于 2026 年秋季全面上线。
OpenAI 在密歇根破土动工一个 1GW 数据中心项目,属于 Stargate 计划的一部分。该项目建设 AI 基础设施,目标是扩大接入、创造就业并支持当地社区。
推荐理由:OpenAI 在密歇根动工 1GW 数据中心,读者可了解 Stargate 的落地规模与选址进展。
Mistral AI 本周签署最终协议收购 Physics AI 先驱 Emmi AI,以强化其作为工业企业 AI 转型伙伴的定位。Emmi AI 成立于奥地利,专注 Physics AI 与大型工程模型,可实时仿真替代多日计算并构建数字孪生,其 30 多名研究人员与工程师将于 5 月加入 Mistral 的 Science 与 Applied AI 团队。
推荐理由:Mistral 通过收购 Physics AI 公司 Emmi 补强工业仿真能力,读者可了解其 Science 路线与工业 AI 布局。
OpenAI 与 Dell 达成合作,将 Codex 引入混合云和本地部署环境,帮助企业在数据与工作流中安全部署 AI 编程智能体。
OpenAI 推出企业部署公司 DeployCo,帮助各类组织将前沿 AI 投入生产环境并转化为可衡量的业务成果。该公司定位为企业级部署主体,聚焦前沿 AI 的实际落地与业务影响。
OpenAI 推出 MRC(Multipath Reliable Connection)超级计算机网络协议,通过 OCP 开放发布,用于提升大规模 AI 训练集群的韧性与性能。
Safetensors 已加入 PyTorch 基金会,成为 Linux 基金会下由基金会托管的项目,与 DeepSpeed、Helion、Ray、vLLM 和 PyTorch 并列。
OpenAI 公布其与美国国防部(Department of War)的合同细节,内容涵盖安全红线、法律保护条款,以及 AI 系统在涉密环境中的部署方式。
推荐理由:OpenAI 官方披露与国防部门合同的边界条款,可了解 AI 进入涉密环境的合规与安全约束。
OpenAI 与 Amazon 宣布战略合作,将 OpenAI 的 Frontier 平台引入 AWS,并扩展 AI 基础设施、定制模型和企业级 AI 智能体。
推荐理由:OpenAI 与 Amazon 达成战略合作,读者可据此了解前沿模型平台进入 AWS 生态后的企业落地路径。
OpenAI 宣布推出 Frontier Alliance Partners,帮助企业从 AI 试点走向生产环境,实现安全、可扩展的智能体部署。
Hugging Face 宣布 GGML(llama.cpp 的创建者)加入 HF,Georgi Gerganov 及团队一同加入,目标是持续支持 ggml 与 llama.cpp 社区,推动本地 AI 发展。
推荐理由:GGML 与 llama.cpp 团队加入 Hugging Face,读者可了解本地推理项目在资源与维护方式上的变化。
OpenAI 公布 Stargate 社区计划,提出以社区优先的方式建设 AI 基础设施,方案将根据社区意见、能源需求与劳动力优先事项进行本地化定制。
ServiceNow 扩大对 OpenAI 前沿模型的接入,用于驱动 ServiceNow 平台上的 AI 工作流、摘要、搜索与语音功能。此次合作将 OpenAI 模型能力引入企业级工作场景,覆盖 AI 驱动的企业流程自动化与交互体验。
OpenAI 发起一项新的 RFP,旨在通过加速美国本土制造、创造就业岗位并扩展 AI 基础设施,强化美国 AI 供应链。
OpenAI 宣布与 Cerebras 合作,新增 750MW 高速 AI 算力,用于降低推理延迟。该合作旨在让 ChatGPT 在实时 AI 工作负载下响应更快。
推荐理由:OpenAI 与 Cerebras 达成算力合作,读者可了解其新增算力规模与对推理延迟的直接影响。
OpenAI 与软银集团合作,联合 SB Energy 开发多吉瓦级 AI 数据中心园区,其中包括一座位于得克萨斯州、容量 1.2 GW 的设施,用于支持 Stargate 计划。
推荐理由:OpenAI 与软银、SB Energy 合作建设多吉瓦数据中心,可了解 Stargate 的算力落地规模。
Mistral AI 宣布与 SAP 建立多年合作伙伴关系,为其 AI Foundation 提供完全自主的 AI 技术栈,并联合开发面向欧洲复杂行业与政府机构的行业解决方案。Mistral AI 同时与 Helsing 合作加速面向国防与安全应用的视觉-语言-动作模型研发。该公司还计划在未来数月内于德国开设办公室,并大幅扩充本地团队。
Hugging Face 宣布与 Google Cloud 建立更深层合作,让企业用开放模型构建自有 AI。