DeepSeek 联合华为发布昇腾芯片开源编程工具
DeepSeek 与华为合作,为华为昇腾芯片打造开源编程工具,核心是 TileLang 语言,DeepSeek 称其编程模型比 CUDA 更简单。发布内容还包括计算库和芯片间数据传输库,双方还优化了由 128 颗昇腾 950 芯片组成的超级节点。TileLang 最初由北京大学研究人员开发,DeepSeek 已使用约一年,目前是其 AGI 工作的主要工具。
DeepSeek 与华为合作,为华为昇腾芯片打造开源编程工具,核心是 TileLang 语言,DeepSeek 称其编程模型比 CUDA 更简单。发布内容还包括计算库和芯片间数据传输库,双方还优化了由 128 颗昇腾 950 芯片组成的超级节点。TileLang 最初由北京大学研究人员开发,DeepSeek 已使用约一年,目前是其 AGI 工作的主要工具。
Latent Space 公布 AINews v3 改版计划,将把已运营 3 年、订阅超 20 万的 AINews 与 Latent Space Discord 合并,并探索迁移至 Beehiiv 和新主页。
Latent Space 的 AINews 汇总 9 月 15 日至 16 日动态,其中 Steve Yegge 关停了 Gas Town,并承认每月花费数千美元订阅编码智能体,最终只做出了 Gas Town 这一个项目。
NVIDIA 在 MLPerf Inference v6.1 中首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。
推荐理由:MLPerf v6.1 成绩给出了 Vera Rubin 与 GB300 的吞吐对比和 99% 扩展效率,可据此判断推理基础设施的性价比走向。
英国 AI Security Institute 分析显示,开源权重模型与闭源前沿模型的网络能力差距正在收窄:GLM-5.2 与 DeepSeek V4-Pro 的表现接近 4 到 7 个月前发布的闭源前沿模型,而 2025 年大部分时间这一差距为 6 到 10 个月;在长周期网络靶场 The Last Ones 上差距更大。
Hugging Face 发起 Open-R1 项目,计划系统重建 DeepSeek-R1 的数据与训练流程,补上官方未公开的数据集和训练代码。项目分三步:从 DeepSeek-R1 蒸馏高质量推理数据集复现 R1-Distill 模型,复现 R1-Zero 所用的纯强化学习流程并整理数学、推理、代码数据集,以及展示从基座模型经 SFT 到 RL 的多阶段训练。
推荐理由:Hugging Face 公开复现 DeepSeek-R1 的三步计划,读者可了解开源推理模型训练链路的缺口与补全路径。