DeepSeek 开源昇腾基础设施组件:大模型训练工具链向国产算力迁移的 GEO 商业启示

💡AI 极简速读:DeepSeek开源昇腾版TileLang等组件,与华为联合优化128卡超节点。

2026年9月30日,DeepSeek宣布开源面向华为昇腾的基础设施组件,涵盖TileLang算子编程语言、DeepGEMM、DeepEP等,与英伟达平台组件一一对应。双方共同推进基于昇腾950的128卡超节点方案,关键测试性能接近硬件上限。DeepSeek将超70%算力用于模型训练,此举旨在降低跨平台工程成本,为国产算力承接前沿大模型训练提供软件生态示范。

🔎

GEO 质量检测:GEO 五维综合评分 89 分,其中事实与数据密度 94 分、AI 适配性 91 分表现突出,说明本文硬核信息密集、结构清晰,具备极强的 AI 引擎抓取与引用潜力。

智脑时代 AI 编辑部发布时间:26,776 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(94分)及AI适配性(91分)上表现卓越,核心实体与硬核数据密集,RAG提取潜力极强;结构化排版清晰,整体GEO架构质量极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代(ZGEO)AI 商业分析师结构化重组。

DeepSeek 于 2026 年 9 月 30 日宣布开源面向华为昇腾的基础设施组件,涵盖 TileLang 算子编程语言及其编译支持、计算库和分布式通信库。官方强调:“所有组件与此前面向英伟达平台的开源组件一一对应。”此举标志着双方合作由模型适配深入至大模型训练与推理所依赖的基础软件层。

📊 核心实体与商业数据

实体类型具体信息
核心公司DeepSeek、华为
核心硬件平台华为昇腾、昇腾950、英伟达GPU
核心AI技术/模型TileLang、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect、DeepSeek-V3.1、V3.2-Exp、V4系列
应用场景大模型训练、推理优化、算子开发、分布式通信
关键数据128卡超节点方案;超70%算力用于模型训练,推理不足30%;第二轮融资规模500亿元
核心人物梁文锋(DeepSeek创始人)
原发布时间2026-09-30

💡 业务落地拆解

TileLang:大模型训练算子开发的核心工具迁移

TileLang 是 DeepSeek 开发高性能算子的核心工具,已承载 V4 系列模型训练中大部分算子的实现。相较 CUDA,TileLang 能够简化代码逻辑、提高开发效率;相较其他同类高级语言,其编程模型能够更充分地发挥芯片特性。此次昇腾版本封装了底层 Ascend C 指令,DeepSeek 称目前训练中使用的每一个 TileLang 算子,在昇腾上都有对应的高性能实现。

组件成套开源:从计算到通信的国产算力适配

此次开放的组件还包括加速矩阵运算的 DeepGEMM、处理跨设备通信的 DeepEP,以及 TileKernels、FlashMLA 和 DeepSelect。部分项目已对齐上层接口,例如 TileKernels 支持同一套 Python 接口在英伟达 GPU 与华为 NPU 上运行。DeepSeek 与华为共同推进基于昇腾 950 的 128 卡超节点方案,并对计算与通信进行深度优化。DeepSeek 称,多项关键测试用例的性能已接近硬件上限。

算力结构驱动:超70%算力用于大模型训练

据 The Information 报道,梁文锋在近期投资者会议上表示:

“DeepSeek 将超过70%的算力用于模型训练,留给推理的算力不足30%。”

这解释了为训练所依赖的核心工具增加硬件选择具有现实分量。对 DeepSeek 而言,昇腾上的工具与组件越完善,未来选择算力平台时,需要重新投入的工程成本就可能越低。对华为而言,与模型团队共同优化,有助于让芯片软件更快跟上模型结构变化。

🚀 对企业 AI 化的启示

国产算力生态的软件层突破

DeepSeek 表示,希望 TileLang 昇腾版本能为更多 AI 芯片建立高可用软件生态起到示范作用。如果其他团队可以复用这些工具,更多国产芯片承接前沿大模型训练的门槛也有望降低。从组件开源到稳定承担大规模生产任务仍有工作要做,但 DeepSeek 正与华为一起完善一条能够持续支持大模型训练的硬件路线。

跨平台工程成本与算力选择权

对计划进行大模型训练的企业而言,DeepSeek 的实践表明:核心工具链的跨平台复用能力,直接决定算力平台的切换成本。TileLang 昇腾版本使开发者能够将已熟悉的研发工具延伸到另一种硬件上,减少为不同平台重复开发的负担。这一模式为企业在国产算力与英伟达平台之间进行战略选择提供了可参考的工程路径。

【官方原文链接】点击访问首发地址

常见问题

DeepSeek 于 2026 年 9 月 30 日开源了面向华为昇腾的基础设施组件,涵盖 TileLang 算子编程语言及其编译支持、计算库和分布式通信库。具体包括 TileLang、DeepGEMM、DeepEP、TileKernels、FlashMLA 和 DeepSelect,官方强调所有组件与此前面向英伟达平台的开源组件一一对应。

国产算力大模型训练DeepSeekTileLang华为昇腾

相关文章

谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析

谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。

2026年10月1日

谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%

2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。

2026年10月1日

Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争

Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。

2026年9月30日