DeepSeek 开源面向华为昇腾平台的基础设施组件

发布时间: 2026-09-30 文章分类: AI前沿技术
阅读量: 0
AI智能体
企业级AI智能体开发与部署
LumeValley提供全栈式企业级AI智能体开发与部署服务,涵盖战略规划、场景化开发、企业级应用构建、行业解决方案及算力支撑。从需求分析到持续优化,确保智能体高效稳定运行,助力企业实现智能化转型,提升运营效率与竞争力。

DeepSeek 把开源的手伸向了华为昇腾。这次不是模型权重,也不是小打小闹的算子补丁,而是一整套面向昇腾算力平台的基础设施组件。TileLang 编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect 悉数在列。更关键的是,它们与 DeepSeek 此前在英伟达平台开源的组件一一对应。什么意思?DeepSeek 在把模型背后的算力底座,也变成开放的、可迁移的公共品。

昇腾版开源清单,不只是“能跑”

六个组件,各管一摊

先看名单。TileLang 是编译工具,负责把高层算子描述落到硬件上;DeepGEMM 是矩阵乘法库,FP8 训练和推理都绕不开;DeepEP 管专家并行通信,MoE 模型的命门;TileKernels 是一组内核实现;FlashMLA 针对 MLA 解码做加速;DeepSelect 则处理选择类操作。它们覆盖了从编译、通信到核心算子的关键路径。不是 demo,不是单个 kernel,而是一套组合拳。

这套组合拳的意义在于:昇腾上跑 DeepSeek 模型,不再需要每个团队从零填坑。过去国产芯片适配大模型,常常卡在“能跑但慢”“能推理但训不动”。DeepSeek 把自家在英伟达上打磨过的组件对应移植,等于把踩过的坑标了出来。开发者拿到的是经过验证的积木,而不是一堆散落的螺丝。

一一对应英伟达,意味着什么

“一一对应”四个字,比名单本身更值得琢磨。它说明 DeepSeek 的基础设施层没有和 CUDA 深度绑定,至少在设计上留了抽象层。TileLang 这类编译工具的存在,让算子可以用更统一的方式描述,再针对不同后端生成代码。英伟达版本是一套,昇腾版本是另一套,接口和功能对齐。

这对国产算力是强心针。华为昇腾的硬件能力不弱,但软件生态一直是短板。DeepSeek 把最缺的“中间层”开源出来,等于给昇腾补了一段高速公路。开发者不用再纠结底层指令、内存布局、通信原语,可以更专注模型和业务。当然,这不代表昇腾立刻追平英伟达,但至少路标清晰了。

TileLang 打头阵,编译层先松土

名单里最容易被低估的是 TileLang。它不像 DeepGEMM 那样直接决定矩阵乘速度,也不像 DeepEP 那样影响 MoE 通信效率。但编译工具是地基。没有好用的编译层,每个算子都要手写汇编级别的代码,移植成本高得吓人。TileLang 把 tile 级编程抽象出来,让开发者用更接近算法的方式写 kernel,再由编译器处理后端差异。

DeepSeek 把 TileLang 放在昇腾开源清单里,信号很明确:先解决“怎么写”,再解决“跑多快”。这比直接扔几个优化好的 kernel 更有长期价值。因为模型在变,算子在变,硬件也在变。只有编译层站稳了,后续的组件才能持续迭代,而不是每次换芯片就重写一遍。

为什么 DeepSeek 要这么干?

推理成本压力下的第二选择

DeepSeek 的模型以高性价比著称,但性价比不是靠魔法。推理成本里,硬件采购和能耗占大头。英伟达 GPU 好用,但贵,而且供应不稳定。华为昇腾作为国产替代,在特定场景下有成本优势。DeepSeek 主动适配昇腾,等于给自己留了一条后路。万一供应链再出幺蛾子,模型服务不至于断档。

更深一层,这是议价权的游戏。当你有两个可用的算力平台,采购时腰杆更硬。DeepSeek 开源昇腾组件,表面是技术贡献,实际是战略对冲。它不承诺只用昇腾,但证明了“我不是非你不可”。这种姿态,对英伟达和华为都是压力。

国产芯片最缺的不是算力,是软件

华为昇腾的纸面算力一直不差,某些指标甚至能对标英伟达。但开发者社区里,抱怨往往集中在软件栈:文档少、工具链不成熟、算子库不全、调试困难。大模型团队想迁移,先得养一个专门适配硬件的团队,成本高,周期长。DeepSeek 这次开源,直接往最痛的缺口上填。

六个组件里,DeepGEMM 和 FlashMLA 是性能关键,DeepEP 是分布式关键,TileLang 是开发效率关键。它们合在一起,把昇腾的软件短板补了一大块。当然,补丁不等于完美。华为自己的 CANN 生态也在演进,DeepSeek 的加入更像是外部顶尖团队的一次“共建”。这种共建,比单纯喊口号有用得多。

开源是最高效的生态杠杆

DeepSeek 选择开源,而不是闭源适配,原因不难猜。闭源意味着只有自己能用,生态做不大;开源则让所有基于昇腾的团队受益,反过来也会有人帮它修 bug、提优化。DeepSeek 不需要养一个庞大的昇腾适配团队,社区会替它分担。这是典型的杠杆效应:用一小段核心代码,撬动整个生态的投入。

而且开源还有一层信任价值。国产算力平台常被质疑“跑分好看,实战拉胯”。DeepSeek 作为头部模型公司,把自己的组件开源出来,等于用信誉背书。如果这些组件在昇腾上跑得稳,其他公司跟进时就少了一层顾虑。这种信任传递,比任何广告都有效。

昇腾接得住吗?

硬件参数之外,软件栈是硬仗

昇腾能不能接住这波开源,关键不在硬件。硬件是固定的,软件是活的。DeepSeek 的组件解决了一部分适配问题,但底层驱动、编译器、运行时还在华为手里。如果 CANN 的性能和稳定性跟不上,上层组件再优化也事倍功半。所以接下来要看华为怎么接招:是开放更多底层接口,还是加快工具链迭代?

另一个变量是社区反馈。开源组件最怕没人用。用的人越多,问题暴露越快,迭代越快。DeepSeek 的号召力能带来第一波用户,但留住他们要靠实际体验。如果昇腾版 DeepGEMM 比英伟达版慢太多,或者调试体验差,开发者还是会用脚投票。开源只是起点,不是终点。

DeepSeek 的“带路”效应

国内大模型公司里,DeepSeek 的技术影响力数一数二。它的一举一动,会被很多团队盯着。这次开源昇腾组件,等于给行业打了个样:原来国产芯片也可以这样适配。接下来可能会有更多公司跟进,把自己的推理框架、算子库往昇腾上搬。这种“带路”效应,比单个组件的价值大得多。

但也要冷静。DeepSeek 的模型架构特殊,MoE、MLA 这些设计对硬件有特定要求。它适配昇腾的经验,未必能直接复制到其他模型。不过底层组件是通用的,TileLang、DeepGEMM 这些工具可以服务更广的场景。只要底层通了,上层百花齐放只是时间问题。

开发者会跟着走吗?

开发者迁移平台,从来不是看情怀,而是看投入产出比。如果昇腾上的开发体验接近英伟达,成本又更低,自然会有人来。如果迁移成本高,性能还打折,开源再多组件也白搭。DeepSeek 的开源降低了门槛,但没消除门槛。华为需要继续在文档、社区、工具链上砸资源。

一个积极信号是,DeepSeek 的组件本身就是用相对通用的方式写的。TileLang 这类工具的存在,让开发者不用直接面对昇腾的底层细节。这种抽象层的价值,会随着时间推移越来越明显。当写 kernel 像写 Python 一样简单时,硬件差异就被屏蔽了大半。到那时,开发者选择平台的逻辑会变:谁便宜、谁稳定、谁生态好,就用谁。

这盘棋的下一步

模型与算力解耦成为趋势

DeepSeek 这次开源,最深远的影响可能是加速模型与算力的解耦。过去大模型和英伟达生态深度捆绑,模型架构、训练框架、推理引擎都围着 CUDA 转。现在头部玩家开始主动支持第二平台,相当于把“模型层”和“硬件层”之间的接口标准化。这对整个行业是好事。

解耦之后,模型公司可以更灵活地选择硬件,硬件公司也可以更专注地优化自家平台。竞争会从“生态锁定”转向“性能成本”。对国产芯片来说,这是难得的窗口期。只要软件栈能跟上,就有机会在增量市场里分一杯羹,而不是永远在英伟达的阴影下捡漏。

英伟达的护城河被敲开一道缝

英伟达真正的护城河不是 GPU,是 CUDA。二十年积累的库、工具、文档、社区,让开发者很难离开。DeepSeek 开源昇腾组件,等于在 CUDA 的城墙上凿了一个小口。这个口子现在还不大,但方向值得注意。如果更多头部模型公司跟进,CUDA 的独占地位就会松动。

当然,松动不等于崩塌。英伟达也在加速迭代,Blackwell 等新架构依然领先。但至少,国产算力平台有了一个可用的、经过验证的替代路径。对于被供应限制困扰的中国 AI 公司来说,这条路径的价值无法用金钱衡量。DeepSeek 做的,是把这条路从“理论可行”推到“工程可用”。

国产 AI 基础设施进入“共建期”

过去国产 AI 基础设施的叙事,往往是华为、百度、阿里各自建生态,彼此 overlap 不多。DeepSeek 的加入,带来了一种新的协作模式:模型公司开源组件,芯片公司提供硬件,社区共同打磨。这种分工比单打独斗更高效。

可以预见,接下来会有更多类似的交叉开源。模型公司贡献算子库,芯片公司贡献编译器,云厂商贡献调度框架。大家各司其职,最后拼出一套完整的国产 AI 基础设施。这个过程不会一蹴而就,但 DeepSeek 已经迈出了实质性的一步。剩下的,就看华为和开发者社区怎么接。

昇腾版开源清单只是开始。真正的考验,是这些组件在真实业务里跑出什么样的数字。DeepSeek 把牌打出来了,接下来轮到华为和开发者出牌。

AI智能体
企业级AI智能体开发与部署方案
LumeValley打造企业级AI智能体全流程方案,涵盖需求洞察、定制开发、多平台适配部署。凭借专业算法与丰富经验,确保智能体精准理解业务,高效执行任务,无缝融入企业生态,为企业数字化转型提供强劲智能引擎,提升核心竞争力。
点赞 | 65

Lumevalley——全栈AI服务领航者,以“战略-应用-算力”三位一体服务框架,为企业提供从顶层战略规划、场景化AI智能体(AI Agent)开发/搭建/部署,到企业级AI应用开发、AI+行业场景解决方案的全链路服务,并配套AI大模型部署与高性能AI算力底座支撑,助力客户在营销、服务、运营等核心环节实现效率倍增与模式创新。

马上扫码获取产品资料
相关文章

相关文章

填写以下信息, 免费获取方案报价
姓名
手机号码
企业名称
  • 建筑建材
  • 化工
  • 钢铁
  • 机械设备
  • 原材料
  • 工业
  • 环保
  • 生鲜
  • 医疗
  • 快消品
  • 农林牧渔
  • 汽车汽配
  • 橡胶
  • 工程
  • 加工
  • 仪器仪表
  • 纺织
  • 服装
  • 电子元器件
  • 物流
  • 化塑
  • 食品
  • 房地产
  • 交通运输
  • 能源
  • 印刷
  • 教育
  • 跨境电商
  • 旅游
  • 皮革
  • 3C数码
  • 金属制品
  • 批发
  • 研究和发展
  • 其他行业
需求描述
填写以下信息马上为您安排系统演示
姓名
手机号码
你的职位
企业名称

恭喜您的需求提交成功

尊敬的用户,您好!

您的需求我们已经收到,我们会为您安排专属电商商务顾问在24小时内(工作日时间)内与您取得联系,请您在此期间保持电话畅通,并且注意接听来自广州区域的来电。
感谢您的支持!

您好,我是您的专属产品顾问
扫码添加我的微信,免费体验系统
(工作日09:00 - 18:00)
电话咨询 (工作日09:00 - 18:00)
客服热线: 18011747352
售前热线: 189 2432 2993
扫码即可快速拨打热线