跳到主要内容据The Information最新报道,DeepSeek创始人梁文锋在近期与投资人沟通中透露:公司正把“用更多国产华为芯片训练大模型”作为重要战略方向,华为训练卡最早有望在2026年第四季度到货。结合圈内流传的信息,DeepSeek当前正在推进2万亿参数级别的下一代旗舰模型训练,远期目标甚至指向8T(8万亿)参数规模。现役V4-Pro总参数约1.6T,下一档直接跳到2T,训练侧开始认真转向国产芯片。过去几年,DeepSeek在训练上高度依赖英伟达算力。V3时代用过大量H800,后续也在受限环境下持续堆叠。如今,华为昇腾系列(尤其是面向训练的新卡)被明确放到“能不能训出下一代前沿模型”的位置上,这已经不只是推理侧的适配,而是训练侧的实质性切换。梁文锋此前就多次表达过对国产芯片的看法:短期仍有差距(约“四张华为卡顶一张顶级英伟达卡”、技术落后约两年),但生态和任务能力正在快速追平,产能释放后替代窗口会打开。这次把训练卡交付时间明确到Q4,说明双方在软件栈、集群互联、稳定性上的验证已经走到了可量产落地的阶段。中国AI算力自主可控进入实战阶段
推理侧已经跑通万亿级模型,训练侧一旦跑通2T甚至更大参数,意味着从“能用”到“能训出前沿模型”的关键跨越。出口管制原本是限制,现在反而加速了国产替代的节奏。DeepSeek的战略一致性
梁文锋一直强调愿景驱动,而不是被市场推着走。开源是本意,硬件自主也是同一条逻辑——不把命运完全押在外部供应链上。大模型竞争进入“参数+算力+生态”三重赛道
2T到8T的参数目标,背后是超大规模集群、高效稀疏架构、以及国产芯片软件栈的全面考验。谁能先在受限环境下把Scaling Law跑通,谁就可能重新定义下一轮竞争规则。当然,挑战依然巨大。训练卡的稳定性、互联带宽、软件成熟度、实际训练效率,都需要时间验证。华为能否按时、足量交付,DeepSeek能否在新硬件上保持以往的训练效率,都是接下来几个季度的观察重点。出口管制没有卡住中国AI,反而把“必须自己做”变成了真实的交付时间表。DeepSeek这一步,不只是一家公司的选择,更是整个中国AI产业链在算力自主道路上的又一次关键试探。接下来,就看Q4的芯片到货,以及那台2T模型最终能跑出什么成绩了。 前往微信阅读全文内容来自公众号,可前往微信查看原文。