阿里把模型、芯片和云数据中心放进了一项长期扩张计划。20GW 与 5 万亿至 10 万亿参数目前都是公开目标,后续要看它们如何转化为可用服务和收入。
图注:阿里集团帖配图中的云栖大会现场与路线图语境,文章首图用于交代这次发布的全栈 AI 方向。
01
三个数字,指向同一套扩张计划。
9 月 22 日,路透社报道阿里计划训练一个参数规模为 5 万亿至 10 万亿的新人工智能模型。报道还提到,阿里发布了真武 V900 芯片,并把阿里云全球数据中心容量目标定在 2032 年超过 20GW。
这三个数字分别落在模型训练、专用芯片和数据中心三个层面。模型参数规模决定训练任务的上限。芯片提供计算能力,数据中心负责把这些设备组织成可以持续运行的云服务。
图注:X 帖配图把新模型、真武芯片和 2032 年 20GW 数据中心目标并列整理,呈现出这次发布的三层结构。
02
5 万亿至 10 万亿,首先是训练目标。
“5 万亿至 10 万亿参数”很容易被读成一个已经存在的模型名称。路透社报道的原意是,阿里计划训练这一规模的新模型。公开信息目前交代了目标规模,没有公布模型名称、发布时间、训练完成状态或独立评测结果。
参数规模本身也不能直接换算成模型效果。它会带来更高的训练和推理成本,也要求更大的存储、片间通信和集群调度能力。阿里把模型目标与芯片、云容量放在同一场发布里,说明公司正在同时扩展训练资源和服务承载能力。
当前能确认的是计划规模和基础设施目标。模型是否完成、能否开放服务,以及实际任务表现,都要等后续产品和技术资料。
03
芯片信息已经出现,型号口径仍需对齐。
路透社和趋势页代表帖把这次新芯片写作真武 V900。它们还转述阿里方面称其性能达到上一代的 3 倍,并称其为中国最强 AI 芯片。这里的“最强”和“3 倍”都属于发布方口径,当前材料没有给出统一测试协议。
型号也存在公开资料差异。阿里 5 月 20 日的官方资料曾介绍真武 M890,并称其性能为上一代真武 810E 的 3 倍。资料还列出 144GB 芯片内存和 800GB/秒片间带宽。9 月报道使用 V900,现有公开材料没有说明 V900 与 M890 的对应关系。
图注:X 帖截图转述了现场关于芯片、10 万亿参数模型和 2032 年 20GW 目标的判断,属于社区整理与观点表达。
这条消息当前最可靠的读法是:阿里正在把 AI 投入扩展到模型、芯片和数据中心三层。20GW 与 5 万亿至 10 万亿参数仍是路线图上的目标。后续公开的芯片产品页、模型服务入口和 AI 相关收入变化,才会显示这项扩张计划推进到了哪一步。
来源:Reuters;Alibaba Group;Alibaba Cloud;X @AlibabaGroup、@SusanLiTV、@negligible_cap。