阿里云真武 M890 超节点投产:自研芯片跑起 2.4 万亿参数 Qwen3.8
阿里云宣布基于平头哥自研芯片的真武 M890 超节点在百炼平台承接旗舰模型 Qwen3.8 的生产推理,称推理成本直降四成——国产超节点首次伺服 2 万亿参数级模型。
阿里云宣布旗舰模型已经跑在自家芯片上。灵骏系列的真武 M890 超节点基于平头哥自研的训推一体芯片,现已在百炼平台为 Qwen3.8——阿里 2.4 万亿参数的 MoE 旗舰——提供生产环境推理。多家中文媒体称,这是国产超节点首次伺服 2 万亿参数以上的模型。
硬件规格
每个 M890 超节点由 64 颗平头哥芯片组成,芯片间互联带宽 800GB/s,池化内存 9TB,精度支持覆盖 FP32 到 FP4。阿里云宣称该系统让 Agent 类推理负载提速 1.5 倍、推理成本下降超 40%。消息在中文科技和财经媒体广泛传播,但在西方信息流里几乎无人注意。
垂直整合的中国版本
这套打法与谷歌 TPU 路线如出一辙:模型、芯片、云全部自有,不再为推理向英伟达交"过路费"。对阿里而言,战略分量更重——美国出口管制早已禁售顶级英伟达硬件,上周华盛顿还在放风制裁中国 AI 模型。让旗舰级推理在国产芯片上以生产规模跑给付费云客户用,恰恰是那些政策想要延缓的能力。
为什么重要:AI 算力开支的大头正在从训练转向推理,而阿里刚刚证明 2 万亿参数级模型可以在不依赖美国加速器的情况下商用化伺服。如果宣称的经济性成立,其他中国云厂商的超节点时间表会加速,华盛顿的出口管制辩论也将从"中国能不能拿到芯片"转向"在赚钱的负载上中国还需不需要芯片"。悬念在训练侧:用真武伺服 Qwen3.8 是一回事,在上面训练它的下一代才是真正的独立里程碑。