
8月12日,阿里云在乌兰察布悄悄拉开了一场算力变革的序幕——灵骏真武M890超节点实例正式开售。这不是一款普通的云服务器,而是把64张高性能显卡以800GB/s的速度紧紧连成一体的超级计算单元。过去,企业想用这样的算力,得自己建机房、买设备、养工程师,现在,打开云端就能租到,按需付费,连门槛都省了。
这个超节点最惊人之处,是它能扛起“十万亿参数”级别的MoE大模型推理。什么概念?目前行业里跑在万亿参数以上的大模型屈指可数,而M890是国内首个成功承载超2万亿参数模型的超节点算力。Kimi K3和Qwen3.8Max这两个名字,已经在这套系统上稳定运行,向外界证明它的实力不只是一纸参数表。
它凭什么这么猛?技术细节说了三个关键词。第一,ICN Switch1.0芯片把Scale-up互联规模从过去的16卡直接拉到64卡,卡间通信带宽飙到800GB/s——相当于每秒钟能传完几百部高清电影。第二,它内置FP8和FP4低精度计算,省显存、提速度,是大模型推理的“加速键”。第三,在智能驾驶、具身智能这类重训练场景里,它的训练性能比上一代真武810E整整提升了3倍,这意味着原本要跑一个月的训练任务,10天左右就能收工。
阿里云把这套能力封装进灵骏智算平台,背后还有一张HPN8.0训推一体网络兜底,单集群最高支持13万卡异构算力混布,理论上还能扩展到百万卡级。对大模型公司来说,这相当于从“自己买发动机造车”变成了“直接上高速租车道”。
超节点算力从自建走向公共云,这背后是行业风向的转变。随着万亿级乃至十万亿参数MoE模型进入规模化部署阶段,单纯的芯片堆叠已经不够看,高速卡间互联、低精度计算、大规模集群调度——这些能力正在成为AI基础设施竞赛的新标尺。阿里云这次抢先落子,给行业立了一个参照物:当算力像水电一样随开随用,模型的天花板,就不再被硬件锁死了。