告别自建机房!阿里云M890超节点开售,64卡800G互联硬刚十万亿大模型

随着大模型参数规模向十万亿级别狂飙,AI企业面临的算力焦虑日益加剧。8月12日,阿里云给出了自己的“解药”——灵骏真武M890超节点实例正式上线,首批落地乌兰察布。这意味着,企业再也不用苦哈哈地重金自建机房,直接在云端就能调用64卡高速互联的顶级算力单元。

打破物理极限:64卡互联与800GB/s狂飙

M890最大的杀手锏在于其恐怖的内部通信能力。得益于自研ICN Switch1.0芯片的加持,该实例将Scale-up互联规模从传统的16卡一举拉升至64卡,卡间互联带宽更是飙升至惊人的800GB/s。同时,它对FP8、FP4等低精度计算的完美支持,让其能够从容应对最高十万亿参数级MoE大模型的庞大推理需求。

实战检验:搞定2万亿参数,训练性能翻3倍

光有纸面参数不行,还得看实际疗效。作为国内首个成功运行超2万亿参数大模型的超节点形态算力,M890已经有了亮眼的“买家秀”——Kimi K3和Qwen3.8Max目前正依托该实例对外提供稳定服务。在智能驾驶、具身智能等极度吃算力的训练场景中,M890相比上一代真武810E,训练性能直接提升了3倍。

底气所在:可扩展至百万卡的灵骏底座

M890的强悍并非空中楼阁,其背后是阿里云灵骏智算平台的深厚功底。依托HPN8.0训推一体网络,该平台单集群最高已支持13万卡异构算力混布,并且具备向百万卡级规模平滑扩展的能力,为大模型的训练与推理提供了深不见底的算力蓄水池。

行业洞察:AI基建竞争进入“超节点云化”时代

M890的正式开售,释放了一个强烈的行业信号:超节点算力正在从少数巨头的“自建特权”,加速向公共云服务普及。当万亿乃至十万亿参数的MoE模型步入规模化部署的深水区,高速卡间互联、低精度计算效率以及超大规模集群的调度能力,无疑将成为下一场AI基础设施军备竞赛的核心胜负手。

类似文章