阿里云近日宣布,其自主研发的真武M890超节点成功适配旗舰大模型Qwen3.8,成为国内首个能够稳定运行超2万亿参数规模的AI计算集群。该系统基于平头哥最新一代训推一体AI芯片构建,通过突破性技术架构实现了算力与能效的双重跃升。
真武M890芯片原生支持从FP32到FP4的多精度计算,覆盖从高精度模型训练到超低延迟推理的全场景需求。为应对2.4万亿参数模型的运行挑战,研发团队创新采用ICN Switch 1.0互联芯片,将64块M890芯片通过800GB/s的超高带宽互联,构建出显存容量达9TB的超级计算单元。这种架构设计突破了传统GPU集群的通信瓶颈,单实例即可满足大规模混合专家模型(MoE)的并行计算需求。
在阿里云百炼平台正式上线的该系统,通过全链路软硬件协同优化展现出显著性能优势。实测数据显示,在复杂Agentic推理场景中,经过算子级优化和架构协同设计的系统,推理效率较传统方案提升最高达1.5倍。这种提升得益于从芯片指令集到云平台调度系统的垂直整合,包括内存访问模式优化、并行计算任务拆分等关键技术创新。
该系统的突破性意义不仅在于参数规模,更在于构建了超大规模AI模型落地的可行路径。传统集群受限于GPU间通信带宽,往往需要数百张显卡协同工作,而真武超节点通过芯片级互联技术,将资源集中度提升数个量级。这种架构创新为AI大模型从实验室走向产业应用提供了新的计算范式,特别是在需要实时交互的智能客服、自动驾驶等场景具有重要应用价值。















