阿里云百炼平台近日迎来重大技术突破——国内首个支持超2万亿参数大模型运行的超节点实例正式上线。该实例基于平头哥最新研发的灵骏真武M890芯片集群构建,成功实现与Qwen3.8旗舰模型的深度适配,标志着我国在超大规模AI模型部署领域取得关键进展。
作为阿里最新一代大语言模型,Qwen3.8的参数规模达到惊人的2.4万亿级。要实现如此庞大模型的稳定运行,需要将参数分散至数十甚至上百张GPU卡进行并行计算。传统AI集群受限于通信带宽瓶颈,难以满足万亿参数模型对高吞吐、低延迟、高并发的严苛要求。此次上线的灵骏真武M890超节点通过架构创新,成功突破这一技术壁垒。
该超节点采用平头哥新一代训推一体AI芯片真武M890,原生支持从FP32到FP4的多精度计算,可灵活应对高精度训练与低精度推理的不同场景需求。通过搭载ICN Switch 1.0互联芯片,64张真武M890芯片实现了800GB/s的极致互联带宽,构建出总显存容量达9TB的超级计算单元。这种设计使得单实例即可支撑2万亿参数MoE(混合专家)模型的完整专家并行计算需求。
技术团队从芯片架构到云平台服务进行了全链路优化。通过定制化算子开发与软硬件协同设计,Qwen3.8在该超节点上的运行效率得到显著提升。实测数据显示,在Agentic推理等复杂场景中,推理性能较传统方案提升最高达1.5倍,同时有效降低了单位算力的使用成本。这项突破为金融、医疗、科研等领域处理超大规模AI任务提供了新的技术路径。
此次技术突破不仅体现在硬件性能上,更展现了阿里在AI基础设施领域的系统化创新能力。灵骏真武M890超节点通过将计算、存储、网络资源深度整合,构建出可扩展的智能计算基座。这种架构设计既保证了当前Qwen3.8等超大模型的运行需求,也为未来更大规模模型的部署预留了充足空间,为我国AI产业发展提供了重要的技术支撑。















