阿里云近日宣布,其自主研发的真武M890超节点成功适配Qwen3.8大模型,并在阿里云百炼平台正式上线推理服务。这一突破标志着国内首次实现超2万亿参数规模大模型在单一超节点上的稳定运行,为AI算力领域树立了新的里程碑。
作为阿里最新推出的旗舰模型,Qwen3.8拥有高达2.4万亿参数,其运行需要依赖数十甚至上百张GPU卡的高速协同。传统AI集群受限于通信带宽,难以满足这种规模模型对高吞吐、低延迟和强并发的严苛要求。阿里云通过技术创新,成功攻克了这一技术难题。
真武M890是平头哥半导体推出的新一代训推一体AI芯片,支持从FP32到FP4的多精度计算,可覆盖高精度训练和低精度推理的全场景需求。该芯片通过ICN Switch 1.0互联技术,实现了64颗芯片间800GB/s的超高带宽互联,构建出显存规模达9TB的超级计算单元。这种架构设计使得单实例即可支持2万亿参数MoE模型的专家并行计算需求。
在系统优化层面,阿里云实现了从芯片架构到云服务平台的垂直整合优化。通过定制化算子开发和软硬件协同设计,Qwen3.8在真武超节点上的推理效率得到显著提升。实测数据显示,在Agentic推理场景中,该系统较传统方案可实现最高1.5倍的性能提升,同时有效降低了推理成本。这项突破为大规模AI模型的商业化应用提供了更经济的解决方案。










