阿里云于7月23日宣布,其自研芯片真武M890超节点已成功适配旗舰模型Qwen3.8,并正式上线阿里云百炼平台,对外提供模型推理服务。这是国内首个成功运行超2万亿参数大模型的超节点实例,标志着国产AI基础设施在支撑超大模型方面取得关键突破。
Qwen3.8是阿里最新发布的旗舰大模型,参数规模高达2.4万亿。运行如此规模的模型,通常需要将参数分散到数十甚至上百张高速互联的GPU卡上,并解决高吞吐、低延迟、高并发的通信瓶颈。普通AI集群因通信带宽局限,难以满足这类需求。
真武M890是平头哥推出的新一代训推一体AI芯片,原生支持从FP32到FP4等多种数据精度,可覆盖高精度训练、低精度推理及超低精度推理等全场景。该超节点实例通过ICN Switch 1.0互联芯片,将64张真武M890芯片连接在一起,实现了800GB/s的高速互联,显存规模达到9TB。单实例即可支撑大规模2万亿参数MoE(混合专家)模型的专家并行需求,大幅降低了模型部署的硬件门槛。
此外,阿里从芯片到云平台层面实现了与Qwen模型的全链路优化。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在Agentic推理场景中最多可实现1.5倍的推理性能提升。这意味着,在同样硬件条件下,推理效率显著提高,推理成本也随之降低。
这一进展对AI产业投资者而言,意味着国产AI芯片在支撑超大规模模型推理方面已具备实际落地能力,不再仅停留在理论或小规模测试阶段。阿里云通过将自研芯片与自有模型深度绑定,有望在AI云服务市场中形成差异化竞争力,并带动国产AI芯片产业链(如互联芯片、先进封装、服务器等)的需求增长。同时,这也为其他云厂商和模型公司提供了“芯片-模型-平台”全栈协同的参考路径,可能加速国内AI基础设施的自主化进程。