🤖 由 文心大模型 生成的文章摘要

阿里云宣布了一项在大模型基础设施领域的重大进展:其自主研发的灵骏真武M890超节点实例已成功适配并稳定运行Qwen3.8大模型,并正式上线阿里云百炼平台,对外提供模型推理服务。这标志着国内首个成功运行超2万亿参数大模型的超节点正式落地。
此次亮相的Qwen3.8大模型,其参数规模达到了惊人的2.4万亿,属于超大规模MoE(混合专家)模型。这类模型的运行需要将海量参数分散至数十张高速互联的GPU或AI芯片上,对计算集群的显存容量、芯片互联带宽和并行计算效率提出了极高要求。
灵骏真武M890超节点正是为此而生。其核心技术底座来自平头哥新一代训推一体AI芯片“真武M890”。该芯片原生支持从FP32到FP4的多种计算精度,兼顾了训练与推理场景的灵活性与效率。
该超节点的关键突破在于其互联架构。通过自研的ICN Switch 1.0互联芯片,灵骏真武M890超节点实现了64张真武M890芯片以高达800GB/s的超高速互联,构建了总容量达9TB的统一显存池。这一规模足以单实例承载超大规模MoE模型的专家并行需求,从根本上解决了大模型“内存墙”的瓶颈。
经过全链路软硬件的深度协同优化,灵骏真武M890超节点在关键的Agentic推理场景(指AI代理执行复杂多步任务的推理)中表现卓越,推理性能最多可提升1.5倍。这意味着它能以更低的延迟和更高的吞吐量,支持复杂的AI应用。
目前,该超节点实例已正式登陆阿里云百炼平台,开发者可以直接调用其推理服务,无需自建复杂集群即可获得超大规模模型的强大能力。这将极大降低开发前沿AI应用的门槛,加速从大模型研发到实际场景落地的进程。






