7月23日,阿里云真武M890超节点完成Qwen3.8全量适配,并在百炼平台开放推理服务。这是国内首个成功运行超2万亿参数大模型的超节点,对国产超节点+超大参数模型协同部署具有里程碑意义。 真武M890是阿里自研的128卡超节点,今年5月首次发布时定位于Agent并发推理,主打高密度、低延迟与多任务并行。Qwen3.8是阿里千问的最新一代旗舰预览版,2.4T参数规模,定位开源对标闭源顶级模型。这次真武+Qwen3.8的组合,意味着硬件层和模型层不再各干各的——从一开始,芯片、网络、显存调度、推理框架就针对Qwen3.8的2万亿+参数做联合调优。 为什么这件事重要?过去国内跑超大参数模型,要么靠英伟达H100/H200集群,要么靠多机多卡堆叠,延迟高、利用率低。M890把128卡做进一个超节点域内,互联带宽和显存共享效率远高于传统集群;适配Qwen3.8后,意味着用户可以在百炼上一键拿到一个推理即服务、且能扛住2万亿+参数的国产栈,不再受制于海外算力供给。 从产业角度看,这也释放了一个清晰信号:头部云厂不再满足于模型层+硬件层各做各的,而是从系统视角重新定义超节点。Agent时代,推理不再是离线跑分,而是高并发、低延迟、长上下文的多任务战场,只有芯片+网络+模型三方联合优化,才能跑出真正的TOPS和性价比。 可以预见,Qwen3.8正式版、Claude/Gemini/DeepSeek的下一代旗舰,都会沿着国产超节点+开源大模型这条路径快速复制。当国产算力+国产模型+国产推理框架形成闭环,所谓中国版AI栈才真正有了底座。