[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"news-b86fa77c-b9cb-406f-af26-7c79329c6d43":3},{"id":4,"title":5,"summary":6,"original_url":7,"source_id":8,"tags":9,"published_at":23,"created_at":24,"modified_at":25,"is_published":26,"publish_type":27,"image_url":13,"view_count":28},"b86fa77c-b9cb-406f-af26-7c79329c6d43","真武M890超节点跑通Qwen3.8：国内首个2万亿参数模型推理集群落地阿里云百炼","7月23日，阿里云真武M890超节点完成Qwen3.8全量适配，并在百炼平台开放推理服务。这是国内首个成功运行超2万亿参数大模型的超节点，对国产超节点+超大参数模型协同部署具有里程碑意义。\n\n真武M890是阿里自研的128卡超节点,今年5月首次发布时定位于Agent并发推理,主打高密度、低延迟与多任务并行。Qwen3.8是阿里千问的最新一代旗舰预览版,2.4T参数规模,定位开源对标闭源顶级模型。这次真武+Qwen3.8的组合,意味着硬件层和模型层不再各干各的——从一开始,芯片、网络、显存调度、推理框架就针对Qwen3.8的2万亿+参数做联合调优。\n\n为什么这件事重要?过去国内跑超大参数模型,要么靠英伟达H100\u002FH200集群,要么靠多机多卡堆叠,延迟高、利用率低。M890把128卡做进一个超节点域内,互联带宽和显存共享效率远高于传统集群;适配Qwen3.8后,意味着用户可以在百炼上一键拿到一个推理即服务、且能扛住2万亿+参数的国产栈,不再受制于海外算力供给。\n\n从产业角度看,这也释放了一个清晰信号:头部云厂不再满足于模型层+硬件层各做各的,而是从系统视角重新定义超节点。Agent时代,推理不再是离线跑分,而是高并发、低延迟、长上下文的多任务战场,只有芯片+网络+模型三方联合优化,才能跑出真正的TOPS和性价比。\n\n可以预见,Qwen3.8正式版、Claude\u002FGemini\u002FDeepSeek的下一代旗舰,都会沿着国产超节点+开源大模型这条路径快速复制。当国产算力+国产模型+国产推理框架形成闭环,所谓中国版AI栈才真正有了底座。","https:\u002F\u002F36kr.com\u002Fnewsflashes\u002F3907857698903424","5e4fd3d1-9cb4-44a6-bae5-9ffb449c05c1",[10,14,17,20],{"id":11,"name":12,"slug":12,"description":13,"color":13},"fca9258a-9430-455a-b95d-b9fae5e373a8","ai-inference",null,{"id":15,"name":16,"slug":16,"description":13,"color":13},"a8002d98-9df1-4ab9-94d4-a7625af634c4","china-ai",{"id":18,"name":19,"slug":19,"description":13,"color":13},"01598627-1ea6-4b27-a5d8-874971571a71","llm",{"id":21,"name":22,"slug":22,"description":13,"color":13},"c187600e-804c-4697-b828-1e4330e0eb10","qwen","2026-07-23T10:05:00Z","2026-07-23T10:06:22.836762Z","2026-07-23T10:06:22.836776Z",true,"agent",3]