阿里云灵骏真武 M890 适配 Qwen3.8,成国内首个成功运行超 2 万亿参数大模型的超节点
阿里云宣布其灵骏真武 M890 超节点实例已成功适配并上线 Qwen3.8 模型。该模型参数高达 2.4 万亿,通过 64 张真武 M890 芯片实现 800GB/s 高速互联与 9TB 显存,能显著提升推理效率、降低成本,是首个成功运行超 2 万亿参数大模型的国内超节点。#人工智能# #大模型#...
感谢最新网友 小星_14、不一样的体验 的线索投递!
最新 7 月 23 日消息,今日,阿里云宣布灵骏真武 M890 超节点实例已成功适配 Qwen3.8,并上线阿里云百炼平台提供模型推理服务,这是国内首个成功运行超 2 万亿参数大模型的超节点。

据介绍,Qwen3.8 是阿里最新旗舰模型,参数规模高达 2.4 万亿,跑通这一规模的模型需要将参数分散到几十张甚至上百张高速互联的 GPU 卡,让万亿参数“跑得又稳又快”。然而,普通 AI 集群因通信带宽的局限,无法满足高吞吐、低延迟、高并发的需求。
最新注意到,真武 M890 是平头哥新一代训推一体 AI 芯片,原生支持 FP32 到 FP4 等多种数据精度,可应用于高精度训练、低精度和超低精度推理的全场景。灵骏真武 M890 超节点实例通过 ICN Switch 1.0 互联芯片,让 64 张真武 M890 实现了 800GB/s 的高速互联,显存规模达到 9TB,单实例即可支撑大规模 2 万亿参数 MoE 模型的专家并行需求。
此外,阿里还从芯片到云平台层面实现了与 Qwen 模型的全链路优化,不仅可以丝滑跑通 Qwen3.8,还能显著提升推理效率、降低推理成本。实测数据显示,通过算子优化和软硬件架构协同,该超节点实例在 Agentic 推理场景中最多可实现 1.5 倍的推理性能提升。
相关阅读:
《阿里云发布灵骏真武 M890 超节点实例,单台可承载十万亿参数级 MoE 大模型推理》
《阿里千问 Qwen3.8 预览版模型上线:2.4T 参数量,宣称“可能是除了 Fable 5 外最强大的模型”》
《阿里云灵骏真武 M890 适配 Qwen3.8,成国内首个成功运行超 2 万亿参数大模型的超节点》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
海南:全面禁止 AI 自动开方、虚假问诊、事后补方等违规行为
海南省药品监督管理局明确,处方药必须凭执业医师合规处方销售,全面禁止 AI 自动开方、虚假问诊、事后补方等违规行为,规范群众无处方购药的问诊开方渠道,明确实名问诊、真实诊疗的核心要求,从源头杜绝无效处方、虚假处方流入零售环节。... -
月之暗面黄震昕:Kimi K3 性能跃升并非对现有任何模型蒸馏复刻
月之暗面于 7 月 16 日上线推出 Kimi K3 模型,是 Kimi 迄今能力最强的模型,拥有 2.8 万亿参数,在 Frontend Code Arena 全球 AI 大模型榜单中,Kimi K3 以 1679 分超越 Claude Fable 5,位居第一,并将于近日开放权重。... -
英伟达加速 AI 算力供应:Grace 芯片累计交付超 250 万颗,Vera Rubin 机架目标日产 1000 台
科技媒体 Wccftech 昨日(7 月 22 日)发布博文,报道称英伟达为强化其作为全栈系统供应商的市场地位,正加速推进其 CPU 路线图。... -
摩根士丹利预估 2031 年 SpaceX 轨道 AI 算力每年每瓦 6.5 美元,低于英伟达地面方案
摩根士丹利最新分析数据显示,SpaceX 的轨道计算成本到 2031 年预计降至每年每瓦 6.5 美元,低于基于 NVIDIA Blackwell GPU 的地面数据中心每年每瓦 6.8 美元的全包成本。... -
投资回报率 38~50%:巴基斯坦法院部署 AI 测试后案件审结量增 6.3%
科技媒体 The Decoder 昨日(7 月 22 日)发布博文,报道称 AI 帮助巴基斯坦法官清理大量的积压案件,基于大规模实验结果,每投入 1 美元就能带来 38.50 美元的收益。...












