AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

阿里云灵骏真武M890超节点开售 可承载十万亿参数大模型推理

2026年8月12日,阿里云正式上线灵骏真武M890超节点实例,首批在乌兰察布地域开售。该超节点采用ICN Switch1.0芯片实现64卡800GB/s高速互联,是国内首个可运行超2万亿参数大模型的超节点算力,支持十万亿参数级MoE大模型推理,目前Kimi K3、Qwen3.8Max已基于该实例对外提供服务。

配图

随着MoE架构大模型参数规模快速突破万亿级,AI企业对高密度、高互联算力的需求呈指数级上涨,但自建超算集群动辄数亿的前期投入、长达数月的部署周期,成为不少团队落地大模型服务的核心门槛。阿里云此次推出的云端超节点产品,恰好瞄准了这一市场缺口。

不同于传统算力产品需要用户自行调试多卡互联网络,灵骏真武M890直接以64卡高速互联的算力单元为交付形态,企业客户无需自建机房、无需自行调试集群网络,在云端一键开通即可获得完整的超节点算力,支持随用随付的弹性计费模式,大幅降低了大模型企业的算力准入门槛。

M890的核心突破在于互联能力的升级:其搭载的ICN Switch1.0芯片,将传统Scale-up架构的互联上限从16卡提升至64卡,卡间互联带宽达到800GB/s,基本解决了高密度算力集群内的通信延迟瓶颈。同时该实例内置FP8/FP4低精度计算支持,可大幅提升大模型训推效率。
官方测试数据显示,在智能驾驶、具身智能等对算力密度要求极高的训练场景中,M890的训练性能较上一代真武810E提升3倍。值得注意的是,该实例是国内首个成功运行超2万亿参数大模型的超节点形态算力,目前月活过亿的Kimi K3、阿里云自研的Qwen3.8Max两款大模型产品,已经率先基于M890对外提供服务,稳定性已过亿级用户场景验证。

作为标准化算力单元,M890可接入阿里云灵骏智算平台底座,依托HPN8.0训推一体网络,单集群最高支持13万卡异构算力混布,还可进一步扩展至百万卡级,既能支撑超大规模大模型的长期预训练需求,也能满足高并发C端大模型产品的推理调度需求,为不同发展阶段的AI企业提供弹性算力支撑。

此前超节点级的高密度算力基本只被头部AI企业通过自建机房的方式持有,中小团队很难负担相关成本。此次M890上线公有云,意味着超节点算力正式从专属基础设施走向普惠供给,有望推动更多十万亿参数级的MoE大模型落地到C端应用、产业场景中。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。