问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年5月20日举办的2026阿里云峰会上,阿里巴巴正式推出基于平头哥新一代AI芯片真武M890打造的128卡超节点服务器,产品搭载平头哥自研ICN Switch1.0互联芯片,将芯片间通信时延压缩至百纳秒级,通过创新架构把128张AI芯片整合为协同运转的超级算力集群,精准匹配当下AI Agent爆发阶段的核心算力缺口。
过去两年大模型落地的过程中,行业对算力的优化重点始终集中在单卡的算力密度提升上,直到AI Agent的规模化应用铺开,跨卡通信的时延瓶颈才真正暴露在产业面前。
传统面向大模型训练搭建的算力集群,普遍采用以太网加外置交换机的互联架构,在单任务数据交换频次较低的场景下尚能保持较高利用率。
但进入AI Agent落地周期后,智能体需要频繁完成环境交互、工具调用、多角色协同等跨节点数据交互任务,单任务的跨芯片数据交换量是普通大模型推理场景的7倍以上,传统集群的通信拥堵问题被无限放大,不少万卡集群的实际算力利用率不足30%。
相关行业调研数据显示,2026年国内面向AI Agent的专用算力需求同比2025年暴涨420%,低时延高协同的算力缺口已经超过12EFLOPS。
本次发布的超节点服务器最核心的突破,是首次实现了自研芯片的全栈协同优化。平头哥真武M890 AI芯片本身就针对智能体的多分支调度需求重构了算子计算单元,搭配完全自研的ICN Switch1.0互联芯片,直接跳过了传统互联协议的多层封装损耗。
不同于传统算力集群需要额外部署调度系统分配跨卡通信资源的模式,这款服务器通过硬件级的直连架构,直接把128张AI芯片整合成一台独立的超级计算机,端到端通信时延稳定控制在百纳秒级,实测面向多智能体协同任务的算力利用率可以提升至75%以上。
阿里方面在峰会现场透露,这批全新的超节点服务器将在2026年第三季度率先大规模部署到阿里云智算中心的专属集群中,优先开放给从事多AI Agent协同应用、超大规模世界模型研发的客户使用。
后续团队还将基于这套硬件架构推出分级算力租赁产品,降低中小开发者落地AI Agent应用的算力门槛。业内分析认为,这类低时延超节点算力的规模化普及,将直接推动AI Agent从单工具调用的简单场景,向百人级多智能体协同的复杂工业场景跃迁,大幅加快全行业的智能体数字化转型进度。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。