问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年3月17日举办的GTC2026开发者大会上,英伟达创始人黄仁勋正式揭晓下一代AI加速平台Vera Rubin。该平台采用台积电3纳米制程工艺,集成3360亿颗晶体管,FP4推断算力达前代Blackwell平台的5倍,标志着英伟达从单一芯片供应商向全栈AI工厂基础设施服务商转型,将大幅降低混合专家大模型的训练与部署门槛。
作为全球AI产业的年度风向标,每年GTC大会的新品发布环节都被业内视为未来2-3年AI算力的走势锚点,今年黄仁勋揭晓的Rubin平台,刚一亮相就引发了超算服务商、大模型研发厂商的集体关注。
从硬件参数来看,Rubin平台的性能提升远超行业此前预期。其核心GPU采用台积电3nm先进制程,集成3360亿颗晶体管,核心性能较上一代Blackwell平台提升60%以上。
该平台首创的「六芯协同」架构重构了超算的硬件标准:单个超级芯片集成1颗Vera CPU与2颗Rubin GPU,同时搭载288GB HBM4高速内存,内存带宽高达22TB/s,可支撑超大规模大模型参数的高速调用。在实际性能表现上,Rubin平台的FP4推断算力达到50PFLOPS,是Blackwell平台的5倍,每瓦特性能更是提升了10倍,这也意味着大模型厂商训练混合专家模型(MoE)的算力成本将出现明显下降。
值得注意的是,此次英伟达将新平台命名为Vera Rubin,正是致敬此前发现暗物质存在证据的知名天文学家薇拉·鲁宾,延续了英伟达用顶尖科学家命名核心算力产品的传统。
而Rubin平台的发布,也标志着英伟达的战略定位出现了明确调整:从过往的单一AI芯片供应商,转向为全球客户提供从芯片、集群到软件栈的全栈AI工厂基础设施服务商。过去两年,越来越多大模型厂商不再单独采购GPU芯片,而是直接采购可快速部署的算力集群,Rubin平台正是英伟达响应这一需求推出的整体解决方案。
在发布Rubin平台的同时,黄仁勋也同步披露了下一代产品的迭代路线:更高阶的Rubin Ultra预计将于2027年正式推出,其NVL576配置将进一步提升推断算力上限,匹配未来2-3年超大规模通用人工智能模型的训练需求。
业内人士分析称,当前AI大模型对算力的需求每年增速超过10倍,英伟达维持1-2年一代的算力产品迭代节奏,刚好能够跟上产业的爆发式增长需求,也将进一步巩固其在全球AI算力市场的主导地位。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。