问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年3月17日举办的GTC大会上,英伟达正式推出Nemotron 3系列开源多模态模型家族,其中基于Blackwell架构深度优化的Nemotron 3 Ultra吞吐量效率较前代提升5倍,可适配复杂代码辅助、企业级工作流等场景,目前已获得CrowdStrike、ServiceNow等行业巨头的部署支持,同时亮相的还有面向物理AI、医疗领域的配套模型方案。
作为全球AI产业的年度技术风向标,英伟达GTC大会的每一次产品更新,都直接影响着下游开发、企业应用的技术路线选择。2026年的本次发布,英伟达没有继续堆高闭源大模型的参数天花板,反而选择给开源模型家族做“重量级扩容”,瞄准的正是高速增长的企业级AI落地需求。
本次发布的Nemotron 3是英伟达首个全栈开源多模态模型系列,覆盖从边缘端到数据中心的全场景部署需求。其中定位最高的Nemotron 3 Ultra针对Blackwell架构做了深度适配,吞吐量效率较前代提升5倍,可以同时承载多用户的复杂代码生成、企业工作流调度请求,推理成本直接降到原有水平的五分之一。
除了核心推理模型,该系列还补全了多模态交互的细分场景能力:Nemotron 3 Omni实现了音频、视频、文本能力的无缝整合,支持直接处理多模态输入的复杂指令;Nemotron 3 VoiceChat则打通了端到端的语音识别、大模型推理、语音合成链路,能提供毫秒级延迟的实时语音对话体验,适合智能客服、车载交互等场景。
目前该系列模型已经开放下载,网络安全厂商CrowdStrike、企业数字化服务商ServiceNow已经率先完成部署,将其用于各自的产品功能迭代。
除了通用多模态模型,英伟达本次还同步发布了面向物理AI与机器人领域的世界基础模型Cosmos 3,首次实现了合成世界生成与机器人动作仿真的端到端打通,开发者可以直接基于该模型训练机器人的实体操作能力,不需要额外做跨模型适配。
此外,英伟达也披露了Nemotron 3系列在医疗场景的优化版本,后续将支持医疗影像分析、药物分子生成等专业场景的微调需求,相关模型预计在2026年第二季度开放给行业合作伙伴测试。
业内分析指出,英伟达本次大规模扩展开源模型矩阵,本质上是为了进一步强化自身算力生态的护城河。所有Nemotron 3系列模型的最优性能都需要在Blackwell架构的GPU上才能实现,企业选择该系列模型落地,就意味着会优先采购英伟达的算力硬件,形成“模型-算力”的正向循环。
相较于闭源大模型的API收费模式,开源模型允许企业自行做数据、场景的私有化微调,更符合金融、医疗、政务等敏感行业的AI落地需求,也能帮助英伟达抢占原本属于其他开源大模型的市场份额。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。