问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年8月,芯片巨头英伟达被曝正开发新一代开源大模型Nemotron 4,参数规模至少达1万亿,目标直指全球顶尖开源大模型阵营,意在扩大开源AI生态影响力、拉动GPU算力需求。长江证券分析指出,该类模型落地将显著降低企业AI开发门槛,加速多元场景渗透,推动AI产业进入落地爆发期。

据行业知情人士透露,英伟达此次研发的Nemotron 4,是其Nemotron系列开源模型的全新迭代产品,相比2023年推出的3400亿参数的Nemotron-4 340B系列,参数规模直接跃升至万亿级,综合性能提升幅度创下该系列产品的历史纪录。
当前全球开源大模型赛道已经形成多强争霸的格局,Meta的Llama系列、国内的DeepSeek等产品凭借较高的性价比和开放的授权规则,占据了超过60%的开源大模型市场份额。而英伟达此前推出的Nemotron系列模型,此前主要面向B端开发者,广泛应用于大语言模型训练数据生成、核心模型精调以及金融、工业等领域的企业级AI落地,已经积累了数十万开发者用户基础。
此次英伟达推出万亿级开源模型,本质上是其“算力+生态”战略的延伸。万亿参数大模型的单轮训练需要至少3000张H100级别的高端GPU协同运行,推理阶段的算力需求更是上一代千亿级模型的4倍左右,这将直接拉动市场对英伟达高端GPU的需求。另一方面,开源大模型作为最佳的“算力应用样板”,将进一步绑定开发者使用英伟达的CUDA计算框架和配套工具链,巩固其在AI产业的底层话语权。
长江证券的行业分析显示,随着高性能开源大模型的陆续推出,AI模型调用成本较2024年已经下降了92%,企业的AI开发试错门槛显著降低。开发者在同等预算下,可以开展3倍规模的用户测试和产品迭代,这将直接催生出更多垂直场景的创新应用。而英伟达此次将万亿级大模型开源,相当于把此前只有头部科技企业能够使用的大模型能力下放给中小开发者,将推动医疗辅助诊断、工业数字孪生、智能客服等场景的落地速度提升至少2倍。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。