字节跳动Seed基模完成架构调整 攻坚5万亿参数下一代大模型

2026年8月,字节跳动旗下大模型部门Seed完成组织架构深度调整,为参数规模超5万亿的下一代多模态大模型研发铺路。本次调整打破按模态、研究方向划分的传统模式,新设四大一级部门,预训练数据团队由李成刚负责,强化学习团队由唐晟宇牵头,全面整合分散资源提升研发效率。

配图

当前全球大模型赛道已经进入白热化竞争阶段,千亿参数级通用大模型已经完成从技术验证到规模商用的落地,头部科技厂商纷纷将研发目标瞄准万亿参数以上的下一代通用多模态模型,试图拿下下一代AI基础设施的定义权。字节跳动旗下Seed基模此前已经迭代多个版本,在内容生成、多模态理解等维度的表现跻身行业第一梯队,且已经完成了抖音、今日头条等内部核心业务的场景适配,具备成熟的大模型研发、落地经验。

本次Seed基模的架构调整,核心目标就是打破过去长期存在的部门墙,全面提升超大模型的研发效率。过去Seed团队按照文本、语音、视觉等不同模态,以及预训练、后训练等不同研究方向拆分团队,很容易出现数据标准不统一、研发进度不同步的问题,对于5万亿参数级别的超大模型研发来说,这种架构的协同成本极高。

调整后,Seed基模新设四大一级部门,覆盖大模型研发全链路。其中预训练数据团队Pretrain Data由李成刚担任负责人,整合了此前散落在各个模态方向的预训练团队,统一负责下一代Omni多模态大模型的数据集治理、标注和预训练全流程工作,相当于掌握了超大模型研发的“原材料”话语权。另一个披露的核心部门强化学习团队Horizon RL由唐晟宇牵头,整合了过去分散在后训练、推理优化、视觉理解等环节的技术团队,核心目标是通过强化学习技术拉升大模型的通用智能上限,同时优化超大模型的推理效率,降低后续商用落地的成本。

目前字节暂未对外披露剩余两个一级部门的具体定位,据行业人士推测,大概率会覆盖算力调度、业务侧适配落地两大方向。

此次字节Seed基模的架构调整,也让业内对其5万亿参数大模型的落地节奏充满期待。按照行业普遍共识,5万亿参数级的多模态大模型如果实现商用,将在复杂逻辑推理、跨模态内容理解、通用任务适配等能力上实现量级跃升,有望推动AI技术从消费端场景向科研、工业设计、自动驾驶等重产业场景渗透。

不过也有技术人士指出,超大规模参数大模型的研发并不只是“堆参数”,还需要解决算力供给稳定性、训练精度控制、数据合规、价值观对齐等多重挑战。从目前的研发进度来看,字节已经成为全球范围内最有可能率先落地5万亿参数级商用大模型的厂商之一,其后续的研发进展也将成为全球AI行业的风向标。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。