字节跳动Seed部门重组,为5万亿参数超大模型铺路
字节跳动大模型部门Seed近期完成新一轮深度组织架构调整,打破以往按模态和研究方向划分的传统模式,将分散团队重新整合,以优化研发效率,为传闻中参数规模超5万亿的下一代超大模型做准备。
此次调整中,Seed基础模型正式成立四个全新一级部门。预训练数据团队Pretrain Data由李成刚负责,该团队由原先分散在文本、编程、视觉理解和语音等方向的预训练团队合并而来,统一负责新Omni模型的多模态数据及超大模型预训练工作。
强化学习团队Horizon RL由唐晟宇负责,整合了此前分散在后训练、推理和视觉理解等领域的后训练力量,核心目标是通过强化学习提升模型的基础智能上限。
应用后训练方面,字节跳动进行了更精细化的任务拆分。Product Posttrain-Work部门由秦禹嘉负责,重点针对办公场景优化模型的Agentic能力,支持豆包和Dola的任务模式,负责B端应用及Agentic模型整合发布;原朱文佳负责的Application团队更名为Product Posttrain-Chat,专责C端对话模型的整合发布,与Work团队形成分工协作。上述四个新部门负责人均向吴永辉汇报,同时Seed还为AI安全等前沿探索方向单独任命了负责人。
此前,Seed团队主要按具体模态和研究方向独立划分,该机制在模型研发早期能够快速补齐各项能力,但随着技术边界模糊,跨团队沟通成本增加及重复建设问题显现。此次架构调整旨在"合并相似工作、减少重合、内聚在一起"。
此前有媒体称,字节跳动正处于讨论训练参数规模超5万亿模型的早期阶段。若计划全面落地,其参数量将超越阿里Qwen 3.8-Max及月之暗面K3,成为国内已知参数规模最大的模型。