商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 为5万亿参数超大模型铺路?消息称字节调整Seed基模团队组织架构

为5万亿参数超大模型铺路?消息称字节调整Seed基模团队组织架构

  发布于2026-08-20 阅读(0)

扫一扫,手机访问

IT之家 8 月 19 日消息,晚点 LatePost 今天(19 日)晚间发布消息称,字节跳动的大模型部门 Seed 已于上周完成了新一轮的组织调整。其中最关键的部分是 Seed Foundation Model (Seed 基础模型)成立了四个新的一级部门:

为5万亿参数超大模型铺路?消息称字节调整Seed基模团队组织架构

Pretrain Data:负责人李成刚。它由原先分散于文本模型、编程、视觉理解和语音等方向的预训练数据团队整合而成,如今统一负责新Omni模型的多模态数据,以及超大模型预训练所需的数据工作。Horizon RL:负责人唐晟宇。该部门整合了之前散落在后训练、推理和视觉理解的后训练团队,主要专注于强化学习,以提升模型的基础智能上限。Product Posttrain-Work:负责人秦禹嘉。这个新部门主要服务于B端应用,负责Agentic模型的整合与发布,并针对办公场景对模型的Agentic能力进行优化,包括支持豆包和Dola的任务模式。Product Posttrain-Chat:由原本朱文佳负责的Application团队更名而来,主要服务于C端应用,负责对话模型的整合与发布,与Product Posttrain-Work分工合作。

四个新部门的负责人均向吴永辉汇报。此外,Seed 还为 AI 安全及其他前沿探索方向分别任命了负责人。Seed 在这次调整公告中提到:“合并相似工作、减少 overlap(重合),内聚在一起”。

在此之前,Seed 主要按照模态和研究方向划分团队,文本、代码、视觉、推理等方向都有自己的数据、后训练团队。这一机制在大模型研发早期利于快速补齐不同能力,但团队间的边界随着研究方向增多而变得越来越模糊,导致出现了“重复造轮子”的情形,提高了跨团队沟通和协作的成本。

据IT之家所知,本月初,该媒体曾透露字节跳动正在探讨训练一个参数规模超5万亿的模型。这个模型一旦成型,将会超越阿里的Qwen 3.8-Max(2.4万亿参数)以及月之暗面的K3(2.8万亿参数),成为国内目前已知参数规模最大的模型。一般来说,模型规模越大,其智能水平往往也越高。不过,目前这个计划还处于早期阶段。

而这一计划,也给了字节跳动打破原有团队边界和分工模式的更强决心和动力。调整中的一个明显变化,就是将负责应用后训练的团队按照用户任务拆分为 Work 和 Chat 两个方向。

本文转载于:https://www.163.com/dy/article/L4NTBT0J0511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注