8 月 19 日
信息,晚点 LatePost 今日(19 日)晚间公布
信息称,字节跳动的大模型部门 Seed 已于上周
实现了新一轮的组织调整 。其中最
要害的
部分是 Seed Foundation Model (Seed
根底模型)成立了四个新的一级部门: 四个新部门的负责人均向吴永辉汇报 。此外,Seed 还为 AI 安全及
其余前沿探究方向分别任命了负责人 。Seed 在这次调整布告中提到:“合并
类似工作、削减 overlap(重合),内聚在一同” 。 在此之前,Seed 重要依照模态和探究方向划分团队,文本、代码、视觉、推理等方向都有自己的数据、后训练团队 。这一机制在大模型研发早期利于
快捷补齐不同
威力,但团队间的边界随着探究方向增多而变得越来越含糊,招致浮现了“
反复造轮子”的
情景,
遍及了跨团队沟通和
合作的成本 。 据了解,本月早些时候,该媒体公布了字节跳动正在
探讨训练参数规模超 5 万亿模型的
信息 。该模型将超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之暗面的 K3(2.8 万亿参数),也是当前国内已知参数规模最大的模型 。通常而言,模型规模越大,智能水平一般越高,不过该
方案仍处于早期阶段 。 而这一
方案,也给了字节跳动
攻破原有团队边界和分工模式的更强
信念和动力 。调整中的一个显而易见
变迁,便是将负责
利用后训练的团队依照消费者
使命拆分为 Work 和 Chat 两个方向 。 |