
据晚点LatePost报道,字节跳动的大模型部门Seed已于上周完成新一轮组织调整。此次调整的核心是Seed Foundation Model(Seed基础模型)成立了四个新的一级部门,这四个部门的负责人均向Seed技术负责人吴永辉汇报。
四个新部门分别为Pretrain Data、Horizon RL、Product Posttrain-Work和Product Posttrain-Chat。
Pretrain Data负责人为李成刚。该部门由原先分散在文本模型、编程、视觉理解和语音等方向的预训练数据团队合并而来,统一负责新Omni模型的多模态数据及超大模型预训练所需的数据工作。
Horizon RL负责人为唐晟宇。该部门整合了此前散落在后训练、推理和视觉理解等方向的后训练团队,主要负责强化学习,以提升模型的基础智能上限。
Product Posttrain-Work负责人为秦禹嘉。该部门主要服务B端应用,负责Agentic模型的整合与发布,并针对办公场景优化模型的Agentic能力,包括支持豆包和Dola的任务模式。
阿里虎鲸文娱自研AI大模型,并内测视频创作工具
Product Posttrain-Chat由原本朱文佳负责的Application团队更名而来,主要服务C端应用,负责对话模型的整合与发布,与Product Posttrain-Work分工协作。
此外,Seed还为AI安全及其他前沿探索方向分别任命了负责人。
在此次调整前,Seed主要按照模态和研究方向划分团队,文本、代码、视觉、推理等方向各自拥有独立的数据和后训练团队。
这种架构在研发早期有利于快速补齐不同能力,但随着研究方向增多,团队间边界日益模糊,出现了重复劳动的情况,跨团队沟通和协作成本也随之增加。
Seed在调整公告中表示,此次调整旨在“合并相似工作、减少overlap(重合),内聚在一起”。
本月早些时候有消息称,字节跳动正在讨论训练一个参数规模超过5万亿的模型。如果该计划落地,将成为国内已知参数规模最大的模型。
原创文章,作者:admin,如若转载,请注明出处:https://www.jiangshaxiaoshou.com/623.html