字节原计划 8 月推出的豆包大模型 2.2 要延期了。多位接近字节的人士给出的说法是:用更充分的预训练和后训练把编程、工具调用和 Agent 能力拉上去,用更长的研发周期换一次明显提升。
放在过去两个月的节奏里看,这个决定挺显眼。Kimi、智谱、阿里千问、腾讯混元几家密集更新,字节反而在放慢。同一段时间里,字节在 Coding 能力上的动作是碎的——7 月几乎每天都有小功能迭代,属于打补丁式的追赶。
真正说明问题的是 8 月 20 日那次组织调整。Seed 基础模型部门被重组,按预训练数据、强化学习、办公场景、C 端场景重新划成四个一级部门。这个划法把”技术能力”和”落地场景”并列成了同级单位,办公和 C 端各自独立,意味着后训练和产品对齐的优先级被提到了跟预训练一样的位置。
为什么是编程和 Agent。这两块正好是国产模型这一年拉不开也追不上的地方:对话和写作大家差不多,但一到多轮工具调用、长任务规划、代码库级改动,差距就出来了。而这类能力对后训练的依赖极重,不是把预训练数据堆多就能起来的,需要大量高质量的轨迹数据和一整套强化学习基建。字节把强化学习单独立成一级部门,指向很清楚。
延期的代价是窗口期。豆包的用户规模在国内是第一梯队,靠的是产品分发而不是模型领先。C 端用户对版本号不敏感,短期不会流失;但企业侧和开发者侧不一样,选型的时候就是拿具体能力横向比,晚三个月可能就意味着一批客户先在别家把工作流搭完了。
反过来说,硬推一个能力没到位的 2.2 更亏。国内模型发布现在有个不太好的惯例:版本号跳得快,实际提升靠榜单话术撑。真按这个路子走一遍,等到用户拿真实任务一试就露馅,比晚发更伤。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
豆包 2.2 推迟发布,字节把 Seed 部门拆成了四块