豆包大模型2.2推迟发布,字节跳动选择用时间换能力跃升

多位接近字节的人士透露,延期的核心原因是团队希望通过更充分的预训练和后训练,把编程、工具调用和Agent能力拉上去——用更长的研发周期换一次更明显的能力提升。

豆包大模型2.2推迟发布,字节跳动选择用时间换能力跃升

夹在两代模型之间的关键补强

Seed团队当前同时面对两件事:推进下一代超大模型的预研,维持现有模型的正常迭代。2.2更像是夹在两代模型之间的一次关键补强。它不能等到下一代超大模型完成再解决编程问题,也不能沿用过去的方式简单迭代一次。

编程能力跻身第一梯队,是Seed团队在2026年的主要目标之一。字节希望Seed模型的Coding能力在年底之前能产生类似智谱GLM-5.2和Kimi-K3的行业冲击力。

组织架构同步调整

为补齐编程短板,字节在8月对Seed基础模型部门进行了重大调整。原本按文本、语音、代码、视觉等模态划分的团队被拆分重组为四个一级部门:Pretrain Data(预训练数据)、Horizon RL(强化学习)、Product Posttrain-Work(面向办公场景的产品后训练)和Product Posttrain-Chat(面向C端用户的产品后训练)。Horizon RL团队被直接赋予攻坚编程后训练的重任,Work团队则专攻工具调用、GUI操作和长任务执行。

高层定调:坚持自研,接受短期落后

据The Information报道,字节跳动创始人张一鸣在上月Seed团队全体会议上明确表示,即使意味着暂时落后于竞争对手,公司也不会依赖AI蒸馏技术来改进模型。

8月6日,CEO梁汝波在2026年度年中全员会上进一步表态:在大语言模型上,字节跳动还是会坚持自研,做好基本功,接受短期落后,坚持优化长期。

研发团队透露,2.2版本的延期不会影响整体产品路线图,下一代超大模型的预研工作仍在按计划推进,预计将在2027年进入测试阶段。

© 版权声明
为这篇文章评分
10.0/ 10
2 人评价
点击⭐️进行评分

相关文章

暂无评论

none
暂无评论...