8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。
一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。
“落后”到什么程度?
梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视频生成模型Seedance维持了SOTA(最先进)地位,但大语言模型确实被海外领先模型拉开了差距。
他给出的对策是:接受短期落后,坚持自研,优化长期。“希望团队延迟满足感,打好技术基础,这对长期实现AGI很关键。”
更值得关注的是张一鸣的表态。
据字节跳动内部人士透露,创始人张一鸣在上个月的内部会议上罕见发声,明确表示:字节Seed的AI研发将坚持长期主义、走自主路线,不依赖外部模型输出提升自身能力。
张一鸣特别强调了一个词——“蒸馏” 。
所谓“蒸馏”,就是用顶尖模型的生成数据来训练自己的模型,快速提升参数效果和评测分数。这是AI行业常见的“速成法”,见效快,但会让模型失去原生创新能力。
张一鸣明确拒绝这条路。字节跳动内部对开源模型严禁蒸馏,甚至通过API检测等方式在内部加强限制。张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。
字节为什么要走这条“慢路”?
一方面,字节跳动与美国政府因TikTok所有权的复杂关系,使其在AI合规上必须更加谨慎。另一方面,张一鸣相信——短期落后可以接受,但底层技术根基绝不能依赖外力。
与此同时,字节正在两条腿走路。据《金融时报》报道,字节跳动正在训练一款参数量高达10万亿的AI大模型,目前处于预训练阶段。10万亿是什么概念?是Kimi K3(2.8万亿)的三倍有余,据行业估算已逼近Anthropic Mythos 5的规模。
一边承认落后,一边默默训练10万亿模型——字节的战略很清晰:不抄近道,但要修一条更宽的路。
A5创业网 版权所有