字节跳动承认大模型“落后”:张一鸣罕见发声,拒绝AI蒸馏捷径

来源:互联网 时间:2026-08-07

8月6日,字节跳动举办了2026年度年中全员会。CEO梁汝波在会上坦承了一件事——字节跳动在大语言模型上面临被海外先进模型拉开差距的问题。

一家中国顶级互联网公司的CEO,在全员会上公开承认自己“落后”了。这在这个行业里极为罕见。

“落后”到什么程度?

梁汝波的总结很直白:豆包在C端应用上保持了竞争力,视频生成模型Seedance维持了SOTA(最先进)地位,但大语言模型确实被海外领先模型拉开了差距。

他给出的对策是:接受短期落后,坚持自研,优化长期。“希望团队延迟满足感,打好技术基础,这对长期实现AGI很关键。”

更值得关注的是张一鸣的表态。

据字节跳动内部人士透露,创始人张一鸣在上个月的内部会议上罕见发声,明确表示:字节Seed的AI研发将坚持长期主义、走自主路线,不依赖外部模型输出提升自身能力。

张一鸣特别强调了一个词——“蒸馏” 。

所谓“蒸馏”,就是用顶尖模型的生成数据来训练自己的模型,快速提升参数效果和评测分数。这是AI行业常见的“速成法”,见效快,但会让模型失去原生创新能力。

张一鸣明确拒绝这条路。字节跳动内部对开源模型严禁蒸馏,甚至通过API检测等方式在内部加强限制。张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。

字节为什么要走这条“慢路”?

一方面,字节跳动与美国政府因TikTok所有权的复杂关系,使其在AI合规上必须更加谨慎。另一方面,张一鸣相信——短期落后可以接受,但底层技术根基绝不能依赖外力。

与此同时,字节正在两条腿走路。据《金融时报》报道,字节跳动正在训练一款参数量高达10万亿的AI大模型,目前处于预训练阶段。10万亿是什么概念?是Kimi K3(2.8万亿)的三倍有余,据行业估算已逼近Anthropic Mythos 5的规模。

一边承认落后,一边默默训练10万亿模型——字节的战略很清晰:不抄近道,但要修一条更宽的路。

相关文章

A5创业网 版权所有

返回顶部