字节训10万亿参数大模型 拒走蒸馏捷径

时间:2026年8月7日 地点:中国北京(字节跳动总部) 人物:字节跳动创始人张一鸣;字节跳动CEO梁汝波;Seed Foundation负责人项亮;字节跳动大语言模型预训练数据负责人沈科;Seed团队负责人吴永辉 事件详情: 2026年8月7日,英国《金融时报》援引三名知情人士报道,字节跳动正在训练一款参数规模最高可达10万亿的AI大模型,目前处于预训练早期阶段,预训练周期通常需要3至6个月,最终参数规模将在后期阶段才能确定。此前一日晚点LatePost独家报道的规模为"超5万亿",最新数字较此前翻倍。该模型由字节Seed Foundation负责人项亮主导,与字节大语言模型预训练数据负责人沈科合作推进。同日,字节跳动创始人张一鸣在Seed全员会上罕见明确表态"拒绝模型蒸馏",CEO梁汝波在8月6日All-Hands会议上强调大语言模型将坚持自研、接受短期落后。 背景: 字节跳动此次曝光的10万亿参数模型如最终达到目标规模,将显著超过已公开或被披露的多数大语言模型:约为月之暗面Kimi K3(2.8万亿)和阿里Qwen 3.8-Max(2.4万亿)的三倍以上,并接近Anthropic的Mythos 5(约8万亿)。张一鸣解释模型蒸馏可在短期改善模型表现但本质上仍是复制已有能力,"沿着这条路走,模型能力最多只能不断逼近对方,很难真正实现超越"。字节内部对开源模型严禁蒸馏,并通过API检测等方式加强限制。 影响: - 字节跳动在10万亿参数模型上押注若成功,将打破国产大模型参数规模天花板,重塑全球AI竞争格局,与Anthropic、OpenAI形成正面抗衡 - 张一鸣"拒绝蒸馏"表态为国内大模型行业树立差异化路线标杆,可能促使其他厂商重新审视短期榜单排名与长期技术突破之间的取舍 - 字节大模型如以10万亿参数规模落地,将对算力基础设施提出极高要求,进一步拉动AI芯片、数据中心、电力等上游产业链需求 - 国内大模型窗口期叠加字节激进投入,可能加速阿里、腾讯、月之暗面等头部厂商同步上调训练规模,引发新一轮军备竞赛 总结: 字节跳动押注10万亿参数大模型并由张一鸣亲自定调"拒绝蒸馏",标志着国内头部AI厂商正式放弃"小步快跑"路线,转向以极致参数规模+长期主义为核心的硬碰硬竞争。该模型尚处预训练早期,最终参数规模和发布时间仍未确定,但已为中国大模型行业新一轮军备竞赛按下启动键,字节能否在Anthropic、OpenAI的安全争议窗口期内完成赶超值得持续关注。 参考来源: - https://zhidx.com/p/583239.html - https://www.tmtpost.com/8096279.html - https://new.qq.com/rain/a/20260807A0ASRA00 - https://new.qq.com/rain/a/20260807A040R000 - https://so.html5.qq.com/page/real/search_news?docid=70000021_5206a757d2a84252 - https://so.html5.qq.com/page/real/search_news?docid=70000021_8246a7609bd04052 - https://so.html5.qq.com/page/real/search_news?docid=70000021_1846a76196464852 - https://so.html5.qq.com/page/real/search_news?docid=70000021_7816a76e83a78865