时间:2026年8月6日
地点:北京
人物:字节跳动、Seed Foundation负责人项亮、LLM预训练数据负责人沈科、字节跳动创始人张一鸣
事件详情:据《晚点 LatePost》8月6日报道,字节跳动正讨论训练一个参数规模超过5万亿的模型,由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作。新模型规模将超过阿里Qwen3.8-Max(2.4万亿参数)和月之暗面K3(2.8万亿参数),成为目前国内已知参数规模最大的模型。张一鸣在Seed全员会上明确表态反对蒸馏,认为蒸馏短期内能改善模型表现,但本质仍是复制Claude已有能力,沿此路线最多只能不断逼近对手,难以真正实现超越。
背景:当前大模型参数规模竞赛进入白热化阶段。Anthropic此前已指控DeepSeek、月之暗面、MiniMax、智谱和阿里巴巴对其Claude模型进行蒸馏,字节跳动选择从零开始自研路线,与全行业策略产生明显差异。项亮本科毕业于中国科学技术大学,博士就读于中国科学院自动化研究所,2016年加入字节,曾负责机器学习中台AML团队;沈科2018年清华毕业后加入字节,主导LLM预训练数据。
影响:
- 字节跳动模型能力有望跻身世界第一梯队,重塑国内大模型竞争格局
- 推动国产算力需求增长,昇腾等国产AI芯片厂商有望获得新订单
- 蒸馏争议可能升级,进一步影响AI公司国际合作与监管态度
总结:字节跳动选择以参数规模优势和从零自研路线参与大模型竞争,张一鸣反对蒸馏的表态也是对当前国际版权争议的主动回应。然而5万亿参数训练仍处于早期阶段,并不代表模型最终一定会发布,能否如期落地仍存较大不确定性。
参考来源:
- https://www.ithome.com/0/986/739.htm
- https://tech.ifeng.com/c/8vLkt9GlB8A
- https://m.gelonghui.com/live/2597477
- https://www.laohu8.com/post/593939302859328
- https://app.myzaker.com/news/article.php?pk=6a74847f8e9f093c3d6d48f4
- https://m.sohu.com/a/1059689927_114760/
- https://kan.china.com/article/6086949.html