字节跳动创始人张一鸣于2026年7月在公司Seed团队内部会议上透露,字节跳动不会使用模型蒸馏技术作为提升人工智能模型能力的捷径,即使因此落后于国内对手也在所不惜 [1, 2, 3, 4]。他强调,公司将坚持长期主义策略,愿意牺牲一部分短期收益,以追求长期技术突破,而非依赖他人模型输出换取当下的排名提升。张一鸣说:“字节跳动应该愿意为长期目标牺牲一部分短期收益”,并指出“做模型要坚持长期主义、延迟满足感,而不是用别人的输出,换一时的榜单排名” [1, 4]。
模型蒸馏是一种通过利用大型复杂语言模型的输出结果,来训练或改进较小模型的技术。业内广泛使用该手段以节约训练时间和计算资源,实现对模型的快速迭代更新 [1, 4]。但字节跳动内部严格禁止对开源模型进行蒸馏,并建立了API检测机制防止外部模型输出被用作训练数据 [1, 2, 3, 4]。
今年以来,随着竞争对手推出强大的开源人工智能模型,让字节跳动内部关于是否采用蒸馏的讨论更加激烈。尽管外部压力巨大,但字节跳动是国内为数不多仍主营自主闭源大型语言模型的公司 [2, 3]。相较之下,其他中国AI企业倾向于依赖开源模型改造和蒸馏技术。
美国财政部长2026年7月明确警示,若中国人工智能公司使用工业规模的蒸馏攻击,可能面临制裁和列入实体名单的风险 [1]。美国官方指控中国AI企业通过蒸馏技术“偷取”美国模型。而中国商务部则表态将采取一切必要措施,维护国家合法权益,反对任何实质性损害中国利益的行为 [1]。
另据报道,国内另一家AI企业DeepSeek于7月31日发布了DeepSeek-V4-Flash API的公开测试版,8月6日宣布将大幅上调API服务价格 [2, 3]。多数国内厂商正在加速利用开源模型及蒸馏技术调整市场策略。
7月张一鸣的表态体现了字节跳动对AI技术发展路径的坚定选择。接下来,公司将继续以自主研发为核心,推进长期技术积累与突破,拒绝依赖国外或开源模型的直接“复制粘贴”。