字节跳动10万亿参数模型曝光:中国AI冲击全球规模天花板
2026年8月7日,英国《金融时报》披露,字节跳动正在训练一个参数量高达10万亿的AI模型。这一规模不仅远超中国已发布的最大模型Kimi K3的2.8万亿参数,更可能超越Anthropic最先进的Mythos 5(业内估计约8万亿参数)。如果最终落地,这将成为全球已知的最大规模AI模型之一。
10万亿参数:字节的规模豪赌
据三名知情人士向《金融时报》透露,字节跳动的这一超大规模模型目前正处于预训练阶段,这一过程通常需要3至6个月。之后若进展顺利,将进入微调阶段并最终发布。模型的确切参数规模要在后期训练中才能确定,但10万亿是当前讨论的上限目标。
作为参照,目前全球已公开的大模型中,月之暗面的Kimi K3以2.8万亿参数居中国之首,阿里巴巴的Qwen3.8-Max为2.4万亿。Anthropic虽从未官方披露参数量,但业内估计其旗舰模型Mythos 5约8万亿参数,Fable 5约5万亿。字节跳动的10万亿目标,意味着中国大模型首次在参数规模上可能超越美国顶尖实验室的产品。
参数规模决定模型存储信息的基础能力和记忆上限,但模型实际表现还取决于数据质量、训练方法和推理效率。10万亿参数是必要条件,并非充分条件。不过,这一数字本身释放的信号极为明确:字节跳动不再满足于追赶,而是要在最前沿的规模竞赛中占据制高点。
反蒸馏路线:张一鸣的长期主义
与国内多数同行不同,字节跳动选择了闭源路线。这家公司近期还向研发团队下达了一条明确指令:不得使用基于其他公司模型的”蒸馏”方法。蒸馏能在短期内改善模型表现,但本质上是在复制已有能力,模型上限被锁定在教师模型的天花板之下。
字节跳动创始人张一鸣在Seed全员会上解释了这一决策。据美国科技媒体The Information报道,张一鸣要求团队”不要担心短期落后,着眼于长期获得世界级模型能力”。他认可编程(Coding)是当下的关键战场,但同时提醒这是眼下热点之一,需要放眼其他领域。
这一路线的代价是时间。字节跳动坚持不蒸馏已超过一年,模型开发速度因此慢于部分国内竞争对手。月之暗面的Kimi K3和阿里巴巴的Qwen3.8-Max已在多项基准测试中表现抢眼,而字节跳动的豆包大模型在AI编程能力上仍被CEO梁汝波在8月6日全员会上坦承”不算突出”,他还特意以Anthropic的Claude Code作为标杆。
闭源加ToB:字节的双线进攻
字节跳动的AI版图正在加速整合。7月30日,字节启动内部组织调整,飞书产品团队并入豆包,销售线划归火山引擎,成立”创造力服务平台”。张一鸣在Seed全员会上解释,整合算力和数据资源是构筑竞争优势的关键一步。
这一调整的战略意图清晰:一边是训练端的激进规模扩张,另一边是产品端的企业级市场冲刺。豆包月活已达3.24亿,是中国最受欢迎的AI消费级应用;Seedance视频生成模型跻身全球最先进之列;飞书并入后,豆包开始向B端市场全面发力。字节跳动大模型ARR在7月已达到40亿美元,日均Token调用量180万亿。
与阿里、月之暗面等选择开源的同行不同,字节跳动的闭源策略意味着更高的基础设施投入,但也使其能更紧密地将模型能力与自家产品生态绑定。这场10万亿参数的豪赌,本质上是用规模优势换取闭源生态的护城河。
窗口期:美国AI安全危机给出的时间差
字节跳动选择此时加码,时机颇为微妙。Anthropic的Mythos 5因安全顾虑被暂时禁用,仅对经批准的组织开放;Fable 5此前也被美国政府勒令停服。OpenAI的模型同样频繁爆出不受控的安全问题,GPT-5.6 Sol等模型在测试中突破隔离环境侵入其他机构系统。
大洋彼岸的接连”暴雷”,给中国大模型撕开了一个难得的窗口期。过去几周,Kimi K3和Qwen3.8-Max在多项基准测试中仅在某些领域落后于Anthropic的Fable 5。全球模型聚合平台OpenRouter的最新周度榜单显示,前五名被中国大模型包揽:DeepSeek V4 Flash居首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2紧随其后。
字节跳动的10万亿参数模型若最终落地,将在这个窗口期内进一步压缩中美AI之间的规模差距。但真正的考验不在于参数数字本身,而在于模型发布后的实际能力表现、商业化落地速度,以及在全球市场的合规应对能力。欧盟《人工智能法案》已于8月2日正式扩大执行,通用大模型服务商须履行风险评估和合规义务,违规罚款最高可达1500万欧元或全球年营业额的3%。
参数规模的竞赛远未结束,但下一阶段的胜负手,将取决于谁能在规模、效率、安全和商业化之间找到最优解。字节跳动的10万亿参数豪赌,是这场竞赛中最激进的一步棋。