字节跳动启动"星纪"项目:训练5万亿参数超大规模大模型,张一鸣明令禁止蒸馏
字节跳动启动"星纪"项目:训练5万亿参数超大规模大模型,张一鸣明令禁止蒸馏
8月9日多方信源披露,字节跳动已内部启动代号"星纪"的超大规模模型训练计划,目标参数规模达5万亿,超越Kimi K3与Qwen3.8-Max,所需算力相当于百万卡级GPU集群。
8月9日,据多方可靠信源披露,字节跳动已在内部正式启动代号为"星纪"的超大规模人工智能模型训练计划。该项目目标参数规模达到5万亿,一举超越目前国内已发布的Kimi K3(2.8万亿参数)与阿里通义Qwen3.8-Max(2.4万亿参数),成为目前国内已知参数规模最大的大模型训练项目。
项目核心要点
- 参数规模:目标达到5万亿参数,采用MoE混合专家架构
- 算力需求:所需算力相当于百万卡级GPU集群规模
- 研发要求:张一鸣在内部会议明确强调"宁可牺牲短期收益也不走蒸馏捷径",要求团队坚持自研数据体系与训练范式,违反者将被追责
- 战略意义:标志着国内大模型竞争从"追平旗舰"阶段切换到"参数规模与训练范式双线超车"的新阶段
行业影响
这一动向不仅将国内大模型参数竞赛推向新的高度,同时也把"大模型蒸馏是否构成技术侵权"这一长期存在争议的话题重新摆上台面。字节跳动选择全自研路线,表明头部科技公司正在将AI核心技术自主权提升到战略高度。
此前在8月6日的2026年度年中全员会上,字节跳动CEO梁汝波就曾明确表示,公司大语言模型会坚持自研,做好基本功,接受短期落后,坚持优化长期发展,最重要的是动作不要变形。"星纪"项目的启动正是这一战略的具体落地。