字节跳动讨论训练超5万亿参数模型,规模逼近Kimi K3两倍
2026-08-07 13:21:12
币界网消息,字节跳动正在讨论训练一个超过5万亿参数的大语言模型,希望通过扩大模型规模追赶国内外领先对手。如果计划落地,该模型将超过阿里Qwen3.8-max的2.4万亿参数和月之暗面Kimi K3的2.8万亿参数,成为目前国内已知参数规模最大的模型。不过,项目仍处于早期讨论阶段,最终是否训练和发布尚未确定。新模型计划由Seed Foundation负责人项亮主导,与大语言模型预训练数据负责人沈科合作。字节跳动已开始预训练一款最高10万亿参数的大模型,若按上限训练,将达到Kimi K3的三倍以上,成为目前已知中国团队中参数规模最大的模型。该模型目前还在预训练阶段,通常需要3至6个月,之后还要继续后训练,顺利才会发布。张一鸣近期在Seed内部明确反对蒸馏竞争对手模型,要求团队接受短期落后,靠自研冲击世界第一梯队。
来源:互联网
本内容只为提供市场信息,不构成投资建议。
关注HQYC官方账号,及时关注最新动态









