字节跳动拟训练50万亿参数大模型:规模超阿里Qwen3.8-Max,项亮牵头、Seed团队重组
据LatePost报道,字节跳动正讨论训练参数超50万亿的大模型,规模超过阿里Qwen3.8-Max与Dark Moon K3,为目前国产已知最大。该计划由Seed负责人项亮牵头,尚处早期阶段,Seed团队已启动重组。
- 字节跳动
- SeedFoundation
- 50万亿参数
- 国产大模型
- Qwen3.8-Max
据LatePost报道,字节跳动正在讨论训练参数规模超过50万亿的大模型,超过阿里巴巴Qwen3.8-Max(24万亿参数)和Dark Moon K3(28万亿参数),成为目前国产已知参数规模最大的模型。一般来说,模型规模越大,智能水平越高。
不过,该计划仍处于早期阶段,并不能保证模型最终会对外发布。新模型将由SeedFoundation负责人项亮(Xiang Liang)牵头,与负责大语言模型预训练数据的沈柯(Shen Ke)合作推进。为此,Seed团队正在进行重组,明确职责并分配资源。
核心信息梳理
• 参数规模:目标超过50万亿,超过阿里Qwen3.8-Max(24万亿)与Dark Moon K3(28万亿)。 • 项目阶段:尚处早期讨论阶段,存在不确定性,不保证最终发布。 • 组织架构:由SeedFoundation负责人项亮牵头,联合沈柯负责推进;Seed团队正在内部重组、重新定责并分配资源。 • 行业定位:若按计划推进,将成为目前国产已知参数规模最大的大模型。
国产大模型参数规模怎么看
参数规模是衡量大模型潜在能力的重要指标之一。当前报道显示,阿里Qwen3.8-Max为24万亿参数,Dark Moon K3为28万亿参数,而字节跳动此次讨论的目标直接跃升至50万亿以上。需要注意的是,参数规模大并不直接等同于实际应用表现,训练数据质量、对齐技术、推理成本及后续落地能力同样关键。
后续观察指标
由于该计划尚处早期,短期内可关注以下方向:一是Seed团队重组后的人员与算力资源配置情况;二是字节跳动官方是否会在未来披露更具体的训练计划或技术路线;三是模型若进入实质训练阶段,其后续是否对外开源或提供API服务。目前该计划能否最终落地仍存变数。