字节讨论训练超5万亿参数模型,规模逼近Kimi K3两倍

BiRun 讯,字节跳动正在讨论训练一个超过 5 万亿参数的大语言模型,希望靠扩大模型规模追赶国内外领先对手。

如果计划落地,它将超过阿里 Qwen3.8-Max 的 2.4 万亿参数和月之暗面 Kimi K3 的 2.8 万亿参数,成为目前国内已知参数规模最大的模型。不过,项目仍处于早期讨论阶段,最终是否训练和发布都未确定。

新模型计划由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。Seed 正在重新划分团队职责,并为项目调配资源。

字节认为,与其继续在现有模型规模上追赶,不如一次把参数推到同行的数倍,争取重新进入第一梯队。

晚点 LatePost
利多 加密大盘 查看原文
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯