2026-08-07 · AI 资讯
字节跳动大模型研发新动作:讨论挑战 5 万亿参数级别,内部重组资源以支持预训练
关于字节跳动大模型研发的最新动向显示,该公司正讨论训练参数规模突破 5 万亿的大型语言模型。若该项目最终实施,其参数量将超越目前国内最大的阿里 Qwen3.8-Max(2.4 万亿)与月之暗面 Kimi K3(2.8 万亿),标志着字节在基础模型能力建设上迈出了激进的一步。
该项目由 Seed Foundation 负责人项亮与大语言模型预训练数据负责人沈科主导。为了支撑这一超大规模任务,字节跳动正在对其“搜广推”技术体系背景的研发团队进行组织架构调整与资源整合,旨在从模型底层架构到数据预处理层面全面发力。
作为国内互联网大厂,字节跳动此举不仅是对于技术巅峰的追逐,更是大模型竞争升级的信号。随着国内厂商逐渐从应用层竞争转向基础能力建设的军备竞赛,字节通过对底层参数规模的持续探底,旨在为其豆包生态构建更强大的通用人工智能内核。
