
字节跳动正在讨论训练一个参数规模超过5万亿的AI模型。该模型若实现,将超过阿里巴巴Qwen3.8-Max(2.4万亿参数)和月之暗面K3(2.8万亿参数),成为国内已知参数规模最大的模型。该项目目前处于早期阶段,由SeedFoundation负责人项亮与大语言模型预训练数据负责人沈科主导。两人均为字节跳动AI及大模型研发体系核心成员。字节跳动内部人士称,公司上半年多个Seed团队已开始反思,此为推动超大规模模型讨论的原因之一。两周前的Seed全员会上,创始人张一鸣表示,训练大模型本就困难,团队不必过度焦虑,并称可接受一段时间内模型落后于行业,目标是追求智能上限,使Seed模型能力进入世界第一梯队。张一鸣同时强调编程是当前关键方向,并反对使用蒸馏方法,认为其仅能短期改善表现,难以实现能力超越。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”