字节跳动讨论训练超 5 万亿参数大模型

字节跳动讨论训练超 5 万亿参数大模型

字节跳动正讨论训练一个参数规模超 5 万亿的大模型,由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作。该计划目前仍处于早期阶段,若落地将超越阿里 Qwen 3.8-Max 和月之暗面 K3,成为国内已知参数规模最大的模型。

两周前的 Seed 全员会上,张一鸣明确反对蒸馏路线,认为其只是复制 Claude 已有能力、难以实现超越,鼓励团队以追求智能上限为目标,接受短期落后并做出有特色的模型。他认可编程是当下关键方向,已整合火山引擎、飞书和豆包资源重点补课,但也提醒不应被短期热点完全牵着走。目前 Seed 正重新梳理组织、取消赛马机制,收拢资源以推动该项目。

晚点 LatePost

© 版权声明
THE END
喜欢就支持一下吧
点赞10 分享
评论 抢沙发
头像
欢迎您留下宝贵的见解!
提交
头像

昵称

取消
昵称表情代码图片快捷回复

    暂无评论内容

免责声明:

本站所有内容和资源均来自网络,仅供用户交流、学习与研究使用。版权归原版权方所有,本站不承担任何版权争议责任。

用户下载后不得用于商业或非法用途,需在24小时内从电脑中删除,否则责任自负。

访问和下载文件即表示您同意仅将其用于参考和学习,其他用途后果自负。

如您喜欢该程序,请支持正版软件,购买注册以获得更好的服务。

本站为非营利性个人网站,所有软件信息来自网络,仅供学习和研究参考,无商业用途。会员捐赠仅用于支持服务器的维护,完全自愿。