登录体验完整功能(收藏、点赞、评论等) — 已累计有 13406 人加入

字节跳动拟研发5万亿参数大模型 有望刷新国内规模纪录

详情页推荐

字节跳动正推进参数规模超5万亿的大语言模型研发论证工作,该项目由Seed Foundation负责人项亮主导,联合大语言模型预训练数据负责人沈科共同推进。若最终落地,其参数规模将超越阿里通义千问Qwen3.8-Max的2.4万亿、月之暗面Kimi K3的2.8万亿,成为国内已知最大的大语言模型,目前项目仍处早期阶段,发布时间尚未确定。

配图

国内大语言模型的规模竞赛正在迈入新的节点。过去两年间,国内头部科技公司和AI创企先后完成了从千亿参数到万亿参数的技术跨越,参数规模的迭代速度从原来的18个月一轮缩短到如今的6-8个月,核心能力的追赶节奏远超行业预期。

从2025年开始,国内大模型厂商就集体开启了参数规模的升级:阿里率先推出2.4万亿参数的通义千问Qwen3.8-Max,在复杂数学推理、多模态理解上实现了30%以上的能力提升;AI创企月之暗面紧随其后发布2.8万亿参数的Kimi K3,将长上下文窗口能力推升到了1000万token的新高度。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。