登录体验完整功能(收藏、点赞、评论等) — 已累计有 13213 人加入

海光DCU完成万亿参数Kimi K3全栈适配 国产算力再获核心突破

详情页推荐

2026年7月,海光信息宣布完成月之暗面旗下万亿参数大模型Kimi K3在海光DCU平台的全栈适配与性能验证,这是国产算力首次实现对万亿参数级别MoE架构大模型的稳定支撑。本次适配针对KDA注意力机制与896专家并行架构做了算子级优化,模型迁移成本近乎为零,打破了此前超大规模大模型只能依赖海外旗舰芯片的垄断局面。

对于国内AI产业而言,万亿参数级超大规模大模型的部署此前一直是绕不开的“卡脖子”环节——这类模型参数量大、并行调度复杂度高,对底层算力芯片的硬件性能、软件栈适配能力都有极高要求,长期以来只有少数几款海外厂商的旗舰芯片能够稳定支撑,不仅采购成本居高不下,还随时面临供应链波动的风险。

本次海光信息的适配工作覆盖了从底层算子到上层推理引擎的全链路,针对Kimi K3的核心架构做了定制化打磨:针对模型采用的KDA注意力机制、896专家MoE架构,海光技术团队做了算子级的深度优化,哪怕在百万级上下文的重载场景下,896个专家同时并行推理也能保持高效稳定,无卡顿情况

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。