登录体验完整功能(收藏、点赞、评论等) — 已累计有 13283 人加入

AMD发布全开源16B参数MoE大模型 单Token仅激活2.8B参数

详情页推荐

近日,芯片厂商AMD正式发布全开源混合专家(MoE)大语言模型Instella-MoE-16B-A3B。该模型总参数规模达16B,单Token推理过程中仅激活2.8B参数,全程基于AMD Instinct系列GPU训练完成,模型权重、训练框架、部署工具均完全开放,为大模型轻量化部署、边缘侧AI落地提供了新的技术路径。

在大模型商业化落地逐步进入“成本优先”的竞争周期,兼顾效果与推理效率的MoE结构已经成为业内公认的主流技术方向,而硬件厂商的下场布局,更是进一步加快了这类技术的普及速度。

此前行业内推出的MoE大模型大多存在开源不彻底的问题:部分模型仅开放推理接口不开放权重,部分模型训练、部署工具高度绑定特定厂商硬件,无形中抬高了中小开发者的使用门槛。对于大量需要本地化部署大模型的企业而言,既需要模型效果达到可用标准,也需要尽可能降低推理硬件的投入成本,而现有开源模型很难同时满足这两个需求。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。