国内两大AI实验室智谱AI、阿里通义千问团队近期先后推出的GLM-5.3-Flash、Qwen3.8-Flash-Next两款轻量化大模型,被证实独立研发却在核心架构上完全趋同,二者均采用混合线性注意力、2048token稀疏索引器、四路残差流设计,这一罕见的技术趋同事件,也被业内视为大模型端侧落地路径迎来明确共识的重要信号。

这一事件最早在8月底由海外AI技术社区曝出,起初有开发者质疑两款模型存在设计抄袭嫌疑,随后两家团队均公开回应称,相关架构完全由内部团队独立研发完成,发布时间相差仅两周的两款产品会出现架构重合,完全是技术路线选择上的“不谋而合”。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录