2026年8月,AI评测机构Artificial Analysis联合Liquid AI发布全新手机端本地AI性能基准,针对4bit量化后体积不超过8GB的端侧大模型,在iPhone 17 Pro设备上从智能水平、推理性能两大维度,覆盖函数调用、指令遵循等5类场景完成测试,验证小参数端侧模型也可实现高智能表现,南北阁实验室Nanbeige4.2-3B等模型跻身第一梯队。

随着端侧AI成为智能手机核心竞争卖点,行业长期缺乏针对移动设备优化的统一AI性能评测体系——过往测试要么侧重纯推理速度忽略实际智能表现,要么采用远超普通消费级设备承载能力的大模型,参考价值十分有限。
本次测试最大的特点是打破了过往端侧评测“唯速度论”的误区,两家机构分工明确:Artificial Analysis负责模型智能水平测试,设置函数调用、指令遵循、知识认知、高难问答与数学五类核心场景,覆盖普通用户日常使用端侧AI的绝大多数需求;Liquid AI负责推理性能测试,重点统计模型运行的时延、功耗、内存占用等硬件相关指标。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录