登录体验完整功能(收藏、点赞、评论等) — 已累计有 13751 人加入

2026年最新智力测试结果:前沿AI频繁答错谜题 人类可同台比拼

2026年8月26日,科技作者Grace Huckins发布的AI能力测试结果显示,当前GPT-5、Claude 4等主流前沿大语言模型在逻辑谜题、博弈类智力测验中存在明显能力短板,平均正确率不足40%,远低于成年人类平均水平。本次测试共包含7项不同类型的趣味智力题,普通用户可直接参与答题,对比自身与AI的表现,直观感知当前AI的能力边界。

配图

翻开这套包含7道题的测试卷,第一题是经典的“三个开关控制三盏灯”逻辑题,这道成年人类正确率超过80%的常规智力题,在GPT-5的10次重复测试里只答对了2次,甚至还给出过“用水浇灯判断温度”的违背常识的离谱答案。

从AI学科诞生之初,各类智力游戏、谜题、博弈场景就一直是衡量AI能力的核心标尺。1997年深蓝战胜国际象棋冠军卡斯帕罗夫,2016年AlphaGo击败围棋世界冠军李世石,都曾被视作AI能力跃迁的标志性节点,也让不少公众产生了“AI智力已经全面超越人类”的刻板认知。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。