AI 门萨智商测试获满分 151 分 超过绝大多数人类
2 小时前
Claude Fable 5.1 与 GPT-6 Astra 在限时 25 分钟、共 35 道图形推理题的门萨挪威智商测试中连续 7 次取得满分,拿到该测试理论极限 151 分,远超 130 分的门萨入会线,跻身人类智商金字塔顶端序列。TrackingAI 榜单显示多款头部 AI 的该测试成绩已突破 140 分,国产模型也进入第一梯队。AI 此前在图形推理这类代表人类流体智力的题型上曾是软肋,2024 年初多数 AI 得分仅 64 分左右,之后头部 AI 分数快速攀升,2024 年 5 月至 2025 年 10 月平均每月涨 2.5 分,远超人类智商增长的弗林效应。为排除 AI 刷题背答案的质疑,测试者使用从未公开的全新保密卷测试,头部 AI 依然逼近满分,证明其推理能力确实实现了实质提升。当前人类能设计出的可区分 AI 能力的难题正在快速耗尽,相关领域研究者也将原本预估的 AGI 到来时间提前,人类长期用来定义自身智能优势的智商测试标尺,其前提已经发生动摇。
体验专业版特色功能,拓展更丰富、更全面的相关内容。