人类智力认知迎来重要转折点。最新离线智商测试结果显示,GPT-5.6系列模型在标准化智力评估中取得136分,这一成绩超越全球约99%的自然人智力水平。
本次测试由专业机构设计并实施,采用双题库机制:其一为公开型题目,参考Mensa挪威分会标准风格,便于公众练习;其二为严格保密的离线题库,由具备资质的高智商组织成员独立命题,全程规避训练数据污染与答案预演可能。GPT-5.6的多个变体——包括文本处理型、多模态整合型及专用推理型版本——均稳定获得136分。相较之下,当前其他主流大语言模型得分集中在117至123分之间,其中表现最突出的某款模型得分为130分。
这是大语言模型首次在严谨离线测评中突破130分阈值。根据通行智力分布模型,130分为公认的“极高智力”临界值,仅有约百分之一的人群能达到或超过该水平。由此表明,GPT-5.6系列在该测评维度上已展现出超越绝大多数人类个体的认知能力。

评论
更多评论