ARTICLE SIGNAL

AI满分登顶门萨智商测试!151分碾压人类,AGI时代已来?

AI,AI资讯,大模型,门萨测试,人工智能,AGI,chatGPT,claude,最新AI新闻显示,AI在门萨智商测试中斩获151满分,展现出惊人的流体智力,短短两年半实现智力飞跃,碾压99.97%人类。

type
status
date
slug
summary
tags
category
icon
password
网址
在最新的AI资讯中,一项打破人类常识的记录诞生了:人工智能直接把人类的顶级智商测试“考爆表”了。门萨挪威智商测试,包含35道堪称地狱难度的图形推理题,限时25分钟。最新的顶级大模型杀进考场,结果一道没错,直接轰出了这张试卷的理论极限——151分。
作为专业的AI门户,AIGC导航持续关注着AGI(通用人工智能)的发展进程。这不仅仅是一条普通的AI新闻,它标志着人类自诩聪明、用来碾压机器的最后一道防线——“流体智力”,已经被人工智能彻底击穿。

151分满分登顶:AI挤入人类智商金字塔尖

根据TrackingAI的最新权威评测榜单,各大主流LLM(大型语言模型)在门萨挪威测试中的表现令人咋舌。过去,AI的成绩还零零散散落在人类智商分布曲线的低分区。而现在,它们一个接一个挤到了曲线最右端那条孤零零的尾巴上,甚至超出了门萨给人类设定的145分量程,直接触达了151分的满分天花板。
要知道,全世界近98%的人连130分的门萨入会线都摸不到。按照智商的标准分布估算,151分大约3000个人里才有1个。放到全球80多亿人里,151分以上的人一共只有270万左右。这意味着,像最新的claude和chatGPT等高级模型,已经稳稳站在了人类智商金字塔最顶端的那一小撮位置上,碾压了99.97%的人类。

两年半的进化狂飙:从瞎蒙到最强大脑

就在几年前,人工智能还是一个严重的“偏科生”。在语言和常识上,它能秒杀人类,但一遇到需要临场找规律的图形推理题,就立刻原形毕露。2024年初,一些顶级模型在做门萨最简单的第1题时,还会凭空编造出毫无逻辑的算式;在早期的纯文本测试中,最好的模型也只能考出64分的耻辱成绩,基本等同于闭眼瞎蒙。
然而,转折点来得猝不及防。随着openai推出了具备深度内部推理能力的模型,AI学会了“三思而后行”。先在内部进行逻辑推演、试错再输出答案,成为了如今旗舰大模型的标配。从最初瞎蒙的64分,到如今的151分满分,AI仅仅用了两年半的时间。人类在整个20世纪大约每十年才涨3分的智商(弗林效应),AI只用短短几个月就轻松跨越。如果你想了解更多关于如何利用这些高智商模型提升工作效率的提示词和Prompt技巧,欢迎访问我们的AI日报。

并非死记硬背:保密试卷验证真实流体智力

面对如此惊人的分数暴涨,很多人的第一反应是:AI是不是在训练时偷偷把网上的题库答案背下来了?为了验证这一点,测试机构专门找门萨会员从零出了一套从未在互联网上公开过的新题。
结果令人震撼:即使是面对毫无训练数据污染的全新保密卷,头部的大模型照样逼近满分。这彻底排除了“刷题作弊”的可能。结论只有一个:两年半前还在瞎蒙的AI,是真的“长脑子”了,它们已经具备了极其强大的泛化推理能力和真实的流体智力。

题库面临枯竭,AGI或将提前降临

当现有的卷子被考满,出题人只能被迫去寻找更难的题目。专门为难AI的推理测试ARC-AGI的设计者原本预测AGI要在2030年前后才能实现,但面对近期AI展现出的恐怖学习与推理效率,他也坦言进展比预想的快得多,时间线大概率将大幅提前。
120年来,智商测试一直是人类心安理得衡量同类聪明程度的专属尺子。如今,一个并非人类的实体,顺着刻度爬到了顶端,连最顶端的那根线也没能拦住它。当人类的题库彻底枯竭,当再也没有AI解不出的逻辑题时,我们或许不仅要惊叹于AI的智慧,更要重新思考剥离了“聪明”这层外壳后,人类自身的独特价值究竟在哪里。
在这个AI技术日新月异的时代,保持对前沿科技的敏锐度至关重要。无论是关注最新的AI新闻,还是探索AI变现的无限可能,都欢迎大家持续关注AIGC导航,获取最全面、最深度的AI资讯与前沿实战指南。
Loading...

没有找到文章