讲智力测验 · 第一讲《那个叫智商的数字,是怎么诞生的?》

问AI · 韦氏离差智商怎样化解越老越蠢的数字笑话?

王祖承领衔· 李广智健康大讲堂 · 量表合集

讲智力测验· 第一讲

《那个叫智商的数字,是怎么诞生的?》

图片

【开场八句诗】

数海茫茫测智商,百年求索路漫长。

高尔顿开先河浪,比纳量尺度短长。

推孟算出商与数,韦氏立标定纲常。

一纸分数非天意,莫把数字作穹苍。

【大白话解读】

这八句说的是:人类琢磨量脑子这事,前前后后折腾了一百多年。高尔顿第一个动了念头,比纳做出了第一把尺子,推孟发明了智商这个词,韦克斯勒把它改成了更靠谱的标准。但您记住——一个分数定不了乾坤,量尺有长短,人心无边疆。今天这一讲,咱就把这把尺子的来龙去脉,从头到尾给您讲明白。

各位朋友好,我是王祖承领衔的李广智健康大讲堂。

今天咱们开启一个新合集,叫量表合集。什么叫量表?就是心理学家用来人的各种尺子。咱们这个合集专门讲智力测验——那个号称能测出你脑子好不好使的东西。

我先问各位一个问题:你测过智商吗?

有没有在学校做过那种智力筛查?或者在网上看到那种五分钟测出你的智商的小广告?测完之后给你一个数字——11095130——这个数字到底意味着什么?

有人说:我测了120,比普通人聪明!也有人说:完了,我只有90,是不是算笨?

您先别急着给自己贴标签。今天这一讲,我就把这个数字的来龙去脉,从头到尾给您讲一遍。这个故事跨越了三个国家、四代人,像一部跨世纪的电影。

一、从兰德公司的量表学到 ICD-11:智力测量为什么是件正经事

您可能要问了:测个智商,至于扯上兰德公司、扯上 ICD-11 吗?

还真至于。

兰德公司——就是那个给美国军方和政府部门做战略咨询的智库中的智库”——早在上世纪就系统研究过心理测量学的量表体系。他们得出的结论很明确:一个量表能不能用,不看它名字多好听,要看它的信度效度、标准化样本够不够大。这套标准,后来成了全世界的通用语言

再看医学界。《国际疾病分类》第11——也就是 ICD-11,世界卫生组织 2022 年正式生效的那个版本——里面对智力发育障碍有明确的分级标准,用的就是韦氏量表和斯坦福-比纳量表的分数体系。这不是心理学家关起门来自嗨,这是全球卫生系统的官方认证

《新英格兰医学杂志》上也多次刊文讨论智力测验在临床诊断、教育安置、司法评估中的核心作用。说白了——这东西不是娱乐八卦,是硬核工具。

所以今天咱讲的,不是网上五分钟测智商那种小把戏,是人类花了上百年打磨出来的一把正经尺子。

二、一切都从一个什么都想量的英国人开始

咱们先认识第一个人。他叫弗朗西斯·高尔顿。您可能没听过他的名字,但他的表哥您一定听过——查尔斯·达尔文,就是写《物种起源》那个达尔文。

高尔顿是个神童。两岁识字,五岁读荷马史诗,八岁懂拉丁文。放在今天,妥妥的别人家的孩子

长大以后,他受达尔文的影响,琢磨了一个问题:人的智力是不是遗传的?聪明人的孩子是不是大概率也聪明?

他用的研究方法很特别——什么都想量一量。高尔顿有一句名言——“凡是有可能测量的,都要把它量出来。

1884 年,伦敦国际健康展览会上,他做了一件特别有意思的事。他在展厅里租了一个只有 36×6 英尺的小展台,挂了个牌子叫人体测量实验室。里面摆着几台木头和金属做的仪器——有测量反应时的摆锤和按键,有测量视力的光度计,还有测量听力的管子。参观者只要花 便士,就能进去测 13 项指标:反应速度、视力和听力的灵敏度、色彩分辨能力、判断长度的能力、拉力、拧力、身高、体重、臂长、呼吸力量、肺活量……全测。

整个展会期间,居然有 9337 位参观者真的付了钱去测。想想那个画面——19 世纪的伦敦人,排队花 便士去测自己的反应速度,就为了知道自己聪不聪明

高尔顿的想法是:智力高的人,感官应该更敏锐、反应应该更快、脑袋应该更大。

结论是什么?——全错了。

这些生理指标跟智力压根没什么关系。你反应快不一定聪明,你头围大也不代表脑子好用。还有一个特别逗的细节——高尔顿自己就长着一个小于平均值的脑袋,可他自己明明那么聪明!这让他特别纠结。

但是,高尔顿做对了一件事,一件影响深远的事:他把测量智力这个念头,种进了人类的脑子里。在他之前,没人想过智力还能打分。在他之后,越来越多的人开始琢磨:既然身高能量、体重能量,那脑子为什么不能量?

高尔顿的路没走通,但他的执念传了下去。30 年后,法国有一个人接过了这个难题。

三、法国教育部的头疼事儿

1904 年,法国巴黎。教育部的一帮官员坐在会议室里,愁眉苦脸。

他们遇到一个麻烦:法国搞了全民义务教育,所有孩子都得进学校。这本来是好事,但问题来了——有一批孩子上课完全跟不上进度。老师讲三遍,别的孩子都明白了,这几个还瞪着大眼睛一脸茫然。

教育部的难题是:怎么从一堆孩子里,准确找出那些真正智力跟不上的?

为什么这事重要?因为如果是懒,老师多督促、多鼓励就行了。但如果是智力落后,那就不能跟普通孩子一块儿混着上——不然两边都耽误,老师也崩溃。

可问题在于:当时没有任何一把尺子可以量出孩子的智力水平。老师只能凭感觉说我觉得这孩子不行”——这哪行啊?

于是法国教育部找到了一个人。他叫阿尔弗雷德·比纳,一位心理学家。教育部跟他说:你帮我们设计一套工具,把那些真正需要特殊帮助的孩子筛出来。

比纳接了这个活儿。

四、比纳的智慧:简单,但管用

比纳这个人很有意思。他不是那种天才型的学者——他原来是学法律的,半路出家转心理学,属于跨界人士。但正是这种背景,让他做事特别务实。

比纳想:我不搞那些复杂的理论。我就设计一堆题目,从最简单到最难排好序,让孩子挨个做。做对多少题,就对应什么智力水平。

1905 年,比纳和助手西蒙发表了人类历史上第一个智力测验——“比纳-西蒙量表。这套量表一共 30 道题,从易到难排好。

题目长什么样?

最基础的:指认自己的身体部位——“鼻子在哪?耳朵在哪?

中等难度的:比较两条线的长短、重复一串数字——“我说 369,你跟着说一遍。

更高难度的:解释一个词的意思——“什么叫?什么叫公平

最高难度的:判断一句话有没有道理——“‘天黑了是因为太阳累了,这话对吗?

 3 岁孩子到十几岁少年,都能找到适合自己的题目。

1908 年,比纳和西蒙做了第一次修订。这次他们做了一个关键性的创造:把题目按年龄分组——3 岁组能通过哪些题、岁组能通过哪些题……一直到 15 岁。这样,一个孩子能做对哪个年龄组的题,他的智力水平就在哪个年龄段。这就是后来大名鼎鼎的智龄概念。

打个比方:一个 6 岁的孩子,如果他能做对 岁孩子才能通过的题目,那他的智龄就是 岁。这个办法特别直观,特别管用。

1911 年,比纳又做了第二次修订,增加了成人组。但就在这一年,比纳去世了。他留下了一句话,特别打动我。他说:

不管孩子们的起点多么低,只要方法得当、训练跟上,他们都能进步。

100 多年前,很多人相信智力天注定。比纳不这么看。他做测验,不是为了给孩子贴笨蛋标签,而是为了帮他们找到合适的路。

五、美国人接棒:推孟发明智商

比纳-西蒙量表传到了美国。

斯坦福大学有一位教授,叫路易斯·推孟。他对比纳的量表特别感兴趣,但觉得有些题目不适合美国孩子——毕竟法国人和美国人的文化不一样。

于是推孟做了一件大事:他对比纳的量表做了大手术——加题、扩年龄、重新标准化。1916 年,他推出了斯坦福-比纳量表。名字还挂着比纳,但本质上已经是美国货了。题量从原来的 30 项增加到 90 项,测试对象也从儿童扩展到了成人。

更重要的是,推孟发明了一个词——“智商

他提出了一个公式:智商 = 智龄 ÷ 实龄 × 100

岁孩子做对了 岁孩子的题,智龄就是 88÷6×100≈133——聪明。6÷6×100100——正常。

人类第一次有了一个数字来量化智力。这是巨大的进步。

推孟还是个天才研究狂”——他追踪了 1500 个智商 140 以上的天才儿童,跟了他们一辈子,想看看这些天才长大后会做出什么惊天动地的大事。结果您猜怎么着?这些人成年后大多数成了普通的专业人士——律师、医生、教授……但没有一个人拿诺贝尔奖。这个研究告诉我们:小时候测出来智商高,不代表这辈子就一定能封神

推孟自己也发现了比率智商的漏洞——对小孩子好使,对大人不灵。我给您举个例子:一个 岁孩子智龄测出来 岁,智商 133。可一个 30 岁的成年人呢?他的智龄是多少?成年人的智力增长到十六七岁就趋于平稳了,但实龄一直在涨啊!结果就是:人没变笨,数字自己往下掉。30 岁的人测出来可能 90 多,50 岁的人测出来可能 80——这不是闹笑话吗?

推孟没能彻底解决这个漏洞。真正补上它的,是另一个人。

六、离差智商:韦克斯勒的神来之笔

这个人叫大卫·韦克斯勒。他是罗马尼亚移民二代,在纽约长大,参加过一战时期的军队心理测评工作,给成千上万的士兵做过测试,经验非常丰富。

他的想法很简单但很聪明:不问你相当于几岁的水平,问你在同龄人里排什么位置

比如你 40 岁,做了测验得了某个原始分。韦克斯勒的做法是:先找一大群 40 岁的人来做同样的测验,算出这群人的平均分;再看你的分数比平均分高还是低、高多少低多少;最后换算成一个数字——这就是你的智商。

公式是:智商 = 你的分数 ÷ 同龄人平均分 × 100

30 岁的人跟 30 岁的人比,50 岁的人跟 50 岁的人比——再也不会出现越老越蠢的笑话了。

这就叫离差智商”——看你和平均分了多远。

韦克斯勒还把测验分成两大部分——语言和操作。不光考你动嘴(词汇、理解、算术),还考你动手(拼图、搭积木、排列图画)。这样就能更全面地反映一个人的智力水平。

后来他陆续推出了成人版、儿童版、学龄前版——韦氏家族量表,至今仍是全世界最常用的智力测验。ICD-11 里引用的智力分级标准,很大一部分就来自韦氏。

七、智商稳不稳?弗林效应又是什么?

故事讲到这里,您可能要问:这个智商数字,一辈子不变吗?

答案是:既稳又不稳。

先说稳的部分。遗传对智商有明显影响——血缘越近,智商越像。双胞胎哪怕分开养,智商也比普通人更像。环境也稳——一个家庭一直给孩子提供好的教育、营养、阅读氛围,那孩子的智商整体水平就高。

再说变的部分。发展心理学有一个经典数据:岁时的智商,跟 18 岁时的智商,相关性只有 0.35——不高。也就是说,一个 岁孩子测出来偏低,不代表他 18 岁还偏低。但 岁时的智商,跟 18 岁时的智商,相关性就达到了 0.9——非常高。也就是说,岁之后,智商基本就定型了。

所以有句话叫:“3 岁看不了老,岁之后基本能看了。

还有一个更奇怪的现象——弗林效应1980 年代,美国一位叫弗林的政治学家发现了一个怪事:每过 10 年,全人类的智商平均分涨 分。

也就是说,您爷爷奶奶那一辈人,如果把当年的原始分拿到今天的标准下来算,平均智商可能只有 85 左右。不是他们笨,是时代进步了——营养好了、教育普及了、信息丰富了,整个社会的认知能力在提升。所以韦氏量表过几年就得重新定标”——因为大家整体变聪明了,100 分的标准也得跟着上调。

八、分数怎么看?别急着给自己贴标签

最后,咱们来看看智商分数怎么分级。韦克斯勒的标准是这样的(见下表)。

您注意:90–109 这个区间占了整整一半人口。所以您测了 95 分,不是笨,就是正常——中等偏下一点点而已。

70 以下才叫智力缺陷,又分四级:

轻度(50–70),能接受小学教育,能学会简单技能;

中度(35–49),语言能力有限,需要监护;

重度(25–34),基本没有学习能力;极度(25 以下),完全依赖他人照顾。

这个分级的意义在于:不是所有智商低的人都一样,他们需要不同程度的支持。还是那句话——测验不是为了贴标签,是为了给对的支持。

智商分数

等级

人群中占比

130 及以上

极优秀

 2.2%

120–129

优秀

 6.7%

110–119

中上

 16.1%

90–109

中等

 50%

80–89

中下

 16.1%

70–79

边缘

 6.7%

70 以下

智力缺陷

 2.2%

【结尾八句诗】

百年量智路漫长,四代人接力谱华章。

高尔顿播下一粒种,比纳浇水花自香。

推孟算出商与数,韦氏定标更周详。

一纸分数非天意,莫把数字作穹苍。

尺子能量聪明浅,量不尽志气与热肠。

天生我材必有用,何须一纸定行藏。

若问智力是几种,且听下回说端详——

一个英国人、一个美国人、一个哈佛教授,吵了一辈子。

【大白话解读】

这八句诗说的是:人类量智力的这条路,走了上百年,四代人接力才走到今天。高尔顿动了念头,比纳做出了第一把尺子,推孟发明了智商这个词,韦克斯勒把它改得更靠谱。但您记住——分数高低只是个数字,天塌不下来。尺子能量出你聪明到什么程度,但量不出你的志气、你的韧劲、你对别人的善意。老话说天生我材必有用,一张纸上的分数,定不了你这一辈子。

至于智力到底是一种还是好几种——一个英国人、一个美国人和一个哈佛教授吵了大半辈子——咱们第二讲接着聊。

(第一讲完)

【版权声明】