王祖承领衔· 李广智健康大讲堂 · 量表合集
讲智力测验· 第一讲
《那个叫智商的数字,是怎么诞生的?》
【开场八句诗】
数海茫茫测智商,百年求索路漫长。
高尔顿开先河浪,比纳量尺度短长。
推孟算出商与数,韦氏立标定纲常。
一纸分数非天意,莫把数字作穹苍。
【大白话解读】
这八句说的是:人类琢磨“量脑子”这事,前前后后折腾了一百多年。高尔顿第一个动了念头,比纳做出了第一把尺子,推孟发明了“智商”这个词,韦克斯勒把它改成了更靠谱的标准。但您记住——一个分数定不了乾坤,量尺有长短,人心无边疆。今天这一讲,咱就把这把尺子的来龙去脉,从头到尾给您讲明白。
各位朋友好,我是王祖承领衔的李广智健康大讲堂。
今天咱们开启一个新合集,叫“量表合集”。什么叫量表?就是心理学家用来“量”人的各种尺子。咱们这个合集专门讲智力测验——那个号称能测出你脑子好不好使的东西。
我先问各位一个问题:你测过智商吗?
有没有在学校做过那种“智力筛查”?或者在网上看到那种“五分钟测出你的智商”的小广告?测完之后给你一个数字——110、95、130——这个数字到底意味着什么?
有人说:“我测了120,比普通人聪明!”也有人说:“完了,我只有90,是不是算笨?”
您先别急着给自己贴标签。今天这一讲,我就把这个数字的来龙去脉,从头到尾给您讲一遍。这个故事跨越了三个国家、四代人,像一部跨世纪的电影。
一、从兰德公司的量表学到 ICD-11:智力测量为什么是件“正经事”?
您可能要问了:测个智商,至于扯上兰德公司、扯上 ICD-11 吗?
还真至于。
兰德公司——就是那个给美国军方和政府部门做战略咨询的“智库中的智库”——早在上世纪就系统研究过心理测量学的量表体系。他们得出的结论很明确:一个量表能不能用,不看它名字多好听,要看它的信度、效度、标准化样本够不够大。这套标准,后来成了全世界的“通用语言”。
再看医学界。《国际疾病分类》第11版——也就是 ICD-11,世界卫生组织 2022 年正式生效的那个版本——里面对智力发育障碍有明确的分级标准,用的就是韦氏量表和斯坦福-比纳量表的分数体系。这不是心理学家关起门来自嗨,这是全球卫生系统的“官方认证”。
《新英格兰医学杂志》上也多次刊文讨论智力测验在临床诊断、教育安置、司法评估中的核心作用。说白了——这东西不是娱乐八卦,是硬核工具。
所以今天咱讲的,不是“网上五分钟测智商”那种小把戏,是人类花了上百年打磨出来的一把正经尺子。
二、一切都从一个“什么都想量”的英国人开始
咱们先认识第一个人。他叫弗朗西斯·高尔顿。您可能没听过他的名字,但他的表哥您一定听过——查尔斯·达尔文,就是写《物种起源》那个达尔文。
高尔顿是个神童。两岁识字,五岁读荷马史诗,八岁懂拉丁文。放在今天,妥妥的“别人家的孩子”。
长大以后,他受达尔文的影响,琢磨了一个问题:人的智力是不是遗传的?聪明人的孩子是不是大概率也聪明?
他用的研究方法很特别——什么都想量一量。高尔顿有一句名言——“凡是有可能测量的,都要把它量出来。”
1884 年,伦敦国际健康展览会上,他做了一件特别有意思的事。他在展厅里租了一个只有 36×6 英尺的小展台,挂了个牌子叫“人体测量实验室”。里面摆着几台木头和金属做的仪器——有测量反应时的摆锤和按键,有测量视力的光度计,还有测量听力的管子。参观者只要花 3 便士,就能进去测 13 项指标:反应速度、视力和听力的灵敏度、色彩分辨能力、判断长度的能力、拉力、拧力、身高、体重、臂长、呼吸力量、肺活量……全测。
整个展会期间,居然有 9337 位参观者真的付了钱去测。想想那个画面——19 世纪的伦敦人,排队花 3 便士去测自己的反应速度,就为了知道自己“聪不聪明”。
高尔顿的想法是:智力高的人,感官应该更敏锐、反应应该更快、脑袋应该更大。
结论是什么?——全错了。
这些生理指标跟智力压根没什么关系。你反应快不一定聪明,你头围大也不代表脑子好用。还有一个特别逗的细节——高尔顿自己就长着一个“小于平均值”的脑袋,可他自己明明那么聪明!这让他特别纠结。
但是,高尔顿做对了一件事,一件影响深远的事:他把“测量智力”这个念头,种进了人类的脑子里。在他之前,没人想过“智力还能打分”。在他之后,越来越多的人开始琢磨:既然身高能量、体重能量,那脑子为什么不能量?
高尔顿的路没走通,但他的执念传了下去。30 年后,法国有一个人接过了这个难题。
三、法国教育部的头疼事儿
1904 年,法国巴黎。教育部的一帮官员坐在会议室里,愁眉苦脸。
他们遇到一个麻烦:法国搞了全民义务教育,所有孩子都得进学校。这本来是好事,但问题来了——有一批孩子上课完全跟不上进度。老师讲三遍,别的孩子都明白了,这几个还瞪着大眼睛一脸茫然。
教育部的难题是:怎么从一堆孩子里,准确找出那些真正智力跟不上的?
为什么这事重要?因为如果是懒,老师多督促、多鼓励就行了。但如果是智力落后,那就不能跟普通孩子一块儿混着上——不然两边都耽误,老师也崩溃。
可问题在于:当时没有任何一把尺子可以量出孩子的智力水平。老师只能凭感觉说“我觉得这孩子不行”——这哪行啊?
于是法国教育部找到了一个人。他叫阿尔弗雷德·比纳,一位心理学家。教育部跟他说:“你帮我们设计一套工具,把那些真正需要特殊帮助的孩子筛出来。”
比纳接了这个活儿。
四、比纳的智慧:简单,但管用
比纳这个人很有意思。他不是那种“天才型”的学者——他原来是学法律的,半路出家转心理学,属于“跨界人士”。但正是这种背景,让他做事特别务实。
比纳想:我不搞那些复杂的理论。我就设计一堆题目,从最简单到最难排好序,让孩子挨个做。做对多少题,就对应什么智力水平。
1905 年,比纳和助手西蒙发表了人类历史上第一个智力测验——“比纳-西蒙量表”。这套量表一共 30 道题,从易到难排好。
题目长什么样?
最基础的:指认自己的身体部位——“鼻子在哪?耳朵在哪?”
中等难度的:比较两条线的长短、重复一串数字——“我说 3、6、9,你跟着说一遍。”
更高难度的:解释一个词的意思——“什么叫‘家’?什么叫‘公平’?”
最高难度的:判断一句话有没有道理——“‘天黑了是因为太阳累了’,这话对吗?”
从 3 岁孩子到十几岁少年,都能找到适合自己的题目。
1908 年,比纳和西蒙做了第一次修订。这次他们做了一个关键性的创造:把题目按“年龄”分组——3 岁组能通过哪些题、4 岁组能通过哪些题……一直到 15 岁。这样,一个孩子能做对哪个年龄组的题,他的“智力水平”就在哪个年龄段。这就是后来大名鼎鼎的“智龄”概念。
打个比方:一个 6 岁的孩子,如果他能做对 8 岁孩子才能通过的题目,那他的“智龄”就是 8 岁。这个办法特别直观,特别管用。
1911 年,比纳又做了第二次修订,增加了成人组。但就在这一年,比纳去世了。他留下了一句话,特别打动我。他说:
“不管孩子们的起点多么低,只要方法得当、训练跟上,他们都能进步。”
100 多年前,很多人相信“智力天注定”。比纳不这么看。他做测验,不是为了给孩子贴“笨蛋”标签,而是为了帮他们找到合适的路。
五、美国人“接棒”:推孟发明“智商”
比纳-西蒙量表传到了美国。
斯坦福大学有一位教授,叫路易斯·推孟。他对比纳的量表特别感兴趣,但觉得有些题目不适合美国孩子——毕竟法国人和美国人的文化不一样。
于是推孟做了一件大事:他对比纳的量表做了大手术——加题、扩年龄、重新标准化。1916 年,他推出了“斯坦福-比纳量表”。名字还挂着比纳,但本质上已经是美国货了。题量从原来的 30 项增加到 90 项,测试对象也从儿童扩展到了成人。
更重要的是,推孟发明了一个词——“智商”。
他提出了一个公式:智商 = 智龄 ÷ 实龄 × 100。
6 岁孩子做对了 8 岁孩子的题,智龄就是 8。8÷6×100≈133——聪明。6÷6×100=100——正常。
人类第一次有了一个数字来量化智力。这是巨大的进步。
推孟还是个“天才研究狂”——他追踪了 1500 个智商 140 以上的天才儿童,跟了他们一辈子,想看看这些“天才”长大后会做出什么惊天动地的大事。结果您猜怎么着?这些人成年后大多数成了普通的专业人士——律师、医生、教授……但没有一个人拿诺贝尔奖。这个研究告诉我们:小时候测出来智商高,不代表这辈子就一定能“封神”。
推孟自己也发现了比率智商的漏洞——对小孩子好使,对大人不灵。我给您举个例子:一个 6 岁孩子智龄测出来 8 岁,智商 133。可一个 30 岁的成年人呢?他的智龄是多少?成年人的智力增长到十六七岁就趋于平稳了,但实龄一直在涨啊!结果就是:人没变笨,数字自己往下掉。30 岁的人测出来可能 90 多,50 岁的人测出来可能 80——这不是闹笑话吗?
推孟没能彻底解决这个漏洞。真正补上它的,是另一个人。
六、离差智商:韦克斯勒的神来之笔
这个人叫大卫·韦克斯勒。他是罗马尼亚移民二代,在纽约长大,参加过一战时期的军队心理测评工作,给成千上万的士兵做过测试,经验非常丰富。
他的想法很简单但很聪明:不问你“相当于几岁的水平”,问你在同龄人里“排什么位置”。
比如你 40 岁,做了测验得了某个原始分。韦克斯勒的做法是:先找一大群 40 岁的人来做同样的测验,算出这群人的平均分;再看你的分数比平均分高还是低、高多少低多少;最后换算成一个数字——这就是你的智商。
公式是:智商 = 你的分数 ÷ 同龄人平均分 × 100。
30 岁的人跟 30 岁的人比,50 岁的人跟 50 岁的人比——再也不会出现“越老越蠢”的笑话了。
这就叫“离差智商”——看你和平均分“离”了多远。
韦克斯勒还把测验分成两大部分——语言和操作。不光考你动嘴(词汇、理解、算术),还考你动手(拼图、搭积木、排列图画)。这样就能更全面地反映一个人的智力水平。
后来他陆续推出了成人版、儿童版、学龄前版——韦氏家族量表,至今仍是全世界最常用的智力测验。ICD-11 里引用的智力分级标准,很大一部分就来自韦氏。
七、智商稳不稳?弗林效应又是什么?
故事讲到这里,您可能要问:这个智商数字,一辈子不变吗?
答案是:既稳又不稳。
先说稳的部分。遗传对智商有明显影响——血缘越近,智商越像。双胞胎哪怕分开养,智商也比普通人更像。环境也稳——一个家庭一直给孩子提供好的教育、营养、阅读氛围,那孩子的智商整体水平就高。
再说变的部分。发展心理学有一个经典数据:3 岁时的智商,跟 18 岁时的智商,相关性只有 0.35——不高。也就是说,一个 3 岁孩子测出来偏低,不代表他 18 岁还偏低。但 9 岁时的智商,跟 18 岁时的智商,相关性就达到了 0.9——非常高。也就是说,9 岁之后,智商基本就定型了。
所以有句话叫:“3 岁看不了老,9 岁之后基本能看了。”
还有一个更奇怪的现象——叫“弗林效应”。1980 年代,美国一位叫弗林的政治学家发现了一个怪事:每过 10 年,全人类的智商平均分涨 3 分。
也就是说,您爷爷奶奶那一辈人,如果把当年的原始分拿到今天的标准下来算,平均智商可能只有 85 左右。不是他们笨,是时代进步了——营养好了、教育普及了、信息丰富了,整个社会的认知能力在提升。所以韦氏量表过几年就得重新“定标”——因为大家整体变聪明了,100 分的标准也得跟着上调。
八、分数怎么看?别急着给自己贴标签
最后,咱们来看看智商分数怎么分级。韦克斯勒的标准是这样的(见下表)。
您注意:90–109 这个区间占了整整一半人口。所以您测了 95 分,不是笨,就是正常——中等偏下一点点而已。
70 以下才叫“智力缺陷”,又分四级:
轻度(50–70),能接受小学教育,能学会简单技能;
中度(35–49),语言能力有限,需要监护;
重度(25–34),基本没有学习能力;极度(25 以下),完全依赖他人照顾。
这个分级的意义在于:不是所有智商低的人都一样,他们需要不同程度的支持。还是那句话——测验不是为了贴标签,是为了给对的支持。
智商分数 | 等级 | 人群中占比 |
130 及以上 | 极优秀 | 约 2.2% |
120–129 | 优秀 | 约 6.7% |
110–119 | 中上 | 约 16.1% |
90–109 | 中等 | 约 50% |
80–89 | 中下 | 约 16.1% |
70–79 | 边缘 | 约 6.7% |
70 以下 | 智力缺陷 | 约 2.2% |
【结尾八句诗】
百年量智路漫长,四代人接力谱华章。
高尔顿播下一粒种,比纳浇水花自香。
推孟算出商与数,韦氏定标更周详。
一纸分数非天意,莫把数字作穹苍。
尺子能量聪明浅,量不尽志气与热肠。
天生我材必有用,何须一纸定行藏。
若问智力是几种,且听下回说端详——
一个英国人、一个美国人、一个哈佛教授,吵了一辈子。
【大白话解读】
这八句诗说的是:人类量智力的这条路,走了上百年,四代人接力才走到今天。高尔顿动了念头,比纳做出了第一把尺子,推孟发明了“智商”这个词,韦克斯勒把它改得更靠谱。但您记住——分数高低只是个数字,天塌不下来。尺子能量出你聪明到什么程度,但量不出你的志气、你的韧劲、你对别人的善意。老话说“天生我材必有用”,一张纸上的分数,定不了你这一辈子。
至于智力到底是一种还是好几种——一个英国人、一个美国人和一个哈佛教授吵了大半辈子——咱们第二讲接着聊。
(第一讲完)
【版权声明】