平均智商分数是怎么回事

负责机构
MOSAIC-48
首次发布
最后审核
审核标准
依据已公开的方法和第一手文献审核事实、局限与分数说明。

简短的答案是100。不过这个数字比看上去有意思。智商量表在设计时就把平均定在100,标准差定在15。这是设计上的选择,不是自然界的事实。要想不夸大也不低估地读懂一个分数,包括你自己的那个,得先知道这把尺子是怎么造出来的。

下面依次讲清楚:100 ± 15的量表如何运作,各个分数区间意味着什么,百分位怎样与之对应,以及解读单次结果时容易踩的坑。

100 ± 15的量表如何运作

智商分数用的是正态分布,就是那条熟悉的钟形曲线,中心是平均100,标准差(SD)是15。任务上的原始表现要先过一道转换,让群体平均正好落在100,离散程度对应15的标准差。所以100永远是平均:它是被这样定义的,不是被发现的。

标准差是这把尺子的刻度单位。向上1个标准差是115,2个是130,3个是145;向下1个标准差是85,依此类推。曲线左右对称,性质也早已清楚,所以这些刻度可以直接换算成某个分数有多常见:

  • 约68%的人落在1个标准差以内,也就是85到115之间。
  • 约95%的人落在2个标准差以内,也就是70到130之间。
  • 只有约2%的人高于130,低于70的也只有约2%。

分数区间和它们对应的百分位

量表本身就是一种比较,所以每个分数都对应一个百分位,也就是参照群体里分数等于或低于它的人所占的比例。下面的区间为了好读做了取整,百分位请当近似值看:

  • 130及以上,很高的范围,大致是前2%(约第98百分位以上)。
  • 120到129,较高的范围,大致是第91到97百分位(约前3%到9%)。
  • 110到119,高于平均,大致是第75到90百分位。
  • 90到109,多数人所在的平均范围,大致是第25到73百分位。
  • 80到89,低于平均,大致是第9到23百分位。
  • 79及以下,偏低的范围,大致是后8%(第9百分位以下)。

为什么“平均”会被定期重设

既然100是定下来的平均,而不是发现来的,它就不绑定任何固定的原始表现水平。整个20世纪,认知任务上的原始分数一代代稳步上升,研究者称之为弗林效应,记录相当充分。要是放任不管,今天一个普通人拿旧的参照群体来比,看起来会远高于100。

为了让中心留在100,测试会定期对着新的代表性样本重新标准化。每一次重新制定常模,都把平均拉回100。所以一个分数的意思永远是“相对于近期的参照群体”,而不是“相对于某种绝对、超越时代的标准”。孤零零一个数字说明不了什么,这也是理由之一:它只有对照自己所依据的那套常模,才生出意义。

谨慎地读一个分数

留意中间那一段有多宽:从90到109,20分的跨度里装着将近一半的人。这提醒我们,100附近的分数在实际中几乎分不出高下。单个数字还藏着误差。任何分数都带着测量误差,同一个人两次作答可能相差几分;睡眠、压力、对题型的熟悉程度、动机,也都会把结果推开一点。

两个习惯能让解读保持诚实。第一,把分数当区间读,而不是当一个点:“一百出头”比“正好104”更接近真相。第二,记住几项能力的平均,在两个截然不同的人身上可能长得一模一样。同一个综合分可以藏着明显的强项和弱项,而这些只有领域画像才看得见。

试做几道示例题

上面这些区间背后是百分位的概念。两道短题,试一下。

第1题,共3题

在200人的群体里,约2%的人分数超过某个界限。大约是多少人?

关于MOSAIC-48的分数

MOSAIC-48把综合分放在熟悉的、以100为中心的范围附近,是为了让人一眼就读得懂。但外观像,不等于同一把尺子。上面的分数区间和百分位说的是标准化智商测试,它们换算不了MOSAIC-48的综合分:MOSAIC给出的数值,只是对着计分时假定的一套内部参照分布估出来的,并不是在那些区间所依据的100/15标准化常模上的位置。MOSAIC-48不是官方智商测试,也不采用标准化的临床常模。它给出的数值是供自我了解的内部参照估计,不是官方认证的分数,不能用于诊断、选拔或任何医疗决定。

MOSAIC-48想添的价值在形状,不在那一个数字。综合分旁边还有八个领域的画像。总分相同的两个人,因此仍能看出各自是沿着多么不同的路走到这个数值的。

常见问题

智商分数多少才算“好”?

按设计,100正好是平均,多数人落在85到115之间。与其盯着某条门槛,不如看看自己在各项能力上的强弱分布。

100分算差吗?

不是。100正好是量表的正中间。大约一半人在它下面,一半人在它上面,所以100不是弱的结果,而是“典型”这个词的定义本身。

我的分数会随时间变化吗?

当天的状态加上常见的测量误差,就足以让任何一次结果上下浮动几分。别把某个数字当成固定值,要看多次作答里稳定出现的模式。

平均智商随时间变过吗?

平均会随着测试重新标准化而回到100,所以按定义它始终是100。变的是原始表现:整个20世纪,一代比一代高,因此测试要定期对着新的参照群体重新制定常模。

看看你自己的认知剖面

MOSAIC-48是一项覆盖八个领域的完整在线复合认知测验。它不是官方IQ测验,也不套用标准化的临床常模。给出的是基于内部参照的估计值,供你自我了解,不是诊断。