简要回答

我们分析了 2026 年 4 月 15 日至 10 月 6 日期间,来自 134 个国家和地区的用户在 IQ-EXAMS.COM 上完成的 3834 次智商测试。有三个规律最明显:不到三分钟就做完 25 道题的人,平均分比用三到五分钟的人低约 17 分;空间推理是最容易答错的领域(答对率 58%,而记忆题为 77%);下午测试的平均分略高一些。本文所有数字均为汇总结果,不涉及任何个人成绩。

主要发现

  1. 太快会吃亏。不到 3 分钟就做完的人平均得分 99.6,用 3–5 分钟的人平均 117.1,相差 17.5 分。但时间拖得太久也没有帮助:用时超过 20 分钟的 43 人平均只有 109.5 分。
  2. 3 到 8 分钟最理想。将近一半的测试者(3834 人中的 1824 人,即 48%)在这个区间内完成,他们的得分也最高。用时的中位数是 7 分 58 秒。
  3. 空间推理最弱。在 3810 次测试中,空间题的答对率为 58.4%,逻辑推理 63.6%,语言能力 69.2%,图形规律识别 74.4%,记忆 76.9%。
  4. 下午略占优势。在来自单一时区国家的 2968 次测试中,当地时间下午 1 点到 4 点测试的人平均 116.4 分,清晨 5 点到 8 点则为 113.3 分。差距不大,但与昼夜节律和警觉度方面的研究结论一致。
  5. 周六成绩最好,但只好一点点。周六的平均分为 115.9,工作日都在 114.1 到 114.4 之间。
  6. 在线测试者并不是随机样本。平均分是 114.5,而不是 100。七分之一的人(13.3%)得分在 130 及以上,低于 85 分的只有 1.5%。主动到网上做智商测试的人,平均而言比一般人群对自己的能力更有信心。

一、答题速度:3 到 8 分钟最理想

IQ-EXAMS.COM 的标准测试共有 25 道题,采用累积计时:开始时有 45 秒,每答一题再增加 45 秒,没用完的时间会留到后面,时间全部用完时测试结束。在这个时间范围内,每个人按自己的节奏答题,因此可以看出答题时长与分数之间的关系。

不同答题时长的平均分 90 96 102 108 114 120 99.6 不到 3 分钟 n = 117 117.1 3–5 分钟 n = 361 115.4 5–8 分钟 n = 1463 114.1 8–12 分钟 n = 1306 114.8 12–20 分钟 n = 543 109.5 超过 20 分钟 n = 43 来源:IQ-EXAMS.COM,2026 年 4 月 15 日至 10 月 6 日的 3834 次完整标准智商测试
不同答题时长的平均分。分数采用平均分为 100、标准差为 15 的量表。

不到三分钟就做完的 117 人答对了 41% 的题。四个选项的题如果纯靠猜,正确率大约是 25%,所以他们并不是完全乱点,但显然也没有认真读题。他们 99.6 的平均分反映的更多是耐心,而不是智力。从三分钟开始,情况就完全不同了:3–5 分钟平均 117.1,5–8 分钟 115.4,8–12 分钟 114.1。

超过五分钟后分数缓慢下降,这一点值得多想一下。并不是想得越久成绩越差,更可能的解释是:觉得题目难的人自然用时更长,觉得容易的人做得更快。用时超过 20 分钟的 43 人(平均 109.5 分,答对率 54%)里,可能既有非常仔细的人,也有中途暂停去做别的事的人。

对准备做智商测试的人来说,实际建议是:每道题都要读完,但不必反复纠结。对于 25 道题的测试,大部分高分都落在三到十分钟之间。

二、空间推理是最难的领域

每次测试在五个领域各有五道题。比较各领域的答对率,可以看到一个清晰的排序:在研究期间的七个月中,有六个月空间推理都是得分最低的领域,而记忆在七个月里都是得分最高的。

各认知领域的答对率 40 48 56 64 72 80 58.4% 空间 推理 63.6% 逻辑 推理 69.2% 语言 能力 74.4% 图形 规律识别 76.9% 记忆 来源:IQ-EXAMS.COM,2026 年 4 月 15 日至 10 月 6 日的 3834 次完整标准智商测试
各领域的答对率,基于 3810 次带有完整分项结果的测试。

空间题的答对率为 58.4%。这些题目是用文字描述而不是用图画出来的,例如:把一块像披萨切片一样的扇形卷起来,让两条直边对齐,会得到什么立体图形;从正上方看一个正四面体是什么形状(只有 28% 的人答对);正方形有几条对称轴。

造成这种差距的原因可能有两个。第一,空间题和日常生活、学校学习中练习的内容最不相似,而语言和记忆能力每天都在被使用。第二,没有图的空间题要求人先仅凭文字在脑中把图形构建出来,然后才能开始推理。题库在 2026 年 8 月底更新过;更新后空间题的答对率从 55% 左右升到 65% 左右,但仍然处于或接近排名末尾。最容易和最难的领域之间相差 18 个百分点,这个差距大到不可能是偶然。

三、测试时间:下午略占优势

对于 2968 次测试,我们可以较有把握地把测试时间换算成测试者的当地时间(来自荷兰、西班牙、印度尼西亚、日本等单一时区国家)。按一天中的六个时段分组后,可以看到一个温和但明显的规律。

按当地时间划分的平均分 105 108 111 114 117 120 113.3 5–8 点 清晨 115.6 9–12 点 上午 116.4 13–16 点 下午 114.2 17–20 点 傍晚 114.9 21–23 点 晚上 115 0–4 点 深夜 来源:IQ-EXAMS.COM,2026 年 4 月 15 日至 10 月 6 日的 3834 次完整标准智商测试
按当地时间划分的平均分,基于 51 个单一时区国家的 2968 次测试。

清晨(5–8 点,146 次测试)平均 113.3 分,下午(13–16 点,692 次测试)平均 116.4 分,傍晚又回落到 114.2 分。三分的差距不大,大约是五分之一个标准差,而且清晨组是样本中最小的一组,所以不必据此安排作息。不过,这与睡眠研究者对一天中警觉度变化的发现相符:刚醒来时有一段低谷,午后早些时候达到高峰,之后到晚上慢慢下降。

工作日和周末之间的差别更小。周六的平均分最高(115.9),工作日彼此之间相差不到 0.3 分(114.1 到 114.4)。如果可以选择,周六下午是稍微好一点的时间段,周一早上 7 点则稍微差一点。

四、谁在网上做智商测试?

这 3834 次测试来自 134 个国家和地区,人数最多的是中国、美国、西班牙、印度尼西亚、荷兰、波兰和印度。平均分为 114.5,明显高于量表设定的 100。这并不说明网民特别聪明。原因有两方面。一是量表本身的构成:分数是按难度加权的答对题数,用固定公式换算出来的,并没有在有代表性的样本上建立常模,所以任何群体在这个量表上的平均分都不一定正好是 100。二是谁会选择来做测试:预期自己会考得好的人、在为门萨或求职测评做准备的人,以及本来就喜欢解谜的人。七分之一的测试者得分在 130 及以上;按教科书中的正态曲线(平均分 100、标准差 15),这个比例大约是四十四分之一。

这是理解本文所有数字时最重要的前提。这里没有任何数字是国家或人群统计,它只是描述了几千名主动选择做免费在线测试的人,请以这种方式来解读。

方法与局限

  • 样本:2026 年 4 月 15 日至 10 月 6 日期间,IQ-EXAMS.COM 上所有记录了完成时间的标准智商测试(3834 次)。网站的其他测评(WAIS 风格、斯坦福-比奈风格、Mensa 风格、CHC 和 MoCA 风格筛查,另有 3170 次完成记录)均未纳入,以确保所有分数都来自同样的 25 道题。
  • 计分:测试根据答对题数,给出平均分为 100、标准差为 15 的量表分数。分数由按难度加权的答对题数通过固定公式算出,没有在有代表性的样本上建立常模。这是一项在线自测,不是由专业人员施测的临床工具,其分数不能与专业施测的智商评估直接互换。
  • 领域:3810 次测试有完整的分项结果(每个领域五道题),其余 24 次是早期没有分项记录的测试。
  • 时段:当地时间根据访问者连接所在国家推算,仅限 51 个单一时区国家(适用时已考虑夏令时)。美国、巴西、俄罗斯、澳大利亚等多时区国家只在这一项分析中被排除。
  • 用时分组:记录用时不到 60 秒的测试被视为未完成,不纳入领域和时段分析,但计入用时图中“不到 3 分钟”一栏。
  • 隐私:所有数字均为汇总结果。我们没有查看、也不公布任何姓名、电子邮箱或个人分数。国家是唯一的地理字段,由于各国样本量小且为自选样本,我们不公布国家之间的分数排名。
  • 统计说明:标准差约为 15 时,组平均数的标准误约等于 15 除以组内人数的平方根:最大的几组约为 0.6 分,不到 3 分钟组约为 1.4 分。用时和领域上的差距比这大很多倍,时段上的差距约为其两到三倍。

引用本数据

欢迎媒体、教师和研究人员引用这些发现并转载图表,请注明来源并附上本页链接。如需汇总数据表、其他维度的分析(例如按语言或月份),或希望获得评论,请通过媒体页面联系我们。样本增加后我们会更新本研究,并在此注明变化。

延伸阅读:怎样的智商分数算好、智商测试是如何工作的,以及智商能不能提高。英文原文见这里。

看看你的位置

25 道题,约 20 分钟,立即得到结果和你自己的分项解读。

开始免费智商测试 →