智商测试(IQ测试)
题目数量:50题
测试说明:本量表进行测试以及查看结果完全免费,请认真答题再提交。量表中每道题以下都有6个选项,请选出其中最合理的选项,使题目合理、完整。
瑞文智力测试(60题)
瑞文智力测试(72题)
智商测试免费在线测试。智商测试又称IQ测试或智力测试,它主要基于心理统计学原理,对智力进行科学测量,通过IQ测试就可以对一个人的智力水平进行划分。智商不能代表一个人未来的成就大小,但是和生活中的考试一样,它却能对这群人的成绩高低进行划分,而成绩也不能代表一个人未来的成就大小,但是从统计学角度来看,成绩高的比成绩低的成功的概率更大。从统计学的角度去看待智商,可以具有一定参考价值。
数据对比 · 本量表 vs 瑞文60题
一、信度指标
| 指标 |
本量表 |
瑞文60题 |
| 题目数 |
50 |
60 |
| 测验包含的题目总数。题目越多,通常信度越高。 |
| 平均正确率 |
0.6363 |
0.8593 |
| 所有被试在所有题目上的平均答对比例。数值越高,说明测验整体越容易。 |
| 总分标准差 |
6.947 |
6.4552 |
| 反映被试总分的离散程度。数值越大,说明个体差异越明显。 |
| KR-20 / α |
0.8431 |
0.8802 |
| 内部一致性信度,衡量题目是否测量同一特质。一般 ≥0.80 为良好,≥0.90 为优秀。需要注意,在同样条件下,题目越多,该指标可能会越高。 |
| 分半相关系数 r |
0.7399 |
0.8169 |
| 奇偶两半卷得分的相关系数,反映两半测验的一致性。 |
| Spearman-Brown |
0.8505 |
0.8992 |
| 将分半相关系数校正为整卷信度的结果,与 KR-20 互为参照。 |
| SEM(原始分) |
2.7522 |
2.2339 |
| 测量标准误,估计真分数的误差范围。数值越小,测量越精确。 |
| SEM(IQ分) |
5.9425 |
5.191 |
| 换算到 IQ 分数(均值 100、标准差 15)后的测量误差。 |
| IQ 95%区间 |
±11.65 |
±10.17 |
| 真实 IQ 有 95% 概率落在此范围内。区间越窄,估计越可靠。 |
二、难度分布
| 等级 |
本量表 |
瑞文60题 |
| 极易(p ≥ 0.8) |
17 (34%) |
47 (78%) |
| 偏易(0.6 ≤ p < 0.8) |
12 (24%) |
8 (13%) |
| 中等(0.4 ≤ p < 0.6) |
10 (20%) |
2 (3%) |
| 偏难(0.2 ≤ p < 0.4) |
8 (16%) |
3 (5%) |
| 极难(p < 0.2) |
3 (6%) |
0 (0%) |
说明:p为正确率;以上数据表示不同正确率区间内题目数量。
三、各等级平均区分度
| 等级 |
本量表 |
瑞文60题 |
| 极易(p ≥ 0.8) |
0.3218 |
0.2975 |
| 偏易(0.6 ≤ p < 0.8) |
0.4216 |
0.4887 |
| 中等(0.4 ≤ p < 0.6) |
0.4157 |
0.5091 |
| 偏难(0.2 ≤ p < 0.4) |
0.2605 |
0.465 |
| 极难(p < 0.2) |
0.0376 |
— |
说明:p为正确率。极易题区分度普遍偏低,属正常现象,因高能力者几乎全对;极难题区分度低,未必是题目质量问题,猜测效应会大幅稀释区分度。
四、优缺点对比
| 项目 |
本量表 · 难题偏多 |
瑞文版 · 易题偏多 |
| 优点 |
- 难度跨度大,含极难题,可避免天花板效应
- 不同难度区间题目占比层次分明,区分层次丰富
- 适合资优鉴别与高阶选拔
|
- 信度相对更高(α=0.8802),测量误差相对更小(SEM=2.23)
- 完成体验好,适合普通人群大规模筛查
- 对中低能力者区分效果稳定
|
| 缺点 |
- 整体偏难(平均正确率 0.6363),易产生挫败感
- 极难题区分度低(0.0376),可能原因难度过高引发猜测效应。
|
- 极易题占 78%,存在明显天花板效应
- 对高能力者区分不足,难以鉴别资优个体
|
| 适用场景 |
高能力者精细区分、资优鉴别、高阶选拔 |
基础筛查、普通人群、大规模施测 |
|
总结:以上统计数据来自本平台长期、大量用户有效测评结果(通过系统筛选规则)。瑞文60题适合基础筛查与普通人群,本量表适合高能力者精细区分。两者可互补使用:先用瑞文60题快速筛查,再用本量表对高分者进一步鉴别。
|