心理指南認知與注意力

IQ 分數分佈與百分位數:如何解讀平均數 100、標準差 15 量表上的分數

IQ 130 是第幾百分位?常態分佈曲線上平均數 100 和標準差 15 代表什麼,各分數區間的百分位數表,線上 IQ 測驗能告訴你和不能告訴你的事,弗林效應,以及 Soundary 綜合認知功能測驗如何計算分數。

Soundary · 6 分鐘閱讀 · 更新於

IQ 分數是一種標準分數,建立在平均數為 100、標準差為 15 的常態分佈上。這就是為什麼 100 分代表你同齡群體的中間值(第 50 百分位),115 分大約在前 16%,而 130 分大約在前 2%。本指南涵蓋了如何解讀該分佈、線上測驗能告訴你和不能告訴你的事,以及 Soundary 分數的意義。

為什麼 IQ 的平均數是 100、標準差是 15

原始分數(即你答對的題數)本身沒有任何意義。測驗會先對你同齡群體的代表性樣本(常模群體)進行施測,然後將你在該分佈中的位置轉換為常態曲線上的標準分數。現代測驗使用這種「離差 IQ」,而不是早期史丹佛-比奈智力量表將心理年齡除以生理年齡的比例,而魏氏智力量表則讓平均數 100、標準差 15 成為了慣例。

在常態曲線上,大約 68% 的人落在平均數的一個標準差內,大約 95% 的人落在兩個標準差內。以 IQ 來說,大約三分之二的人分數在 85 到 115 之間,而每 20 人中約有 19 人的分數在 70 到 130 之間。因此,130 分以上或 70 分以下的分數很罕見,各自約佔總人口的 2%。

各分數區間的百分位數

下表將魏氏類型測驗常用的描述性分類,與常態分佈下的近似百分位數配對。百分位數是指分數低於你的人數比例。這些數字不會與測驗手冊精確到小數點完全一致,因此請將它們視為粗略的參考。

IQ 區間常見分類近似百分位數
130 以上非常優秀約 98 以上(前 2%)
120 到 129優秀約 91 到 97
110 到 119中上約 75 到 90
90 到 109中等約 25 到 73
80 到 89中下約 9 到 23
70 到 79邊緣約 2 到 8
69 以下極低約 2 以下

有兩件事值得記住。第一,同樣是 15 分的差距,在曲線中間人群密集處會讓百分位數大幅變動,但在兩端則變動極小。第二,任何標準化測驗都有測量標準誤,因此你的真實能力是一個區間,而不是一個單一數值。即使是製作精良的完整測驗,其 95% 信賴區間大約也在正負 5 分左右,這意味著 112 分和 117 分在統計上很難區分。

線上 IQ 測驗能告訴你和不能告訴你的事

線上測驗最大的限制在於常模。平均數 100 只有在測驗於具代表性的樣本上進行標準化時才有意義,但在網路上主動尋找測驗的人,在年齡、教育程度和動機上往往存在偏差;題目是公開的;而且時間和環境都不受控制。因此,大多數線上 IQ 數據更接近你在該網站使用者中的位置,而不是你在整體人口中的 IQ。

這並不代表它毫無用處。像瑞文氏圖形推理這類題目很少依賴語言,在不同文化間的比較相對公平,且與流體智力高度相關。由這類題目組成的測驗,如果在相同條件下重複進行,非常適合用來觀察你較強和較弱領域的模式,以及你如何隨自身狀態而變化。然而,若是為了學校、工作或醫療保健上的決策,智力測驗必須由受過訓練的施測人員在標準化程序下進行個別施測。

弗林效應:常模會過時

在整個二十世紀,許多國家的智力測驗原始分數穩定上升,大約每十年增加 2 到 3 分。這就是弗林效應(Flynn, 1987;Trahan 等人, 2014)。營養、教育以及對抽象思考日益熟悉等都是被提出的原因,但目前沒有單一的定論。實際的影響是,過時的常模會使分數膨脹:如果用二十年前的常模來計分,同一個人的分數可能會比應得的分數高出幾分,這就是為什麼標準化測驗需要定期重新建立常模。

Soundary 綜合認知功能測驗如何編製與計分

在韓文版中,該測驗包含五個部分:語文推理(12 題,5 分鐘)、數理推理(12 題,7 分鐘)、3×3 圖形推理(10 題,7 分鐘)、數字順向與逆向背誦(工作記憶),以及 60 秒符號比對(處理速度)。其他語言版本則省略了語文部分,僅進行四個部分。綜合分數是 0 到 100 分量表上的加權平均值:在韓文版中,語文、數理和圖形各佔 25%,記憶和速度各佔 12.5%;在其他版本中,數理和圖形各佔三分之一,記憶和速度各佔六分之一。

結果畫面上的 IQ 換算分數是一個參考值,將這個綜合分數對應到平均數 100、標準差 15 的量表上。由於標準化樣本仍在收集當中,目前使用的是暫定常模,並設計為在測驗累積足夠的結果後,自動切換到真實的使用者分佈。請將其視為以熟悉的量表來表達你在本測驗中相對位置的估計值,而不是等同於魏氏等標準化測驗的 IQ 值。

為什麼同一個人會得到不同的分數

即使在標準化測驗中,重新測驗的分數也會有幾分的落差。測量誤差、你的狀態(睡眠、疲勞、焦慮)、因熟悉題型而產生的練習效應,以及時間壓力下不同的策略,全都混合在一起。線上測驗更增加了裝置和環境變數,因此波動更大。這就是為什麼在相似條件下進行多次測驗的平均值,連同你在各個領域的表現輪廓,會比將單一分數認定為你的 IQ 有用得多。

智力的相對排名在成年期相當穩定,但處理速度與工作記憶對你當天的狀態很敏感。如果你的綜合分數掉了幾分,合理的初步推測是速度或記憶部分出現波動,而不是你的智力退化了。將它與多元智能量表(一份包含 24 題、評估八種智力傾向的自陳量表)搭配使用,也能讓你比較測驗能力與個人偏好的差異。

簡而言之,IQ 是你在常模群體中的相對位置,以平均數 100、標準差 15 的量表來表示,其準確度完全取決於背後的常模與測驗條件。在了解其限制的前提下,線上測驗是檢視你的能力輪廓與趨勢的好工具;當需要決定性的判斷時,標準化的個別測驗才是解答。

常見問題

IQ 130 落在什麼百分等級?

在平均數 100、標準差 15 的量表上,130 高於平均數兩個標準差,在常態分配下大約是前 2%(約為第 98 百分等級)。不過,這個計算僅適用於在具代表性常模群體上標準化的測驗分數。

我可以完全相信線上 IQ 測驗的結果嗎?

不能當作你在一般母體中的 IQ:線上測驗並未在具代表性的樣本上建立常模,且測驗環境不受控制。最適合的用法是在相同條件下重複進行相同的測驗,以觀察你在各領域的能力輪廓與隨時間變化的趨勢。

Soundary 的 IQ 換算分數和魏氏 IQ(Wechsler IQ)一樣嗎?

不一樣。這是一個參考值,將 Soundary 的綜合分數對應到平均數 100、標準差 15 的量表上,目前是使用暫定常模進行換算。請勿將其視為等同於標準化測驗的 IQ。

我第二次測驗的分數提高了。是我變聰明了嗎?

大多數時候,這是因為熟悉題目格式而產生的練習效應,加上當天狀態的差異。要稱之為真正的改變,重複測驗的平均分數必須持續變動,即便如此,線上測驗也無法給出確定的答案。

相關測驗

參考文獻

  1. Wechsler, D. (2008). Wechsler Adult Intelligence Scale–Fourth Edition (WAIS-IV): Administration and scoring manual. Pearson.
  2. Flynn, J. R. (1987). Massive IQ gains in 14 nations: What IQ tests really measure. Psychological Bulletin, 101(2), 171–191.
  3. Trahan, L. H., Stuebing, K. K., Fletcher, J. M., & Hiscock, M. (2014). The Flynn effect: A meta-analysis. Psychological Bulletin, 140(5), 1332–1360.
  4. Raven, J. (2000). The Raven's Progressive Matrices: Change and stability over culture and time. Cognitive Psychology, 41(1), 1–48.
  5. Deary, I. J. (2012). Intelligence. Annual Review of Psychology, 63, 453–482.

本文為 Soundary 依據公開學術文獻與診斷標準撰寫的一般資訊,不構成對個人的醫學診斷或治療建議。若對症狀有顧慮,請諮詢精神科專業醫師。