レーヴンの漸進的行列:非言語的抽象推論のテスト方法
Dr. Daria Dudnik 9 min read 2 views

レーヴンの漸進的行列:非言語的抽象推論のテスト方法

レーヴンの漸進的行列は、言語や文化の偏りなく流動性知能を測るゴールドスタンダードである。その仕組み、測定するもの、そして世界で最も広く使われる非言語IQテストであり続ける理由を解説する。

レーヴンの漸進的行列とは何か?

1936年、スコットランドの心理学者ジョン・C・レーヴンは、世界で最も広く使用される非言語知能評価となるテストを発表した。レーヴンの漸進的行列(RPM)は、受検者に一つのピースが欠けた視覚的幾何学パターンを提示する。課題は単純:複数の選択肢のうち、どれがパターンを正しく完成するかを特定すること。

言葉はない。数字はない。文化的参照はない。あるのは抽象的な図形と論理的関係だけである。この意図的な設計により、RPMは心理測定学者が「文化公平」テストと呼ぶもの——言語、教育、文化的背景が推論能力の測定に与える影響を最小化するテスト——となっている。

三つのバージョン
レーヴンはテストの三つのバージョンを作成した:一般人口向けの標準漸進的行列(SPM)、子供と認知障害のある個人向けのカラー漸進的行列(CPM)、および高能力個人向けの上級漸進的行列(APM)。三つすべて同じ基盤となる論理を使用するが、難易度範囲が異なる。


テストの仕組み

レーヴンの行列の各項目は、3×3のグリッド(標準版)で構成され、右下のセルが空である。グリッドの下に6または8の回答選択肢がある。受検者はグリッドを支配するパターンを特定し、それを完成するピースを選択しなければならない。

パターンはランダムではない。少数の論理的原則から構築されている:

1. 連続パターン

図形が行や列に沿って漸進的に変化する。例えば、形が各セルで45度回転する、または線が徐々に長くなる。欠落したピースは進行を続ける。

2. 図形の加算と減算

行の二つの図形が組み合わさって三つ目を生成する。例えば、最初のセルに円、二つ目に正方形、三つ目に両方の形が重なって表示される。または、最初の二つのセルに存在する要素が三つ目で消える(減算)。

3. 図形の分配

各要素が行に一度、列に一度だけ出現する。行に三角形、正方形、円が含まれる場合、すべての行に三つの形すべてが含まれなければならず、行や列内で形が繰り返されてはならない。これは本質的に視覚的数独の論理である。

4. パターンの合成

複雑な項目は複数の原則を同時に組み合わせる。一つの項目が、回転パターン、分配パターン、加算パターンを同時に追跡することを要求するかもしれず、それぞれがグリッドの異なる軸に沿っている。

💡 なぜ「漸進的」か
テストが「漸進的」と呼ばれるのは、項目が進むにつれて難易度が上がるからである。初期の項目は明らかな続きを持つ単純なパターンを使用する。後の項目は複数の論理的原則を組み合わせ、複数のルールを作業記憶に同時に保持することを要求する。この漸進的構造により、テストは単一の道具で広範な能力レベルを測定できる。


レーヴンの行列が実際に測定するもの

レーヴンの行列は流動性知能(Gf)——新しい問題を解決し、パターンを特定し、抽象的に推論する能力——を測定するよう設計されている。具体的には、二つの中核的認知プロセスに関わる:

1. 帰納的能力

これは複雑な状況を理解し、混乱から意味を引き出す能力である。行列項目を見るとき、最初は曖昧に見える視覚データから基盤となるルールを抽出しなければならない。これは新しい状況に遭遇し、それがどう機能するかを理解しなければならない時に使うのと同じ精神プロセスである。

2. 再生的能力

RPMは主に帰納的能力を測定するが、ある程度の再生能力——対称性、回転、数値的進行などの学習した概念の想起と適用——も必要とする。ただし、これらの概念は普遍的であり、正規教育に依存しない。

💡 スピアマンとのつながり
レーヴンは自分の行列をスピアマンのg——一般知能因子——を測定するために設計した。数十年の研究がRPMスコアがgと高く相関すること(通常0.8以上)を確認しており、これが利用可能な最良の単一テスト一般知能測定の一つとなっている。だからRPMは完全なバッテリーが実用的でない時に全体のIQの迅速な推定としてよく使われる。


なぜレーヴンの行列が文化公平なのか

伝統的なIQテストは文化的偏りで批判されてきた。英語の語彙テストは明らかに非母語話者を不利にする。西洋の歴史の知識を要求するテストは異なる文化背景の人を不利にする。RPMはこれらの問題を完全に回避する:

  • 言語不要:テストは視覚的幾何学パターンのみを使用する。指示はジェスチャーで伝えられ、未就学児や任意の言語の話者にアクセス可能にする。
  • 教育内容不要:テストは算数、読書、特定のカリキュラムの知識を必要としない。正規教育を受けていない人が推論能力が同等なら、大学卒業者と同じようにパフォーマンスできる。
  • 文化的知識不要:パターンは抽象的——形、線、回転。いかなる特定の文化への親しみも必要としない。

⚠️ 完全に文化公平ではない
設計の意図にもかかわらず、完全に文化公平なテストはない。研究は、視覚パズルへの親しみ、テスト受験戦略、さらには抽象的幾何学形への快適さが文化間で異なり得ることを発見した。一部の集団はRPMでより良い成績を出すが、それは単により多くの類似パズル形式にさらされているからである。それでも、RPMは言語や知識ベースのテストよりはるかに文化公平であり続ける。


三つのバージョンの詳細

標準漸進的行列(SPM)

  • 対象人口:一般人口、8歳から65歳
  • 形式:60項目、5セット(A、B、C、D、E)、各12項目
  • 難易度範囲:易から中程度
  • 実施時間:40-60分
  • 使用例:一般知能スクリーニング、教育評価、研究

カラー漸進的行列(CPM)

  • 対象人口:5-11歳の子供、高齢者、認知障害のある個人
  • 形式:36項目、3セット(A、Ab、B)、関心を維持するためのカラー背景
  • 難易度範囲:易
  • 実施時間:15-30分
  • 使用例:臨床評価、発達評価、認知低下のスクリーニング

上級漸進的行列(APM)

  • 対象人口:高能力個人、大学生、専門家
  • 形式:48項目、2セット(セットI:12項目、セットII:36項目)
  • 難易度範囲:中程度から極めて困難
  • 実施時間:40-60分
  • 使用例:高知能の特定、ギフティッドプログラムの選抜、専門的スクリーニング

天井効果
APMは、SPMで全員が最大点に近いスコアを取る高能力個人を区別するために特別に設計されている。標準版で60点中55+点を取る場合、APMはあなたの真の能力が人口のトップ10%、トップ1%、トップ0.1%のどれにあるかを区別できる。これはギフティッドの特定と高 stakesの選抜に不可欠である。


採点と解釈

レーヴンの行列は単純に採点される:正解項目ごとに1点、部分点なし。生のスコアは年齢ベースのノルムを使用して百分位数とIQ換算に変換される。

スコアの意味

百分位数 IQ換算 解釈
トップ1% 135+ 極めて高い — 例外的な抽象推論
トップ5% 125-134 非常に高い — 優れたパターン認識
トップ10% 119-124 高い — 平均以上の推論能力
トップ25% 110-118 平均以上
トップ50% 90-109 平均 — 典型的な推論能力
下位25% 80-89 平均以下
下位5% <75 非常に低い — 認知障害を示す可能性

IQ換算の論争

RPMスコアをIQ換算に変換することは一般的だが論争がある。RPMは主に流動性知能を測定するが、ほとんどのIQテスト(WAISなど)は流動性と結晶性知能の組み合わせを測定する。RPMスコアが高いが語彙が低い人は、RPMスコアが示すよりも低い全IQを持つ可能性がある。変換は流動性推論能力の推定と見なすべきで、包括的なIQではない。

💡 年齢とRPMパフォーマンス
RPMパフォーマンスは古典的な流動性知能の曲線に従う:スコアは20代前半にピークに達し、徐々に低下する。70歳の人が自分の年齢グループの50百分位数でスコアする場合、平均的な70歳と同じくらいうまくパフォーマンスしている——しかし生のスコアは平均的な25歳より低くなる。だから年齢ベースのノルムは正確な解釈に不可欠である。


研究におけるレーヴンの行列

RPMは作成以来数千の研究で使用されてきた。最も重要な発見のいくつか:

フリン効果

おそらくRPMの最も有名な使用はフリン効果の文書化であった——20世紀を通じて平均IQスコアが10年ごとに約3ポイント増加したという観察。この増加の多くはRPMを使用して測定された。なぜならテストの非言語形式が教育と言語の変化を制御するからである。フリン効果はRPMのような流動性知能測定で最も強く、結晶性測定でより弱いようである。

異文化間比較

RPMは文化公平であるため、言語差の交絡なしに集団間の知能を比較するために使用されてきた。研究は数十カ国でRPMを実施し、利用可能な唯一の有効な異文化間知能データの一部を提供した。

認知老化研究

RPMは老化研究の標準ツールである。なぜなら流動性知能——老化の影響を最も受ける認知能力——をきれいに測定するからである。RPMを使用した縦断研究は、生涯にわたる流動性知能低下の軌跡をマッピングした。

フリン効果は逆転している可能性がある
最近の研究は、フリン効果が2000年代初頭以降、一部の先進国で減速、停止、または逆転さえしていることを示唆している。原因は議論されている——可能な説明には教育の質の変化、持続的注意を減少させるデジタルメディアの台頭、または統計的天井効果が含まれる。RPMデータはこの議論の中心にある。


実際の応用

臨床評価

RPMは臨床設定で以下に使用される:

  • 認知障害と認知症のスクリーニング
  • 知的障害の評価
  • 言語テストを受けられない個人の評価(非母語話者、失語症患者、聴覚障害者)
  • 縦断的モニタリングでの認知低下の追跡

教育評価

学校はRPMを以下に使用する:

  • ギフティッド児童の特定、特に言語テストで見落とされる可能性のある非英語背景の児童
  • 言語能力が低下しているが推論能力が無傷の学習障害の評価
  • 多様な学校人口における文化公平な評価の提供

採用選抜

多くの組織がRPM(または類似の行列テスト)を採用プロセスの一部として使用する。特に抽象的問題解決を必要とする役割で:

  • 複数国での将校選抜
  • 技術・エンジニアリング役割
  • 経営コンサルティングと分析職
  • ソフトウェア開発スクリーニング

⚠️ RPMの選抜への限界
RPMは抽象推論の優れた測定手段だが、職務パフォーマンスに関連するすべての能力を測定するわけではない。高いRPMスコアは強い流動性知能を示すが、誠実性、感情的知能、領域知識、社会的スキードについては何も言わない。RPMを唯一の選抜基準として使用する組織は、これら他の次元で優れる候補者を見逃す。


レーヴンの行列への準備方法

練習によって流動性知能を有意に増加させることはできないが、テスト形式への親しみは不安を減らし、パターンタイプをより速く認識するのを助けることでスコアを向上させることができる。

五つのパターンタイプを理解する

  1. 連続的変化:特徴が行に沿って安定して変化する(サイズ、回転、要素数)
  2. ペア加算:二つの図形が組み合わさって三つ目を形成する
  3. 値の分配:各値が行に一度、列に一度出現する
  4. 図形変換:図形が変換を受ける(回転、反射、反転)
  5. 複雑な合成:複数の原則が一つの項目に組み合わされる

練習戦略

  • 形式への親しみを構築するために練習項目を解く
  • 各項目がどのパターンタイプを表すかを特定する学習
  • 時間管理の練習 — 単一の困難な項目で立ち止まらない
  • 体系的アプローチの開発:行をスキャン、変化を特定、欠落要素を予測

💡 練習は向上と同じではない
RPM項目の練習はRPM項目でより良くするが、基盤となる流動性知能を増加させない。見える向上は、テスト親しみ、不安の軽減、より速いパターンタイプ認識の組み合わせである——すべて合法的なテスト受験スキル。しかし真の流動性推論能力が60百分位数にある場合、練習は65百分位数まで移すかもしれないが、90まではいかない。


レーヴンの行列 vs. 他のIQテスト

特徴 レーヴンの行列 WAIS-IV Stanford-Binet 5
主要測定 流動性知能(Gf) 全IQ(Gf + Gc + その他) 全IQ
形式 非言語、視覚パターン 言語 + 非言語 言語 + 非言語
文化公平 はい いいえ — 英語が必要 部分的
実施 自己実施または監督 訓練された試験官が必要 訓練された試験官が必要
時間 40-60分 60-90分 45-60分
コスト 低(紙またはデジタル) 高(認証が必要)
最適 文化公平スクリーニング、流動性IQ 包括的評価 臨床評価

💡 RPMを使う時 vs. 完全なIQテストを使う時
推論能力の迅速で文化公平な推定が必要な時——スクリーニング、研究、異文化間比較——にRPMを使う。言語能力、作業記憶、処理速度、結晶性知識を含む包括的認知プロファイルが必要な時に完全なIQテスト(WAIS、Stanford-Binet)を使う。RPMはメス;完全なバッテリーはMRI。


結論

💡 重要なポイント
- レーヴンの漸進的行列は非言語的抽象パターン完成を通じて流動性知能を測定する。

  • 文化公平な設計:言語、数字、文化的知識不要 — 背景に関係なく誰もがアクセス可能。
  • 三つのバージョン(標準、カラー、上級)が認知障害から極端なギフティッドまで全能力範囲をカバーする。
  • 一般知能(g因子)との高い相関により、利用可能な最良の単一テストIQ推定の一つ。
  • 研究(フリン効果、異文化間研究、老化研究)、臨床評価、教育、採用選抜で広く使用
  • 練習は形式の親しみに役立つが、基盤となる流動性知能を有意に増加させない。
  • 流動性推論のスクリーニングツールとして最適であり、包括的IQ評価の代替ではない。

あなたの抽象推論スキルがどれくらいか知りたいですか?NeuroLabで行列推論やその他の認知評価を含むプロフェッショナルなIQテストを受けてください。
今すぐテストを受ける →