暗黙的連想テスト(IAT )は、記憶内の対象(概念)の心的表象間の潜在意識的な連想を検出することを目的とした評価法です。[ 1 ]最もよく知られている応用例は、特定の人種カテゴリーとそれらのグループに関するステレオタイプとの関連など、被験者が抱く暗黙のステレオタイプの評価です。 [ 2 ]このテストは、人種グループ、性別、性的指向、年齢、宗教など、さまざまな信念の関連だけでなく、被験者の自尊心、政治的見解、予測にも適用されています。[ 3 ]暗黙的連想テストは、その妥当性、信頼性、および暗黙の偏見を評価する上での有用性に関して、学術界と一般社会で大きな議論の対象となっています。[ 1 ] [ 4 ] [ 5 ] [ 6 ] [ 7 ] [ 8 ] [ 9 ]
IATは1998年にアンソニー・グリーンウォルド、デビー・マクギー、ジョーダン・シュワルツによって科学文献に紹介されました。[ 2 ] IATは現在、社会心理学の研究で広く使用されており、臨床心理学、認知心理学、発達心理学の研究でもある程度使用されています。最近では、IATは参加者の無意識の偏見や差別的行動を減らすことを目的とした暗黙の偏見トレーニングの評価に使用されています。[ 8 ]
1995年、社会心理学研究者のアンソニー・グリーンウォルドとマザリン・バナジは、暗黙的記憶と明示的記憶の概念は社会的構成概念にも適用できると主張した。[ 10 ]意識にアクセスできない記憶が私たちの行動に影響を与える可能性があるならば、連想も私たちの態度や行動に影響を与える可能性がある。したがって、概念の連想における個人差を捉える尺度を開発する必要がある。これにより、意識の欠如や社会的望ましさバイアスのために明示的な自己報告法では測定できない態度を研究者が理解できるようになる。[ 1 ]本質的に、IATの目的は、大きな効果量を生み出す方法で個人差を確実に評価することであった。[ 11 ]最初のIAT論文は3年後の1998年に発表された。[ 12 ]
初版以来、IAT の画期的な論文は 4,000 回以上引用されており[ 13 ] 、過去 20 年間で最も影響力のある心理学的発展の 1 つです。[ 14 ]さらに、テストの限界に対処するために、IAT の手順にいくつかのバリエーションが導入されており[ 14 ]、肥満に対する偏見、自殺リスク、恋愛関係、性に関する態度、政治的嗜好などを調査するバージョンを含む、IAT の多数の応用も開発されています。[ 3 ]最後に、あらゆる心理学的測定ツールに共通する特徴として、IAT の信頼性と妥当性に関する議論と論争は、特にこれらの要因がテストのさまざまなバリエーション間で異なるため、導入以来続いています。[ 14 ]
コンピュータを用いた測定法であるIATでは、ユーザーは2つのターゲット概念を属性(例えば、「男性」と「女性」という概念に「論理的」という属性)とともに迅速に分類する必要があり、簡単な組み合わせ(反応が速い)は、難しい組み合わせ(反応が遅い)よりも記憶の中でより強く関連付けられていると解釈される。[ 2 ]
IATは、暗黙の態度を測定すると考えられています。「内省的に認識されていない(または不正確に認識されている)過去の経験の痕跡で、社会的対象に対する好意的または非好意的な感情、思考、または行動を媒介する」ものです。[ 15 ]研究では、IATは暗黙の認知(つまり、人が意識的に認識していない認知プロセス)を理解するための理論を開発するために使用されてきました。これらのプロセスには、記憶、知覚、態度、自尊心、およびステレオタイプが含まれる可能性があります。IATはユーザーに一連の迅速な判断を求めるため、研究者はIATスコアが、人々が公に明らかにしたがらない態度も反映している可能性があると考えています。[ 2 ] IATは、研究者が社会的望ましさバイアスの難しい問題を回避することを可能にするため、アフリカ系アメリカ人や同性愛者と自認する個人など、一般的に偏見の対象となるグループに対する人々の態度を評価するために広く使用されてきました。[ 16 ] [ 17 ]
典型的な IAT 手順は、7 つのタスクの連続で構成されています。[ 18 ]最初のタスクでは、被験者は刺激を 2 つのカテゴリに分類するように求められます。たとえば、コンピュータ画面が表示され、左上隅に「Black」という単語、右上隅に「White」という単語が表示されます。画面の中央には、通常「Black」または「White」のいずれかのカテゴリに関連付けられる単語(たとえば、名前)が表示されます。画面の中央に表示される各単語について、被験者は適切な左手または右手のキーを押して、その単語を適切なカテゴリに分類するように求められます。2 番目のタスクでは、被験者は何らかの属性を使用して同様の分類手順を完了します。たとえば、画面の左上隅に「Pleasant」という単語、右上隅に「Unpleasant」という単語が表示されます。画面の中央には、快い単語または不快な単語が表示されます。再び、被験者は適切なキーを押して、各単語を快いか不快かに分類するように求められます。 3 番目のタスクでは、被験者は最初の 2 つのタスクのカテゴリと属性の両方を含む複合タスクを完了するように求められます。この例では、「黒/快」という単語が左上隅に表示され、「白/不快」という単語が右上隅に表示される可能性があります。次に、被験者は画面の中央に名前または単語のいずれかで構成される一連の刺激を見ます。名前または単語が「黒/快」カテゴリに属する場合は左側のキーを、それが「白/不快」カテゴリに属する場合は右側のキーを押すように求められます。 4 番目のタスクは、名前、単語、または画像の繰り返しがさらに多い、3 番目のタスクの繰り返しです。
5 番目の課題は、最初の課題の繰り返しですが、2 つのターゲット ワードの位置が逆になります。たとえば、「Black」は画面の右上隅に、「White」は左上隅に表示されます。6 番目の課題は、3 番目の課題の繰り返しですが、研究対象と主題が以前の試行とは逆の組み合わせになります。この場合、「Black/Unpleasant」が右上隅に、「White/Pleasant」が左上隅に表示されます。7 番目の課題は、6 番目の課題の繰り返しですが、名前、単語、または画像の繰り返し回数が増えます。研究対象のカテゴリ (たとえば、Black または White) が提示された属性 (たとえば、Pleasant/Unpleasant) と異なる程度で関連付けられている場合、より強い関連性を反映する組み合わせ (または「互換性のある」組み合わせ) の方が参加者にとって容易であるはずです。[ 2 ]黒/白-快/不快の例では、参加者は、黒人に対して白人よりも肯定的な連想を持っている場合、黒人と快がペアになっている場合の方が、白人と快がペアになっている場合よりも早く分類することができます(白人と快がペアになっている場合の方が早く分類できる場合も同様です)。
IAT のバリエーションには、Go/No-go Association Test (GNAT) [ 19 ] 、 Brief-IAT [ 20 ]、Single-Category IAT [ 21 ]などがあります。IATと SC-IAT を使用して潜在的不安を測定する個別的アプローチでは、個別の刺激選択が結果、信頼性、外部基準との相関に影響を与えないことが示されました。[ 22 ]
Go/No-go 連想テスト (GNAT) は、IAT の変形であり、対象概念と属性の 2 つの異なる極端な関係を測定することによって、暗黙の態度や信念を評価します。[ 19 ]具体的には、関係の強さは、対象カテゴリと特定の属性 (黄色で良い、または黄色で悪い) に属する項目を、対象概念や属性に関連付けられていない周囲の妨害項目からどれだけ早く選択できるかによって評価されます。回答者は、これらのカテゴリのいずれかに属する刺激を識別したときにキーを押し、これらのカテゴリに属さない刺激を見たときはキーを押さないようにする必要があります。概念を特定の属性と正しく関連付ける能力の差は、自動的な態度の尺度として説明されます。反応潜時を測定する IAT とは異なり、GNAT は対象概念と特定の属性の間の特定の関係を識別する精度を測定します。
単一カテゴリーIAT(単一ターゲットIAT(ST-IAT)とも呼ばれる)は、元のIATで必要とされる2つのターゲットカテゴリーの代わりに1つのターゲットカテゴリーを使用するという点で独特です。[ 23 ] ST-IATでは、回答者は評価刺激の弁別ブロックを完了します。2番目のブロックは、1つの応答キーでターゲット概念と肯定的な項目を、もう1つの応答キーで否定的な項目を分類することから構成されます。最後のブロックでは、回答者は1つのキーでターゲット刺激と否定的な項目を一緒に、もう1つのキーで肯定的な項目を分類する必要があります。2つの概念と2つの属性間の潜時のコントラストを使用するIATと比較して、ST-IATは1つの概念と2つの属性に関連する潜時の差に焦点を当てています。[ 23 ]
価数IATは、概念と肯定的または否定的価数との関連性を測定します。これらは一般的に、あるカテゴリーを別のカテゴリーよりも好むこととして解釈されます。たとえば、人種IATでは、70%以上の人が黒人よりも白人を暗黙的に好むことが示されています。[ 24 ] [ 25 ]一方、黒人の半数だけが白人よりも黒人を好んでいます(初期の公民権運動時代に心理学者のケネスとメイミー・クラークによって開発された以前の「人形実験」を参照)。同様に、年齢IATでは、IATを受ける人の年齢に関係なく、ほとんどの人が年配者よりも若い人を暗黙的に好むことが一般的に示されています。体重IATは、医学生は一般の人々と比較して肥満の人に対する暗黙の偏見が低いが、明示的な偏見は増加していることを示していますが、一般の人々の明示的および暗黙の偏見は安定しています。[ 26 ]セクシュアリティIATを用いた研究では、異性愛者は異性愛者に対して暗黙の好みを持ち、異性愛者をより肯定的な属性と関連付けていることが示されています。[ 27 ]対照的に、両性愛者は同性愛者よりも異性愛者を好む傾向を示し、特に同性愛者に否定的な属性を帰属させた結果、このような傾向が見られました。特定の性的アイデンティティに肯定的または否定的な属性をより多く帰属させるというこれらの傾向は、同性愛者の回答者には見られません。[ 28 ]他の価値IATには、体重IAT、セクシュアリティIAT、アラブ・イスラム教徒IAT、肌の色IATなどがあります。
ステレオタイプIATは、特定の社会的ステレオタイプをどの程度強く持っているかを反映する概念間の関連性を測定します。たとえば、ジェンダー-科学IATでは、ほとんどの人が女性をリベラルアーツと強く結びつけ、男性を科学と強く結びつけていることが明らかになります。[ 25 ]同様に、ジェンダー-キャリアIATでは、ほとんどの人が女性を家族と強く結びつけ、男性をキャリアと強く結びつけていることがわかります。アジアIATでは、多くの人がアジア系アメリカ人を外国のランドマークと強く結びつけ、ヨーロッパ系アメリカ人をアメリカのランドマークと強く結びつけていることがわかります。その他のステレオタイプIATには、武器IATやネイティブIATなどがあります。
潜在的関連テスト(IAT)は、概念と評価またはステレオタイプとの関連性の強さを測定し、個人の隠れた、あるいは無意識の偏見を明らかにします。人は自分の属する集団に対して自動的に好みを抱きます。ステレオタイプに基づくIATのもう一つの例は、人種IATです。このテストでは、黒人の画像と「良い」または「悪い」、白人の画像と「良い」または「悪い」を、それぞれキーボードの様々なキーに関連付けるよう求められます。多くの場合、人々は「黒人」と「悪い」に対して、「白人」と「良い」よりも早く反応します。そのため、黒人に対する無意識の偏見がより強いことが明らかになっています。例えば、アレン・R・マコーネルとジル・M・レイボルドによる学術論文「潜在的関連テスト、差別的行動、および人種的態度の明示的測定間の関係」には、「予測どおり、IATで黒人(白人と比較して)に対するより強い否定的態度を示した人は、黒人(白人と比較して)の実験者との社会的相互作用がより否定的であり、明示的測定において相対的に多くの否定的な黒人に対する偏見を報告した。これらの結果がIATと集団間差別および態度の明示的測定との関係に及ぼす影響について議論する。」とある。[ 29 ]
自己肯定感IATは、「自分」と「他者」という言葉を肯定的および否定的な意味を持つ言葉と組み合わせることで、潜在的な自己肯定感を測定します。 [ 30 ]「自分」を否定的な言葉よりも肯定的な言葉と組み合わせやすい人は、潜在的な自己肯定感が高いとされています。一般的に、IATを含む潜在的な自己肯定感の測定法は、互いに強い相関関係がなく、明示的な自己肯定感の測定法とも強い相関関係はありません。[ 31 ]
簡易IAT(BIAT)は、標準IATと同様の手順を使用しますが、分類の回数が少なくなります。[ 20 ] 7つではなく約4〜6つのタスクで構成され、複合タスク(標準IATのタスク3、4、6、7に最も近い)のみを使用し、繰り返し回数が少なくなります。さらに、各タスクで焦点となる概念と、2つではなく1つの属性を指定する必要があります。たとえば、白、黒、快感、不快の刺激がすべて表示されますが、参加者は白と快感の単語が表示されたときに1つのキーを押し、「その他」が表示されたときに別のキーを押します。その後、参加者は黒と快感の単語が表示されたときに1つのキーを押し、「その他」が表示されたときに別のキーを押します。GNATとは異なり、簡易IATは要求された特定の概念と属性を正しく識別する精度を使用しません。代わりに、潜時を使用して結果を取得します。
児童IAT(Ch-IAT)[ 32 ]では、4歳という幼い子供でもIATを受けることができます。Ch-IATは、言葉や絵の代わりに音と絵を使用します。例えば、肯定的および否定的な感情価は、笑顔としかめっ面で示されます。分類する肯定的および否定的な言葉は、子供たちに声に出して読み上げられます。
Ch-IATを用いた研究では、6歳の白人の子供、10歳の白人の子供、および白人の成人は、人種IATにおいて同程度の潜在的態度を持っていることが明らかになった。[ 32 ]
グリーンウォルドによれば、IATは、無意識的(無意識的、自動的、暗黙的、衝動的、直感的など)な方法で機能する精神活動のレベルへの「窓」を提供する。なぜなら、能動的な思考なしに(自動的に)機能する連想は、IATの2つの「複合」タスクのうちの1つのパフォーマンスを助ける一方で、もう1つのタスクを妨げるからである。IATの回答者は、自動的な連想の影響を克服しようとするときに、より高い(意識的、制御された、明示的、反省的、分析的、合理的など)精神活動のレベルを経験する。IATが測定法として成功するのは、より高いレベルが低いレベルを完全に克服できないからである。[ 33 ]
IATが無意識の精神内容への「窓」を提供するという解釈は、ハーンらが異議を唱え、彼らの研究結果は、人々がさまざまな社会集団に対する自身のIATスコアを非常に正確に予測できることを示した。[ 34 ]
デ・ハウワーは、IATは応答適合性効果の測定であり、参加者はまず肯定的および否定的な単語や概念をキーボードの特定のキーを押すことと関連付けることを学習すると理論づけている。テストの後半で、参加者が否定的および肯定的な単語や概念を同じキーボードのキーに分類するように指示された場合、デ・ハウワーは、この変化によって生じる遅延や誤った応答の多くは、タスクの認知的複雑性の増加によるものであり、必ずしも暗黙のバイアスを反映したものではないと主張している。[ 14 ] [ 35 ]
Brendl、Markman、Messnerは、IATの重要な部分での反応を説明するためにランダムウォークモデルプロセスを提案しました。彼らは、テストの回答者が、いずれかのオプション(右または左のキー)の証拠が閾値に達するまで続く精神的な証拠収集プロセスに基づいて反応し、その時点で決定が下され、行動が取られると理論付けています。これには、概念と属性の両方を考慮する必要があり、これらは一致する場合も一致しない場合もあります。これらはすべて、決定の速度に影響を与える要因です。テストの適合ブロック中のすべての証拠は一致しており、迅速な意思決定を可能にします。しかし、不適合タスクにおける不一致の概念と属性は、処理時間を長くします。タスクの難易度が上がると、証拠の閾値基準も高くなり、決定の速度がさらに低下します。[ 14 ]
ミールケとクラウアーによる代替的または補完的な理論では、概念に基づく分類と属性に基づく分類の間を行き来するために必要な認知制御プロセスが、テストの重要なブロックでの速度低下につながるとされています。言い換えれば、概念の1つの側面だけに焦点を当てればよい互換性のあるブロックで概念を分類する方が、精神的に負担がはるかに少ないということです。それに比べて、概念と属性の両方に焦点を当てる必要がある非互換性のあるブロックで概念を分類するには、複雑さが増すだけでなく、前の概念が異なる認知的努力を必要とした可能性があるため、処理に時間がかかります。[ 14 ]
最後に、RothermundとWenturaはIATの説明として図地モデルを提案している。本質的に、この理論はIATの回答者が顕著性に頼ることでタスクを単純化することを示唆している。例えば、ほとんどの人にとって否定は顕著なので、回答者が否定語に対して右キーを押す場合、個人はすべての否定語(図)に対して右キーを押し、その他の(否定でない)語(地)に対して左キーを押すように計画する。これにより、適合タスクと2つの重要なタスクでは迅速な意思決定が可能になるが、2つの顕著なカテゴリで異なるキーを押す必要がある3つ目の重要なタスクではそうではない。[ 14 ]
IATの効果に関するこれらの説明すべてに経験的な裏付けがありますが、これらの理論は相互に排他的ではないため、これは必ずしもIATの全体的な妥当性に反する証拠ではありません。さらに、IATの基本的な認知プロセスに関係なく、研究によると、このテストの複数の実装は、対象となる構成概念を妥当に測定しており、各実装の心理測定値は、その個々の特性(測定される構成概念、参加者の特性、テスト環境など)に応じて変化します。[ 14 ] [ 36 ]
1958年、フリッツ・ハイダーはバランス理論を提唱した。この理論は、好き嫌いの関係のシステムが、システム内のすべての関係の価数の積が正であればバランスが取れていると述べた。この理論には、概念と関連付けがある。概念は人、グループ、または属性であり、属性概念には正と負の価数がある。関連付けは概念のペア間の関係であり、関連付けの強さは、外部刺激または他の既に活性化している概念との関連付けによる興奮によって、ある概念が別の概念を活性化する可能性である。この理論は、関連付けによる社会的知識の仮定に基づいている。社会的知識の重要な部分は、人概念(自己とグループを含む)と属性(価数を含む)の間の可変強度の関連付けのネットワークとして表現できる。[ 37 ]
リンクされていない、または弱くリンクされた2つのノードが同じ第3のノードにリンクされると、これら2つの間の関連性が強化されるはずです。これがバランス・コングルイティの原理です。バランス・コングルイティの原理におけるノードは、ハイダーのバランス理論における概念に相当し、関係する3つのノード/概念がシステムを構成します。ここでのシステム内のすべての関係は正の相関関係にあるため、ハイダーの理論の導出によれば、これはシステム内のすべての関連性の方向の積が正となるバランスのとれたシステムも表しています。[ 37 ]
2002年、グリーンウォルドとその同僚は、ハイダーのバランス理論の相関予測を検証する方法として、バランスアイデンティティデザインを導入した。バランスアイデンティティデザインは、ハイダーの理論、バランス一致原理、および自己中心性の仮定を取り入れている。自己中心性の仮定とは、連想知識構造において、自己の中心性は、構造内で高度に結びついた他の多くの概念と関連付けられることによって表されるというものである。典型的なバランスアイデンティティデザインの概念は、自己、社会集団/対象、および価属性または非価属性のいずれかである。したがって、典型的なバランスアイデンティティデザインでは、これら3つの概念カテゴリーを結びつける5つの重要な関連付けが可能である。態度は、社会集団/対象と価属性の関連付けである。ステレオタイプは、社会集団と1つ以上の非価属性の関連付けである。自尊心は、自己と価属性の関連付けである。自己概念は、自己と1つ以上の非価属性の関連付けである。そして最後に重要な関連性は、自己と社会集団/対象との間のものであり、これはアイデンティティと呼ばれます。しかし、典型的なバランスのとれたアイデンティティ設計では、可能な5つの関連性のうち3つだけが関与し、それらは通常、アイデンティティ、自己概念、ステレオタイプ、またはアイデンティティ、自尊心、態度のいずれかです。バランスのとれたアイデンティティ設計を使用する研究者は、調査したい概念のセットを決定し、研究者が作成したシステム内の各関連性は、暗黙的および明示的な尺度の両方を使用して統計的にテストおよび分析されます。[ 37 ]
バランスのとれたアイデンティティ設計の典型的な結果は、少なくとも暗黙的な尺度では、グループのアイデンティティがバランスがとれていることを示しています。ハイダーのバランス理論の導出によれば、典型的なバランスのとれたアイデンティティ設計には 3 つの概念があるため、3 つの関係すべてが肯定的である場合、または 1 つの肯定的関係と 2 つの否定的関係がトライアド システムに存在する場合に、アイデンティティはバランスがとれています。ここでは、「私 - 男性 - 数学が得意」というトライアド システムを例として使用し、暗黙的関連テスト (IAT) から得られた典型的な結果を以下に示します。男性被験者の場合、トライアド内の 3 つの関連は通常すべて肯定的です。女性被験者の場合、「私 - 男性」の関連は通常否定的、「男性 - 数学が得意」の関連は通常肯定的、「私 - 数学が得意」の関連は通常否定的です。示されているように、男性被験者と女性被験者の両方で、グループのアイデンティティはバランスがとれています。[ 37 ]
自己報告は、バランスのとれたアイデンティティ設計においてもよく用いられます。自己報告は必ずしもハイダーの理論で予測される一貫性パターンを反映するとは限りませんが、暗黙的関連テスト(IAT)の結果と比較するためによく用いられます。バランスのとれたアイデンティティ設計において、自己報告とIATの結果に同じ関連性に関する不一致が見られる場合、それは葛藤の経験を示している可能性があります。上記の「私―男性―数学が得意」という三項関係は良い例です。女性被験者の場合、暗黙的関連テスト(IAT)では「男性」と「数学が得意」の正の関連性がより強く示されるのに対し、明示的な自己報告では「男性」と「数学が得意」の正の関連性がより弱くなるか、あるいは負の関連性がより弱くなることが一般的です。また、同じ女性被験者の場合、IATでは「私」と「数学が得意」の負の関連性がより強く示されるのに対し、自己報告では「私」と「数学が得意」の負の関連性がより弱くなるか、あるいは正の関連性がより弱くなることが一般的です。この場合、女性グループが葛藤を経験していると考えられています。グループが葛藤を経験している一般的な説明は、社会に長年存在してきたステレオタイプな見方を変えようとする努力の中で、特定の社会集団に属する人々がそのステレオタイプを拒否できると信じていても(明示的な尺度で示されている)、そのステレオタイプな考えは依然として頭の片隅に残る(暗黙的な尺度で示されている)、おそらく実際にその考えを信じている人ほどではないにしても、というものです。ですから、時間が経つにつれてステレオタイプが徐々に薄れていくにつれて、その葛藤も薄れていくかもしれません。[ 37 ]
IATは、バランスのとれたアイデンティティ設計の測定法として広く用いられてきました。この方法で得られたデータから、ハイダーの理論から予測される一貫性パターンが、IATによる暗黙的測定のデータでは顕著に現れているものの、自己報告による並行的な明示的測定のデータではそうではないことが明らかになったためです。自己報告による明示的測定がハイダーの理論から予測される一貫性パターンを反映しない一般的な理由は、回答者が正確に報告したがらない、あるいは報告できない場合、自己報告による測定は誤った結果になる可能性があり、こうした問題は一貫性プロセスの働きを不明瞭にするのに十分なほど大きい可能性があるからです。しかし、この理論にはまだ限界があります。例えば、バランスのとれたアイデンティティのIAT測定は、個人の結果ではなくグループの結果しか得られないため、例えば、自分のアイデンティティが他者と比べてどの程度バランスが取れているかを分析するために、個々のピンポイントデータが必要な場合には限界があります。しかし、暗黙的関連テスト(IAT)に取り組む研究者たちは、上記のような課題を克服しようと懸命に努力していることが期待されます。[ 37 ]
IATは、科学文献[ 4 ]と一般社会(例えばウォール・ストリート・ジャーナル)の両方で論争を巻き起こしている[ 6 ] [ 7 ] 。例えば、親近感[ 38 ]、知覚的顕著性の非対称性[ 39 ] 、あるいはその知識に対する個人的な支持とは無関係な単なる文化的知識を評価するものとして解釈されてきた[ 40 ] [ 7 ]。より最近の批判では、一般の人々に提示される診断的記述を正当化する実証的研究が不足していると主張している[ 41 ]。例えば、フィードバックでは、誰かが[ヨーロッパ系アメリカ人/アフリカ系アメリカ人]に対して[最小限/やや/中程度/強い]自動的な好みを持っていると報告されるかもしれないが、批評家は、そのような結論がIATからどの程度導き出せるかに異議を唱えている。IATの支持者はこれらの非難に反論しているが、議論は続いている。[ 42 ]ニューヨーク・タイムズの記事によると、「同じ人がテストをもう一度受けても、スコアにそれほど一貫性はない」とのことです。 [ 5 ]さらに、研究者たちは最近、IATの結果は、参加者がカテゴリーの切り替えに適応する認知能力が不足しているために偏っている可能性があり、最初のカテゴリーの組み合わせ(例えば、「アジア人」を最初に肯定的な刺激と組み合わせるのではなく、「アジア人」を最初に否定的な刺激と組み合わせる)に有利な結果に偏っている可能性があると主張しています。[ 43 ]
1998年に科学文献に導入されて以来、 IATの心理測定特性を検証し、妥当性と信頼性に関するその他の批判に対処するために、多くの研究が行われてきました。 [ 42 ]
IATは関連性の相対的な強さを測定するとされている。しかし、一部の研究者は、IATは属性の顕著性[ 39 ]や文化的知識[ 40 ]などの構成概念を測定している可能性があると主張している。
2009年にグリーンウォルドが主導したメタ分析[ 36 ]では、IATは明示的尺度の予測妥当性とは独立した予測妥当性を持つと結論づけられた。フレデリック・L・オズワルドが主導した追跡メタ分析では、グリーンウォルドの研究は、実際に差別的行動を測定していない研究(高いIATスコアと特定の脳パターンとの関連性を見出した研究など)を含め、高いIATスコアが内集団メンバーよりも外集団メンバーに対するより良い行動と相関するという発表された結果を、暗黙の偏見を持つ個人が過剰補償している証拠として扱うことで、IATスコアと差別的行動との相関を過大評価していると批判された[ 44 ] 。オズワルドのチームは、暗黙的尺度は行動を弱く予測するだけであり、明示的尺度よりも優れているわけではないことを発見した。いくつかの研究では、IATは従来の「明示的な」自己報告法[ 36 ]よりも社会的に敏感な状況(差別や自殺行動など)における行動のより良い予測因子となる傾向があることがわかっています[ 45 ]。一方、明示的な測定法は、社会的に敏感でない状況(政治的嗜好など)における行動のより良い予測因子となる傾向があります。具体的には、IATは投票行動(未決定の有権者の最終的な候補者選択など)[ 46 ] 、メンタルヘルス(自傷行為IATは自傷行為をした青少年と自傷行為をしなかった青少年を区別しました)[ 47 ] 、医療結果(医師による医療勧告など)[ 48 ] 、雇用結果(イスラム系アラブ人とスウェーデン人の求職者との面接など)[ 49 ] 、教育結果(ジェンダー科学のステレオタイプは、各国の科学と数学のテストスコアにおけるジェンダー格差を予測します)[ 50 ]、環境保護主義(環境保護団体への加入など)を予測することが示されています。[ 51 ]
簡易死の暗黙的関連テストは、人が自分自身を自動的に生ではなく死と同一視する度合いを評価する短いコンピュータ化されたタスクであり、臨床サンプルでは、自己の死の同一視が高いほど自殺リスクが高まることが示されていますが[ 52 ] 、このテストが特定の個人に対して正確に何を測定しているのかについては議論の余地があります[ 53 ] 。
応用分野では、IATはマーケティングや産業心理学で使用されています。例えば、一般航空のパイロットのリスクテイク行動の予測因子を決定する際に、IATで測定された危険な飛行行動に対する態度は、従来の明示的な態度尺度や性格尺度よりも危険な飛行行動をより正確に予測することが示されています。[ 54 ]また、IATは臨床心理学の研究、特に不安や依存症の研究でも使用されています。[ 55 ]
研究者らは、IATは関連性ではなく概念の顕著性を測定している可能性があると主張してきた。IATの支持者は、概念をペアにしたときの反応時間が速いほど関連性が強いと主張する一方、批判者は、反応時間が速いほど概念の顕著性が似ている(反応時間が遅いほど概念の顕著性が異なる)と主張する。[ 39 ]この主張を裏付ける証拠もある。例えば、高齢者と若者のIATでは、高齢者の顔は若者の顔よりも顕著である。そのため、研究者らは、若者と高齢者の顔を中立的な単語(顕著でない属性)と非単語(顕著な属性)とペアにする高齢者と若者のIATを作成した。高齢者の顔(顕著)を非単語(顕著)とペアにしたときの反応時間は、高齢者の顔(顕著)を中立的な単語(顕著でない属性)とペアにしたときの反応時間よりも速く、顕著性を一致させることで反応時間を短縮できるという主張を裏付けている。
IATの支持者は、顕著性の非対称性によって影響を受ける可能性があることを認めているものの、それがIATを関連性の尺度として解釈することを妨げるものではないと主張している。[ 56 ]
IATに対するもう1つの批判は、それが実際に個人の中に存在する関連性ではなく、文化的知識から得られた関連性を測定している可能性があるという点である。[ 40 ]反論としては、そのような関連性は確かに文化から生じるかもしれないが、それでも行動に影響を与える可能性があるというものである。[ 57 ]
IAT が個人の信念ではなく文化的な知識を拾い上げてしまう可能性に対処するため、標準 IAT の批判者の中には、パーソナライズ IAT を作成した者もいる。[ 58 ]標準の価数 IAT とパーソナライズ IAT の主な違いは、カテゴリ ラベルとして快い言葉と不快な言葉を使用する代わりに、「好き」と「好きではない」をカテゴリ ラベルとして使用することである。さらに、パーソナライズ IAT は、標準 IAT のように間違った回答に対するエラー フィードバックを提供しない。この形式の IAT は、バイアスの明示的な自己報告尺度とより強く関連している。
標準IATの支持者は、パーソナライズIATでは、受験者が概念を分類するのではなく評価する可能性が高まると主張している。[ 59 ]これにより、文化知識の影響を必ずしも排除することなく、明示的な測定との関連性が高まることになる。実際、一部の研究者は、一般的なアメリカ人の態度に対する認識とパーソナライズIATスコアとの関係を調査し、IATと文化知識との関係はパーソナライズによって低下しないと結論付けている。しかし、文化知識と標準IATスコアの間にも関連性はなかった。
IATは社会的望ましさバイアスに対してもかなりの抵抗力があることが示されています。IATで回答を偽装するように求められた被験者は、いくつかの研究でそうすることが難しいことが示されています。たとえば、自分自身について肯定的な印象を与えるように求められた参加者は、不安の自己報告尺度ではそうすることができましたが、不安を測定するIATではできませんでした。[ 60 ]それにもかかわらず、偽装は可能であり、[ 61 ] [ 62 ] [ 63 ]研究によると、IATを偽装する最も効果的な方法は、比較的容易であるはずのペアリングの回答を意図的に遅くすることです。 [ 64 ] IATの偽装を推定するために開発されたアルゴリズムは、約75%の精度で偽装している者を特定できます。[ 65 ]しかし、より最近の研究では、参加者がさまざまな偽装戦略を使用していることが示されており[ 66 ]、偽装を検出しようとする際にはこの発見を考慮する必要があります。
最近の研究では、自伝的記述の真偽を検証することを目的とした自伝的暗黙的連想テストにおいて、比較的難しい応答ペアリングの際に参加者が応答速度を上げることができることが示されています。具体的には、テストを偽装するために応答速度を上げるよう指示された参加者は、実際にそうすることができました。参加者が応答速度を上げる訓練を受けた場合、その効果はより大きくなりました。最も重要なのは、難しい応答ペアリングの際に応答速度を上げた有罪の参加者が、テストをうまくクリアして無罪の結果を得ることができたことです。言い換えれば、参加者は検出されることなくテスト結果を覆すことができるのです。[ 67 ]
偽装(真の関連性を意図的に隠蔽すること)とは異なり、テストの性質に対する意識を高めることで、異なる流暢性や関連性を活性化させ、結果を変えることができることを示す研究もある。例えば、ある研究では、実験者からの簡単な注意喚起(「次の課題セクションではステレオタイプ化しないように注意してください」)だけで、人種IATにおける偏った関連性の表現を大幅に減らすことができた。[ 68 ]注目すべきは、この実験では全体的な反応時間に有意な減少が見られなかったことであり、この「制御」も暗黙のうちに行われている可能性があることを示している。
IATに対する一般的な批判は、あまり馴染みのない概念に肯定的な属性を関連付けるのが難しい可能性があるという点である。[ 38 ]例えば、ある人が特定の民族グループのメンバーとあまり接触していない場合、単に馴染みがないという理由だけで、その民族グループのメンバーを肯定的な言葉と関連付けるのが難しくなる可能性がある。アフリカ系アメリカ人と白人の名前、および人種IATに登場する顔に等しく馴染みがあることを保証した研究に基づくと、馴染みやすさに反する証拠もある。[ 69 ]
IATは概念と属性を組み合わせるさまざまなタスクにおける反応時間の比較に基づいているため、IATを実施する研究者やその他の人々は、最初の組み合わせタスクでの組み合わせが次の組み合わせタスクのパフォーマンスに影響を与える可能性があると推測しています。たとえば、女性の名前と家族に関する単語を組み合わせることから性別ステレオタイプIATを開始した参加者は、その後、女性の名前と職業に関する単語を組み合わせるタスクをより困難に感じるかもしれません。実際、研究では順序によるわずかな影響が示されています。そのため、5番目のIATタスクで必要とされる分類の数を増やすことが推奨されています。[ 1 ]これにより、参加者は2回目の組み合わせを行う前に練習する機会が増え、順序の影響が軽減されます。グループで研究を行う場合、異なる参加者に最初に組み合わせを与えることでこの影響を打ち消すことができます(たとえば、参加者の半数は最初に女性の名前と家族に関する単語を組み合わせ、残りの半数は最初に女性の名前と職業に関する単語を組み合わせます)。
IATは、平均IAT反応時間の個人差の影響を受け、全体的な反応時間が遅い人はIATスコアがより極端になる傾向があります。[ 70 ]高齢の被験者もIATスコアがより極端になる傾向があり、これは認知流暢性、つまり全体的な反応時間の遅さに関連している可能性があります。
IATの認知流暢性の影響を軽減する改良されたIAT採点アルゴリズムが導入された。[ 71 ]採点アルゴリズムの概要は、グリーンウォルドのウェブページで確認できる。[ 72 ]
IAT を繰り返し実施すると、特定の人に対する効果の大きさが低下する傾向があります。この問題は、スコアリング アルゴリズムの改善により多少軽減されます。[ 71 ] IAT の経験を制御するための追加の安全策は、比較対象として別のタイプの IAT を含めることです。これにより、研究者は、後続の IAT を実施したときの効果の大きさの低下の度合いを評価できます。
人種IATを受ける行為は、評価しようとしている否定的な潜在的態度を悪化させることもわかっています。[ 73 ]事前登録された4つの実験の結果は、人種IATを完了すると、2つの異なる潜在的測定法(単一カテゴリーIAT [ 74 ]と感情的誤帰属手続き[ 75 ] )で測定された白人参加者の黒人に対する否定的な自動的人種評価が増加するものの、自動的人種バイアスの別の測定法(射撃バイアス課題[ 76 ] )には一般化されないことを示しました。
IATは一貫性のない内的整合性を示し、再テスト信頼性は0.60と比較的低いレベルにとどまっている。[ 1 ] IATスコアは複数回の実施間でも変動するようで、特性(人々の安定した特徴)と状態(状況に応じた変動の対象となる)特性の組み合わせを測定している可能性があることを示している。後者の例としては、人種IATのスコアは、受験者が事前に肯定的な黒人の模範(例:マーティン・ルーサー・キング)を想像すると、アフリカ系アメリカ人に対するバイアスが少なくなることが知られている。[ 77 ]同様に、ある個人の人種IATスコアはバイアスを示す可能性があるが、人種混合グループと交流した後に実施される別のIATではそのバイアスが軽減される。[ 78 ]実際、人種IATスコアはさらに簡単に変更できる。異なる言語でIATを実施すると、バイリンガルの個人では著しく異なるスコアが得られる。例えば、フランス語とアラビア語の両方に堪能なモロッコ人参加者を対象に行われた研究では、参加者は母語でIATを完了すると偏りが見られるが、別の言語でIATを完了するとその偏りが軽減されることが示された。[ 79 ]同様の結果は、バイリンガルのヒスパニック系アメリカ人に英語とスペイン語のIATを実施した場合にも米国で見られた。[ 79 ] IATスコアに影響を与える可能性のあるもう1つの状態特性は、人がタスクを完了する時間帯であり、自分の人種グループへの好みは午前中に最も低く、日中から夕方にかけて増加するという発見がある。[ 80 ]ただし、これは概日リズムの機能というよりも、各時間帯に誰がタスクを完了するかに関係している可能性がある。[ 81 ]
IATを科学文献に確立した後、グリーンウォルドはマザリン・バナジ(ハーバード大学心理学教授)とブライアン・ノセック(バージニア大学心理学准教授)と共に、暗黙的認知の研究を促進する仮想実験室および教育普及組織であるプロジェクト・インプリシット[ 82 ]を共同設立した。
IATは主要メディア(例えばワシントン・ポスト)[ 83 ]や人気書籍『Blink』で取り上げられ、ネルソン・マンデラのような尊敬される黒人指導者をイメージすることで、暗黙の人種差別テストでより良いスコアを獲得できると示唆された。IATは2006年のオプラ・ウィンフリー・ショーのエピソードでも議論された。[ 84 ]
アニメ「キング・オブ・ザ・ヒル」のエピソード「人種差別主義者の犬」では、ハンクとペギーが、白人と黒人のどちらと付き合うことを好むかを調べるために、俗に「人種差別テスト」と呼ばれるIAT(内因性アレルギー検査)を受ける。
{{cite book}}: CS1メンテナンス: 場所の発行元が見つかりません (リンク){{cite journal}}: CS1 maint: 複数の名前: 著者リスト (リンク){{cite journal}}:ジャーナルを引用するには|journal=(ヘルプ)