SAT ( / ˌ ɛ s . ˌ eɪ . ˈ t iː /ⓘ、ess-ay- TEE)は、米国で大学入学に広く使用されている標準化テスト。1926年に登場して以来、その名称と採点方法Scholastic Aptitude Testと呼ばれVerbalとMathematical の2 つのコンポーネントがあり、それぞれが 200 から 800 の範囲で採点されていました。その後、Scholastic Assessment Test、次にSAT I: Reasoning Test、次にSAT Reasoning Test、そして単にSAT。
SATはカレッジボードが所有、開発、発行しており、教育テストサービスが運営しています。[ 6 ]このテストは、学生の大学進学準備度を評価することを目的としています。歴史的には、1937年頃から、SATの名称で提供されるテストには、オプションの科目別SAT科目テストも含まれており、1993年まではSAT達成度テストと呼ばれ、その後2005年まではSAT II:科目テストと呼ばれていました。これらは2021年6月以降廃止されました。[ 7 ] [ 8 ]元々は高校のカリキュラムに沿わないように設計されていましたが、[ 9 ] 2016年に導入されたSATのバージョンではいくつかの調整が行われました。カレッジボードの社長であるデビッド・コールマンは、新しい共通コア基準で高校で学生が学ぶ内容をより正確に反映させたいと付け加えました。[ 10 ]
多くの学生は、さまざまな企業や団体が提供する書籍、クラス、オンラインコース、個別指導を利用してSATの準備をしています。しかし、(高額な)準備コースは成績に大きな改善をもたらすことはなく、 [ 11 ]エリート高校も同様です。[ 12 ] [ 13 ]以前は、SATは紙で実施されていました。しかし、2023年3月から留学生は、2024年3月から米国内の学生は、Bluebookと呼ばれるコンピュータプログラムを使用してSATが実施されています。[ 14 ] [ 15 ]また、テストは適応型になり、テストの前半で出題された問題に対する学生の成績に基づいて、学生に提示される問題がカスタマイズされ、テスト時間は3時間から2時間14分に短縮されました。[ 1 ] [ 16 ]
SATについてはかなりの研究が行われてきましたが、多くの疑問や誤解が残っています。[ 17 ] [ 18 ]大学入学以外にも、SATは人間の知能全般、特に知的早熟性を研究する研究者[ 19 ] [ 20 ] [ 21 ]や、採用プロセスで一部の雇用主によっても使用されています。[ 22 ] [ 23 ] [ 24 ]
SATは通常、高校3年生と4年生が受験します。[ 25 ]カレッジボードは、SATは大学での学業成功に必要な読み書き能力、計算能力、作文能力を測定することを目的としていると述べています。SATは、受験者が学校で学んだ、大学で必要となる問題分析と解決能力を評価するものだと述べています。
カレッジボードは、SATと高校の成績平均点(GPA)を組み合わせることで、大学1年次のGPAで測定される高校の成績のみよりも、大学での成功のより良い指標になると主張している。SATの実施期間中に実施されたさまざまな研究では、SATを考慮に入れると、高校の成績と大学1年次の成績の相関が統計的に有意に増加することが示されている。 [ 26 ] SATの予測妥当性と予測力は、心理測定学の研究テーマである。[ 17 ]
SATは、受験者間で正規分布に従うスコアが得られるように設計された基準参照型テストです。この分布を実現するために、テスト作成者は、もっともらしいが誤った選択肢(「誤答選択肢」と呼ばれる)を含む難易度の高い多肢選択問題を含め、大多数の学生が正解する問題を除外し、試験中に厳しい時間制限を設けています。[ 27 ]
米国の連邦制、地方自治、私立学校、遠隔学校、ホームスクーリングの生徒の普及により、米国の中等学校間では資金、カリキュラム、成績評価、難易度に大きな違いがあります。SAT(およびACT)のスコアは、中等学校の記録を補完し、入学担当者がコースワーク、成績、クラス順位などの地域データを全国的な視点から捉えるのに役立つことを目的としています。[ 28 ]
歴史的に、SATは沿岸州の学生により広く利用され、ACTは中西部と南部の学生により広く利用されていましたが、近年では東海岸と西海岸の学生の間でACTを受験する人が増えています。[ 29 ] [ 30 ] 2007年以降、入学願書の一部としてテストを要求する米国のすべての4年制大学はSATまたはACTのいずれかを受け入れており、2022年秋の時点で、1400以上の4年制大学は入学に標準化されたテストのスコアをまったく要求していませんでしたが、コロナウイルスのパンデミックのため、この方針を一時的に適用する予定の大学もありました。[ 31 ] [ 32 ]
SATの受験者には、テストを完了するために2時間14分が与えられます(読解・作文セクションと数学セクションの間に10分間の休憩があります)[ 33 ] 。 2024年現在試験費用は 60 米ドルで、遅延登録、電話による登録、登録変更、結果の迅速な配信、4 つ以上の機関への結果の配信、試験後 9 日以上経過してからの結果の配信、および該当する場合は米国外で実施される試験には追加料金がかかります。また、米国およびその領土内の低所得の学生には料金免除が提供されます。[ 34 ] [ 35 ] [ 36 ] SAT のスコアは 400 から 1600 の範囲で、2 つの 200 から 800 ポイントのセクション (数学セクションと証拠に基づく読解および作文セクション) のテスト結果が組み合わされています。 SAT、またはその競合であるACTの受験は、米国の多くの大学への入学に必須ですが、[ 37 ] 2010年代後半には多くの教育機関がこれらの入学試験を任意としましたが、[ 38 ] [ 39 ] [ 40 ]学生とその親は、この文脈での「任意」の意味に懐疑的であったため、高得点を目指すことをやめませんでした。 [ 41 ] [ 42 ]実際、受験者数は着実に増加しており、[ 43 ]これは長期的にスコアの低下につながった可能性がありますが、[ 43 ] [ 44 ] [ 45 ]専門家は、これを米国全体の学力レベルを測るために使用することに警告を発しました。[ 45 ]
スコアは通常、試験後2〜4週間後に発表されます。SAT週末のスコアは通常2週間後に発表されますが、SAT学校日中のスコアは変動が大きくなります。[ 46 ]学生は試験後1週間以内であればスコアをキャンセルできる場合があります。[ 47 ]
現在デジタル形式で実施されているSATは、主にリーディングとライティング、そして数学の2つのセクションで構成されています。これらのセクションはそれぞれ、同じ長さの2つの「モジュール」にさらに細分化されています。(2021年の夏までは、受験者は追加のテストセクションの一部としてエッセイを書くことも任意で可能でした。エッセイは、一部の州と学区を除いて、2021年6月以降廃止されました。[ 48 ])SATの採点対象部分の合計時間は2時間14分です。[ 1 ]
各セクションのスコアは200から800の範囲で報告され、各セクションのスコアは10の倍数です。SATの合計スコアは、2つのセクションのスコアを合計して計算され、合計スコアは400から1600の範囲になります。2つのセクションのスコアに加えて、各セクションにはいくつかのサブセクションの「パフォーマンス」スコア(例:リーディングとライティングの「構成と構造」、数学の「代数」)も報告されます。SATでは推測によるペナルティや減点はありません。スコアは正解した問題数に基づいています。[ 49 ] [ 50 ]
SAT School Day 試験の一部として実施されるエッセイは、2 つのセクションのスコアとは別に採点されます。[ 51 ] [ 52 ] 2 人の採点者が、それぞれ 3 つのカテゴリ (読解、分析、作文) で 1 ~ 4 点を与えて、各エッセイを採点します。[ 53 ]これらの異なる採点者による 2 つのスコアが合算され、カテゴリごとに 2 ~ 8 点の合計スコアが与えられます。エッセイのスコアを 24 点満点で引用する人もいますが、カレッジ ボード自体は、異なるカテゴリを合算して 1 つのエッセイ スコアを与えるのではなく、各カテゴリごとにスコアを与えます。
任意提出のエッセイは、2021 年 6 月の試験で最後に全国的に採用されました。[ 7 ] [ 8 ]カレッジ ボードは、試験の読解と作文の部分を含め、「学生がエッセイの書き方を習得していることを示す他の方法がある」ため、エッセイのセクションを廃止したと述べています。[ 7 ] [ 8 ]また、 COVID-19 のパンデミックがこの変更に影響を与え、「すでに進行中のプロセス」を加速させたことも認めています。 [ 8 ]
読解・作文セクションは、それぞれ32分で27問からなる2つの同等のモジュールで構成されています。[ 6 ]モジュールは短い読解文または2つの文のペアで構成され、それぞれの後に1つの多肢選択問題が続きます。文の長さは25~150語です。読解・作文セクションの内容領域には、語彙、文の構造と用法、表とグラフの解釈が含まれます。[ 54 ]

SATの数学セクションは2つのモジュールに分かれており、それぞれ35分で22問出題されます。[ 1 ]出題範囲は、代数(13~15問)、高校上級数学(13~15問)、問題解決とデータ分析(5~7問)、幾何学と三角法(5~7問)です。[ 55 ]数学問題の約75 %は4択の多肢選択式で、残りの25%は学生作成応答(SPR)問題で、数値で解答を入力する必要があります。SPR問題には正解が複数ある場合があります。[ 56 ] SATの数学セクションのすべての問題で電卓の使用が許可されています。Desmosベースの電卓が利用可能で、テストソフトウェアに組み込まれています。さらに、学生は承認されたタイプの物理的な電卓を使用することもできます。[ 57 ]
SAT I: 推理テストの数学のスコアにおける電卓の使用に関する研究では、数学セクションの成績は電卓の使用頻度と関連していることがわかりました。約 3 分の 1 から 2 分の 1 の項目で電卓を使用した人は、それより頻繁にまたはあまり頻繁に電卓を使用した人よりも平均して高いスコアを獲得しました。しかし、その効果は「電卓の使用そのものというよりも、能力の高い生徒が能力の低い生徒とは異なる方法で電卓を使用した結果である可能性が高い」とのことです。[ 58 ]学校でテスト以外の状況で電卓を頻繁に使用すると、学校で電卓を使用しない人に比べてテストの成績にプラスの効果があるという証拠がいくつかあります。[ 59 ]
SATのほとんどの問題は、数学セクションの学生作成解答(SPR)を除いて、多肢選択式です。すべての多肢選択式問題には4つの選択肢があり、そのうち1つが正解です。数学セクションの約25%はSPRです。SPRでは、受験者は代わりに数値を入力する必要があります。[ 60 ]
SATの各セクションのすべての問題が均等に配点されているわけではなく、より難しい問題に正解すると、生徒はより高いスコアを獲得します。[ 61 ]カレッジボードは、将来のテスト問題をテストするために実験的な問題を使用します。実験的な問題に正解または不正解で答えても、テストのスコアには影響しません。実験的な問題は、将来のSATの新しいタイプの問題を評価するために使用されます。[ 62 ]
SATは現在、世界中で年間8回、8月、9月、10月、11月、12月、3月、5月、6月に実施されています。[ 3 ]当初、留学生向けには、SATは年間4回、10月、12月、3月、5月に実施されていました(2020年の例外:5月の世界的な中止に対応するため、9月に追加の試験が導入され、8月も海外の受験者に提供されました)。[ 64 ] 10月、11月、12月、5月、6月の試験は通常、その月の最初の土曜日に実施されます。[ 3 ] 2025年卒業生のうち、2,004,965人がこの試験を受けました。[ 4 ]
試験を受けたい受験者は、試験日の少なくとも3週間前までに、カレッジボードのウェブサイトからオンラインで登録するか、郵送で登録することができます。
学校でSATを受験する生徒向けに、SATスクールデイテストもあります。[ 65 ]これらは3月から4月と10月に実施されます。[ 66 ]
2024年現在、SATの受験料は68米ドルで、米国以外で受験する場合は追加料金がかかります。[ 34 ]カレッジボードは、低所得の学生向けに受験料免除制度を設けています。遅延登録、待機試験、登録変更、電話によるスコア通知、追加のスコアレポート(無料で提供される4通以外)には追加料金がかかります。
身体障害や学習障害など、証明可能な障害を持つ学生は、特別な配慮を受けてSATを受験することができます。学習障害や身体障害のために追加時間が必要な学生に対する標準的な時間延長は、規定時間+50%ですが、規定時間+100%の延長も可能です。
2022 年 1 月に、カレッジ ボードは SAT が紙ベースからデジタル (コンピュータベース) に変更されることを発表しました。[ 14 ]国際 (米国以外) のテスト センターは、2023 年 3 月 11 日にデジタル形式の使用を開始しました。2023 年 12 月の SAT は、紙で提供される最後の SAT テストでした。デジタル形式への切り替えは、米国では 2024 年 3 月 9 日に行われました。[ 67 ]デジタル SAT は、紙ベースのテストよりも約 1 時間短くなります (2 時間対 3 時間)。以前と同様に公式のテスト センターで実施されますが、生徒は自分のテスト デバイス (ポータブル コンピュータまたはタブレット) を使用します。ただし、学校によっては、キャンパスでデジタル SAT を受験する生徒に学校支給のデバイスの使用を要求する場合があります。生徒が自分のデバイスを持参できない場合は、カレッジ ボードにデバイスをリクエストできます。[ 68 ]テストの前に、カレッジ ボードの「Bluebook」アプリがテスト デバイスに正常にインストールされている必要があります。[ 69 ]
生徒はセクションごとに 2 つのモジュール (読解/作文と数学) に取り組みます。読解と作文のモジュールでは、各問題に短い文章が用意されています。数学のモジュールでは、文章問題がより簡潔になっています。生徒は最初の 2 つの英語モジュールの後と 2 つの数学モジュールの前に 10 分間の休憩があります。タイマーはテスト ソフトウェアに組み込まれており、生徒が 2 番目の英語モジュールを終了すると自動的に開始されます。デジタル SAT には、問題フラグ、タイマー、統合されたDesmos搭載のグラフ電卓などの新しいツールが含まれています。[ 70 ]
新しいテストは適応型で、第2モジュールは第1モジュールの結果に基づいて、生徒の習熟度に合わせて調整されます。具体的には、各セクションの第2モジュールの難易度は、第1モジュールでの生徒の成績によって決まります。第1モジュールで好成績を収めると、より難易度の高い第2モジュールに配置され、そこにはテストの中で最も難しい問題が含まれています。成績が低い場合は、より易しい第2モジュールに割り当てられます。難易度の高い読解モジュールには、非常に学術的で修辞的に複雑な短い文章が含まれることが多く、難易度の高い数学モジュールは、より抽象的で高度な概念や問題に焦点を当てています。
受験者は、試験実施後約 2 ~ 4 週間後にオンラインのスコア レポートを受け取ります (郵送の紙のスコアの場合はさらに時間がかかります)。[ 71 ]レポートには、合計スコア (2 つのセクション スコアの合計で、各セクションは 200 ~ 800 のスケールで採点されます) と、オプションのエッセイの 3 つのサブスコア (リーディング、ライティング、分析で、それぞれ 2 ~ 8 のスケールで採点されます) が含まれます。[ 72 ]受験者は、追加料金でスコア検証サービスを受けることもできます。テスト問題、受験者の解答、正解、各問題の種類と難易度を提供する質疑応答サービス[ 73 ]は、デジタル SAT では利用できません。[ 74 ]
さらに、生徒は2つのパーセンタイルスコアを受け取ります。それぞれは、カレッジボードによって、比較グループ内で同等またはそれ以下のテストスコアを持つ生徒の割合として定義されています。1つのパーセンタイルは「全国代表サンプルパーセンタイル」と呼ばれ、SATを受験したかどうかに関わらず、米国の11年生と12年生全員を比較グループとして使用します。このパーセンタイルは理論上のものであり、統計的推論の方法を使用して導出されます。2つ目のパーセンタイルは「SATユーザーパーセンタイル」と呼ばれ、最近SATを受験した米国の生徒の比較グループの実際のスコアを使用します。たとえば、2019~2020学年度のSATユーザーパーセンタイルは、高校在学中にSAT(具体的には2016年改訂版)を受験した2018年と2019年の卒業生のテストスコアに基づいています。生徒は、合計スコアとセクションスコアの両方について、両方のタイプのパーセンタイルを受け取ります。[ 72 ]
以下の表は、2005年3月から2016年1月にかけて実施されたSATのバージョンで使用された元のパーセンタイルをまとめたものです。これらのパーセンタイルは、2006年の卒業生を比較対象グループとして使用しました。[ 76 ] [ 77 ]
SATを受験した学生の平均言語スコアは461、全学生のサンプルでは383でした。[ 79 ]
1969~70年の数学の得点は、全体として報告されるのではなく、性別ごとに分けられて報告された。男子の平均数学得点は415、女子は378だった。全国的に抽出された数学の人口の差(表には示されていない)は、言語セクションの差と似ていた。[ 79 ]
1995年4月以前に実施されたSATのバージョンは、非常に高い上限がありました。例えば、1985年から1986年の学年度では、170万人の受験者のうち、1600点を獲得した生徒はわずか9人でした。[ 80 ]
2015年の卒業生の平均スコアは、満点2400点中1490点でした。これは前年の卒業生の平均スコアより7点低く、過去10年間で最低の総合スコアでした。[ 44 ]
カレッジボードとACT社は、2004年9月(ACTの場合)または2005年3月(SATの場合)から2006年6月までの間にSATとACTの両方を受験した学生を対象に共同調査を実施しました。2005年1月以降2016年3月以前にSATを受験した学生のスコアを一致させるための表が提供されました。[ 81 ] [ 82 ] 2016年5月、カレッジボードは、2005年3月から2016年1月まで使用されたSATのスコアを2016年3月以降に使用されたSATのスコアに一致させるための表、および2016年3月以降に使用されたSATのスコアをACTに一致させるための表を公開しました。[ 83 ]
2018年、カレッジボードはACTと提携し、あるテストと別のテストの成績をより適切に比較するための新しいコンコーダンス表を導入しました。[ 84 ]これは現在、大学関係者が使用する公式のコンコーダンスとみなされており、2016年のものに取って代わっています。新しいコンコーダンスには、旧SAT(2,400点満点)は含まれておらず、新SAT(1,600点満点)とACT(36点満点)のみが含まれています。
2018年現在、与えられたACTスコアに対応する最も適切なSATスコアポイントも以下の表に示されています。[ 85 ]
1946年にスタンレー・カプランが64時間のコースで先駆者となった[ 86 ] SAT対策は、非常に儲かる分野となった[ 87 ] 。多くの企業や団体が、書籍、クラス、オンラインコース、個別指導の形で試験対策を提供している[ 88 ] 。試験対策業界は、米国で大学入学試験が導入されたのとほぼ同時に始まり、当初から繁栄した[ 89 ] 。試験対策詐欺は、親や学生にとって深刻な問題である[ 90 ] 。一般的に、東アジア系アメリカ人、特に韓国系アメリカ人は、民間のSAT対策コースを受講する可能性が最も高く、アフリカ系アメリカ人は通常、補習学習のために個別指導に頼ることが多い[ 91 ]。
それにもかかわらず、カレッジボードはSATは基本的にコーチング不可能であると主張しており、カレッジボードと全米大学入学カウンセリング協会による調査では、個別指導コースによって数学セクションで平均約20点、言語セクションで平均10点のスコア上昇が見込まれると示唆している。[ 92 ]実際、研究者たちは、準備コースはテストスコアをせいぜいわずかに向上させるにとどまる傾向があることを繰り返し示してきた。[ 93 ] [ 94 ] [ 95 ] IQスコアと同様に、SATスコアは時間の経過とともに安定する傾向があるため、SAT準備コースは限られた利点しか提供しない。[ 11 ]初期のメタ分析(1983年)では同様の結果が得られ、「マッチングまたはランダム化研究から推定されたコーチング効果の大きさ(10点)は、実際的に重要となるには小さすぎるように思われる」と指摘した。[ 96 ]統計学者のベン・ドミンゲとデレク・C・ブリッグスは、2002年の教育縦断調査のデータを調べ、コーチングの効果は数学でのみ統計的に有意であることを発見しました。さらに、コーチングは、特に厳しいコースを受講した生徒や社会経済的地位の高い生徒など、特定の生徒に対して他の生徒よりも大きな効果がありました。[ 97 ] 2012年の体系的な文献レビューでは、数学と言語のテストでコーチングの効果はそれぞれ23ポイントと32ポイントと推定されました。[ 89 ] 2016年のメタ分析では、言語セクションと数学セクションで効果の大きさはそれぞれ0.09と0.16と推定されましたが、かなりの異質性がありました。[ 98 ]一方、2011年の研究では、1対1の個別指導の効果はすべての民族グループで最小限であることがわかりました。[ 91 ] SATの準備方法に関する一般の人々の誤解は、準備業界によって引き続き悪用されている。[ 17 ]
家庭環境とSAT対策講座の受講には関連性があるものの、すべての学生がそのような投資から等しく恩恵を受けるわけではない。実際、そのような講座によるSATスコアの平均上昇は、主に東アジア系アメリカ人の成績向上によるものである。[ 99 ]このグループをさらに細分化すると、韓国系アメリカ人は中国系アメリカ人よりもSAT対策講座を受講する可能性が高く、教会コミュニティや民族経済を最大限に活用している。[ 100 ]
カレッジボードは、低所得家庭の生徒の学習機会均等を支援するため、2015~16年度から無料の試験対策教材を提供する非営利団体カーンアカデミーとの提携を発表しました。 [ 101 ] [ 44 ]また、生徒はカレッジボードのより手頃な価格の公式ガイドとしっかりとした学習習慣を用いることで、高額な準備プログラムを回避することも可能です。[ 102 ]
カレッジボードは、予備SAT/全米優秀奨学生資格試験(PSAT/NMSQT)と呼ばれるテストも提供しており、PSATを少なくとも1回受験すると、SATでより良い成績を収めるのに役立つという証拠がいくつかあります。[ 103 ]さらに、SATの場合と同様に、PSATで高得点を取った人は奨学金を得ることができました。[ 42 ]認知科学者のシアン・ベイロックによると、SATの受験などの重要な機会に「チョーキング」、つまり標準以下のパフォーマンスになることは、手順記憶を向上させるために多くの練習問題と監督付き試験を行い、作業記憶の過負荷を避けるために中間手順を書き留めるために冊子を使用し、自己共感と肯定的な自己イメージを高めるために試験当日の不安について日記を書くことによって防ぐことができます。[ 104 ] 試験までの数日間の睡眠の質がパフォーマンスを向上させる可能性があるため、睡眠衛生は重要です。さらに、10代の若者の概日リズムの変化により適した遅い授業時間( 午前7時30分ではなく 午前8時30分)は、SATスコアを十分に向上させ、学生が入学できる大学のレベルを変えることができることが示されている。[ 105 ] [ 106 ]
COVID-19パンデミックの影響で、多くのアメリカの大学が入学希望者に対して標準テストのスコアを任意とすることを決定した。それにもかかわらず、多くの学生は依然としてSATを受験し、準備プログラムに登録することを選択し、それらは引き続き収益を上げていた。[ 107 ]
2009年、カリフォルニア大学(UC)システムの教育研究者リチャード・C・アトキンソンとソール・ガイザーは、高校の種類や質に関係なく、高校のGPAはSATよりも大学の成績を予測する上で優れていると主張した。[ 108 ] UCの学術評議会は2020年の報告書で、SATは1年次のGPAを予測する上で高校のGPAよりも優れており、学部GPA、1年次の在籍率、卒業を予測する上では高校のGPAと同程度に優れていることを発見した。この予測妥当性は人口統計学的グループ全体で維持されることがわかり、報告書では、標準化されたテストのスコアは実際には「少数派学生(URM)、第一世代の学生、または低所得の家庭の学生の成功をよりよく予測する」と指摘している。[ 109 ]カレッジボードの一連の報告書は、人口統計学的グループ全体で同様の予測妥当性を示している。[ 110 ] [ 111 ]
しかし、UC 学術評議会の報告書から 1 か月後、ソール・ガイザーは、UC 学術評議会の調査結果が学生の人口統計を省略しているため「偽り」であると否定した。高校の GPA を人口統計と組み合わせて予測すると、SAT の信頼性が低下すると指摘した。評価、基準、学生テストに関する国立研究センターを運営するUCLA教授のリー・カイは、UC 学術評議会は一般の人々が理解しやすいように異なるより単純なモデルを使用することで学生の人口統計を含めており、SAT の差別的影響は入学選考プロセスで補償されていると指摘した。UCバークレーの公共政策および経済学の教授であるジェシー・ロススタインは、リーの主張に反論し、UC 学術評議会は SAT の価値を誤解し過大評価していると主張した。ロススタインによれば、UC の入学選考方針はテスト スコアのグループ間の違いを「補償」していない。[ 112 ]
しかし、ブラウン大学、イェール大学、ダートマス大学は、自校のデータを分析した結果、SAT スコアは GPA よりも大学での成功をより確実に予測できるという結論に達しました。さらに、スコアによって、恵まれない境遇にある潜在的に優秀な学生を、そうでなければ見つけられなかったであろう学生をより多く特定することができました。[ 113 ]テキサス大学オースティン校では、SAT スコアの提出が任意であったにもかかわらず提出を拒否した学生は、提出した学生よりも成績が悪かった。[ 113 ]これらの結果は、非営利団体 Opportunity Insights がアイビーリーグの大学 (ブラウン大学、コロンビア大学、コーネル大学、ダートマス大学、ハーバード大学、プリンストン大学、ペンシルベニア大学、イェール大学) に加えて、スタンフォード大学、マサチューセッツ工科大学、シカゴ大学のデータを分析して実施した調査によって再現されました。[ 114 ] [ 113 ]
2009年の研究では、SATまたはACTのスコアと高校のGPAが、累積大学GPAの強力な予測因子であることがわかりました。特に、標準化テストのスコアが50パーセンタイル以上の人は、累積大学GPAが上位半分に入る確率が3分の2ありました。[ 115 ] [ 18 ]ミネソタ大学の研究者による2010年のメタ分析では、SATなどの標準化された入学試験が、1年目のGPAだけでなく、大学全体のGPAも予測するという証拠が示されました。[ 116 ] [ 11 ]同じ大学による2012年の研究では、複数の機関のデータセットを使用して、社会経済的地位と高校のGPAを調整した後でも、SATスコアは大学またはカレッジの学生の1年目のGPAを予測するのに依然として有効であることが明らかになりました。[ 117 ] 2019 年に約 25 万人の学生を対象とした研究では、SAT スコアと高校の GPA を組み合わせると、大学 1 年次の GPA と 2 年次の継続の優れた予測因子となることが示唆されました。[ 17 ] 2018 年に心理学者の Oren R. Shewach、Kyle D. McNeal、Nathan R. Kuncel、および Paul R. Sackett は、高校の GPA と SAT スコアの両方が、アドバンストプレイスメント単位を考慮に入れた後でも、大学の上級コースへの登録を予測することを示しました。[ 118 ] [ 17 ]
教育経済学者のジェシー・ロススタインは2005年に、高校の平均SATスコアは、個々のSATスコアよりも大学1年次のGPAを予測する上で優れていると指摘した。言い換えれば、生徒のSATスコアは、その生徒の高校の平均スコアほど将来の学業成績に関する情報を提供しない。対照的に、個々の高校のGPAは、平均高校GPAよりも大学での成功をよりよく予測する。[ 119 ] [ 120 ]さらに、平均SATスコアを考慮に入れなかった入学担当者は、スコアの低い学校の生徒の将来の成績を過大評価し、スコアの高い学校の生徒の将来の成績を過小評価するリスクがある。[ 120 ]
SATは知能と相関があり、個人差を推定するものの、「効果的な認知能力」や知能の高い人が何をするかについては何も語っていない。[ 17 ]また、肯定的な態度や誠実さなど、学業の成功に関連する非認知特性も測定していない。[ 17 ] [ 116 ]心理測定学者のトーマス・R・コイルとデビッド・R・ピローは2008年に、SATは、高い相関関係にある知能の一般因子(g)を除去した後でも、大学のGPAを予測できることを示した。[ 121 ]
ACTやGREなどの他の標準化テストと同様に、SATは、教育経験が大きく異なる学生の学力適性を評価する伝統的な方法であり、そのため、学生が学習過程を通して遭遇することが合理的に期待される共通の教材に焦点を当てています。そのため、数学セクションには、たとえば微積分前のレベルを超える教材は含まれていません。心理学者のレイモンド・キャッテルは、これを「現在の」結晶性知能ではなく「過去の」結晶性知能をテストしていると述べています。[ 122 ]心理学者のスコット・バリー・カウフマンはさらに、SATは特定の時点での個人のパフォーマンスのスナップショットしか測定できないと指摘しています。[ 123 ]教育心理学者のジョナサン・ワイ、デビッド・ルビンスキー、カミラ・ベンボウは、SATの予測妥当性を高める方法の1つは、現在のSATにはそのような質問が含まれていないため、学生の空間推論能力を評価することであると指摘しています。空間推論スキルは、STEMでの成功に重要です。[ 124 ]心理測定学者ロバート・スターンバーグが主導した2006年の研究では、SATスコアと高校のGPAによる大学での成績予測能力は、分析的思考、創造的思考、実践的思考の追加評価によってさらに向上させることができることがわかった。[ 125 ] [ 126 ]
心理学者のナンシー・エトコフは、容姿の良い生徒ほど高い点数を取る可能性が高いことから、SATのような標準化テストは公平性を確保するのに役立つ可能性があると指摘した。[ 127 ] : 28実験心理学者のメレディス・フレイは、教育研究と神経科学の進歩は将来の学業成績を予測する能力を段階的に向上させるのに役立つ可能性があるが、SATやその他の標準化テストは、おそらく今後も活用していくための貴重なツールであり続けるだろうと指摘した。[ 17 ] 2014年のニューヨーク・タイムズの論説で、心理学者のジョン・D・メイヤーは、SATの予測力を「驚くべき成果」と呼び、SATやその他の標準化テストを任意にすることに警告を発した。[ 128 ] [ 18 ]心理測定学者のデビッド・ルビンスキー、カミラ・ベンボウ、および同僚による研究では、SATは大学卒業後の人生の結果さえも予測できることが示されている。[ 18 ]
SATは、学生の精神力、記憶力、スピード、正確さ、抽象的かつ分析的な推論能力を厳密に評価します。[ 102 ]アメリカの大学では、標準化されたテストのスコアが、高校のGPAに次いで入学において最も重要な要素です。[ 126 ]しかし、国際基準からすると、SATはそれほど難しくありません。[ 129 ]例えば、韓国の大学進学適性試験(CSAT)とフィンランドの大学入学試験は、どちらもより長く、より難しく、大学入学の可否においてより大きな比重を占めます。[ 130 ]世界中の多くの国では、大学入学試験を含む試験が、入学の唯一の決定要因であり、学校の成績は全く関係ありません。[ 129 ]中国とインドでは、それぞれ高考(Gaokao)またはIIT-JEEで良い成績を収めると、学生とその家族の社会的地位が向上します。 [ 131 ]
2012年の記事で、教育心理学者のジョナサン・ワイは、SATは簡単すぎて、最も競争の激しい大学には役に立たないと主張した。これらの大学の志願者は通常、高校のGPAと標準テストのスコアが非常に優秀である。そのため、入学担当者は、学生の満点またはほぼ満点のスコアが本当に学力適性を反映しているかどうかわからないまま、上位のスコアを持つ学生を区別するという負担を負っていた。彼は、カレッジボードがSATをより難しくすることで、テストの測定上限が上がり、トップ校が志願者の中で最も優秀な学生を特定できるようになると提案した。[ 132 ]当時、カレッジボードはすでにSATをより難しくすることに取り組んでいた。[ 132 ]変更は2014年に発表され、2016年に実施された。[ 133 ]
2018 年 6 月のテストが例年より簡単だったことに気づいたカレッジ ボードは調整を行い、予想より低いスコアとなったため、学生から苦情が出たが、公平性を確保するためだと同意する学生もいた。[ 134 ]この事件の分析で、プリンストン レビューは成績のカーブの考え方を支持したが、このテストでは数学で 86 パーセンタイル (650 ポイント) 以上の学生を区別できないと指摘した。プリンストン レビューはまた、この特定のカーブは、優秀な学生の不注意や直前のミスに対する緩衝材がないという点で異例であると指摘した。[ 135 ]レビューは、同様の事件が発生し、カレッジ ボードが同じように対応した 2019 年 8 月の SAT についても同様のブログ記事を投稿し、「簡単なテストで 2 問間違えた学生は、難しいテストで 2 問間違えた学生と同じスコアを得るべきではない。等化によってその問題は解決される」と述べた。また、すぐにSATを再受験すると再び失望する可能性があるため、すぐに再受験しないよう学生に注意を促し、代わりに再挑戦する前に少し「余裕」を持つよう勧めた。[ 136 ]
カレッジボードは、2023~24年度の時点で、米国以外では約70か国でSATが大学入学の判断材料として使われていると主張している。[ 137 ]
2000年の研究で、心理測定学者のアン・M・ギャラガーとその同僚は、SATの数学セクションで遭遇する問題を解決する際に直観的推論を利用したのはトップクラスの学生だけであることを発見した。 [ 138 ]認知心理学者のブレンダ・ハノンとメアリー・マクノートン=カシルは、良好なワーキングメモリ、知識統合能力、および低いレベルのテスト不安がSATでの高得点を予測することを発見した。[ 139 ]
FreyとDetterman(2004)は、SATスコアと知能テストスコアの関連性を調査した。彼らは、Armed Services Vocational Aptitude Batteryに基づく一般知能(g)の推定値を用いて、1979年の全国確率調査から抽出したサンプルにおいて、SATスコアがgと高い相関関係にあることを発見した(彼らのサンプルではr=.82、非線形性を調整すると.857)。さらに、彼らは、SATの改訂版および再中心化されたテスト形式と、流動性知能(推論)のテストであるRaven's Advanced Progressive Matricesのスコアとの相関関係を、今回は非ランダムサンプルを用いて調査した。彼らは、SATの結果とRaven's Advanced Progressive Matricesのスコアとの相関関係が.483であることを発見し、サンプルの能力範囲の制限がなければ、この相関関係は約0.72であったと推定した。彼らはまた、レイヴンのスコアに天井効果があり、それが相関を抑制した可能性があることも指摘した。 [ 140 ]ボージャンらは(2006年)、フレイとデターマンと同様の結論に達した。[ 141 ] SATは一般知能と強い相関があるため、特に時間のかかる従来の評価方法が利用できない場合、知能を測定するための代理指標として使用できる。[ 17 ]
心理測定学者のリンダ・ゴットフレッドソンは、SATは知的に優れた大学進学希望者を特定するのに効果的であると指摘した。[ 142 ]
数十年にわたり、多くの批評家が、貧しい受験者と裕福な受験者のスコアの差を説明するために、言語SATの設計者に文化的な偏見があると非難してきた[ 143 ]。最も大きな批判はカリフォルニア大学システムから来ている[ 144 ] [ 145 ] 。SAT Iにおけるこの認識された偏見の有名な例は、現在試験に含まれていない漕ぎ手とレガッタの類推問題である。この問題の目的は、「ランナー」と「マラソン」の関係に最も似た関係を持つ用語のペアを見つけることだった。正解は「漕ぎ手」と「レガッタ」だった。正解の選択は、裕福な人々に人気のスポーツであるボート競技に対する学生の知識を前提としていると考えられた。 [ 146 ]しかし、心理測定学者にとって類推問題は学生の精神的能力を測るのに役立つツールである。なぜなら、2 つの単語の意味が不明瞭であっても、十分に強力な分析的思考スキルを持つ学生であれば、それらの関係性を特定できるはずだからである。[ 144 ]類推問題は 2005 年に廃止された。[ 147 ]その代わりに、学生が単語の関連する定義を知らない場合に、より多くの文脈情報を提供する問題が導入され、学生が正解を推測しやすくなっている。[ 148 ]
2015年、デューク大学の教育心理学者ジョナサン・ワイは、 1946年の陸軍一般分類テスト(10,000人)、1952年の徴兵大学資格テスト(38,420人)、1970年代初頭のプロジェクト・タレント(400,000人)、2002年から2005年の大学院入学共通試験(120万人以上)、2014年のSAT数学と言語(160万人)の平均テストスコアを分析した。ワイは、一貫したパターンを1つ特定した。テストスコアが最も高い人は物理科学と工学を専攻する傾向があり、最も低い人は教育と農業を選択する可能性が高い。(下の図を参照。)[ 149 ] [ 150 ]ボブ・アトルとその共同研究者も同様の結論に達した。[ 151 ]

ローラ・H・ガンとその同僚が2020年に発表した論文では、全米1,389の教育機関のデータを調査し、入学する学生の平均SATパーセンタイルとSTEMおよび社会科学を専攻する卒業生の割合との間に強い正の相関関係があることを明らかにした。一方、前者と心理学、神学、法執行、レクリエーション、フィットネスを専攻する卒業生の割合との間には負の相関関係があることも判明した。[ 152 ]
さまざまな研究者が、SAT または ACT の平均スコアとUS News & World Reportの大学ランキングには、ほぼ 0.9 という高い相関関係があることを明らかにしています。[ 17 ] [ 153 ] [ 95 ] [ b ] 1980 年代から 2010 年代にかけて、米国の人口は増加しましたが、大学やカレッジの収容能力はそれほど大きく拡大しませんでした。その結果、入学率は大幅に低下し、両親が卒業生であるような学校に入学することがより困難になりました。さらに、今日の高得点の学生は、名門校で高等教育を受けるために故郷を離れる可能性がはるかに高くなっています。したがって、SAT などの標準化テストは、入学率よりも選抜性のより信頼できる尺度です。しかし、マイケル・J・ペトリリとペドロ・エナモラードが、米国のトップ大学とリベラルアーツカレッジの1985年と2016年の新入生のSAT総合スコア(数学と言語)を分析したところ、サンプルの新入生の平均スコアは1216から1309へと93ポイント上昇したことがわかりました。特に、ノートルダム大学(1290から1440、つまり150ポイント)やイーロン大学(952から1192、つまり240ポイント)を含む14の教育機関で、少なくとも150ポイントの上昇が見られました。[ 154 ]
私立学校はACTやSATなどの標準テストでより良い成績を収める生徒を輩出する傾向があるという証拠があるように思われるが、ケビン・ダンカンとジョナサン・サンディは、全米青年縦断調査のデータを用いて、年齢、人種、性別(7%)、家族背景(45%)、学校の質(26%)などの生徒の特性やその他の要因を考慮に入れると、私立学校の優位性は78%減少することを示した。研究者らは、私立学校に通う生徒はすでに高得点に関連する特性を自ずと備えていると結論付けた。[ 155 ]


カリフォルニア大学システムが2001年に発表した研究では、1996年秋から1999年秋までの学部生のデータを分析し、SAT II [ c ]が大学での成功を予測する上で最も優れた指標であり、1年次のGPA に次いで高校のGPA、最後にSAT I の順であることがわかりました。家族の収入と親の教育を調整した後、SAT の適性や大学進学準備度を測定する能力はもともと低かったのですが、その能力は急激に低下し、高校のGPA とSAT II の適性や大学進学準備度を測定する能力はそれぞれ低下せず(わずかに向上さえしました)。カリフォルニア大学システムは、この研究の4年間、UCシステムへの出願者にSAT IとSAT IIの両方を要求していました。[ 156 ]この分析は広く報道されていますが、多くの研究で反論されています。[ 116 ]
SATは、4年制大学の課程を修了することを含む、社会および教育上の成果と相関関係にあるという証拠がある。 [ 123 ] [ 157 ]ミネソタ大学の心理学者による2012年の論文では、複数の機関のデータセットを分析した結果、SATは社会経済的地位(親の教育達成度と収入の組み合わせで測定)と高校のGPAを調整した後でも、大学での成績を予測する能力を維持していることが示唆された。つまり、SATスコアは単に社会経済的地位を測定するための代理指標ではないと研究者らは結論付けた。[ 117 ] [ 158 ]この発見は再現され、人種や民族グループ、男女両方に当てはまることが示されている。[ 17 ]さらに、ミネソタの研究者らは、調査した学校の学生の社会経済的地位の分布が、それぞれの志願者プールの分布を反映していることを発見した。[ 117 ]測定対象の性質上、SAT スコアは個人の社会経済的背景から切り離すことはできません。[ 123 ]しかし、SAT スコアと親の収入または社会経済的地位との相関関係は、因果関係を意味するものではありません。高得点者は、認知的に要求の高い仕事をしている知的な親を持ち、そのため高収入を得ている可能性があります。[ 159 ]さらに、相関関係は生物学的な家族間でのみ有意であり、養子縁組の家族間では有意ではないため、これは経済的富ではなく遺伝的遺産によるものである可能性を示唆しています。[ 160 ] [ 159 ]
2007年、レベッカ・ズウィックとジェニファー・グライフ・グリーンは、典型的な分析では、生徒が通う高校の多様性、つまり生徒の社会経済的地位だけでなく、成績評価の基準も考慮されていないことを指摘した。ズウィックとグライフ・グリーンは、これらを考慮に入れると、家族の社会経済的地位と教室の成績や順位との相関が高まり、社会経済的地位とSATスコアとの相関が低下することを示した。彼らは、学校の成績とSATスコアは家族の収入と似たような関係にあると結論付けた。[ 119 ]
カレッジボードによると、2019年の受験者のうち、56%は両親が大学の学位を持ち、27%は高校卒業以下の学歴で、約9%は高校を卒業していない。(8%は質問に回答しなかった。)[ 43 ]
SATなどで測定される教育達成度におけるアジア系アメリカ人学生とヨーロッパ系アメリカ人学生の格差に対する部分的な説明として提案されているものの一つは、アジア系の人々が安定した両親のいる家庭で育つ傾向があることである。[ 161 ]エコノミスト誌は2014年に、少なくとも片方の親が大学院の学位を持っている子供は、両親が高校を中退した子供よりも平均してSAT(2,400点満点)で400点高い点数を取ったと報告した。[ 162 ]経済学者のアダム・ブランディン、クリストファー・ヘリントン、アーロン・スティールマンは、労働統計局の全国縦断調査のデータを用いた2018年の分析で、家族構成が教育成果全般、特にSATの点数を決定する上で重要な役割を果たしていると結論付けた。学位を持たない片方の親のみの家族は1L、両親とも学位を持たない家族は2L、両親とも学位を少なくとも1つ持っている家族は2Hとされた。 2H家庭の子どもたちは1L家庭の子どもたちよりも大きなアドバンテージを持っており、この差は1990年から2010年の間に拡大した。2H家庭のSAT総合スコア(言語と数学)の中央値は20ポイント上昇したのに対し、1L家庭の中央値は1ポイント低下したため、両者の差は21ポイント、つまり標準偏差の5分の1に拡大した。[ 157 ]

2013年、アメリカ大学入学試験委員会は、男子がテストの数学セクションで女子を上回ったとする報告書を発表した。[ 163 ]この大きな差は35年以上も続いている。[ 164 ] 2015年時点で、男子はSATの数学セクションで女子より平均32ポイント多く獲得した。700~800点の範囲で得点した人の中では、男女比は1.6:1だった。[ 165 ] 2014年、心理学者のスティーブン・セシとその共同研究者は、パーセンタイル全体で男子が女子より優れていることを発見した。例えば、女子が同性の上位10%に入るスコアを獲得した場合、男子では上位20%にしか入らない。[ 166 ] [ 167 ] 2010年、心理学者のジョナサン・ワイとその同僚は、デューク大学の才能識別プログラム(TIP)に参加した160万人の知的に優れた7年生の30年間のデータを分析し、1980年代にはSATの数学セクションで上位0.01%のスコアを獲得した生徒の男女比が13.5:1で男子が優勢だったが、1990年代には3.8:1に低下したことを示した。[ 168 ] [ 167 ] 1980年代の劇的な男女比は、ジョンズ・ホプキンス大学のサンプルを使用した別の研究を再現している。[ 169 ]この比率は、1990年代初頭から2000年代後半にかけてのACTの数学と科学のスコアで観察されたものと似ている。[ 168 ] 2000年代末には、この比率はほとんど変化しなかった。[ 168 ] [ 170 ] [ 171 ] SAT数学のスコアにおける男女差は、400点以上のレベルで顕著になり始めた。[ 168 ] 2000年代後半には、SAT数学テストで満点の800点を獲得した女性1人に対して、男性は2人いた。[ 172 ] [ 170 ]
一部の研究者は、言語的および定量的推論能力において男性のばらつきが大きいことを裏付ける証拠を指摘している。 [ 173 ]男性は、体重、身長、認知能力において文化を超えてばらつきが大きいことがわかっており、その結果、テストの最低および最高分布に男性が多く含まれることになる。[ 174 ]その結果、SATなどの標準化テストの数学セクションの成績分布の上下両極端に男性が多く含まれており、観察される男女差が生じる。[ 175 ] [ 167 ] [ 176 ]逆説的ではあるが、これは女子が男子よりも教室での成績が高い傾向と矛盾しており、[ 167 ]女子に学業適性が欠けているわけではないことを証明している。しかし、男子はカリキュラムに直接関係のない標準化テストの問題でより良い成績を収める傾向がある。[ 173 ]
一方、Wai 氏らは、SAT の言語セクションに関しては、上位 5% の男女はほぼ同等であるものの、1980 年代半ばから女子が男子に対してわずかではあるが顕著な優位性を獲得していることを発見した。[ 169 ] SAT で非常に高いスコアを獲得した 7 年生の縦断的研究を行った心理学者 David Lubinski 氏も同様の結果を発見した。女子は一般的に言語推論能力が高く、男子は数学能力が高かった。[ 176 ]これは、95 パーセンタイル以上だけでなく一般人口の認知能力に関する他の研究を反映している。[ 169 ] [ 176 ]
ステレオタイプ脅威などのテストの側面は懸念されるものの、SATの予測妥当性に関する研究では、SATは男子GPAと比較して女子の大学GPAをより正確に予測する傾向があることが示されている。[ 177 ]

SATの数学の問題は、大きく分けて従来型と非従来型の2つのグループに分類できます。従来型の問題は、おなじみの公式やアルゴリズムを使って日常的に解くことができますが、非従来型の問題は、おなじみの解法を通常とは異なる方法で使用したり、問題を解決するために必要な特定の洞察を思いついたりするために、より創造的な思考を必要とします。2000年にETSの心理測定学者アン・M・ギャラガーとその同僚は、自己申告で公開されたSATの数学の問題に学生がどのように対処したかを分析しました。彼らは、男女ともに、最も好まれたアプローチは授業で学んだ公式やアルゴリズムを使用することであることがわかりました。しかし、それが失敗した場合、男性は女性よりも適切な解法を見つける可能性が高いことがわかりました。以前の研究では、男性は珍しい解法を探求する傾向が強く、女性は授業で学んだことに固執する傾向があり、適切なアプローチが教室の教材の習熟以外に何も必要としない場合は、女性の方が適切なアプローチを見つける可能性が高いことが示唆されていました。[ 138 ]
SATの旧バージョンでは、生徒に数学的適性と言語推論能力にどの程度自信があるか、具体的には自分が上位10%に入ると思うかどうかを尋ねていました。デビン・G・ポープは、1990年代後半から2000年代初頭にかけての400万人以上の受験者のデータを分析し、高得点者は自分が上位10%に入ると自信を持っている可能性が高く、最高得点者は最も高いレベルの自信を持っていると報告していることを発見しました。しかし、男女間にはいくつかの顕著な差がありました。男性は女性よりも数学的適性に自信を持つ傾向がありました。たとえば、数学セクションで700点を獲得した人のうち、男性の67%が自分が上位10%に入ると信じていると回答したのに対し、女性では56%しかそう答えませんでした。一方、女性は男性よりも言語推論能力にわずかに自信を持っていました。[ 178 ]
認知神経科学者のリチャード・ハイアーとカミラ・パーソン・ベンボウは、 SATを受験した学生のグルコース代謝率を調査するために陽電子放出断層撮影(PET )スキャンを使用しました。彼らは、男性では、SAT数学のスコアが高いほど、スコアが低い人よりも側頭葉のグルコース代謝率が高く、脳効率仮説に反することを発見しました。しかし、この傾向は女性では見られず、研究者たちは女性については数学的推論に関連する皮質領域を見つけることができませんでした。サンプルでは男女ともに平均スコアは同じで、皮質全体のグルコース代謝率も同じでした。ハイアーとベンボウによると、これは男女間の脳の構造的差異の証拠です。[ 179 ] [ 20 ]


2001年に行われた、認知能力または適性を検査された6,246,729人の参加者の結果のメタ分析では、黒人と白人の学生の平均スコアの差が約1.0標準偏差であることが判明し、SAT(240万人の受験者)でも同様の結果が得られました。[ 180 ]同様に、平均して、ヒスパニック系とアメリカ先住民の学生は、白人とアジア系の学生よりもSATで1標準偏差ほど低い成績を収めています。[ 181 ] [ 182 ] [ 183 ] [ 184 ]数学は試験の中で最も難しい部分であるようです。[ 43 ] 1996年には、数学セクションの黒人と白人の差は0.91標準偏差でしたが、2020年には0.79に減少しました。[ 185 ] 2013年には、アジア系アメリカ人のグループは、数学セクションで白人よりも0.38標準偏差高いスコアを獲得しました。[ 161 ]

一部の研究者は、スコアの差は、アメリカ社会における人種グループの学生間の全体的な学力格差と密接に関係していると考えている。この格差は、恵まれない人種グループの学生が教育の質の低い学校に通う傾向があるという事実によって部分的に説明できるかもしれない。この見解は、黒人と白人の格差が人種的に隔離された都市や地域でより大きいという証拠によって裏付けられている。[ 186 ]他の研究では、SATに関連する主要なコースワーク(英語と数学)におけるマイノリティの習熟度の低さ、および学業に集中しようとする学生に対する同調圧力(「白人のように振る舞う」)が指摘されている。[ 187 ]裕福な家庭で、優秀な親を持つ黒人学生の間でも文化的な問題が明らかになっている。ナイジェリア系アメリカ人の人類学教授であるジョン・オグブは、黒人の若者は親をロールモデルとして見る代わりに、ラッパーなどの他のモデルを選び、良い学生になろうと努力しなかったと結論付けた。[ 188 ]
ある研究では、テスト項目の機能に差があることが報告されている。つまり、テスト問題の中には、受験者の人種によって機能が異なるものがあり、特定のテスト問題を理解する能力や、それに答えるために必要な知識を習得する能力にグループ間で差があることを反映しているというものだ。2003年、フリードルは、SATで難しいとされている言語問題では黒人学生がわずかに有利であるのに対し、簡単な問題では白人学生とアジア人学生がわずかに有利である傾向があることを示すデータを発表した。フリードルは、これらの結果は、「簡単な」テスト項目は、家庭環境で異なる言語を使用することが多い少数派よりも、白人の中流階級の学生にとって理解しやすい語彙を使用しているのに対し、難しい項目は講義や教科書を通してのみ学習する複雑な言語を使用しており、両方の学生グループにそれを習得する機会が平等に与えられていることを示唆していると主張した。[ 189 ] [ 190 ] [ 191 ] この研究はETS委員会から厳しく批判されたが、2010年にSantelicesとWilsonによるその後の研究で結果が再現された。[ 192 ] [ 193 ]

SATのスコアがマイノリティ学生の将来の成績を体系的に過小評価しているという証拠はありません。しかし、SATの予測妥当性は、大学の主要な民族構成や人種構成に依存することが示されています。[ 194 ]また、アフリカ系アメリカ人の学生は、同じSATスコアを持つ白人の学生に比べて大学での成績が低いことを示す研究もあります。研究者らは、これは白人学生が教育環境外の社会的利点(例えば、親の教育への高い関与、キャンパスの学術活動への参加、同人種の教師や仲間からの肯定的な偏見)から恩恵を受け、より良い成績につながる傾向があるためである可能性が高いと主張しています。[ 195 ]
クリストファー・ジェンクスは、アフリカ系アメリカ人は集団として、SATのような標準化された入学試験の導入によって害を受けていると結論付けている。彼によれば、これは試験自体に欠陥があるからではなく、レッテル貼りの偏りや選抜の偏りによるものだ。これらの試験は、アフリカ系アメリカ人が社会化の過程で身につける可能性が低いスキルを測定するものであり、身につける可能性が高いスキルを測定するものではない。さらに、標準化された入学試験は、特定の能力の側面ではなく、一般的な能力を測る試験として分類されることが多い。そのため、教育環境や職場環境においてアフリカ系アメリカ人の能力が常に過小評価される状況が生じ、それが彼らに対する選抜の偏りにつながり、結果として学業不振を悪化させている。[ 195 ]
米国の主要な人種または民族グループの中で、SAT数学スコアの格差は下位層で最も大きく、ヒスパニック系およびラテン系アメリカ人は最も低いスコア帯に、アジア系アメリカ人は最も高いスコア帯にとどまる傾向が強い。さらに、テストに易しい問題と難しい問題の両方をより多く含めると、スコアのばらつきが大きくなり、格差はさらに広がることを示唆する証拠もある。例えば、アジア系の分布を考えると、テストで可能であれば、多くの人が800点を超えるスコアを獲得できる可能性がある。(下の図を参照。)[ 196 ]

2020年は、 COVID-19パンデミックによって世界中の教育が混乱した年であり、実際、SATなどの標準テストにおける米国の学生の成績は低下した。しかし、格差は依然として存在した。[ 197 ]カレッジボードによると、2020年には、アジア系学生の83%が読み書きで大学進学準備の基準を満たし、80%が数学で基準を満たしたのに対し、黒人学生ではそれぞれ44%と21%にとどまった。白人では、読み書きで79%、数学で59%が基準を満たした。ヒスパニック系とラテン系では、それぞれ53%と30%であった。(下の図を参照。)[ 185 ]


ブルッキングス研究所 の経済学者エンバー・スミスとリチャード・リーブスは、国立教育統計センターのデータを分析し、2000年から2020年の間にSATを受験する学生の数が人口と高校卒業率の増加率よりも速いペースで増加したと推論した。この増加はヒスパニック系とラテン系の間で特に顕著だった。高校卒業者数が減少している白人の間でも、SAT受験者数は増加した。[ 185 ]例えば、2015年には170万人の学生がSATを受験し[ 41 ] 、 2013年の160万人から増加した。[ 133 ]しかし、2019年には記録的な220万人の学生が試験を受け、これも記録的な年である2018年の210万人を上回った。[ 43 ] SATを受験する学生数の増加は、多くの学区が授業時間中にSATを実施することを申し出たことが一因であり、多くの場合、学生に追加費用はかかりません。[ 43 ]大学進学の有無に関わらず、学生にSATの受験を義務付けている学区もあります。[ 198 ]しかし、2021年には、COVID-19パンデミックの影響と多くの大学でSATが任意となったため、受験した学生はわずか150万人でした。 [ 14 ]しかし、試験センターが再開すると、意欲的な学生は、希望する学校の入学方針に関わらず、競争相手から自分を際立たせるためにSATまたはACTを受験することを選びました。[ 199 ] [ 113 ] 2023年卒業生のうち、190万人の学生が試験を受けました。[ 113 ]

心理学者のジーン・トゥエンゲ、W・キース・キャンベル、ライン・A・シャーマンは、米国一般社会調査の語彙テストのスコアを分析した()そして、教育を調整した後、高校卒業以下から大学院まで、あらゆる教育レベルで、1970年代半ばから2010年代半ばにかけて高度な語彙の使用が減少していることを発見しました。しかし、カレッジボードはSATの言語スコアが低下していると報告しましたが、受験者の人口構成が変化したこと、そして1970年代よりも2010年代にSATを受験した学生の数が増えたことから、能力が限られている受験者が増えたため、これらのスコアは国全体の語彙レベルを測る不完全な指標であると警告しました。[ 45 ]しかし、アメリカの高校生の間で趣味として読書をする頻度と読解レベルが低下し続けているため、SATを受験する学生は、テストの時間を短縮し、言語部分の特定の文章に関連する質問の数を減らす改革が導入されたとしても、良い成績を収めるのに苦労するかもしれません。[ 200 ]
メンサ、インターテル、プロメテウス協会、トリプルナイン協会などの一部の高IQ協会は、入会試験の1つとして特定の年のスコアを使用しています。たとえば、インターテルは1994年1月までに受験したテストで、少なくとも1300点(言語と数学の合計)のスコアを受け入れています。[ 201 ]トリプルナイン協会は、1995年4月以前に受験したSATテストで1450点以上、1995年4月から2005年2月の間に受験したテストで少なくとも1520点のスコアを受け入れています。[ 202 ]メンサは、1994年1月31日以前に取得した適格なSATスコアを受け入れています。
SATは一般知能と強い相関関係にあるため、特に2004年以降、研究者によって知能を測定するための代理指標としてよく用いられてきた。[ 17 ]特に、数学的に才能のある個人を研究する科学者は、研究対象者を特定するためにSATの数学セクションを使用している。[ 19 ]
研究の蓄積により、SAT スコアが、例えば収入や職業上の業績といった面で、数十年後の個人の成功を予測できることが示されています。[ 17 ] [ 24 ] [ 11 ]教育心理学者のジョナサン・ワイ、デビッド・ルビンスキー、カミラ・ベンボウが 2005 年に発表した縦断研究では、知的に早熟な人 (上位 1%) の中で、12 歳時の SAT の数学セクションで高得点を取った人は、STEM分野で博士号を取得したり、論文を発表したり、特許を取得したり、大学の終身雇用を確保したりする可能性が高いことが示唆されています。[ 203 ] [ 149 ] Wai はさらに、通学した教育機関の平均 SAT または ACT スコアで測定される個人の学力は、最も裕福な人々の間でさえ、収入の個人差を予測し、米国の認知エリート、すなわち Fortune 500 の CEO、億万長者、連邦判事、および議会議員のメンバーであることを示した。[ 204 ] [ 17 ] Wai は、アメリカのエリートは認知エリートでもあると結論付けた。[ 204 ] Gregory Park、Lubinski、および Benbow は、SAT スコアによって特定される知的に優れた青少年は、将来、芸術と STEM の両方で偉大な創造性を発揮することが期待できるという統計的証拠を示した。[ 205 ] [ 17 ]
SATは、数学的に早熟な若者の研究(SMPY)、ジョンズ・ホプキンス大学才能ある若者センター、デューク大学才能識別プログラム(TIP)などの組織によって、12歳または13歳の生徒に実施されることがあり、これは、卓越した能力を持つ生徒、つまり上位1%の生徒を選抜、研究、指導するためである。[ 20 ] SMPY参加者のうち、SAT総合スコア(数学と言語)で上位25%に入った生徒は、下位25%の生徒に比べて、博士号を取得したり、STEM分野で少なくとも1つの論文を発表したり、95パーセンタイルの収入を得たり、少なくとも1つの文学作品を発表したり、少なくとも1つの特許を登録したりする可能性が著しく高かった。デュークTIP参加者は、SAT数学スコアで示されるように数学が得意な場合は一般的にSTEM分野のキャリアを選択し、SAT言語スコアで示されるように言語能力が高い場合は人文科学分野のキャリアを選択した。比較のために言うと、SMPYの最下位四分位は、平均的なアメリカ人よりも特許を取得する可能性が5倍高い。一方、2016年時点で、SMPY参加者の博士号取得者の割合は44%、デュークTIP参加者は37%であったのに対し、アメリカの一般人口では2%であった。[ 21 ]その結果、SATなどの標準化テストで測定される認知能力の差は、ある一定の点を超えると重要ではなくなるという考えは、証拠によって否定されている。[ 206 ]
2010年の論文では、SAT数学のスコアにおける男女差は1980年代初頭から1990年代初頭にかけて劇的に縮小したが、その後20年ほどは持続していることが示され、Wai氏らは「数学を多用する科学分野における女性の不足を説明する要因として、右端の極端な能力差を軽視すべきではない」と主張した。[ 168 ] [ 207 ]
ウォルター・ミシェルとその同僚は、オレオテストやマシュマロテストで測定される子供の満足を遅らせる能力が、SATスコアをはじめ、教育レベルや薬物乱用などの測定可能な人生の成果の強力な予測因子であることを発見した。[ 208 ] [ 209 ]: 101
回帰不連続デザインを用いた独立した研究によると、米国の選抜制学校やマグネットスクールへの入学基準点をわずかに上回るか下回るスコアを取った生徒は、最終的に統計的に同等のSATまたはAPスコアを獲得し、その後同様に名門の大学に進学していることが明らかになった。言い換えれば、これらの学校に通うことは生徒の学業成績に実際には何の影響も与えないということである。[ 12 ] [ 13 ] [ 210 ]: 231-37
ボブ・ウトルとその共同研究者らはSATスコアを用いて、2020年代のアメリカの典型的な大学生のIQスコアは102であり、人口平均(100)に近い値であり、1950年代のように平均より少なくとも1標準偏差(15ポイント)高い値ではないことを示した。彼らによれば、この低下はアメリカにおける高等教育の拡大の結果である。[ 151 ]
認知能力は職業訓練の成果や仕事のパフォーマンスと相関関係があります。[ 116 ] [ 23 ]そのため、一部の雇用主は、特に職務経験が限られている人の場合、採用候補者の適性を評価するためにSATスコアに頼っています。 [ 24 ] [ 23 ]この慣行は新しいものではありません。[ 22 ]大企業は、採用ミスを回避する方法を学ぶために莫大な金額を費やし、標準化されたテストのスコアが、その人が仕事に適しているかどうかを判断するための貴重なツールであると判断しました。場合によっては、企業はコンピュータソフトウェアなどの自社製の専有資料を扱う人を雇う必要があるかもしれません。しかし、そのような資料を扱う能力は外部の認証では評価できないため、そのような企業が一般的な知能を測定する代理指標に頼るのは理にかなっています。[ 24 ] [ 211 ]他の場合、企業は学歴を気にせず、採用候補者の定量的推論能力を評価する必要があり、標準化されたテストのスコアが必要な理由がわかります。[ 22 ]特に投資銀行や経営コンサルティングなどの業界で最も権威があるとされるゴールドマン・サックスやマッキンゼーなどの企業が、求職者にSATスコアについて尋ねていると報告されている。[ 211 ] [ 212 ] [ 213 ] [ 214 ]
しかしながら、 Googleなどの他の大手企業は、応募者が新卒者でない限り、SATやその他の標準化テストのスコアの使用を避けている。Googleのラズロ・ボック氏はニューヨーク・タイムズ紙に、「これらのテストは何も予測できないことがわかった」と説明した。教育心理学者のジョナサン・ワイ氏は、これはSATが知能分布の右端に位置する人々の知的能力を区別できないためかもしれないと示唆した。ワイ氏はニューヨーク・タイムズ紙に、「今日のSATは実際には簡単すぎるため、Googleは相関関係を見出せない。Googleに入社する人は全員、非常に高いスコアを獲得している」と語った。[ 24 ]
2002年、ニューヨーク・タイムズのコラムニスト、リチャード・ロススタインは、SATとACTの米国数学の平均点が、これらのテストの全国的な言語の平均点を10年間上回り続けている一方で、同じテストの言語部分の平均点は低迷していると主張した。[ 215 ]
1960年代と1970年代には、学力テストを廃止する動きがありました。しばらくして、学力テストを再導入した国、州、地方自治体は、学力水準が低下し、学生が勉強する時間が減り、教育を真剣に受け止めなくなったことに同意しました。これらの高リスクのテストがコストを上回る利益を生み出すという研究結果を受けて、一部の地域ではテスト要件が復活しました。[ 216 ]しかし、2001年にアメリカ教育評議会で行った講演で、カリフォルニア大学の学長であるリチャード・C・アトキンソンは、大学入学要件としてSAT Iのような適性テストは廃止すべきだが、SAT IIのような学力テストは廃止すべきではないと主張しました。 [ c ] [ 217 ] SATの予測妥当性と力に対するアトキンソンの批判は、カリフォルニア大学の学術評議会によって異議を唱えられています。[ 109 ] 2020年4月、教員で構成される学術評議会は、標準テストのスコア要件を復活させることを51対0で可決したが、理事会は学術評議会の決定を覆し、テスト要件を復活させなかった。カリフォルニア州の人口規模を考えると、この決定は米国の高等教育全体に影響を与える可能性があり、カリフォルニア州の学生を受け入れようとする学校はより困難になるかもしれない。[ 126 ]
標準化された入学試験に反対する活動家グループであるFairTestによると、2010年代には1,230以上のアメリカの大学やカレッジが、入学にSATとACTを必須としないことを選択した。しかし、そのほとんどは小規模な大学であり、カリフォルニア大学システムとシカゴ大学は注目すべき例外である。[ 218 ]また、宗教系の大学、芸術や音楽の音楽院、看護学校など、ニッチな学生を対象とした教育機関や、米国北東部の教育機関の大部分もリストに含まれている。[ 40 ] COVID-19パンデミックの影響を受け、約1,600の教育機関が、これらのテストの実施と受験の両方が困難で、多くのキャンセルが発生したため、入学にSATまたはACTを必須としないことを決定した。[ 219 ]一部の学校は、プリンストン大学のように1年間だけ、またはウィリアム・アンド・メアリー大学のように3年間だけ、一時的に任意とすることを選択した。他の大学は、この要件を完全に撤廃した。[ 41 ]一部の大学は、2021年に標準化された入学試験の一時停止を延長した。[ 126 ]しかし、これは非常に意欲的な学生が試験を受けることを止めることはなかった。 [ 41 ] [ 220 ]多くの親やティーンエイジャーは、大学入学試験が「任意」であることに懐疑的で[ 220 ]、入学担当者の目に留まりやすいように願書を充実させたいと考えていた。[ 42 ]これにより、2020年の夏には登録サイトがダウンするという苦情が寄せられた。[ 219 ]一方で、SATやACTのスコアを任意にした競争率の高い大学に願書を提出する学生の数は、チャンスがあると考えた学生たちによって劇的に増加した。[ 126 ] [ 221 ] [ 222 ]アイビーリーグ校では出願者数が二桁増加し、コロンビア大学では最大51%増加した一方、入学率はすでに一桁台だったが、ハーバード大学では2020年の4.9%から2021年にはわずか3.4%に低下した。[ 223 ] [ 224 ]同時に、同様の措置をとった格下の大学への関心は急激に低下した。[ 222大学出願プロセスは依然として主にエリート校への志望によって動かされている。 [ 225 ] 2021年時点で900以上の大学が受け入れている共通願書利用した学生のうち、2020 ~ 21年度にSATまたはACTのスコアを提出した学生は44%で、2019~20年度の77%から減少した。テストスコアを提出した学生は、高所得家庭出身で、少なくとも片方の親が大学卒で、白人またはアジア人である傾向があった。 [ 226 ]
「オペレーション・バーシティ・ブルース」の余波で、裕福な親たちが子供の標準テストの点数を上げるために違法に介入していたことが明らかになったにもかかわらず、SATとACTはアメリカの親や大学進学希望の高校生の間で依然として人気が高い。[ 227 ]彼らは「総合的な入学選考」のプロセスに懐疑的で、学校が数値では容易に判別できない特性にアクセスしようとしているため、かなり不透明だと考えている。そのため、テストを任意と宣言する学校が増えているにもかかわらず、競争力を高めようとする受験者の数が増加している。[ 41 ] [ 220 ]総合的な入学選考はもっともらしい代替案のように見えるかもしれないが、出願プロセスは学生や親にとってかなりストレスのかかるものであり、SATの点数やGPAが低いにもかかわらず、自分を拒否した学校に他の人が入学したと知ると、多くの人が動揺する。[ 228 ] [ 225 ]総合的な入学選考はさておき、成績に基づく奨学金が考慮される場合、標準化されたテストのスコアは競争率が高いため、同点の場合の決定要因となる可能性がある。[ 220 ]奨学金や財政援助は、特に経済的に困難な時期に、学生とその親が高等教育の費用を大幅に削減するのに役立つ可能性がある。[ 42 ]さらに、最も選抜性の高い学校では、総合的な入学選考は貴重な時間とその他のリソースを消費するため、検討に値する応募者数を迅速に絞り込むために、標準化されたテストのスコアを使用する以外に良い選択肢がない可能性がある。[ 126 ]
2023年に米国最高裁判所が人種に基づく入学選考をアファーマティブ・アクションの一形態として認めない判決を下したことを受け、多くの学校が民族的多様性の追求を継続する意向を示している。新たな法的現実に適応する一つの方法は、標準化テストの要件を撤廃することであり、これにより潜在的な原告(SFFA対ハーバード大学訴訟とSFFA対ノースカロライナ大学訴訟の2つの訴訟におけるアジア系アメリカ人)が差別の申し立てに対する具体的な証拠を見つけることがより困難になる。[ 229 ]
一方で、SATとACTを入学の任意とすることで、学校はさまざまな社会経済的背景を持つより多くの志願者を集めることができる。[ 39 ]他方で、推薦状は大学での成績の良い指標ではなく、[ 39 ]成績インフレは深刻な問題である。[ 39 ] [ 126 ] [ 230 ]標準化テストがなくなったら、学校の成績がより重要になり、成績インフレを助長することになるだろう。[ 226 ]実際、アメリカの高校の成績は親からの圧力により著しくインフレしており、優秀な生徒が過剰に供給されているように見え、特に低所得家庭出身の生徒は、実際に優秀な生徒が目立つのに苦労している。[ 231 ] SATを任意とした学校は、学力適性や準備状況を客観的に評価する手段を失い、[ 17 ]入学選考のための新たな方法を策定するか、独自の入学試験を開発する必要が生じるだろう。[ 218 ]学生が応募する学校の選抜性は、APクラスなどの厳格なコースの有無や学生の社会経済的地位といった、その学生が通う高校のリソースと相関関係にあることを考えると、SATを任意とすることは社会的不平等を悪化させる可能性がある。さらに、米国の高等教育機関に通う費用は高額であるため、SATの要件を撤廃すると、学業成績が低いために退学させられる可能性があり、入学後に多額の借金を抱えることになる成績不振の学生を受け入れる可能性が高くなるかもしれない。[ 17 ] SATを任意受験にすることに対するもう一つの批判は、出願エッセイなどの出願者の適性に関する主観的な評価がより重要になり、裕福な家庭の生徒は学校のカウンセラーが優れた推薦状を書く能力が高く、出願書類を強化するために外部の支援を雇う余裕があるため、貧しい家庭の生徒を犠牲にして入学しやすくなる可能性があるという点である。[ 226 ]
こうした懸念から、マサチューセッツ工科大学(MIT)は2022年にSATの要件を復活させることを決定した。[ 232 ]米国の他の多くの大学も2024年にこれに続いた。[ 233 ] [ 234 ] [ 113 ]しかし、ノースカロライナ大学システムは高校のGPAが2.8未満の出願者のみにSATまたはACTのスコアを要求する[ 234 ]一方、カリフォルニア大学システムは引き続きテストブラインドとなる。[ 113 ]
2005年、MITライティングディレクターのレス・ペレルマンは、公開されたエッセイを基に、新しいSATのエッセイの長さとスコアの関係をグラフ化し、両者の間に高い相関関係があることを発見した。50以上の採点済みエッセイを分析した結果、エッセイが長いほど一貫して高いスコアが得られることが分かった。実際、彼はエッセイを読まずに長さを推測するだけで、90%以上の確率でエッセイのスコアを正しく判断できると主張している。また、これらのエッセイのいくつかは事実誤認に満ちていることも発見した。カレッジボードは事実の正確さを採点対象としているわけではない。
ペレルマンは、全米英語教師協議会とともに、SATの25分間のライティングセクションが教室でのライティング指導の基準を損なうとして批判した。彼らは、SAT対策のライティング教師は、推敲、深み、正確さに重点を置かず、代わりに長くて定型的で冗長な文章を書くようになると述べている。[ 235 ]「教師が生徒を悪い書き手に育てている」とペレルマンは結論づけた。[ 236 ]
2021年1月19日、カレッジボードは、2021年6月の試験以降、SATの任意エッセイセクションを提供しなくなると発表した。[ 7 ] [ 8 ]

SATを所有する非営利団体であるカレッジボードは、20世紀初頭に、加盟大学に統一入学試験を提供するために設立されました。これらの大学に入学する学生は、米国北東部にある寄宿学校や私立通学制学校出身者が多かったのです。試験はエッセイ形式で、手書きで採点され、受験には数日を要しました。[ 237 ] [ 238 ] 1920年代初頭までに、選抜手段としての知能テストへの関心の高まりを受けて、カレッジボードは大学入学目的のテストを作成するための委員会を設立しました。委員会のリーダーはプリンストン大学の心理学者カール・ブリガムで、彼は当初、優生思想の観点からこれらのテストの価値を見出していました。 [ 237 ]
1926年6月23日、当時Scholastic Aptitude Testとして知られていた最初のSATが8,040人の学生に実施され、そのうち60%が男子学生で、その多くがイェール大学(26%)とスミス大学(27%)に出願していた。[ 239 ] 1934年、ジェームズ・コナントとヘンリー・チャウンシーは、伝統的な北東部の私立学校の生徒以外にも、ハーバード大学の奨学金の受給者を選抜する手段としてSATを使用した。1942年までに、カレッジボードはエッセイ試験の使用を中止し、SATに置き換えた。これは、ハーバード大学のSATプログラムの成功と、第二次世界大戦の勃発による制約が理由の一つであった。[ 237 ]この時、SATは標準化され、ある年に学生が取得したテストスコアを別の年に学生が取得したスコアと直接比較できるようになった。テストのスコアは、2 つのテストセクション (言語と数学) それぞれで 200 から 800 の範囲であり、1995 年まで同じ参照グループの学生が SAT の標準化に使用されました。[ 240 ]

戦後、教育テストサービス( ETS )の設立などいくつかの要因により、SATの利用は急速に増加しました。1951年には約80,000人がSATを受験し、1971年には約150万人にまで増加しました。[ 242 ]この間、SATの内容に加えられた変更は比較的小規模で、文章完成問題や「量的比較」数学問題の導入、およびテストのタイミングの変更などが含まれていました。しかし、1994年に、SATは、学校での生徒の学習内容や大学で必要となるスキルをより正確に反映させる目的で大幅に変更されました。その他の変更点として、言語セクションから反意語問題が削除され、数学セクションに自由記述問題と電卓の使用が追加されました。[ 145 ] 1995年、約40年間スコアが低下し続けた後、SATは平均スコアの低下を補うために各スコアに約100ポイントを追加して再調整されました。
2005年、SATは再び変更された。これは、カリフォルニア大学システムによるテストへの批判が一因であり、同大学はテストが高校のカリキュラムに十分に合致していないと述べていた。[ 147 ]言語セクションから類推問題が、数学セクションから量的比較問題が削除されたことに加え、 [ 145 ]エッセイを含む新しいライティングセクションが追加された。[ 243 ]これらの変更によりセクションスコアが追加され、SATの最高スコアは2400に引き上げられた。[ 244 ]
2016 年初頭、SAT は一般的な高校のカリキュラムとの整合性を図るため、再び変更されました。[ 245 ] [ 246 ]変更内容には、エッセイを任意とし(最高得点を 1600 点に戻す)、すべての多肢選択問題の選択肢を 5 つから 4 つに変更し、不正解に対する減点をなくすこと(正解のみの採点)などが含まれていました。[ 247 ] [ 248 ] COVID-19 パンデミックの状況下で生徒への負担を軽減するため、2021 年半ばまでにエッセイは SAT から完全に削除されました。[ 219 ]

SATは1926年の導入以来、何度か名称変更されている。当初はScholastic Aptitude Testとして知られていた。[ 249 ] [ 145 ] 1990年、カレッジボードがSATプログラムの変更案を検討するために設置した委員会は、 SATの頭文字の意味を「Scholastic Assessment Test」に変更することを推奨した。なぜなら、「達成度と発達した能力の尺度を統合したテストは、もはや適性テストとして正確に説明できない」からである。[ 250 ] [ 251 ] 1993年、カレッジボードはテスト名をSAT I: Reasoning Testに変更し、同時にSAT Achievement Testsの名称をSAT II: Subject Testsに変更した。[ 249 ] Reasoning TestとSubject TestsはまとめてScholastic Assessment Testsとして知られるようになった。当時のカレッジボードの会長によると、名称変更の目的は「SATが努力や指導に関係なく、生まれつきのもので変化しないものを測定しているという一部の人々の印象を正すため」だった。[ 252 ]新しいSATは1994年3月にデビューし、主要な報道機関によってScholastic Assessment Testと呼ばれた。[ 253 ] [ 254 ]しかし、1997年にカレッジボードは、SATをScholastic Assessment Testと呼ぶのは適切ではなく、SATという文字は何の略でもないと発表した。[ 255 ] 2004年に、SAT I: Reasoning Testのローマ数字が削除され、SAT Reasoning TestがSATの名称となった。[ 249 ] 2016年の試験の再設計後、「Reasoning Test」の部分は名称から削除され、現在は単にSATと呼ばれている。[ 256 ]
カレッジボードは、米国で以前に実施された古いSAT試験問題をそのまま再利用したとして非難されている。[ 257 ] 過去の試験問題の再利用は、試験での不正行為を可能にし、一部の学生のテストスコアの正当性を疑わせる原因となっている。アジアの試験対策会社は、新しいSAT試験の実施後数時間以内に学生に試験問題を提供していることが判明している。[ 258 ] [ 259 ]
2018年8月25日、米国で実施されたSATテストは、2017年10月に中国で実施された国際SATテストを再利用したものであることが判明した。流出したPDFファイルは、2018年8月25日の試験前にインターネット上に出回っていた。[ 260 ]
{{cite web}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク)彼はまた、テストが高校での生徒の学習内容をより正確に反映するようにしたいと考えており、おそらく最も重要なことは、裕福な生徒に有利になることが多い、テストの受け方に関する集中的な指導や個別指導を抑制したいと考えていると述べた。
{{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite web}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク)では、テスト スコアは現在、高校の成績平均点 (HSGPA) よりも 1 年の GPA のより良い予測因子であり、1 年の在籍、UGPA、および卒業の予測にはほぼ同等の精度です。³ 特定の (HSGPA) バンド内の学生については、標準化テストのスコアが高いほど、1 年の UGPA が高く、卒業 UGPA が高く、4 年以内 (編入生の場合) または 7 年以内 (1 年の学生の場合) に卒業する可能性が高くなります。さらに、テスト スコアによって説明される学生の結果の分散の量は 2007 年以降増加していますが、高校の成績によって説明される分散は減少しています。ただし、全体として 26% を超えることはありません。テストの点数は、高校の成績(HSGPA)を考慮に入れた後でも、あらゆる人口統計学的グループや分野において予測力を持つ。実際、テストの点数は、マイノリティグループに属する学生、第一世代の大学生、または低所得家庭の学生にとって、成功をより的確に予測する指標となる。
{{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite magazine}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite web}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク)それが、私が入学事務局が願書を審査する様子を観察した年に学んだ汚い秘密です。ほとんどの事務局は、複数のエッセイや推薦状、そして百科事典のような活動リストを要求する際に、正確に何を評価しようとしているのかを知りません。
{{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク)...ミシガン州の訴訟から20年遡って、長年にわたるこれらのアファーマティブ・アクション訴訟の原告は、テストの点数を、1500点のSATで入学を拒否された学生と1200点の学生という差別を受けたという証拠の1つとして使用してきました。しかし、全員の点数がない場合は、その主張を立証するのははるかに困難です。
{{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite news}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク)