
試験(または評価)とは、受験者の知識、技能、適性、体力、またはその他多くのトピック(信念など)における分類を測定することを目的とした教育評価です。[1] 試験は、口頭、紙、コンピュータ、または受験者が一連の技能を実演または実行する必要がある所定の場所で実施される場合があります。
試験は形式、厳格さ、要件が様々です。試験の形式や難易度に関して、一般的な合意や不変の基準はありません。多くの場合、試験の形式や難易度は、講師の教育理念、科目、クラスの規模、教育機関の方針、認定機関や統括機関の要件によって左右されます。
テストは、正式な方法でも非公式な方法でも実施できます。非公式なテストの例としては、親が子供に実施する読解力テストがあります。正式なテストの例としては、教室で教師が実施する期末試験や、診療所で心理学者が実施するIQテストなどがあります。正式なテストの結果は、多くの場合、成績またはテストスコアになります。[ 2 ]テストスコアは、基準または規範、あるいはその両方に基づいて解釈されることがあります。基準は、独立して設定することも、多数の参加者の統計分析によって設定することもできます。
テストは、指導者、臨床医、統括機関、またはテスト提供者によって作成および実施される場合があります。場合によっては、テストの開発者がテストの実施に直接責任を負わないこともあります。例えば、米国では、非営利の教育テストおよび評価機関であるEducational Testing Service (ETS)がSATなどの標準化テストを作成していますが、これらのテストの実施や監督に直接関与していない場合があります。

歴史を通じて、非公式で非公式かつ標準化されていない試験や試験制度が存在してきた。例えば、弓術競技のような技能試験は、周王朝(あるいは神話的には姚王朝)以来中国に存在していた。[ 3 ]口頭試験は、古代中国やヨーロッパを含む世界のさまざまな地域で実施されていた。後の中国の科挙制度の前身は漢王朝から存在しており、その際に試験の儒教的特徴が確立された。しかし、これらの試験は政府への公式な任命の道を提供するものではなく、政府の大部分は社会的地位、道徳、能力などの資質に基づく推薦によって任命されていた。
標準化された筆記試験は、中国で初めて実施された。これらは一般的に科挙(科挙)として知られていた。
官僚制の科挙制度という概念は、短命に終わった隋王朝時代の605年に起源を持つ。その後継王朝である唐王朝は、武則天の治世中に試験制度が大幅に拡大されるまで、比較的小規模な科挙制度を実施した。[ 4 ]拡大された試験制度には、身体能力を測る軍事試験も含まれていたが、軍事試験は中国の将校団に大きな影響を与えることはなく、軍事学位は文官学位よりも劣るものと見なされていた。武則天が科挙制度に与えた影響の正確な性質は、現在も学術的な議論の対象となっている。
宋代には、皇帝は世襲貴族の影響力に対抗するため、試験と官吏登用制度の両方を拡大し、学位取得者の数を唐代の5倍以上に増やした。宋代以降、試験は社会の知識人エリートを形成する官僚を選抜する上で主要な役割を果たした。しかし、試験は、支配者一族への直接任命、指名、割り当て、聖職者の昇進、官職の売買、宦官のための特別手続きなど、他の採用形態と共存していた。1067年に高等学位試験の定期サイクルは3年と定められたが、この3年サイクルは名目上のみ存在した。実際には、これ以前も以後も、試験はかなりの期間にわたって不定期に実施されていた。したがって、毎年授与される学位数の統計平均値は、この文脈で理解されるべきである。進士試験は毎年行われる行事ではなく、そのように考えるべきではない。年間平均数値は定量分析に不可欠な成果物である。[ 5 ]試験制度の運用は帝国の記録管理システムの一部であり、進士の学位を取得した日付はしばしば重要な伝記的データである。中国史において最も著名な人物でさえ、進士の学位を取得した日付が唯一確実な日付として知られている場合がある。
13世紀のモンゴル元王朝初期に試験制度は一時的に中断されたが、その後、モンゴル人に有利で中国南部に不利な地域割り当て制度とともに復活した。明朝と清朝の間、この制度は知的活動の狭く限定的な性質に貢献し、皇帝の専制的な権力を強化した。この制度は、清朝末期の1905年に廃止されるまで、若干の修正を加えながら継続された。現代の官吏選抜のための試験制度も、間接的に皇帝の制度から発展したものである。[ 6 ]


日本は平安時代(794年~1185年)に200年間、試験制度を実施した。中国の試験と同様に、カリキュラムは儒教の経典を中心としていた。しかし、中国とは異なり、試験は下級貴族のみに適用されたため、武士時代の世襲制の下で徐々に衰退していった。[ 7 ]
科挙制度は、高麗の光宗の治世下、958年に朝鮮で確立された。自由民(ノビを除く)であれば誰でも試験を受けることができた。朝鮮時代になると、科挙に合格していない貴族は高官の地位に就くことができなくなった。科挙制度は、1894年に嘉保改革によって廃止されるまで続いた。中国と同様に、科挙の内容は儒教の経典に重点が置かれ、王位を支える忠実な学者官僚階級を確保する役割を果たした。[ 8 ]
ベトナムの儒教試験制度は、 1075年に李朝の李寧宗皇帝の治世下で確立され、阮朝のカイディン皇帝(1919年)まで続いた。ベトナムには、省間試験、宮廷試験、宮廷試験の3段階の試験しかなかった。[ 8 ]
科挙制度は、1570 年頃にはすでにヨーロッパ人に知られていた。イエズス会士のマテオ・リッチ(1552–1610) は、この制度と、その儒教的な合理主義への訴えを、「黙示録」への宗教的依存と比較して好意的に捉え、この制度に大きな関心を寄せた。1614年にリッチの日記がラテン語に翻訳された後、儒教と科挙制度に関する知識はヨーロッパで広く普及した。18 世紀には、科挙制度はしばしば儒教と関連付けて議論され、ゴットフリート・ヴィルヘルム・ライプニッツ、ヴォルテール、モンテスキュー、バロン・ドルバック、ヨハン・ヴォルフガング・フォン・ゲーテ、フリードリヒ・シラーなどの当時のヨーロッパの思想家から大きな注目を集めた。[ 9 ]フランスとイギリスでは、儒教のイデオロギーはエリートの特権を攻撃するために利用された。[ 10 ]ヴォルテールのような人物は、中国人が「道徳科学を完成させた」と主張し、フランソワ・ケネーは中国の経済・政治システムをモデルにしたシステムを提唱した。フェルディナン・ブリュネティエール(1849-1906)によれば、自由貿易の理論が中国の古典理論に基づいていたフランソワ・ケネーのような重農主義の信奉者は、フランスに「中国精神」を導入しようと躍起になっていた親中主義者であった。彼はまた、フランスの教育は実際には、特にヴォルテールなどの哲学者によってフランスで普及した中国の文学試験に基づいていたことを認めている。18世紀の西洋の中国観は、中国の官僚制度が、その見かけ上の実力主義ゆえにヨーロッパの政府よりも好ましいと賞賛していた。[ 11 ] [ 12 ]しかし、クリスチャン・ヴォルフのように中国を賞賛する人々は、時に迫害された。 1721年、彼はハレ大学で儒教を称賛する講演を行ったが、無神論者だと非難され、大学の職を辞任せざるを得なくなった。[ 13 ]
ヨーロッパにおける試験の最も古い証拠は、1215年または1219年にボローニャで行われたものに遡ります。これらは主に口頭で行われ、質疑応答、討論、判定、弁護、または公開講義の形式でした。受験者は、民法または教会法から割り当てられた2つの準備された文章を公開講義し、その後、医師が質問したり、回答に異議を唱えたりしました。筆記試験の証拠は、1702年にケンブリッジのトリニティ・カレッジで現れるまで見られません。サー・マイケル・サドラーによれば、ヨーロッパでは1518年から筆記試験が行われていた可能性があるものの、「証拠はあまり明確ではない」と認めています。プロイセンでは、1725年に医学試験が始まりました。1747年に創設された数学トライポスは、一般的に最初の栄誉試験と考えられていますが、ジェームズ・バス・マリンガーは、学位の資格が単に4年間の在籍であったため、「受験者は実際には何の試験も受けていない」と考えていました。フランスは1791年にフランス革命の結果として試験制度を導入したが、わずか10年後に崩壊した。ドイツは1800年頃に試験制度を導入した。[ 12 ]
18 世紀のイギリス人、例えばユースタス・バジェルは中国の試験制度を模倣することを推奨したが、就職資格を得るための競争試験を推奨した最初のイギリス人は、1776 年のアダム・スミスであった。1838 年、会衆派教会の宣教師ウォルター・ヘンリー・メドハーストは、中国の試験を「模倣する価値がある」と考えた。[ 12 ] 1806 年、イギリスはロンドン近郊に東インド会社のインドにおける行政官の訓練のための公務員養成大学を設立した。これは、中国で勤務し、科挙を見たイギリス東インド会社の役人の勧告に基づいていた。1829 年、同社はインドで限定的に公務員試験を導入した。[ 14 ]これにより、イギリスの公務員の資格取得プロセスの原則が確立された。[ 13 ] 1847 年と 1856 年、トーマス・テイラー・メドウズは、著書『中国の政府と人々に関する雑記』の中で、イギリスで中国の競争試験の原則を採用することを強く推奨した。メドウズによれば、「中国帝国の長期的存続は、才能と功績のある人物のみを昇進させるという優れた統治にのみ起因する」[ 15 ] 。 1833年のセントヘレナ法の成立に尽力したトーマス・バビントン・マコーレーと、英国官僚制度のきっかけとなったノースコート・トレベリアン報告書を作成したスタッフォード・ノースコート初代イデスリー伯爵は、いずれも中国の歴史と制度に精通していた。1854年のノースコート・トレベリアン報告書は、主に4つの勧告を行った。すなわち、採用は標準化された筆記試験によって決定される功績に基づいて行われるべきであり、候補者は部門間の異動を可能にするためにしっかりとした一般教育を受けるべきであり、採用者は階層に等級付けされるべきであり、昇進は「優遇、後援、または買収」ではなく、業績によってなされるべきである、というものである。[ 16 ]
1853年にこの報告書が議会で取り上げられた際、モンティーグル卿は、試験制度は中国の制度であり、中国は「啓蒙された国」ではないとして、試験制度の導入に反対した。スタンレー卿は、この試験制度を「中国の原理」と呼んだ。グランヴィル伯爵はこれを否定しなかったものの、少数民族である満州族が200年以上もこの制度で中国を統治してきたことを考慮し、試験制度に賛成した。1854年、エドウィン・チャドウィックは、一部の貴族が中国人であるという理由で導入された措置に反対していると報告した。試験制度は最終的に1855年にイギリス領インドの高等文官制度で導入された。それ以前は、高等文官制度への入職は完全に縁故主義によるものだった。また、 1870年にはイギリス本国でも導入された。競争試験制度が可決されてから10年経ってもなお、人々はそれを「中国文化の模倣」として非難し続けた。初代ラミントン男爵アレクサンダー・ベイリー=コクランは、イギリス人は「中国から学ぶ必要があることを知らなかった」と主張した。1875年、アーチボルド・セイスは競争試験の普及について懸念を表明し、それを「この新しい中国文化の侵略」と表現した。[ 12 ]
19世紀にイギリスがインドで体系的で公開された競争試験を成功裏に導入した後、同様の制度がイギリス本国や他の西欧諸国にも導入された。[ 17 ]イギリスと同様に、フランスとアメリカの官僚制度の発展は中国の制度の影響を受けた。トーマス・ジェンクスが1868年に緊縮財政に関する合同特別委員会の報告書を作成した際、その中に中国の官僚制度に関する章が含まれていた。1870年、ウィリアム・スピアは『最古にして最新の帝国―中国とアメリカ合衆国』という本を執筆し、その中でアメリカ政府に中国の試験制度を採用するよう促した。イギリスと同様に、アメリカのエリート層の多くは競争試験の導入計画を軽蔑し、それを外国的で中国的で「非アメリカ的」だと考えた。その結果、 1868年に下院に提出された公務員制度改革は1883年まで可決されなかった。公務員委員会は報告書の中でこうした感情に対抗しようと試みた。[ 18 ]
中国の宗教や帝国主義を称賛する意図は全くありませんが、東洋世界で最も啓蒙的で永続的な政府が、公職候補者の資質を問う試験制度を獲得したという事実が、アメリカ国民からその利点(もしそれが利点になり得るならば)を奪う理由が、孔子が政治道徳を教え、中国の人々がこの大陸が未開の地であった数世紀の間に書物を読み、羅針盤、火薬、九九表を使用していたという事実が、我々の国民からそれらの便宜を奪う理由と何ら変わりないように思えます。[ 12 ]
—公務員委員会

標準化されたテストは、中世以来口頭試験が一般的だったイギリスの大学における試験方法に1850年代から影響を与え始めた。アメリカでは、教育改革者ホレス・マンの影響下でこの変化が起こった。この変化は、カリキュラムを科学と人文科学に拡大することの標準化に役立ち、教師と教育機関の評価のための合理的な方法を作り出し、能力に応じて学生を振り分ける基礎を作った。[ 19 ]
第一次世界大戦と第二次世界大戦は、標準化されたテストの必要性と、これらのテストに関連する利点を実証しました。テストは、軍隊への新兵の精神的適性を判断するために使用されました。米陸軍は、兵士のIQをテストするためにスタンフォード・ビネー知能尺度を使用しました。 [ 20 ]戦後、産業界は、さまざまな仕事の応募者をパフォーマンスに基づいて評価するためにテストを使用し始めました。1952年には、高校と大学の間のギャップを埋め始めるために、最初のアドバンスト・プレイスメント(AP)テストが実施されました。[ 21 ]
テストはほとんどの教育制度で用いられています。テストの種類は、教師が選んだ短い非公式な質問から、生徒と教師が数ヶ月かけて準備する本格的なテストまで多岐にわたります。
イギリスやフランスなどの国では、中等学校の生徒全員に、卒業要件として、それぞれ一般中等教育修了証(GCSE)(イギリス)やバカロレアなどの個別科目の標準化テストを受けることを義務付けています。 [ 22 ]これらのテストは主に、数学、科学、文学などの特定の科目における生徒の習熟度を評価するために使用されます。対照的に、アメリカ合衆国などの他の国の高校生は、卒業のために標準化テストを受ける必要がない場合があります。さらに、これらの国の生徒は通常、大学のプログラムに応募するためだけに標準化テストを受け、通常は、主に生徒の推論スキルを測定するために使用されるACTやSATなどのさまざまな標準化テストを受ける選択肢が与えられます。 [ 23 ] [ 24 ]アメリカ合衆国の高校生は、大学レベルの単位を満たすために、特定の科目のアドバンストプレイスメントテストを受けることもできます。テスト作成者または国のポリシーに応じて、標準化テストの実施は、大きなホール、教室、またはテストセンターで行われる場合があります。試験時間中には、指示を与えたり、質問に答えたり、不正行為を防止したりするために、試験監督者または試験官が立ち会う場合もあります。
大学は、標準化テストの成績やテストスコアを使用して、学生の出願者が大学の学術プログラムまたは専門プログラムに入学できるかどうかを判断することもあります。たとえば、英国の大学は、GCE AレベルやケンブリッジPre-Uなどの大学入学前の資格の出願者の成績を主として、または専ら、学部プログラムへの出願者を受け入れます。[ 25 ] [ 26 ]対照的に、米国の大学は、SATまたはACTの出願者のテストスコアを、出願者が学部プログラムに入学できるかどうかを判断するための多くの入学基準の1つとして使用します。この場合、他の基準には、出願者の高校の成績、課外活動、自己紹介文、推薦状などが含まれる場合があります。[ 27 ]入学後、英国または米国の学部生は、それぞれのプログラムで、コースに合格するため、またはそれぞれのプログラムを卒業するために、総合試験を受けることが求められる場合があります。
標準化テストは、教育機関の質を管理するために、一部の国で利用されることがあります。例えば、米国の「落ちこぼれ防止法(No Child Left Behind Act)」では、各州に対し、特定の学年の生徒を対象とした評価方法を開発することを義務付けています。実際には、これらの評価は通常、標準化テストの形で実施されます。教育機関の特定の学年の生徒のテストスコアは、その教育機関の地位、つまり、これまで通り運営を続けるべきか、あるいは資金援助を受けるべきかを判断するために使用されます。
最後に、標準化されたテストは、異なる教育機関や国の学生の能力を比較するために使用されることがあります。たとえば、経済協力開発機構(OECD)は、国際生徒評価プログラム(PISA)を使用して、参加国の学生の特定のスキルと知識を評価しています。[ 28 ]
標準化されたテストは、受験者が特定の職業に従事できるかどうか、特定の職名を使用できるかどうか、あるいは特定のスキルセットにおける能力を証明できるかどうかを判断するために、特定の統括機関によって使用されることがあります。例えば、弁護士を目指す受験者は、通常、政府の弁護士資格認定機関などの統括機関によって、司法試験に合格することが求められます。
標準化されたテストは、移民を規制するために特定の国でも使用されています。たとえば、オーストラリアへの移民希望者は、同国の帰化手続きの一環として、市民権テストに合格することが法律で義務付けられています。[ 29 ]
帰化プロセスにおける言語テキストの文脈で分析すると、イデオロギーは、2つの異なるがほぼ関連した観点から見出すことができる。1つは、国家の構成要素の構築と解体によって独自のアイデンティティを形成するという点であり、もう1つは、特定の目的に役立つ可能性のある特定の言語とイデオロギーの概念をより限定的に捉えている点である。[ 30 ]
テストは、スポーツイベントなどの競技で成功する可能性のある参加者を選抜するためのツールとして使用されることがあります。たとえば、米国でフィギュアスケート競技に参加したいスケーターは、資格を得るために米国フィギュアスケート協会の公式テストに合格する必要があります。[ 31 ]
テストは、特定のタイプの個人をグループに選抜するためにグループによって使用されることがあります。たとえば、メンサ・インターナショナルは、標準化された監督付きIQテストで98パーセンタイル以上のスコアを獲得することを個人に要求する高IQ団体です。 [ 32 ]
評価の種類には以下が含まれます: [ 33 ] [ 34 ] [ 35 ]
基準参照テストは、固定された一連の基準または学習基準に対して生徒の成績を測定するように設計されています。すべての受験者が合格する可能性があり、すべての受験者が不合格になる可能性もあります。これらのテストは、個々のスコアを使用して、理解が不足していたスキルを向上させることに焦点を当てることができます。[ 36 ]
競争試験は、基準参照型の高難易度試験であり、受験者は成績やパーセンタイルに基づいて順位付けされ、上位の受験者が選抜されます。試験の募集人数がn名の場合、上位n名の受験者が合格し、残りは不合格となります。競争試験は、大学や短期大学への入学試験(合同入学試験など)や中等学校への入学試験として利用されます。種類としては、公務員試験(公共部門の職に就くために必要なもの)、米国外交官試験、国連競争試験などがあります。競争試験は、影響力行使、偏見、その他の懸念事項のリスクを負うことなく、優秀な応募者を選抜する平等な方法と考えられています。
一つの試験が複数の性質を持つ場合がある。例えば、弁護士を目指す人のための司法試験は、基準参照型、標準化型、総括型の評価であると言える。これは、高得点を取った受験者のみが合格し、全員が同じ状況下で同じ試験を受け、同じ採点基準で評価され、その試験が法科大学院卒業生が弁護士業務を行うのに十分な知識を習得しているかどうかを判断するためのものであることを意味する。
筆記試験とは、紙またはコンピュータ(電子試験)で実施される試験のことです。筆記試験を受ける受験者は、試験の指定されたスペース内、または別の用紙や文書に、特定の試験項目に記入または入力することで解答することができます。
化学や生物学のように、多くの定数や専門用語の知識が効果的に質問に答えるために必要とされるテストでは、テスト作成者は受験者全員にカンニングペーパーの持ち込みを許可する場合があります。
筆記試験を作成する際に、どのスタイルや形式を使用するかは、試験に関する単一の不変の基準が存在しないため、通常は試験開発者の選択に委ねられます。とはいえ、特定の試験スタイルや形式は、他のものよりも広く使用されるようになっています。以下に、教育者や試験開発者が紙ベースまたはコンピュータベースの試験を作成する際に広く使用している試験項目の形式の一覧を示します。その結果、これらの試験は、1種類の試験項目形式(例:多肢選択式試験、記述式試験)のみで構成される場合もあれば、複数の異なる試験項目形式(例:多肢選択式と記述式の両方を含む試験)が組み合わされている場合もあります。
多肢選択式の質問形式の項目があるテストでは、受験者は各質問に対して複数の選択肢を与えられ、どの回答または回答のグループが正しいかを選択する必要があります。多肢選択式質問には 2 つの種類があります。[ 39 ] 1 つ目の種類は真偽問題として知られており、受験者は適切な回答をすべて選択する必要があります。2 つ目の種類は最良回答1つ問題として知られており、受験者は回答のリストから 1 つだけを選択する必要があります。
テストで多肢選択式問題を使用する理由はいくつかあります。実施面では、多肢選択式問題は通常、受験者が解答するのに要する時間が短く、採点や評価が容易で、より広い範囲の教材を網羅でき、難易度の幅が広く、受験者が特定の概念で苦労しているかどうかを容易に診断できます。[ 40 ]教育ツールとしては、多肢選択式問題は、多くの学習レベルと受験者の情報統合能力をテストし、選択肢がなぜ間違っていたのか、正解がなぜ正しかったのかについて受験者にフィードバックを提供します。しかしながら、多肢選択式問題の使用には困難が伴います。実施面では、効果的な多肢選択式問題の作成には通常、かなりの時間がかかります。[ 40 ]教育ツールとしては、多肢選択式問題は、受験者が提示された選択肢以上の知識を示すことを許さず、少なくとも1つの正解が存在するため、推測や概算を助長する可能性さえあります。たとえば、受験者は明示的にしかし、それを知っていても受験者は48に近い答えを選ぶでしょう。さらに、受験者はこれらの項目を誤解し、その過程でこれらの項目を難解または選り好みの問題だと認識する可能性があります。最後に、多肢選択式の問題では、正解を簡単に偽装できるため、受験者の学習に対する姿勢を測ることはできません。
正誤問題では、受験者は二者択一、つまり記述が真か偽かのどちらかを選択することになります。この方法には問題があり、問題数によっては、かなりの数の受験者が勘だけで100%の正解率を達成できてしまう可能性があり、平均的には50%程度の正解率にとどまるべきでしょう。
マッチング問題とは、定義された用語が提示され、受験者が識別特性を正しい用語と一致させる必要がある問題のことである。[ 41 ]
穴埋め問題は、受験者に識別特性を提供し、受験者に正しい用語を思い出すように要求します。[ 41 ]穴埋めテストには 2 種類あります。簡単なバージョンでは、空欄を埋める可能性のある単語の単語バンクが提供されます。一部の試験では、単語バンクのすべての単語がちょうど 1 回使用されます。教師が中程度の難易度のテストを作成したい場合は、単語バンク付きのテストを提供しますが、一部の単語は複数回使用される場合があり、他の単語は全く使用されない場合があります。このようなテストの最も難しい種類は、単語バンクがまったく提供されない穴埋めテストです。これは一般的に、多肢選択テストよりも高いレベルの理解と記憶を必要とします。そのため、単語バンクのない穴埋めテストは、学生に恐れられることがよくあります。
短答式問題やエッセイ問題などの項目では、通常、受験者は項目の要件を満たす回答を記述する必要があります。管理上の観点から言えば、エッセイ問題は作成に要する時間が短くなります。[ 40 ]評価ツールとして、エッセイ問題は複雑な学習目標だけでなく、質問に答えるために使用されるプロセスもテストできます。また、これらの項目は、テストに対してより現実的で一般化可能なタスクを提供することもできます。最後に、これらの項目は、受験者が正解を推測することを困難にし、受験者に正しいスペルと文法だけでなく、ライティングスキルを示すことを要求します。
エッセイ問題の難しさは主に管理上の問題にあります。例えば、受験者は解答を作成するのに十分な時間が必要です。[ 40 ]これらの問題に解答しても、受験者が解答を整理したり校正したりする時間がないため、解答自体が不十分な場合が多いです。その結果、これらの問題の採点や評価に時間がかかります。これらの問題の採点や評価を行う際、試験とは関係のない情報が評価プロセスに影響を与える可能性があるため、評価プロセス自体が主観的になります。したがって、評価プロセスの主観性を最小限に抑えるには、相当な努力が必要です。最後に、評価ツールとして、エッセイ問題は主題全体の内容を評価する上で信頼性に欠ける可能性があります。
試験受験者への指示は、指示語の使用に依存しており、指示語は受験者に特定の方法で応答するように指示します。たとえば、概念を説明したり定義したり、2つ以上のシナリオや出来事を比較対照したりします。一部の指示語は、他の指示語よりも洞察力やスキルを必要とします。たとえば、「分析する」と「統合する」は、「説明する」よりも高度なスキルを評価します。[ 42 ]より要求の厳しい指示語は、通常、試験でより高い配点を受けます。英国では、Ofqual が指示語の意味を説明する公式リストを維持しています。[ 43 ]ウェールズ政府の指示語の使用に関するガイダンスは、指示語は「一貫して正しく」使用すべきであると助言していますが、一部の科目には受験者の応答に関して独自の伝統と期待があることを指摘しています。[ 44 ]また、ケンブリッジ アセスメントは、場合によっては、科目固有の指示語が使用される可能性があると指摘しています。[ 45 ]
小テストは、授業で扱われた少量の教材を対象とする簡単な評価です。中には、一定期間に行われた2~3回の講義を読解セクションや、授業の最も重要な部分が要約であった演習として扱うものもあります。しかし、簡単な小テストは通常、あまり重要視されず、教師は通常、学生が教材を理解しているかどうかを判断するための形成的評価としてこの種のテストを実施します。さらに、教師がすべての学生を収集した時点でこれを行うことは、最終的なコース成績の重要な部分を占める可能性があります。[ 46 ]
数学の問題、あるいは化学、物理、経済学などの科目の計算問題の大半は、上記のいずれのカテゴリーにも当てはまらない形式を採用している。ただし、英国の数学チャレンジ試験など、一部の試験では多肢選択式が用いられる。その代わりに、ほとんどの数学の問題は、生徒が自由記述で解答を記入する数学的な問題や演習問題として提示される。正解よりも、解答の手順に対して点数が与えられる。問題が複数のパートに分かれている場合、後のパートでは前のパートの解答が使用されることがあり、以前のパートで誤った解答が使われたとしても、正しい解法に従って正解(誤った入力に対して)が返された場合は、点数が与えられることがある。
高度な数学の論文では、真偽判定のバリエーションが含まれる場合があり、受験者はある命題を与えられ、直接証明するか反例を挙げることによってその妥当性を検証するように求められる。
オープンブック(またはオープンノート)テストは、クローズドブックテストほど人気はありませんが、徐々に人気が高まっています。オープンブックテストでは、受験者はテスト中に教科書や自分のノートすべてにアクセスできます。[ 47 ]オープンブックテストで出題される問題は、クローズドブックテストの問題よりも、一般的に思考を刺激し、知的なものです。オープンブックテストでは、受験者が知っている事実をテストするのではなく、事実をより広い問題に適用することを求められます。オープンブックテストの主な利点は、暗記する必要がなく、必要なものを何でも自由に使える現実世界へのより良い準備となることです。[ 48 ]
口頭試験とは、口頭で解答する試験のことです。教師または口頭試験の採点者が生徒に口頭で質問し、生徒は言葉でそれに答えます。

体力テストは、筋力、敏捷性、持久力を測定するために設計されたテストです。これらは、教育機関では体育カリキュラムの一部として、医療では診断テストの一部として、軍隊や警察など身体能力を重視する分野では適格要件として一般的に使用されています。20世紀を通じて、筋力トレーニングと有酸素運動が全体的な健康維持に役立つことを示す科学的証拠が現れ、より多くの機関が標準化された体力テストを取り入れるようになりました。米国では、 1956年に学童の体力向上を奨励および監視する方法として、大統領青少年体力評議会が設立されました。
一般的なテスト[ 49 ] [ 50 ] [ 51 ]には、タイムを計測したランニングや多段階フィットネステスト (一般に「ビープテスト」として知られている)、腕立て伏せ、腹筋運動、懸垂の回数などがあります。特定の仕事や役割を遂行する能力をテストするために、より専門的なテストが使用される場合があります。多くのジム、民間団体、イベント主催者は独自のフィットネステストを持っています。英国陸軍によって開発された軍事技術や、イリノイアジリティランやクーパーテストなどの現代的なテストを使用しています。[ 52 ]
ストップウォッチによる計測は近年まで一般的でしたが、手動計測は不正確で一貫性がないことが判明しました。[ 53 ]電子計測は、正確性と一貫性を促進し、バイアスを減らすために新しい標準となっています。
実技試験とは、受験者が特定の項目に関する質問に答えるだけでなく、実際に課題や活動を実行することを求める評価方法である。その目的は、試験対象との整合性をより高めることにある。
例えば、運転免許を取得するための実技試験が挙げられます。自動車の運転に関する簡単な選択式問題に答えるだけでなく、受験者は評価を受けながら実際に自動車を運転する必要があります。
パフォーマンス テストは、職場や専門職の用途、例えば専門資格や免許などでよく使用されます。人材選考に使用される場合、テストは作業サンプルと呼ばれることがあります。免許の例としては、美容師が実際に人にヘアカットやマニキュアを施すことが求められる場合があります。グループブルドン テストは、英国の鉄道運転士見習いが合格しなければならない心理測定テストの 1 つです。 [ 54 ]
実技試験の中にはシミュレーション形式のものもあります。例えば、眼科技術者の資格取得のための評価は、多肢選択式試験とコンピュータを用いた技能シミュレーションの2つの要素から構成されています。受験者は、検影法など、職場で一般的に行われる7つの作業をコンピュータ上でシミュレーションし、その能力を実証する必要があります。
中間試験とは、学期の中間、または特定の四半期や学期の中間付近に実施される試験のことです。[ 55 ]中間試験は、形成的評価または 総括的評価の一種です。[ 56 ]
期末試験、年次試験、最終面接、または単に最終試験とは、学習コースや訓練コースの最後に学生に課される試験のことです。この用語は体育の分野でも使われることがありますが、最もよく使われるのは学術分野です。ほとんどの高校、大学、専門学校では、特定の学期(通常は四半期または学期)の終わり、あるいはより伝統的には学位取得コースの終わりに期末試験を実施します。
このテストの目的は、学習したトピックを最終的に復習し、各学生のその科目に関する知識を評価することです。期末試験は厳密には「単元テスト」の拡大版です。目的は同じですが、期末試験の方が規模が大きいだけです。すべてのコースやカリキュラムが期末試験で終わるわけではありません。一部のコースでは、教員が学期末レポートや最終プロジェクトを課す場合があります。期末試験の配点も様々です。学生のコース成績の最大の要素、あるいは唯一の要素となる場合もあれば、中間試験と同じ配点となる場合、または学生が免除される場合もあります。ただし、すべての期末試験が累積的である必要はなく、前回の試験以降に提示された内容のみを対象とするものもあります。たとえば、微生物学のコースでは、教授の方針によっては、期末試験で真菌と寄生虫のみを対象とする場合があり、コースで提示された他のすべての科目は期末試験でテストされません。
試験期間の前に、英連邦諸国のほとんどの学生は、 swotvacと呼ばれる1週間ほどの集中的な復習と学習期間を設けます。
イギリスでは、ほとんどの大学が学位取得課程の最後に一度だけ「最終試験」を実施します。オーストラリアでは試験期間は様々で、高校では一般的に1週間か2週間を期末試験期間としていますが、大学の試験期間(「試験週間」または単に「試験」と呼ばれることもあります)は最長で3週間になる場合もあります。
アメリカ合衆国では、試験の実施方法は大学によって大きく異なります。大学レベルでは、「期末試験」または「期末試験期間」は学期終了後2~3週間を指しますが、授業最終週に試験を実施する場合もあります。一部の大学では、授業終了から期末試験開始までの間に「学習週間」または「読書期間」を設け、この期間中は試験を実施しない場合もあります。多くの大学では、期末試験前の週を「デッドウィーク」と呼んでいます。ほとんどの期末試験は、学期を通して指定された読書範囲を網羅しています。
フランスの高等教育機関では一般的だが、フランスの高校では期末試験はあまり行われない。しかし、大学進学を希望するフランスの高校生は、バカロレアと呼ばれる全国統一試験を受験する。
標準化された試験を実施している国や地域では、学校が実際の試験形式を模した模擬試験を実施するのが一般的です。異なる学校の生徒が試験対策として模擬試験問題を交換する姿もよく見られます。
持ち帰り式期末試験とは、学期末に行われる試験で、通常、授業内での期末試験のように一度に完了するには長すぎたり複雑すぎたりするものです。通常、提出期限が設けられており、学期末から1~2週間以内などが目安となります。持ち帰り式期末試験は、調査研究、長文の記述、データの提示などを含むことが多い期末レポートとは異なります。
学校によっては、期末試験の日程を変更し、生徒に試験時間を十分に確保する場合もあります。しかし、これは必ずしもすべての学校に当てはまるわけではありません。
テスト開発者の視点から見ると、テスト作成に必要な時間と労力には大きなばらつきがあります。同様に、受験者の視点から見ても、特定のテストで希望する成績や点数を獲得するために必要な時間と労力には大きなばらつきがあります。テスト開発者がテストを作成する際、必要な時間と労力は、テスト自体の重要性、受験者の習熟度、テストの形式、クラスの規模、テストの締め切り、そしてテスト開発者の経験によって異なります。
テスト作成のプロセスは、いくつかの方法で支援されてきました。1つには、多くのテスト開発者がかつて学生であったため、以前のテストの問題を修正したり、そのまま採用したりすることができます。一部の国では、書籍出版社が、出版した書籍を授業に採用する大学の教員向けに、テストバンクを含む教材パッケージを提供することがよくありました。[ 57 ]これらのテストバンクには、査読され、長期間テストされた最大4,000のサンプルテスト問題が含まれている場合があります。このテストバンクを使用することを選択した教員は、テストを作成するために、このテストバンクから一定数のテスト問題を選択するだけで済みます。
テストの構成と同様に、受験者がテストの準備に要する時間は、テストの頻度、テスト開発者、およびテストの重要性によって異なります。一般的に、短く、頻繁に行われ、受験者のコース全体の成績やスコアの大部分を占めない非標準化テストでは、受験者はテストの準備に多くの時間を費やす必要はありません。[ 58 ]逆に、長く、頻度が少なく、受験者のコース全体の成績やスコアの大部分を占める非標準化テストでは、受験者はテストの準備に多くの時間を費やす必要があります。非標準化テストの準備のために、受験者は参考書、授業や講義のノート、インターネット、および過去の経験に頼ることができます。受験者は、フラッシュカードや記憶術などのさまざまな学習補助ツールを使用してテストの勉強をすることもできます。[ 59 ]受験者は、希望するテストの成績やスコアを獲得する可能性を高めるために、プロセス全体を通して指導してくれる家庭教師を雇うことさえあります。英国などの国では、近年、個人指導の需要が大幅に増加しています。[ 60 ]最後に、受験者は将来の試験の勉強のために、過去の年度または学期の試験のコピーに頼る場合があります。これらの過去の試験は、過去の試験のコピーを持っている友人やグループ、講師とその所属機関、または試験提供者(試験委員会など)自身から提供される場合があります。[ 61 ] [ 62 ]
非標準化テストとは異なり、標準化テストの準備に要する時間は変動が少なく、通常はかなり長い。これは、標準化テストは通常、範囲、形式、難易度が均一であり、特定の大学プログラムへの入学資格や希望する職業への就業資格など、受験者の将来に関して重要な結果をもたらすことが多いためである。受験者が標準化テストの詳細な解説を提供する市販の本や過去のテストのまとめ(シンガポールの10年分のシリーズなど)に頼って標準化テストの準備を行うことは珍しくない。多くの国では、受験者は標準化テストの準備をより良くするために、受験者に広範なまたは補足的な指導を提供するテスト準備センターや予備校にさえ入学している。香港では、そのようなセンターを運営するチューターはそれ自体が有名人であると示唆されている。[ 63 ]このため、先進国では個人指導が新卒者にとって人気の職業選択となっている。[ 64 ] [ 65 ]最後に、一部の国では、教師とその所属機関も、受験者を標準化テストに備えさせる上で重要な役割を果たしてきました。

テストでの不正行為とは、許可されていない手段や方法を用いて、望ましいテストの点数や成績を得る行為のことです。これには、持ち込み禁止の試験中にメモを持ち込んで使用することから、個人テスト中に他の受験者の解答や選択肢を写すこと、お金を払って替え玉受験者を送ることまで、様々な行為が含まれます。 [ 66 ]
不正行為に対処するために、いくつかの一般的な方法が採用されてきました。それらには、試験期間中に複数の試験監督者または監視員を配置して受験者を監視することが含まれます。試験開発者は、同じ試験の複数のバリエーションを作成して、同時に異なる受験者に実施したり、完全に解答された解答は模倣しにくいという理論に基づいて、選択肢の少ない試験を作成したりすることがあります。[ 67 ]場合によっては、教師自身が試験を実施せず、その作業を他の教師や監視員に任せることがあります。これは、監視員が受験者を知らない可能性があり、そのため何らかの身分証明が必要になる可能性があることを意味します。最後に、教師または試験提供者は、不正行為が行われたかどうかを判断するために、試験で不正行為が疑われる受験者の解答を自ら比較することがあります。
{{cite book}}: CS1メンテナンス: 場所の発行元が見つかりません (リンク){{cite book}}ISBN /日付の不一致(ヘルプ)