教育測定とは、教育評価の実施や、教育評価から得られたスコアなどのデータの分析を通して、生徒の能力や習熟度を推測することを指します。このアプローチは、心理測定学のアプローチと重複する部分があります。教育測定は、達成度、興味、態度、適性、知能、パフォーマンスといった特性に数値を割り当てるものです。
教育測定における理論と実践の目的は、一般的に、読解、作文、数学、科学などの分野における生徒の能力と達成度を測定することです。従来、評価の信頼性と妥当性に焦点が当てられてきました。実際には、教育測定は主に教育評価やテストから得られたデータの分析に関わっています。これは通常、多肢選択式か記述式かを問わず、採点基準やガイドを用いて採点された評価の合計点を用いることを意味します。
技術的には、個々の生徒による個々の項目の得点パターンを使用して、生徒のいわゆる尺度位置、つまり「測定値」を推測します。このプロセスはスケーリングの一形態です。基本的に、合計得点が高いほど尺度位置が高くなり、これは合計得点の伝統的かつ日常的な使用と一致します。[ 1 ]ただし、特定の理論を使用すると、合計得点の順序と尺度位置の順序の間には厳密な対応関係はありません。ラッシュモデルは、すべての生徒が同じテスト項目に挑戦するか、または同じ採点基準を使用してパフォーマンスが評価される場合に、厳密な対応関係を提供します。
純粋に数学的な理論の広範な体系という点では、教育測定と心理測定学の間にはかなりの重複がある。しかし、古典的テスト理論、項目反応理論、ラッシュモデルなど、心理測定学の一部と考えられている特定のアプローチは、もともと教育評価のデータ分析のために開発されたものである。[ 2 ] [ 3 ]
教育測定に理論と手法を適用する目的の一つは、テスト等化と呼ばれるプロセスを通して、異なる学生グループに実施された様々なテストの結果を、単一の共通尺度上に位置づけることである。その根拠は、異なる評価は通常、難易度が異なるため、合計スコアを直接比較することはできないという点にある。結果を共通尺度上に位置づけようとする目的は、尺度化プロセスを通して合計スコアから推測される尺度上の位置を比較できるようにするためである。