教育における成績評価とは、標準化された測定方法を用いて、授業における生徒の達成度を評価することです。成績は、アルファベット(通常はAからF)、範囲(例えば1から6)、パーセンテージ、または満点(多くの場合100点満点)で表されます。使用される具体的な評価システムは、世界中で異なります。
国によっては、成績を平均して成績平均点( GPA )を作成します。[ 1 ] GPA は、一定期間に学生が獲得した成績ポイントの数を使用して計算されます。GPA は、高校生、学部生、大学院生に対してよく計算されます。累積成績平均点( CGPA ) は、学生がその教育機関に在籍している間に取得したすべての GPA の平均です。学生は、特定の学術プログラムに入学するため、またはそのプログラムに在籍し続けるために、一定の GPA を維持することが求められる場合があります。成績は、学生に財政援助や奨学金を提供する決定にも使用されます。[ 2 ]
成績は学業成績と能力の指標とみなされ、GPAは将来の仕事の有効性と成功を示すと考えられています。さらに、GPAと将来の仕事の満足度の間には相関関係があることが研究で示されています。[ 3 ]また、GPAが高いほど収入も高くなることが研究で示されています。[ 4 ]
生徒の評価は少なくとも紀元前500年から行われており、当初は口頭や定性的な方法で行われていました。初期の西洋教育には体系的な測定方法が欠けていましたが、教科の習熟度を追跡するための正式な方法は早くから開拓され、特に明朝と清朝(それぞれ1368 ~ 1644年と1636 ~ 1912年頃)には国家学校制度と深く統合されていた中国の科挙制度がその代表例です。[ 5 ]
ヨーロッパでは、ルーヴァン大学が1400年代半ばまでに学生の成績を評価するための正式な4段階の成績評価基準を確立しました。[ 6 ]米国における正式な評価は後に発展し、ハーバード大学は1600年代半ばに口頭による卒業試験を義務付け始めました。また、ハーバード大学でそれ以前に成績評価が行われていたという間接的な証拠はありますが、[ 7 ]アメリカの高等教育における成績評価基準の最初の公式記録は、1785年にイェール大学で記録されました。 [ 7 ]

イェール大学の歴史家ジョージ・ウィルソン・ピアソンは次のように書いています。「言い伝えによると、イェール大学で最初に発行された成績(おそらく国内で最初の成績)は1785年に発行されたもので、エズラ・スタイルズ学長が58人の上級生を審査した後、日記に『20人のオプティミ、16人のセカンドオプティミ、12人のインフェリオレス(ボニ)、10人のペジョレス』と記録した。」[ 8 ] 1837年までに、イェール大学はこれらの形容詞を4段階の数値に変換し、一部の歴史家はこれが現代のアメリカの標準的なGPAスケールの起源であると述べています。[ 7 ] [ 9 ]
ボブ・マーリンは、学生の成績を量的に評価するという概念は、ウィリアム・ファリッシュという名のチューターによって開発され、1792年にケンブリッジ大学で初めて実施されたと主張している。この主張はクリストファー・ストレイによって疑問視されており、ストレイはファリッシュが数値評価の発明者であるという証拠は説得力に欠けるとしている。ストレイの記事では、試験の形式(口頭または筆記)と、これらの形式が教師と学生の両方に示唆するさまざまな教育哲学との間の複雑な関係についても説明している。[ 10 ]
AD/Fシステムは1897年にマウント・ホリヨーク大学で初めて採用されました。しかし、このシステムが広く普及したのは1940年代になってからで、1971年時点でも米国の小中学校の67%でしか使用されていませんでした。[ 7 ]
成績を上げるために努力すると、学生は生涯学習よりも短期的な学習を優先するようになることがあります。このような成績は、一定期間に学生がどれだけ学習したかの短期的なスナップショットにすぎず、実際のパフォーマンスを部分的にしか反映していません。学生の個々の発達を十分に考慮していません。[ 11 ]学生は将来の生活のためや教材への興味からではなく、成績とそれに伴う地位のためだけに学習することが多く、過食症的な学習を助長します。[ 12 ] [ 13 ]
成績の妥当性に関する質問は、成績が学生の学習とどれだけ一致しているかを問うものです。成績は不正確である可能性があり、また教師の偏見を反映して体系的な偏見を強める可能性もあります。 [ 14 ]
リチャード・デイヴィッド・プレヒトは著書『アンナ、学校、そして愛する神:教育制度が子供たちに及ぼす影響』の中で、学校の成績評価制度を批判している。彼は、1から6までの数字(ドイツで使用されている学校の成績評価制度)は子供たちの個性を正当に評価していないと考えている。彼の意見では、成績は意味がなく、差別化もされていないため、役に立たない。例えば、生徒がより意欲的になったか、あるテーマにもっと興味を持ったか、失敗にうまく対処できるようになったか、新しいアイデアを発展させたかといった質問には、成績では答えられない。代わりに、プレヒトは生徒の学習と発達の過程を差別化した筆記評価を提案している。彼の意見では、成績評価制度は心理学や教育学の知識が不足した時代のものであり、21世紀にはふさわしくない。[ 15 ]能力に基づく評価、仕様に基づく評価、そして「評価なし」といった代替的な評価方法も使用できる。[ 16 ]
長期間にわたって成績が悪いと、生徒はほとんど何も学べない、あるいは全く学べないという印象を与え、すべての子どもが本来持っている学習意欲を損ないます。 [ 11 ] [ 12 ]すでに学習意欲を失い、成績のためだけに勉強している子どもは、最高成績を取った後も学習を続ける理由がありません。[ 12 ]さらに、成績が悪いことは、建設的な支援を提供せず、絶対的な重要数値しか示さないため、生徒にとって破壊的なフィードバックとなります。[ 11 ]悪い成績は、親と子どもの将来の見通しの悪さ、困惑、プレッシャー、ストレス、うつ病につながる可能性があります。[ 11 ] [ 12 ]
マーガレット・ラスフェルトは、成績評価制度は役に立たず、その結果として学校で競争的な思考が生まれると批判し、「学校は成功を組織するためにあるのであって、失敗を記録するためにあるのではない」と述べている。[ 17 ]ジェラルド・ヒューザーは、成績評価制度は、生徒が熱意を持って才能を発揮できる分野に特化することを不可能にしているとして批判している。そうしないと、他の分野の成績が悪化してしまうからである。[ 18 ]また、彼は「すべての子どもに同じ評価基準に従うことを強制すれば、私たちの社会はそれ以上発展しないだろう」とも考えている。[ 18 ]
いくつかの国では、教師が民族や性別などのカテゴリーに基づいて、同一の課題に対して体系的に異なる成績を生徒に与えていることが示されています。[ 19 ] 教育縦断研究によると、「教師の期待は、生徒のモチベーションや努力など、ほとんどの主要な要因よりも大学での成功をよりよく予測する」とのことです。[ 20 ]教師が生徒の特性を知っている試験の結果と、生徒が匿名であるブラインド試験の結果を比較することで、 採点バイアスを検出できます。筆記試験の場合、筆跡のスタイルが生徒に関する情報を伝える可能性があるため、この方法はバイアスを過小評価する可能性があります。 [ 21 ]学生評価における教師の人種的偏見に関する実験的証拠によると、「教師は、黒人著者であるとランダムに示された場合、白人著者の場合よりも学生の作文サンプルを低く評価した。この研究では、この偏見は教師と、人種に対する教師の関係と態度に依存することがわかった。」 [ 22 ] 他の研究では、同じ方法を複数年にわたるコホートに適用して、各教師の個々の偏見を測定している。[ 23 ] あるいは、教師の採点における偏見は、生徒の名前(したがって性別と民族)だけが異なる架空の課題を教師に与えることで、実験的に測定することができる。[ 24 ]
ほとんどの国は独自の成績評価システムを採用しており、同一国内でも教育機関によって評価システムが異なる場合がある。しかし、近年、欧州バカロレアなどの国際的な成績評価基準がいくつか登場している。
Schule ist dazu da, das Gelingen zuorganisieren das Misslingen zu dokumentieren und nicht das Misslingen zu dokumentieren
...sich unsere Gesellschaft nicht weiter [entwickele]... Wenn wir alle Kinder [dazu] zwingen, sich andieselben Bewertungsmaßstäbe anzupassen...