『人間と互換性:人工知能と制御の問題』は、コンピュータ科学者のスチュアート・J・ラッセルによる2019年のノンフィクション書籍である。本書は、高度な人工知能(AI)が人類にもたらすリスクは、AIの将来の進歩を取り巻く不確実性にもかかわらず、深刻な懸念事項であると主張している。また、 AI制御問題へのアプローチも提案している。
ラッセルはまず、AI研究の標準モデル、すなわち成功の主な定義が人間が定めた厳格な目標の達成能力の向上にあるというモデルは、危険なほど誤っていると主張する。こうした目標は、目標に含まれていない人間の価値観を考慮していないなど、人間の設計者の意図を反映していない可能性がある。標準モデルに従って開発されたAIが超知能になった場合、人間の価値観を完全に反映することはなく、人類にとって破滅的な結果をもたらす可能性がある。ラッセルは、人間レベルまたは超知能AIの開発時期が非常に不確実であるため、安全性の研究をできるだけ早く開始すべきだと主張する。なぜなら、そのような研究の完了にどれくらいの時間がかかるかも非常に不確実だからである。
ラッセル氏は、経済的圧力によってAIの能力向上は必然的に進むと主張している。こうした圧力は、自動運転車やパーソナルアシスタントソフトウェアといった既存のAI技術の開発にも既に表れている。さらに、人間レベルのAIは数兆ドル規模の市場となる可能性を秘めている。ラッセル氏は次に、AIリスクをめぐる現在の議論を検証する。AIリスクを否定する多くの一般的な主張に反論し、そうした主張が根強く残る理由の多くは、AI研究者がAIリスクへの懸念を自分たちの分野への「攻撃」と捉えるという、いわば部族主義にあると指摘する。ラッセル氏は、AIリスクへの懸念を真剣に受け止めるべき正当な理由があり、経済的圧力によってAIの継続的なイノベーションは必然的に進むと改めて強調する。
ラッセルは次に、人間への配慮を重視する、実証可能な有益な機械を開発するためのアプローチを提案する。目的が厳格かつ明確である従来のAIモデルとは異なり、このアプローチではAIの真の目的は不明確なままであり、AIは人間や世界に関する情報を得るにつれて、その目的についてより確信を深めていく。この不確実性によって、理想的には人間の嗜好に対する壊滅的な誤解を防ぎ、人間との協力とコミュニケーションが促進される。ラッセルは最後に、AIの研究開発に対するより厳格なガバナンスと、AIが支配する世界において保持すべき適切な自律性の量についての文化的内省を提唱する。
ラッセルは、有益な機械の開発を導く3つの原則を挙げている。彼は、これらの原則は機械に明示的にコード化されるべきものではなく、むしろ人間の開発者のためのものであることを強調している。その原則は以下のとおりである。[ 1 ]: 173
1. 機械の唯一の目的は、人間の好みを最大限に実現することである。
2. 機械は当初、それらの好みが何であるか確信が持てない。
3. 人間の嗜好に関する究極の情報源は、人間の行動である。
ラッセルが言及する「選好」は「包括的であり、あなたが関心を持つであろうあらゆる事柄を、任意に遠い未来まで網羅する」[ 1 ]: 173同様に、「行動」には選択肢間のあらゆる選択が含まれ[ 1 ]: 177不確実性が高いため、論理的に可能なあらゆる人間の選好に、非常に小さいかもしれないが、何らかの確率を割り当てる必要がある[ 1 ]: 201
ラッセルは、機械が観察された行動から報酬関数を推論する逆強化学習を、人間の嗜好を学習するメカニズムの可能性のある基礎として探求している。[ 1 ]: 191-193
複数の書評家が本書の主張に賛同した。ガーディアン紙のイアン・サンプルは本書を「説得力がある」「今年最も重要なAIに関する書籍」と評した。[ 2 ]フィナンシャル・タイムズ紙のリチャード・ウォーターズは本書の「刺激的な知的厳密さ」を称賛した。[ 3 ]カーカス・レビューは本書を「機械が人間より賢くなる日に備えて計画を立てるべき強力な根拠」として支持した。[ 4 ]
同じ批評家たちは、この本を「皮肉で機知に富んでいる」[ 2 ]、あるいは「簡潔な文体と辛口のユーモア」[ 3 ] のおかげで「分かりやすい」[ 4 ]と評した。ウォール・ストリート・ジャーナルのマシュー・ハトソンは、「ラッセル氏の刺激的な本は、辛口の機知に富みながらも奥深い」[ 5 ]と評した。ライブラリー・ジャーナルの批評家は、「まさに今必要なガイドだ」[ 6 ]と評した。
タイムズ紙のジェームズ・マコナキーは、「これはAIが緊急に必要としているような一般向けの書籍とは言えない。技術的な部分は難解すぎ、哲学的な部分は簡単すぎる。しかし、魅力的で重要な本である」と書いている。[ 7 ]
対照的に、『ヒューマン・コンパチブル』は、アラン・チューリング研究所の倫理研究員であるデイビッド・レスリーによるネイチャー誌のレビューで批判され、同様にメラニー・ミッチェルによるニューヨーク・タイムズの論説でも批判された。論争の1つは、超知能が可能かどうかであった。レスリーは、ラッセルは「我々が『第二の知的種』の到来を目にするだろうと説得力をもって説明できていない」と述べており[ 8 ]、ミッチェルは、機械が「コンピュータの速度、精度、プログラム可能性」を失うことなく「人間の知能の汎用性と柔軟性を超える」ことはあり得ないと考えている[ 9 ] 。2つ目の意見の相違は、知能機械が、いわゆる「常識」的な道徳的価値観を自然に採用する傾向があるかどうかであった。ラッセルの「海洋の酸性度を下げるために人類を窒息させる」地球工学ロボットに関する思考実験において、レスリーは「知能を特定するのに苦労している」。同様に、ミッチェルは、知能ロボットは「一般的な知能が存在し得ない常識、価値観、社会的判断によって自然と抑制される」傾向があると考えている。[ 10 ] [ 11 ]
この本は2019年のフィナンシャル・タイムズ/マッキンゼー賞のロングリストに選ばれた。[ 12 ]