エリエゼル・シュロモ・ユドコウスキー(/ ˌ ɛ l i ˈ ɛ z ər j ʊ d ˈ k aʊ s k i / EL -ee- EH -zər yuud- KOW -skee ; [ 1 ] 1979年9月11日生まれ)は、アメリカの人工知能研究者[ 2 ] [ 3 ] [ 4 ] [ 5 ]であり、意思決定理論と倫理に関する著述家でもあり、友好的人工知能に関するアイデアを普及させたことで知られています。[ 6 ] [ 7 ]彼は、カリフォルニア州バークレーに拠点を置く民間の非営利研究機関である機械知能研究所(MIRI)の創設者であり、研究員でもあります。[ 8 ]
彼が暴走する知能爆発の可能性について研究したことは、哲学者ニック・ボストロムの2014年の著書『超知能:道、危険、戦略』に影響を与えた。[ 9 ]彼は、ネイト・ソアレスと共著したニューヨーク・タイムズのベストセラー『もし誰かがそれを作ったら、誰もが死ぬ:なぜ超人的AIは私たち全員を殺すのか』や、ハリー・ポッターのファンフィクション『ハリー・ポッターと合理性の方法』で最もよく知られている。
ユドコウスキーが将来の世代のAIシステムがもたらす安全性の課題について述べた見解は、スチュアート・ラッセルとピーター・ノーヴィグの学部生向け教科書『人工知能:現代的アプローチ』で論じられている。ラッセルとノーヴィグは、汎用的な目標を手作業で正式に規定することの難しさを指摘し、自律的かつ適応的なシステムは、時間をかけて正しい行動を学習するように設計されるべきだというユドコウスキーの提案を引用している。
ユドコウスキー(2008)[ 10 ]は、フレンドリーAIの設計方法についてさらに詳しく説明している。彼は、フレンドリーさ(人間を傷つけたくないという願望)は最初から設計に組み込むべきだと主張しているが、設計者は、自分たちの設計に欠陥があるかもしれないこと、そしてロボットが時間とともに学習し進化することを認識する必要があるとも述べている。したがって、課題はメカニズム設計の問題であり、チェックアンドバランスのシステムの下でAIを進化させるメカニズムを設計し、そのような変化に直面してもフレンドリーであり続けるような有用機能をシステムに与えることである。[ 6 ]
目標が不適切に設計された自律的意思決定システムは、デフォルトで人間を虐待するインセンティブを持つことになるという、手段的収束の懸念に対し、ユドコウスキーと他のMIRI研究者は、目標が誤って指定されている場合でも、安全なデフォルトの動作に収束するソフトウェアエージェントを指定する作業を行うことを推奨している。 [ 11 ] [ 7 ]ユドコウスキーはまた、2004年に、理想的な認識的および道徳的条件下で人々が望むであろうことを追求するようにAIを設計することを含む、一貫性のある外挿的意志と呼ばれる理論的なAIアライメントフレームワークを提案した。[ 12 ]
IJ Goodが仮説を立てた知能爆発シナリオでは、再帰的に自己改善する AI システムが、人間以下の一般知能から超知能へと急速に移行します。ニック・ボストロムの 2014 年の著書『超知能: 道、危険、戦略』では、グッドの議論を詳細に概説するとともに、高度な AI システムを擬人化することで、人々が知能爆発の本質を誤解するリスクについて、ユドコウスキーの言葉を引用しています。「AI は、人間が『村の馬鹿』と『アインシュタイン』を知能スケールの両極端と考える傾向、つまり一般的な知能スケール上のほとんど区別できない点ではなく、擬人化の結果として、知能が急激に向上するように見えるかもしれません。」[ 6 ] [ 10 ] [ 12 ]
『人工知能:現代的アプローチ』の中で、ラッセルとノーヴィグは、計算複雑性理論から知的な問題解決には既知の限界があるという反論を提起している。アルゴリズムがさまざまなタスクをどれだけ効率的に解決できるかに強い限界がある場合、知能爆発は起こり得ないかもしれない。[ 6 ]
2023年にタイム誌に寄稿した論説で、ユドコウスキーは人工知能のリスクについて論じ、AI開発の全面停止を含む、AIを制限するための国際協定を提唱した。[ 13 ] [ 14 ]彼は、参加国は「不正なデータセンターを空爆で破壊する」などの軍事行動を取る覚悟を持つべきだと示唆し、そのような一時停止を強制すべきだと主張した。[ 5 ]この記事は、AIの方向性に関する議論を主流に広めるのに役立ち、記者会見でジョー・バイデン大統領にAIの安全性について質問する記者が現れた。 [ 2 ]
ユドコウスキーはネイト・ソアレスと共に『If Anyone Builds It, Everyone Dies』を執筆し、2025年9月16日にリトル・ブラウン・アンド・カンパニーから出版された。[ 15 ]
2006年から2009年にかけて、ユドコウスキーとロビン・ハンソンは、オックスフォード大学の人類の未来研究所が後援する認知科学と社会科学のブログであるOvercoming Biasの主要な寄稿者でした。2009年2月、ユドコウスキーは「人間の合理性の技術を磨くことに専念するコミュニティブログ」であるLessWrongを設立しました。 [ 16 ] [ 17 ] Overcoming Biasはその後ハンソンの個人ブログとして機能し、LessWrongは合理主義コミュニティの主要なオンラインハブに成長しました。
ユドコウスキーによる哲学と科学に関する300以上のブログ記事(元々はLessWrongとOvercoming Biasに掲載)は、2015年にMIRIから電子書籍『Rationality: From AI to Zombies』として出版された。 [ 18 ]この本は『The Sequences』とも呼ばれている。[ 19 ] MIRIはまた、ユドコウスキーの2017年の電子書籍『Inadequate Equilibria』 、社会の非効率性に関する本も出版している。[ 20 ]
ユドコウスキーは、いくつかのフィクション作品も執筆している。彼のファンフィクション小説『ハリー・ポッターと合理性の方法』は、 J・K・ローリングのハリー・ポッターシリーズのプロット要素を用いて、科学と合理性のトピックを説明している。[ 16 ] [ 21 ] [ 22 ]
ユドコウスキーは農業遺伝学者モリス・ソラーの孫である。[ 23 ]
ユドコウスキーは独学で[ 24 ]、高校や大学には通っていません[ 25 ] 。彼はユダヤ人で、現代正統派ユダヤ教徒として育ちましたが、現在は世俗的です[ 26 ] [ 27 ] 。
ベイ エリアにある機械知能研究所の研究員、エリザー・ユドコウスキー氏は、AI の安全に関する推奨事項を火災報知器システムに例えている。古典的な実験では、複数の人がいる部屋に煙の霧が充満し始めたとき、ほとんどの人がそれを報告しなかったことがわかった。彼らは他の人が冷静でいるのを見て、危険を軽視した。公式の警報は、行動を起こすことが正当であることを知らせるかもしれない。しかし、AI では、そのような警報を鳴らす明確な権限を持つ人は誰もおらず、どの進歩が火災の証拠になるかについて、人々は常に意見が分かれるだろう。「実際に動いている AGI でない火災報知器はないだろう」とユドコウスキー氏は書いている。たとえ誰もが脅威を認識していたとしても、競合他社に追い抜かれることを恐れて、どの企業や国も自主的にAI開発を一時停止しようとはしないだろう。…そのためには、運命を弄びながら限界に近づくのではなく、停止すべき時だと感じる前に、AI開発をきっぱりとやめることが必要になるかもしれない。しかし、すべてを停止するには、厳格な措置が必要となるだろう。おそらく、
タイム誌
の論説で最近「全面核戦争」を引き起こすリスクを冒してでも、「暴走したデータセンターを空爆で破壊する覚悟を持つべきだ」と書いたユドコウスキー氏が提唱するような極端な措置が必要になるかもしれない。
『シークエンス』は、[合理主義]運動を生み出した原典である。