Wayback Machineは、カリフォルニア州サンフランシスコに拠点を置くアメリカの非営利団体であるインターネットアーカイブによって設立されたワールドワイドウェブのデジタルアーカイブです。2001年に一般公開されたこのサービスでは、ユーザーは「過去に戻って」ウェブサイトが過去にどのように見えたかを見ることができます。創設者のブリュースター・カーレとブルース・ギリアットは、廃止されたウェブページのアーカイブコピーを保存することで「すべての知識への普遍的なアクセス」を提供するためにWayback Machineを開発しました。[ 2 ]
この名前は、 1960年代のアニメ「ロッキーとブルウィンクル」に登場する同名の架空のタイムトラベル装置に由来する。 [ 3 ] [ 4 ] [ 5 ]「ピーボディのありえない歴史」というタイトルのアニメのエピソードでは、ピーボディ氏とシャーマンが「ウェイバックマシン」を使って過去にタイムトラベルし、有名な歴史的出来事を目撃したり参加したりする。[ 6 ]
Wayback Machineの最も古いアーカイブは少なくとも1995年まで遡り、2009年末までに382億以上のウェブページが保存された。2025年10月現在 Wayback Machineは1兆ページ以上のウェブページと99ペタバイトを超えるデータをアーカイブしている。[ 7 ] [ 8 ]
インターネットアーカイブは、少なくとも1995年からキャッシュされたウェブページをアーカイブしています。最も古い既知のページ( BBCのランディングページ)は、1995年3月1日にWayback Machineによってアーカイブされました。[ 9 ] [ 10 ]
インターネット アーカイブの創設者であるブリュースター・カーレとブルース・ギリアットは、主にウェブコンテンツが変更されたり、ウェブサイトが閉鎖されたりするたびにウェブコンテンツが消えてしまう問題に対処するため、2001 年 10 月にカリフォルニア州サンフランシスコでWayback Machine を立ち上げました。 [ 1 ] [ 11 ] [ 12 ] [ 13 ]このサービスにより、ユーザーはウェブページのアーカイブされたバージョンを時系列で見ることができ、アーカイブではこれを「3 次元インデックス」と呼んでいます。[ 14 ]カーレとギリアットは、インターネット全体をアーカイブし、「すべての知識への普遍的なアクセス」を提供することを目標にこのマシンを作成しました。[ 15 ]
1996年から2001年まで、情報はデジタルテープに保存され、カーレは時折、研究者や科学者が「扱いにくい」データベースにアクセスできるようにしていた。[ 16 ] 2001年にアーカイブが5周年を迎えたとき、カリフォルニア大学バークレー校での式典で公開され、一般に公開された。[ 17 ] Wayback Machineが稼働した時点で、すでに100億ページを超えるアーカイブページが含まれていた。[ 18 ]データは、インターネットアーカイブの大規模なLinuxノードのクラスターに保存されている。[ 15 ]時々、Webサイトの新しいバージョンを再訪してアーカイブする(技術的な詳細は下記参照)。[ 19 ] WebサイトがWayback Machineによる「クロール」とデータの保存を許可している場合、WebサイトのURLを検索ボックスに入力することで、手動でサイトをキャプチャすることもできる。 [ 7 ]
インターネットアーカイブは2009年に独自のストレージアーキテクチャをSun Open Storageに移行し、サンマイクロシステムズのカリフォルニアキャンパスにあるSun Modular Datacenterに新しいデータセンターを設置した。[ 20 ]
インターフェースが更新され、アーカイブされたコンテンツのインデックスがより新しくなった、改良版の Wayback Machine が 2011 年に一般公開テスト用に提供されました。キャプチャはカレンダーレイアウトで表示され、円の幅は毎日のクロール数を視覚化しますが、重複をアスタリスクでマークしたり、高度な検索ページはありません。[ 21 ] [ 22 ]キャプチャ間のナビゲーションを容易にするために、上部のツールバーが追加されました。棒グラフは、年ごとの月ごとのキャプチャ頻度を視覚化します。[ 23 ]その後、「変更」、「概要」、グラフィカルなサイトマップなどの機能が追加されました。
2013年10月、Wayback Machineは「今すぐページを保存」機能を導入しました。この機能により、インターネットユーザーはURLのコンテンツをアーカイブでき、以前のライブウェブ機能とは異なり、すぐに永続的なリンクを生成できます。[ 24 ] [ 25 ]
2020年10月30日、Wayback Machineはコンテンツのファクトチェックを開始しました。[ 26 ] 2022年1月現在、広告サーバーのドメインはキャプチャが無効になっています。[ 27 ]
2021年5月、インターネットアーカイブの25周年を記念して、ウェイバックマシンは「ウェイフォワードマシン」を導入しました。これは、ユーザーが「知識が危機に瀕している2046年のインターネットへ旅する」ことを可能にするものです。[ 28 ] [ 29 ]
アーカイブプロジェクトの問題により、2025 年 5 月から 10 月にかけて、ニュース出版物におけるページキャプチャが 87 % 減少しました。[ 30 ] 2026 年 2 月までに、ガーディアンやニューヨーク タイムズなどの多くのニュース組織は、キャプチャのAIスクレイピングに対する懸念から、Wayback Machine をブロックし始めました。[ 31 ] [ 32 ]
Wayback Machine のソフトウェアは、Web を「クロール」して、Web ページ、 Gopher階層、Netnews (Usenet) 掲示板システム、およびソフトウェア上の公開されているすべての情報とデータ ファイルをダウンロードするように開発されました。[ 33 ]これらの「クローラー」によって収集される情報には、インターネットで利用可能なすべてのコンテンツが含まれているわけではありません。データの多くは発行者によって制限されているか、アクセスできないデータベースに保存されているためです。部分的にキャッシュされた Web サイトの不整合を克服するために、2005 年に Internet Archive によって Archive-It.org が開発されました。これは、機関やコンテンツ作成者がデジタル コンテンツのコレクションを自主的に収集して保存し、デジタル アーカイブを作成できるようにする手段です。[ 34 ]
クロールはさまざまなソースから提供され、一部はサードパーティからインポートされ、その他はアーカイブによって内部的に生成されます。[ 19 ]例えば、コンテンツは、スローン財団とAlexaによって提供されたクロール、 NARAとインターネットメモリ財団のためにインターネットアーカイブが実行するクロール、アーカイブチームによってアーカイブされたウェブページ、[ 35 ]およびCommon Crawlのミラーから得られます。[ 19 ]「ワールドワイドウェブクロール」は2010年から実行されており、グローバルウェブをキャプチャします。[ 19 ] [ 36 ] 2020年9月、インターネットアーカイブは、米国のコンテンツ配信ネットワークサービスプロバイダーであるCloudflareと提携し、「Always Online」サービスを介して配信されるウェブサイトを自動的にインデックス化すると発表しました。[ 37 ]
ドキュメントやリソースは、 などのタイムスタンプ付き URL で保存されます20260730024401。画像、スタイルシート、スクリプトなどのページの個々のリソースや外部ハイパーリンクは、現在表示されているページのタイムスタンプで にリンクされているため、時間的に最も近い個々のキャプチャに自動的にリダイレクトされます。[ 38 ]
スナップショットの取得頻度はウェブサイトによって異なります。[ 19 ]「ワールドワイドウェブクロール」に含まれるウェブサイトは「クロールリスト」に含まれ、クロールごとにサイトがアーカイブされます。[ 19 ]クロールは、規模によっては完了までに数か月または数年かかる場合があります。[ 19 ]例えば、「ワイドクロールナンバー13」は2015年1月9日に開始され、2016年7月11日に完了しました。[ 39 ]ただし、同時に複数のクロールが進行中の場合があり、サイトが複数のクロールリストに含まれる場合もあるため、サイトがクロールされる頻度は大きく異なります。[ 19 ]
2019年10月から、ユーザーは1分あたり15件のアーカイブ要求と取得に制限されました。 [ 40 ]
長年にわたり技術が発展するにつれて、Wayback Machine のストレージ容量は増加してきました。2003 年、一般公開からわずか 2 年で、Wayback Machine は月 12 テラバイトの速度で増加していました。データは、インターネット アーカイブのスタッフが独自に設計したPetaBoxラック システムに保存されています。最初の 100 TB ラックは 2004 年 6 月に完全に稼働しましたが、すぐにそれよりもはるかに多くのストレージが必要になることが明らかになりました。[ 43 ] [ 44 ]
2009年現在Wayback Machineには約3ペタバイトのデータが含まれており、毎月100テラバイトのペースで増加していた。 [ 45 ]
同年3月、Wayback Machineフォーラムで「新しいWayback Machineのベータ版は、2010年までのクロールされたすべての資料のより完全で最新のインデックスを備えており、定期的に更新され続ける。従来のWayback Machineのインデックスは2008年以降の資料が少ししかなく、今年中に段階的に廃止されるため、インデックスの更新は予定されていない」と述べられた。[ 46 ]また、2011年には、インターネットアーカイブが6組目のPetaBoxラックを設置し、Wayback Machineのストレージ容量を700テラバイト増加させた。[ 47 ]
2013年1月、インターネットアーカイブはURLが2400億に達したという節目を発表しました。[ 48 ]
2014年12月時点で、Wayback Machineには4350億のウェブページ(約9ペタバイトのデータ)が保存されており、週に約20テラバイトのペースで増加していた。[ 18 ] [ 49 ]
2016年7月時点で、Wayback Machineには約15ペタバイトのデータが含まれていると報告されている。[ 50 ] 2016年10月、ウェブページのカウント方法が変更され、表示されるアーカイブされたページ数が減少することが発表された。画像、動画、スタイルシート、JavaScriptなどの埋め込みオブジェクトは「ウェブページ」としてカウントされなくなり、HTML、PDF、プレーンテキスト文書は引き続きカウントされる。[ 51 ]
2018年9月時点で、Wayback Machineには25ペタバイトを超えるデータが含まれていました。[ 52 ] [ 53 ] 2020年12月時点で、Wayback Machineには70ペタバイトを超えるデータが含まれていました。[ 54 ]
2025年には、Wayback Machineがアーカイブしたウェブページ数が1兆ページに達し、それを祝う一連のイベントが10月を通して予定されている。[ 55 ]
Wayback Machine サービスは、SavePageNow、Availability、CDX の 3 つの公開 API を提供しています。[ 56 ] SavePageNow は、Web ページのアーカイブに使用できます。Availability API は、Web ページのアーカイブの可用性ステータスを確認するために使用され、[ 57 ] Web ページのアーカイブが存在するかどうかを確認します。CDX API は、キャプチャされたデータの複雑なクエリ、フィルタリング、および分析に使用されます。[ 58 ] [ 59 ]
歴史的に、Wayback Machine は、 Web サイトをクロールするかどうか、または既にクロールされている場合はそのアーカイブを公開するかどうかを決定する際に、 robots 除外標準 (robots.txt) を尊重してきました。Web サイト所有者は、robots.txt を使用して Wayback Machine からオプトアウトするオプションがありました。robots.txt ルールは遡及的に適用されました。サイトがインターネット アーカイブをブロックした場合、そのドメインから以前にアーカイブされたページもすぐに利用できなくなりました。さらに、インターネット アーカイブは、「Web サイト所有者が直接連絡して、サイトのクロールやアーカイブを停止するように依頼することがあります。私たちはこれらの要求に従います。」と述べています。[ 60 ]また、Web サイトには、「インターネット アーカイブは、資料をコレクションに含めたくない人の Web サイトやその他のインターネット ドキュメントを保存したり、アクセスを提供したりすることには関心がありません。」と書かれています。[ 61 ] [ 62 ]
インターネット アーカイブは、閉鎖され、検索エンジンから除外するために robots.txt を使用するパーク ドメインとなったサイトが急増し、その結果 Wayback Machine から除外されるようになったことを受けて、2017 年 4 月 17 日にポリシーを変更し、Wayback Machine からサイトを削除するには明示的な除外リクエストが必要であるとした。[ 63 ] [ 38 ]
Waybackの遡及的除外ポリシーは、2002年にカリフォルニア大学バークレー校情報管理システム学部が発行した「削除要求の管理とアーカイブの完全性の維持に関する勧告」(通称「オークランド・アーカイブ・ポリシー」)に一部基づいており、ウェブサイトの所有者にサイトのアーカイブへのアクセスをブロックする権利を与えている。[ 64 ] Waybackはこのポリシーを遵守することで、高額な訴訟を回避している。[ 65 ]
Wayback の遡及的除外ポリシーは 2017 年に緩和され始め、米国政府および軍事 Web サイト上のロボットによるウェブページのクロールと表示の両方を禁止しました。2017 年 4 月現在、Wayback は米国政府の Web サイトだけでなく、より広範に robots.txt を無視しています。[ 66 ] [ 67 ] [ 68 ] [ 69 ]

Wayback Machineは、2001年の一般公開以来、データの保存と収集方法、そしてアーカイブに含まれる実際のページの両方について、研究者によって研究されてきた。2013年時点で、研究者たちはWayback Machineに関する約350の記事を執筆しており、そのほとんどは情報技術、図書館学、社会科学の分野からである。社会科学の研究者たちは、Wayback Machineを使用して、1990年代半ばから現在までのウェブサイトの発展が企業の成長にどのような影響を与えたかを分析してきた。[ 18 ]
Wayback Machine がページをアーカイブすると、通常はほとんどのハイパーリンクが含まれるため、インターネットの不安定さによってリンクが壊れてしまう可能性があった場合でも、それらのリンクは有効なままになります。インドの研究者たちは、オンラインの学術出版物におけるハイパーリンクを保存する Wayback Machine の有効性を調査し、半分強を保存できることを発見しました。[ 70 ]
「ジャーナリストは、閉鎖されたウェブサイト、古いニュース記事、ウェブサイトの内容の変更を確認するためにウェイバックマシンを使用します。その内容は、政治家の責任を追及し、戦場での嘘を暴くために使用されてきました。」[ 71 ] 2014年、ウクライナの分離主義反乱指導者イゴール・ギルキンのアーカイブされたソーシャルメディアページには、彼が自分の部隊がウクライナ軍機と思われる飛行機を撃墜したと自慢している投稿がありましたが、実際にはその飛行機が民間のマレーシア航空のジェット機(マレーシア航空17便)であることが判明した後、彼は投稿を削除し、飛行機を撃墜したのはウクライナ軍だと非難しました。[ 71 ] [ 72 ] 2017年、科学のための行進は、誰かがArchive.orgにアクセスし、ホワイトハウスのウェブサイトから気候変動に関するすべての言及が削除されていることを発見したというRedditでの議論から始まりました。これに対し、あるユーザーは「ワシントンで科学者の行進が必要だ」とコメントしました。[ 73 ] [ 74 ] [ 75 ]
このサイトは検証に多用されており、Wikipedia編集者による参照やコンテンツ作成へのアクセスを提供している。[ 76 ] Wikipediaに新しいURLが追加されると、インターネットアーカイブがそれらをアーカイブしている。[ 76 ]
2020年9月、 Cloudflareとの提携が発表され、同社の「Always Online」サービスで配信されるウェブサイトを自動的にアーカイブし、元のホストに接続できない場合は、ユーザーをサイトのコピーに誘導することも可能になった。[ 37 ]
2014年当時、ウェブサイトがクロールされてからWayback Machineで閲覧可能になるまでには6ヶ月の遅延がありました。[ 77 ] 2024年現在、遅延時間は3~10時間です。[ 38 ] Wayback Machineは検索機能が限られています。「サイト検索」機能では、ウェブページ自体にある単語ではなく、サイトを説明する単語に基づいてサイトを検索できます。[ 78 ]
Wayback Machine は、Web クローリングのさまざまな制限により、これまで作成されたすべての Web ページを網羅しているわけではありません。Wayback Machine は、Flash プラットフォームや JavaScript で記述されたフォーム、プログレッシブ Web アプリケーションなどのインタラクティブな機能を含む Web ページを完全にアーカイブすることはできません。これらの機能はホスト Web サイトとのやり取りを必要とするためです。つまり、アーカイブ チームによると、コメントはもはや「ページ自体に読み込まれない」ため、2013 年 7 月 9 日頃から、Wayback Machine は動画の視聴ページを保存する際に YouTube のコメントを表示できなくなりました。[ 79 ] Wayback Machine の Web クローラーは、HTML またはその派生形式でコーディングされていないものを抽出するのが難しく、その結果、ハイパーリンクが壊れたり、画像が欠落したりすることがよくあります。このため、Web クローラーは、他のページからリンクされていない「孤立ページ」をアーカイブできません。[ 78 ] [ 80 ] Wayback Machine のクローラーは、事前に設定された深さ制限に基づいて、あらかじめ決められた数のハイパーリンクのみをたどるため、すべてのページのすべてのハイパーリンクをアーカイブすることはできません。[ 36 ]
2009年のNetbula, LLC対Chordiant Software Inc.の訴訟において、被告Chordiantは、Netbulaに対し、Wayback MachineがNetbulaのサイトからアーカイブしたページの以前のバージョンへのアクセスを遡及的に削除する原因となっていたrobots.txtファイルを無効化するよう求める申し立てを行った。Chordiantは、これらのページが自社の主張を裏付けるものになると考えていた。[ 81 ]
Netbulaは、被告らがNetbulaのウェブサイトの変更を求めていること、そして被告らはインターネットアーカイブに直接ページを召喚すべきだったことを理由に、この申し立てに異議を唱えた。[ 82 ]しかし、インターネットアーカイブの従業員は、Chordiantの申し立てを支持する宣誓供述書を提出し、「相当な負担、費用、業務の中断なしには、他の手段でウェブページを提出することはできない」と述べた。[ 81 ]
カリフォルニア州北部地区サンノゼ支部のハワード・ロイド治安判事は、Netbulaの主張を却下し、Chordiantが求めていたアーカイブされたページを取得できるように、robots.txtによるブロックを一時的に無効にするよう命じた。[ 81 ]
2004年10月のTelewizja Polska USA, Inc. v. Echostar Satellite事件(No. 02 C 3293, 65 Fed. R. Evid. Serv. 673 (ND Ill. October 15, 2004))において、訴訟当事者は、おそらく初めて、Wayback Machineアーカイブを証拠として提出しようと試みた。Telewizja PolskaはTVP Poloniaのプロバイダーであり、EchoStarはDish Networkを運営している。裁判手続きに先立ち、EchoStarは、Telewizja Polskaのウェブサイトの過去のコンテンツの証拠としてWayback Machineのスナップショットを提出する意向を示した。 Telewizja Polska は、伝聞証拠および認証されていない情報源を理由にスナップショットを排除する動議を提出したが、治安判事の Arlander Keys は Telewizja Polska の伝聞証拠の主張を却下し、裁判で証拠を排除する TVP の動議を却下した。[ 83 ] [ 84 ]しかし、裁判では、裁判長である地方裁判所判事の Ronald Guzman は、治安判事 Keys の判断を覆し、インターネット アーカイブの従業員の宣誓供述書も、その基となるページ (つまり Telewizja Polska の Web サイト) も証拠として認められないと判断した。Guzman 判事は、従業員の宣誓供述書には伝聞証拠と決定的な裏付けとなる陳述の両方が含まれており、問題の Web ページや印刷物は自己認証できないと判断した。[ 85 ] [ 86 ]
米国特許商標庁および欧州特許庁は、インターネットアーカイブの日付スタンプを、特定のウェブページが一般に公開された時期の証拠として受け入れます。これらの日付は、例えば特許出願の審査において、ウェブページが先行技術として利用可能かどうかを判断するために使用されます。 [ 87 ]
ウェブサイトのアーカイブには技術的な制約があり、その結果、訴訟の相手方がウェブサイトのアーカイブから得られる結果を悪用する可能性があります。この問題は、基となるリンクが公開されていないためエラーが含まれている可能性があるにもかかわらず、訴状、答弁書、または専門家証人報告書にウェブページのスクリーンショットを提出する慣行によって悪化する可能性があります。たとえば、Wayback Machine などのアーカイブはフォームに入力しないため、RESTfulではない電子商取引データベースの内容をアーカイブに含めません。[ 88 ]
ヨーロッパでは、Wayback Machine は著作権法に違反していると解釈される可能性があります。コンテンツの公開場所や複製場所を決定できるのはコンテンツ作成者だけなので、アーカイブは作成者の要求に応じてシステムからページを削除する必要があります。[ 89 ] Wayback Machine の除外ポリシーは、サイトの FAQ セクションに記載されています。[ 90 ]
インターネットアーカイブに対しては、特にWayback Machineによるアーカイブ活動を理由に訴訟が起こされた事例がいくつかある。
2002年後半、インターネットアーカイブは、サイエントロジーを批判する様々なサイトをウェイバックマシンから削除した。[ 91 ]エラーメッセージには、これは「サイト所有者からの要請」によるものだと記載されていた。[ 92 ]後に、サイエントロジー教会の弁護士が削除を要求し、サイト所有者は自分たちのコンテンツが削除されることを望んでいなかったことが明らかになった。 [ 93 ]
2003年、ハーディング・アーリー・フォルマー&フレイリー法律事務所は、インターネットアーカイブのウェイバックマシンを使用して商標紛争で依頼人を弁護した。弁護士らは、数年前のウェブサイトの内容に基づいて、原告の主張が無効であることを証明できた。原告のヘルスケア・アドボケイツはその後、訴状を修正してインターネットアーカイブを追加し、著作権侵害、DMCA違反、コンピュータ詐欺および濫用法違反で同組織を訴えた。ヘルスケア・アドボケイツは、ウェブサイトにrobots.txtファイルをインストールしていたため、最初の訴訟提起後であっても、アーカイブはウェイバックマシンから原告ウェブサイトの過去のコピーをすべて削除すべきだったと主張したが、一部の資料はウェイバック上で引き続き公開されていた。[ 94 ]ウェイバックが問題を修正した後、訴訟は法廷外で和解した。[ 95 ]
活動家のスザンヌ・シェルは、2005年12月に訴訟を起こし、インターネット・アーカイブが1999年から2004年の間に彼女のウェブサイトprofane-justice.orgをアーカイブしたことに対して10万米ドルを支払うよう要求した。[ 96 ] [ 97 ]インターネット・アーカイブは、2006年1月20日にカリフォルニア州北部地区連邦地方裁判所に確認判決訴訟を起こし、インターネット・アーカイブがシェルの著作権を侵害していないという司法判断を求めた。シェルはこれに反論し、インターネット・アーカイブが彼女のサイトをアーカイブしたことは利用規約に違反しているとして、反訴を起こした。[ 98 ] 2007年2月13日、コロラド州地区連邦地方裁判所の判事は、契約違反を除くすべての反訴を却下した。[ 97 ]インターネット・アーカイブは、シェルがコピー活動から生じたと主張する著作権侵害の申し立てを却下するよう申し立てなかったため、この申し立ても継続されることになった。[ 99 ]
2007年4月25日、インターネットアーカイブとスザンヌ・シェルは共同で訴訟の和解を発表した。[ 96 ]インターネットアーカイブは、「ウェブコンテンツのアーカイブを望まない人物の資料をウェイバックマシンに含めることには関心がない。シェル氏が自身のウェブサイトに対して有効かつ強制力のある著作権を有していることは認識しており、彼女のウェブサイトがウェイバックマシンに含まれたことが今回の訴訟につながったことを遺憾に思う」と述べた。シェル氏は、「インターネットアーカイブの目標の歴史的価値を尊重している。その目標を妨害したり、損害を与えたりするつもりは全くなかった」と述べた。[ 100 ]
2013年から2016年にかけて、ポルノ俳優のダニエル・ダヴィディウクは、まずアーカイブに複数のDMCAリクエストを送信し、次にカナダ連邦裁判所に訴えることで、Wayback Machineのアーカイブから自身のアーカイブ画像を削除しようと試みた。[ 101 ] [ 102 ] [ 103 ]これらの画像は2017年にウェブサイトから削除された。
2018年、ストーカーウェアアプリケーションFlexiSpyのウェブサイトのアーカイブがWayback Machineから削除された。同社は、おそらくウェブサイトのアーカイブを削除するためにインターネットアーカイブに連絡したと主張した。[ 62 ]
Archive.org は中国でブロックされています。[ 104 ] [ 105 ] [ 106 ]インターネット アーカイブは、2015~16 年にロシアで完全にブロックされました。表向きの理由は、ジハードの宣伝ビデオをホストしていたためです。[ 71 ] [ 107 ] [ 108 ] 2016 年以降、ウェブサイトは完全に復活しましたが、2016 年にロシアの商業ロビイストが著作権を理由にインターネット アーカイブを禁止するよう訴訟を起こしていました。[ 109 ]
図書館自由プロジェクトのディレクターであるアリソン・マクリナは、「司書は個人のプライバシーを非常に重視しているが、検閲には強く反対している」と述べている。[ 71 ]
少なくとも1つのケースでは、元のウェブサイトから削除された直後にアーカイブからも記事が削除されている。 2016年、デイリー・ビーストの記者が、出会い系アプリでゲイの男性を装った偽のプロフィールを作成し、複数のオリンピック選手がゲイであることを暴露する記事を書いた。デイリー・ビーストは、この記事が広く非難を浴びた後、記事を削除した。その後まもなく、インターネット・アーカイブも同様に記事を削除し、暴露された選手の安全を守るため以外に理由はないと述べている。[ 71 ]
その他の脅威としては、自然災害[ 110 ] 、破壊(遠隔的および物理的)[ 111 ] 、アーカイブの内容の改ざん、問題のある著作権法[ 112 ]、サイト利用者の監視[ 113 ]などが挙げられる。
ロング・ナウ財団のエグゼクティブ・ディレクターであるアレクサンダー・ローズ氏は、複数の世代にわたる長期的な視点では「ほとんど何も」有用な形で生き残らないだろうと推測しており、「もし我々の技術文明に継続性があれば、多くの生データは見つけやすく検索可能のまま残るだろう。しかし、配信された形式はほとんど認識できないだろう」と述べている。なぜなら、「Drupal、Ruby、Djangoのようなコンテンツ管理システムの深いバックエンドを持つ」サイトはアーカイブするのが難しいからである。[ 114 ]
2016年、人類の知識の保存について考察した記事の中で、アトランティック誌は、長期的な目的で構築されていると自称するインターネットアーカイブ[ 115 ]について、「長期的なインフラが何もないままデータが消滅する前に、必死にデータを収集している」とコメントした[ 116 ] 。
2024 年 9 月、インターネット アーカイブはデータ侵害を受け、電子メール アドレスやハッシュ化されたパスワードなどの個人情報を含む 3100 万件のレコードが流出した。[ 117 ] 2024 年 10 月 9 日、分散型サービス拒否攻撃によりサイトがダウンした。[ 118 ] [ 119 ] 10 月 14 日、サイトはオンラインに戻ったが、11 月 4 日まで読み取り専用モードのままで、その間「今すぐページを保存」は無効になり、「一時的に利用できません」というバナーに置き換えられた。[ 120 ]
2025年11月、インターネットアーカイブは「一時的にオフライン」というメッセージを表示し、2025年11月18日に発生したクラウドフレア関連の大規模なインターネット障害を受けて、最新情報についてはソーシャルメディアを参照するよう人々に促した。 [ 121 ]
ページを即座にアーカイブし、Wayback Machine でそのページの永続的な URL を取得する機能を追加しました。このサービスにより、Wikipedia の編集者、学者、法律専門家、学生、または私のような家庭料理人など、誰でも、将来もアクセスできるようにしたい情報を引用、共有、またはブックマークするための安定した URL を作成できます。
1) Internet Archive による、Shell の横領および民事窃盗の反訴 (第 2 訴因) を却下する申し立ては認められる。 2) Internet Archive による、Shell の契約違反の反訴 (第 3 訴因) を却下する申し立ては却下される。 3) Internet Archive による、RICO および COCCA に基づく組織犯罪の反訴 (第 4 訴因) を却下する申し立ては認められる。
コンピュータは人に代わって契約を締結することができる。統一電子取引法 (UETA) では、「個人が電子エージェントの行為や結果として生じる条件や合意を認識したり確認したりしていなくても、当事者の電子エージェントの相互作用によって契約が成立する可能性がある」と規定している。
さらに重要なことに、裁判所は、インターネット アーカイブがシェルのサイトを単にコピーし、それをデータベースに表示しただけでは、被告の財産に対する必要な支配権の行使には当たらないと判断した。重要なことに、裁判所は、被告は常に自身のサイトを所有し、運営していたと指摘した。裁判所は次のように述べた。「シェルは、インターネット アーカイブが彼女のウェブサイトを支配または管理していたことを示す事実を主張できていない。シェルの訴状には、ウェブサイトがウェイバック マシンにアーカイブされている間も、シェルがウェブサイトを所有し、運営し続けていたことが明記されている。シェルは、文書のコピーだけで、転用を支持するのに十分な使用権の剥奪となるという考えを支持する権威を何も示していない。逆に、多くの巡回裁判所はそうではないと判断している。」
両当事者は、訴訟が相手方に引き起こした可能性のある混乱を心から遺憾に思います。インターネット アーカイブもシェル氏も、この訴訟への世間の注目から生じた、いずれかの当事者に損害を与えた可能性のある行為を容認しません。両当事者はそのような行為には関与しておらず、この訴訟の友好的な解決に対する世間の反応が、両当事者にこれ以上の損害や混乱が生じないようにという彼らの希望と一致することを求めます。
Die Betreiber des Archives fürchten neben Zensur und Manipulation der digitalen Aufzeichnungen demnach auch die Überwachung der Archive-Nutzer。 [アーカイブの運営者は、デジタル録音の検閲や操作だけでなく、アーカイブ利用者の監視も恐れている]。