archive.today ( archive.isなど、他のドメインでも知られています)は、オンデマンドでスナップショットを保存するウェブアーカイブWebサイトです。GoogleマップやXなどのJavaScriptを多用するサイトをサポートしています。[ 1 ] archive.todayは2つのスナップショットを記録します。1つは機能するライブリンクを含む元のWebページを複製したもので、もう1つはページのスクリーンショットです。 [ 2 ]
このウェブサイトは2010年代後半から多くの政府から監視の対象となっており、中国やロシアでは禁止措置が取られ、2025年には米国連邦捜査局(FBI)がドメイン登録業者に召喚状を送り、archive.todayのドメイン名の所有者を特定した。
archive.today は 2012 年にウェブ アーカイブとして設立されました。2013年にチェコ共和国で商標登録されたとされています。[ 3 ]当初、このサイトは archive.today というブランド名でしたが、 2015 年 5 月にプライマリミラーを archive.is に変更しました。 [ ‡3 ] 2019 年 1 月に、他のミラーを優先して archive.is ドメインの廃止を開始しました。[ ‡4 ] archive.today のブログによると、このウェブサイトは 2021 年までに約 5 億ページを保存しており、[ ‡5 ]合計サイズは 700 テラバイトです。[ 4 ]
2013 年 7 月、archive.today はロスアラモス国立研究所のウェブ保存プロジェクト Memento プロジェクトのAPIのサポートを開始しました。[ 5 ] [ 6 ] LANL の予算制約のため、Memento プロジェクトは 2025 年 9 月に廃止されました。[ 7 ] Archive.today は、プロジェクトの規模縮小後、Memento プロトコルの最後の主要なアクティブ ユーザーの 1 つです。[ 8 ] 2025 年 9 月に LANL の Memento インフラストラクチャが閉鎖されたのは、サービスに対する監視が強化されたより広範な期間の中でのことでした。
ロシアの独立系メディアであるメディアゾナは、ロシア・ウクライナ戦争で死亡したロシア軍人のソーシャルメディアのプロフィールや投稿を保存するためにこのサイトを利用しており、これはBBCロシア語放送とボランティアチームと共同で作成した、確認済みのロシア軍犠牲者の名前付きデータベースであるロシア200プロジェクトの一環である。[ 9 ] 200.zona.mediaの個々のプロフィールページには、親族によるソーシャルメディアの投稿のスナップショット、地元メディアの死亡記事、および各死亡を確認するために使用されたその他のオープンソースの証拠へのリンクがある。
2023年初頭、アムステルダム大学の研究者チームは、ロシア・ウクライナ戦争に関する欧州デジタルメディア観測所のデータセットに基づき、 archive.todayがファクトチェック組織の間で最も利用されているオープンアクセスアーカイブサービスであると特定した。[ 10 ] [ 11 ]
2023年8月5日、フィンランドのブロガー、ヤニ・パトカリオは自身のブログ「Gyrovague」で、archive.todayの資金源と創設者の身元に関する調査結果を発表した。[ 12 ]
2025年10月30日、米国連邦捜査局(FBI)は、 archive.todayのドメイン登録業者であるTucowsに召喚状を送付した。召喚状には、archive.todayドメイン名の所有者を特定することが目的であり、FBIが実施している犯罪捜査の一環であると記載されていたが、その捜査内容は明らかにされなかった。[ 13 ] [ 14 ]カタルーニャの日刊紙Araは、この措置を、マイクロ寄付に依存する匿名のデジタルアーカイブ( Googleの検索結果から削除されたAnna's Archiveなど)を選択的に犯罪化するキャンペーンの一環だと解釈した。ただし、大規模な言語モデルのトレーニングに使用される産業用データセット( OpenAIとAnthropicが資金提供したCommon Crawlなど)も、コンテンツ作成者や所有者に報酬を支払っていない。[ 4 ] 2025年の召喚状に関するニュース報道では、パトカリオの2023年のブログが取り上げられており、パトカリオはそこで創設者がロシアに拠点を置いている「いくつかの兆候」があったと述べている。[ 12 ]
2025年11月、DNSプロバイダーのAdGuard DNSは、フランスの組織Web Abuse Association Defense(WAAD)がarchive.todayとそのミラードメインをブロックするよう圧力をかけてきたと報告した。WAADは、archive.todayが2023年以来児童性的虐待資料の削除を拒否していると主張した。AdGuardがarchive.todayに連絡したところ、archive.todayは資料を削除し、これらのURLに関する苦情は以前には受けたことがないと述べた。AdGuardは、WAADが最近登録されたばかりで公の場での活動がほとんどないことから、WAADを疑わしいと感じ、他の企業に送られた同様のWAADの苦情には、実際のフランス人弁護士になりすましている可能性を示す証拠があると指摘した。AdGuardは、フランス警察に刑事告訴すると発表した。[ 15 ] [ 16 ]

2026年1月8日、パトカリオのホスティングプロバイダーであるAutomatticは、「Nora」という人物からGDPR違反の申し立てがあったことを彼に通知した。その申し立てでは、2023年のGyrovague調査記事が「中傷的なトーンと文脈で提示された広範な個人データを含んでいる」と主張されていた。パトカリオが反論を提出した後、Automatticは彼の側に立って記事を削除しなかった。[ 17 ]
2026年1月14日、archive.todayがCAPTCHAページを密かに変更し、 Gyrovagueに繰り返しリクエストを送信していたことが明らかになった。これにより、訪問者は知らず知らずのうちにブログに対するDDOS攻撃に加担していた。archive.today自身のブログは同時に、Patokallioに対する複数の公開批判を掲載した。Patokallioが公開したメールによると、archive.todayは彼のレポートの一時的な削除を要求し、その後、AIポルノで彼を脅迫した。[ 12 ]
2026年2月20日、英語版ウィキペディアは、DDoS攻撃とアーカイブされたコンテンツが改ざんされた証拠を理由に、archive.todayへのすべてのリンクを禁止した。議論の結果、Noraの名前がPatokallioの名前に置き換えられており、「Nora」はおそらく不正に流用された身元であることが判明した。この名前は実在の人物のもので、archive.todayとの唯一のつながりは、以前のコンテンツ削除要請だけだった。[ 18 ] [ 17 ] [ 19 ]コミュニティの決定は、コンテンツの検証可能性を維持することへの懸念(改ざんの発見によって部分的に損なわれた)にもかかわらず、ウィキメディア財団のプロジェクト全体で使用されている2番目に大きなアーカイブサービスを削除して置き換えるというものでした。ウィキメディア財団は、コミュニティの判断に関係なく行動する準備ができていると述べていました。[ 18 ] [ 20 ] Patokallioは結果に満足していると表明しました。[ 3 ]
Wikipediaがarchive.todayへのリンクを制限したのは今回が初めてではない。2013年には、コミュニティはボットネット、リンクスパム、サイトの運営方法が不透明であることへの懸念を理由にarchive.isをブラックリストに登録した。この決定は2016年に新たな意見募集を受けて覆され、archive.todayはスパムブラックリストから削除された。2026年の禁止当時、同サイトはWikimedia Foundationの全プロジェクトで使用されているアーカイブサービスの中で2番目に大きく、約40万ページに69万5000以上のリンクが分散していた。[ 18 ]
archive.today は、ユーザーからの明示的なリクエストに応じて個々のページをキャプチャできます。[ 21 ] [ 22 ] [ ‡6 ]開設当初から、現在非推奨となっているハッシュバンフラグメント( #! )を含むURLを持つページのクロールをサポートしていました。 [ ‡7 ]この Web サイトは、テキストと画像のみを記録し、XML、RTF、スプレッドシート( xlsまたはods )、その他の非静的コンテンツは除外します。ただし、Twitterなどの特定のサイトの動画は保存されます。[ ‡8 ]保存されたスナップショットの履歴を追跡し、既に保存されているページの新しいスナップショットを追加する前に確認を求めます。[ 23 ] [ ‡9 ]ウェブ ページがアーカイブされると、インターネット ユーザーは直接削除できません。[ ‡10 ]ユーザーは、 2019 年11 月29 日以降にアーカイブされたページを除き、アーカイブされたページを ZIP ファイルとしてダウンロードできます。 、[ ‡ 11 ] archive.today がブラウザ エンジンをPhantomJSChromium(非ヘッドレス)に変更したとき。 [ ‡ 12 ] archive.today は「人間のユーザーの直接のエージェント」として動作するため、robots.txtに従いません。 [ ‡ 6 ]
ページはブラウザの幅 1,024 ピクセルでキャプチャされます。CSSはインラインCSSに変換され、レスポンシブ Web デザインやセレクタ ( や など:hover)が削除されます:active。クローリング プロセス中にJavaScriptを使用して生成されたコンテンツは、固定された状態で表示されます。 [ ‡ 13 ] HTML クラス名はold-class属性内に保持されます。テキストが選択されると、JavaScript アプレットがブラウザのアドレス バーに表示されるURL フラグメントを生成し、再度アクセスするとそのテキスト部分が自動的にハイライト表示されます。Webページは、第 2 レベルのバックアップとしてarchive.today からweb.archive.orgに複製できますが、archive.today はスナップショットをWARC 形式で保存しません。逆方向 (web.archive.org から archive.today へ) も可能ですが、[ ‡ 14 ]通常は直接キャプチャよりもコピーに時間がかかります。

ページを保存する際、個々のページ要素の URL とそのコンテンツ サイズ、 HTTP ステータス、MIME タイプの一覧が表示されます。この一覧は、クロール処理中にのみ表示できます。アーカイブされたページから広告やポップアップを削除したり、リンクを展開したりするには、ブログの所有者に依頼する必要があります。[ ‡15 ]
サイトの FAQ によると、archive.today のストレージ レイヤーはApache HadoopとApache Accumulo上で動作し、すべてのデータはHadoop 分散ファイルシステム(HDFS) に保存されます。テキスト コンテンツは、ヨーロッパにある 2 つのデータ センターのサーバー間で 3 回複製され、少なくとも 1 つはフランスのプロバイダーOVHによってホストされています。画像は 2 回複製されます。[ ‡6 ]このサイトはWARC 形式のスナップショットを保存しません。[ ‡6 ]
スクレイピングコンポーネントは、2019年11月以降、以前のPhantomJSベースのエンジンに代わり、 Chromiumブラウザの改良版を使用しています。[ ‡6 ]
リサーチツールバーでは、ワイルドカード文字*としてを使用する高度なキーワード演算子が有効になります。 ペアの引用符は、ウェブページのタイトルまたは本文に含まれるキーワードの正確なシーケンスを検索対象としますが、insite演算子は特定のインターネットドメインに限定します。[ ‡ 16 ]動的なリストを保存する場合、archive.today の検索ボックスには、リストの前のセクションと次のセクションにリンクする結果のみが表示されます (たとえば、ページの場合は 20 件のリンク)。[ ‡ 17 ]保存された他のウェブページはフィルタリングされ、場合によってはその出現箇所のいずれかによって見つかることがあります。[ 23 ]検索機能は Google CustomSearch によってサポートされています。結果が返されない場合、archive.today はYandex Searchを利用しようとします。[ ‡ 18 ]
archive.today は、廃止されたサービス12ftと同様に、ニュース ウェブサイトのペイウォールを回避するためによく使用されます。[ 24 ]
有料購読の壁を回避するために archive.today リンクを共有する行為は、ヨーロッパで法的および倫理的な議論を引き起こしている。オランダでは、ジャーナリストのピーター・アンゼーが、De Volkskrant紙に掲載された有料購読記事の archive.ph リンクを共有した医師を公然と批判し、アーカイブされたコピーを配布することは著作権侵害にあたると主張した。この議論は、ハイパーリンクに関する欧州司法裁判所の判例、特に 2016 年のGS Media v Sanoma判決に基づいている。この判決では、違法に公開されたコンテンツへのリンクは、リンク者が違法性を知っていたか、知っているべきであった場合、著作権侵害にあたる可能性があると確立された。この推定は、営利目的で行動する当事者に自動的に適用される。[ 25 ]
オランダ最大の出版社であるDPG Mediaは、archive.todayが「多くの出版社(およびジャーナリスト)にとって厄介な存在」であることを認めつつも、このサイトは匿名で運営され、頻繁に場所が変わる複数のサーバーでホストされており、1つのドメインが削除されると新しいドメインで再出現するため、取り締まりは困難であると指摘した。[ 25 ]
コメンテーターはarchive.todayをインターネットアーカイブのWayback Machineと比較している。archive.ph経由で共有された同じ有料記事VolkskrantはWayback Machineにもアーカイブされていることがわかり、両方のサービスが有料記事の壁を回避するために使用できることが示された。Wayback Machineと同様に、archive.todayは有料記事の壁の回避をその機能として宣伝していない。有料記事の壁を回避できる機能は、訪問者に表示されるウェブページをアーカイブするというコア機能の副産物である。[ 25 ]
ジャーナリストのヘンク・ファン・エスが2025年に調査したところ、ChatGPT、Perplexity AI、Grok、ClaudeなどのAIチャットボットが、ライブウェブ検索中にウェブアーカイブを利用してペイウォールを回避していることが判明した。記録された事例の一つでは、ChatGPTがarchive.today経由でThe Economistから記事全文を取得し、同誌特有のスタイルと用語で5つのポイントからなる経済分析を生成した。ファン・エスは、AIシステムによるペイウォール回避の6つの異なる方法を特定し、その中で「アーカイブの悪用」(archive.todayやインターネットアーカイブなどのサービスでアーカイブされたコピーを見つける)が最も直接的な方法であった。ペイウォールのないコンテンツをAIが学習することに関するよく知られ、記録されている懸念とは異なり、この行動は個々のクエリ中にアーカイブされたコピーを通じてリアルタイムで取得するため、ペイウォール回避が人間のユーザーだけでなく自動化されたエージェントにも効果的に拡大される。[ 26 ]
ユニバーシティ・カレッジ・ロンドン、アラバマ大学バーミングハム校、キプロス工科大学の研究者による2018年の研究では、 AAAI国際ウェブ・ソーシャルメディア会議(ICWSM)で発表され、archive.isのライブフィードからの2100万のURLと、 14か月にわたってReddit、Twitter、Gab、4chanの/pol/掲示板で共有された35万6000のarchive.is URLを分析した。この研究では、ニュース記事とソーシャルメディアの投稿が最も一般的にアーカイブされるコンテンツタイプであることが判明した。これはおそらく「一時的または論争的な性質」であると認識されているためである。[ 27 ]
研究者らは、archive.is の URL が、4chan の /pol/ 掲示板やReddit のサブレディットr/The_Donaldなどの「周辺」コミュニティで広く共有されていることを記録した。これは、議論の的になりそうなコンテンツを保存するためと、イデオロギー的に反対していると見なされるニュース メディアの広告収入を阻止するためである。r/The_Donald のモデレーション ボットは、特定のニュース サイトへの直接リンクを自動的にブロックし (たとえば、ニューヨーク デイリー ニュースへのリンクの 46% が検閲された)、代わりに archive.is の URL を投稿するようにユーザーに促した。著者らは、 Reddit だけでも、直接リンクではなくアーカイブされたコピーを共有する慣行により、ワシントン ポストが年間約 70,000 米ドルの広告収入を失ったと推定している。[ 27 ]
Redditでは、調査対象のサブレディット全体で、 archive.isリンクの44%とWayback Machineリンクの85%がボットによって投稿されており、これはリンクの劣化を軽減しようとするモデレーターによって行われていた。[ 27 ]
2023年にアムステルダム大学の研究者らがvera.aiプロジェクトの一環として行った研究では、欧州デジタルメディア観測所の「ウクライナ戦争」データセットから1,991件のファクトチェック記事を調査した。抽出された41,758件のリンクのうち、6,002件はアーカイブされたページだった。archive.todayが最もよく使われたリンクアーカイブサービスで、44.1%を占め、Internet Archive/Wayback Machine(29.2%)とPerma.cc(26.6%)を上回った。[ 28 ]ファクトチェッカーは主に、アンチボット対策のためにキャプチャするのが難しいFacebookの投稿など、一時的でプラットフォームに制限されたコンテンツを保存するためにこれらのサービスを利用した。[ 29 ]
2019年3月、クライストチャーチのモスク銃乱射事件の余波を受け、オーストラリアとニュージーランドの複数のインターネットプロバイダーが、攻撃の映像の拡散を制限する目的で、このサイトを6か月間ブロックした。 [ 30 ] [ 31 ]
GreatFire.orgによると、archive.todayは2016年3月から中国本土でブロックされている。 、[ 32 ] archive.li2017年9月以降 、[ 33 ] archive.fo(2018年7月以降) 、[ 34 ]また、archive.phも2019年12月以降利用している 。[ 35 ]
2015年7月21日、archive.todayはフィンランドのすべてのIPアドレスからのサービスへのアクセスをブロックし、Twitterでフィンランド政府との間で抱えていたとされる紛争のエスカレートを避けるためにこの措置を取ったと述べた。[ 36 ] [ 37 ]
2026年初頭にフィンランドのブロガーとの衝突があったため、このウェブサイトはフィンランドからの訪問者に対して突破できないキャプチャを表示するようになった。[ 38 ]
2016年、ロシアの通信規制機関ロスコムナゾールは、ロシアからのarchive.isへのアクセスを遮断し始めた。[ 39 ] [ 40 ] [ 37 ]
2026年3月23日、archive.todayといくつかのミラードメインがロシア当局によってブロックされた。[ 41 ]
ウェブサイトが Archive.today のユーザーによるサイトのミラーリングから自身を守る方法はありません。
{{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク)本文中では、これらの参照箇所には二重短剣記号(‡)が付されています。
{{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}: CS1メンテナンス: アーカイブサービスは非推奨になりました (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク){{cite web}}:|archive-date=必要事項|archive-url=(ヘルプ) CS1 maint: 非推奨のアーカイブサービス (リンク) CS1 maint: url-status (リンク)