ロゴ | |
archive.today ホームページのスクリーンショット | |
サイトの種類 | ウェブアーカイブ |
|---|---|
| 利用可能 | 多言語 |
| メールアドレス |
|
| 登録 | いいえ |
| 発売 | 2012年5月16日[2] |
archive.today(またはarchive.is)は2012年に設立されたウェブアーカイブ ウェブサイトで、オンデマンドでスナップショットを保存し、Google MapsやTwitterなどのJavaScriptを多用するサイトをサポートしています。[3] archive.todayは2つのスナップショットを記録します。1つは機能するライブリンクを含む元のウェブページを複製し、もう1つはページのスクリーンショットです。 [4]
運営者の身元は明らかではない。[5]
歴史
Archive.todayは2012年に設立されました。当初はarchive.todayというブランド名で運営されていましたが、2015年5月にメインミラーをarchive.isに変更しました。[6] 2019年1月にはarchive.isドメインを廃止し、他のミラーに移行し始めました。[7]
2021年現在、[アップデート]archive.todayは約5億ページを保存しています。[5]
特徴
機能性
Archive.todayは、明示的なユーザーリクエストに応じて個々のページをキャプチャすることができます。[8] [9] [10]当初から、現在は非推奨となっているハッシュバンフラグメント(#! )を含むURLを持つページのクロールをサポートしてきました。[11]
Archive.todayは、 XML、RTF、スプレッドシート(xlsまたはods)などの非静的コンテンツを除いたテキストと画像のみを記録します。ただし、 X(旧Twitter)などの特定のサイトのビデオは保存されます。[12]保存されたスナップショットの履歴を追跡し、すでに保存されているページの新しいスナップショットを追加する前に確認を求めます。[13] [14]
ページはブラウザの幅 1,024 ピクセルでキャプチャされます。CSS はインラインCSSに変換され、レスポンシブ Web デザインややなどのセレクターが削除されます。クロール プロセス中にJavaScript を使用して生成されたコンテンツは、固定された状態で表示されます。 [15] HTML クラス名は属性内に保持されます。テキストが選択されると、JavaScript アプレットがブラウザのアドレス バーに表示されるURL フラグメントを生成し、再度アクセスしたときにそのテキスト部分が自動的に強調表示されます。
:hover:active
old-class
ウェブページは、第2レベルのバックアップとしてarchive.today からweb.archive.orgに複製できますが、archive.today はスナップショットを WARC 形式で保存しません。逆、つまり web.archive.org から archive.today への複製も可能ですが[16]、コピーには通常、直接キャプチャするよりも時間がかかります。歴史的に、ウェブサイトの所有者は、ロボット排除標準(robots.txt)を使用してWayback Machineからオプトアウトするオプションがあり、これらの除外も遡及的に適用されていました。[17] archive.today は「人間のユーザーの直接の代理人」として機能するため、robots.txt に従いません。[10] 2019 年現在、Wayback Machine は robots.txt に従わなくなりました。
リサーチツールバーでは、ワイルドカード文字*を使用して高度なキーワード演算子を使用できます。引用符を使用すると、タイトルまたはWebページ本文にあるキーワードの正確なシーケンスに検索が行われますが、insite演算子を使用すると、特定のインターネットドメインに制限されます。[18]
ウェブページがアーカイブされると、インターネットユーザーが直接削除することはできません。[19] アーカイブされたページから広告、ポップアップ、または拡張リンクを削除するには、所有者にブログで削除するよう依頼する必要があります。[20]
動的リストを保存している間、archive.todayの検索ボックスには、リストの前のセクションと次のセクションをリンクする結果のみが表示されます(たとえば、ページのリンクが20件)。[21]保存された他のWebページはフィルタリングされ、出現箇所の1つによって見つかる場合があります。[13] [説明が必要]
検索機能はGoogle CustomSearchによってサポートされています。検索結果が見つからない場合、archive.todayはYandex Searchを利用しようとします。[22]
ページを保存すると、個々のページ要素の URL とそのコンテンツ サイズ、HTTP ステータス、MIME タイプのリストが表示されます。このリストは、クロール プロセス中にのみ表示できます。
[update]archive.todayがブラウザエンジンをPhantomJSからChromiumに変更した2019年11月29日以降にアーカイブされたページを除き、アーカイブされたページはZIPファイルとしてダウンロードできます。[ 23]
2013年7月、Archive.todayはMementoプロジェクトのAPIのサポートを開始しました。[24] [25]
世界中で利用可能
オーストラリアとニュージーランド
2019年3月、クライストチャーチのモスク銃乱射事件を受けて、オーストラリアとニュージーランドの複数のインターネットプロバイダーは、攻撃映像の配信を制限するために、このサイトを6か月間ブロックした。 [26] [27]
中国
GreatFire .orgによると、archive.todayは2016年3月から中国本土でブロックされており、[28] archive.liは2017年9月から、[29] archive.foは2018年7月から、[30] archive.phは2019年12月からブロックされている。[31][update][update][update][update]
フィンランド
2015年7月21日、運営者はフィンランドのすべての IPアドレスからのサービスへのアクセスをブロックし、フィンランド政府との紛争の拡大を避けるためだとTwitterで述べた。[32]
ロシア
2016年、ロシアの通信機関ロスコムナゾールはロシアからのarchive.isへのアクセスをブロックし始めた。[33] [34]
Cloudflare DNSの可用性
2018年5月以来[35] [36] Cloudflareの1.1.1.1 DNSサービスはarchive.todayのウェブアドレスを解決できず、Cloudflare DNSサービスのユーザーはアクセスできなくなっていた。両組織は、相手がこの問題の責任を負っていると主張した。Cloudflareのスタッフは、 Cloudflareのネットワークシステムがarchive.todayにリクエストを送信したときに、権威ネームサーバーが無効なレコードを返すため、問題はarchive.todayのDNSインフラストラクチャにあると述べた。archive.todayは、CloudflareはDNSリクエストでEDNSクライアントサブネット情報を送信しないため、問題はCloudflareのリクエストがDNS標準に準拠していないためであると反論した。[37] [38]
参照
参考文献
- ^ @archiveis (2019年10月30日). 「すべてのTorドメインとクリアネットドメインの最新リスト」(ツイート) – Twitter経由。
- ^ Archive.is ブログ (2014年2月18日). 「Archive-is サイトはいつ最初に立ち上げられたのですか?」Tumblr . 2021年3月20日時点のオリジナルよりアーカイブ。 2021年4月10日閲覧。
- ^ Brinkmann, Martin (2015年4月22日). 「Archive.isで公開可能なウェブページアーカイブを作成する」Ghacks . 2019年4月12日時点のオリジナルよりアーカイブ。 2015年6月13日閲覧。
- ^ Brunelle, Justin F.; Kelly, Mat; Weigle, Michele C.; Nelson, Michael L. (2015年1月25日). 「JavaScript がアーカイブ性に与える影響」(PDF) . International Journal on Digital Libraries . 17 (2): 95–117. doi :10.1007/s00799-015-0140-8. S2CID 8433375. 2019年5月27日時点のオリジナルよりアーカイブ(PDF) .
- ^ ab Patokallio, Jani (2023年8月5日). 「archive.today: On the trail of the mystery guerrilla archivist of the Internet」Gyrovague . 2023年8月13日時点のオリジナルよりアーカイブ。 2024年1月1日閲覧。
- ^ 「なぜURLをarchive-todayからarchive-isに戻したのですか?」Archive.is Blog 2015年5月3日。2015年6月1日時点のオリジナルよりアーカイブ。2019年1月6日閲覧。
- ^ @archiveis (2019年1月4日). 「リンクにはarchive.ISミラーを使用せず、他のミラー[.TODAY .FO .LI .VN .MD .PH]を使用してください。.ISはすぐに機能しなくなる可能性があります」(ツイート). 2019年1月6日時点のオリジナルよりアーカイブ – Twitter経由。
- ^ Dascalescu, Dan (2013年2月18日). 「Webページのアーカイブ - Dan DascalescuのWiki (レビュー)」. Wiki.dandascalescu.com. 2013年9月22日時点のオリジナルよりアーカイブ。2013年10月3日閲覧。
- ^ Koebler, Jason (2014年10月29日). 「Dear GamerGate: Please Stop Stealing Our Shit」. Motherboard . 2019年5月27日時点のオリジナルよりアーカイブ。 2017年3月22日閲覧。Archive.today
ユーザーがサイトをミラーリングすることからウェブサイトを保護する方法はありません。
- ^ ab 「Archive.today FAQ」。archive.today 。 2019年2月15日閲覧。
- ^ 「2013年のArchive.isのホームページ」。2013年1月12日時点のオリジナルよりアーカイブ。
- ^ “Archive.today blog”. 2021年9月7日時点のオリジナルよりアーカイブ。
- ^ ab Archive.isによるウェブサイトのアーカイブ、2022年1月27日時点のオリジナルよりアーカイブ、 2022年1月27日閲覧。
- ^ 「archive.is のスナップショット履歴の例」。
- ^ JavaScript で生成されたDailymotionビデオの読み込みアニメーションがフリーズした状態で表示される
- ^ 「例: Web アーカイブから Archive.is に保存されたページ」(スペイン語)。2013 年 5 月 20 日時点のオリジナルよりアーカイブ。2019 年10 月 23 日閲覧。
- ^ 「FAQ - Robots.txt またはその他の除外設定により、一部のサイトが利用できません。これはどういう意味ですか?」。インターネット アーカイブ ウェイバック マシン。2011 年 4 月 15 日時点のオリジナルよりアーカイブ。
- ^ たとえば、文字列 insite: https://en.wikipedia.org "World Cup" は、"World+Cup"/ 関連のスナップショットを返します。
- ^ 「よくある質問」(ブログ) . archive.is . 2013年1月24日. 2013年9月26日時点のオリジナルよりアーカイブ。 2018年11月12日閲覧。
- ^ 「Archive.is ブログのユーザーリクエストの例」。Archive.isブログ。2022年4月29日時点のオリジナルよりアーカイブ。 2022年4月7日閲覧。
- ^ 動的リストの例: "au:"thomas aquinas"". WorldCat . 2019年3月23日時点のオリジナルよりアーカイブ。2018年12月15日閲覧。
- ^ 「今日、アーカイブの検索バーでキーワードを検索できることに気付きました。これは最近追加された機能でしょうか?」Archive.is ブログ。2022年1月18日。2022年1月27日時点のオリジナルよりアーカイブ。 2022年1月27日閲覧。
- ^ 「「zip をダウンロード」ボタンをクリックすると、かなり長い間「見つかりません」というエラーが表示されます」。Archive.isブログ。2020 年 7 月 17 日。2020 年 10 月 3 日時点のオリジナルよりアーカイブ。
- ^ Nelson, Michael L. (2013 年 7 月 9 日). 「Archive.is が Memento をサポート」.研究と教育の最新情報.オールドドミニオン大学の Web サイエンスとデジタル ライブラリ研究グループ. 2013 年 7 月 27 日時点のオリジナルよりアーカイブ。2013 年9 月 17 日閲覧。
- ^ "archive.is". Memento プロトコル情報。Memento 開発グループ。2013 年 9 月 15 日時点のオリジナルよりアーカイブ。2013年9 月 17 日閲覧。
- ^ 「オーストラリアとニュージーランドのISPが法的前例なしにインターネットの検閲を開始」。Private Internet Access。2019年3月19日。2023年4月28日時点のオリジナルよりアーカイブ。 2019年3月20日閲覧。
- ^ 「ニュージーランドのISP、クライストチャーチ銃撃事件の動画を削除しないサイトをブロックしていると発表」Gizmodo Australia 2019年3月19日。2019年5月18日時点のオリジナルよりアーカイブ。 2019年3月20日閲覧。
- ^ 「archive.isは中国で100%ブロックされている」GreatFire Analyzer 2018年8月12日。2018年8月12日時点のオリジナルよりアーカイブ。
- ^ 「archive.liは中国で100%ブロックされている」Great Fire Analyzer 2018年8月12日。2018年8月12日時点のオリジナルよりアーカイブ。
- ^ 「archive.foは中国で100%ブロックされている」Great Fire Analyzer 2018年8月12日。2018年8月12日時点のオリジナルよりアーカイブ。
- ^ “archive.ph is 100% blocked in China”. en.greatfire.org . 2022年4月29日時点のオリジナルよりアーカイブ。 2022年4月7日閲覧。
- ^ ラピンティ、ラッシー (2015 年 7 月 22 日)。 「Suomalaisilta estettiin haktivistien suosimalla verkkosivulla käynti」[ハクティビストが使用するウェブサイトへのフィンランド人のアクセスはブロックされた]。イルタレティ(フィンランド語)。 2019年5月27日のオリジナルからアーカイブ。2016 年3 月 4 日に取得。
- ^ エストラトフ、ウラジミール (2016 年 1 月 29 日)。 「Roskomnadzor zablokiroval servis archive.is、khranyashchiy kopii veb-saytov」Роскомнадзор заблокировал сервис archive.is、хранящий копии веб-сайтов。TJournal (ロシア語)。 2017年8月30日のオリジナルからアーカイブ。2016 年1 月 30 日に取得。
- ^ Cushing, Tim (2016年2月4日). 「ロシア、薬物に関する古いページが含まれている可能性があるため、別のアーカイブサイトをブロック」Techdirt。2019年3月23日時点のオリジナルよりアーカイブ。 2016年2月26日閲覧。
- ^ 「Archive.is – エラー 1001」。Cloudflare コミュニティ。2018年5月15日。2021年12月2日時点のオリジナルよりアーカイブ。2021年12月2日閲覧。
- ^ “Archive.today および関連サイトが再び障害発生”. Cloudflare コミュニティ. 2024年3月3日. 2024年4月3日時点のオリジナルよりアーカイブ。2024年3月20日閲覧。
- ^ @archiveis (2018年7月16日). 「『しなければならない』というのは、ここではそれほど直接的ではありません。EDNSが存在せず、DNSと関連するHTTPリクエストの送信元が(AS/国だけでなく大陸レベルでも)大きく不一致なため、多くの問題が発生するため、CloudflareからのEDNSなしのリクエストは無効であると考えています」(ツイート)。2023年8月2日時点のオリジナルよりアーカイブ – Twitter経由。
- ^ “マシュー・プリンスによるHacker Newsへのコメント”. Hacker News . 2019年5月4日. 2022年5月13日時点のオリジナルよりアーカイブ。2021年10月4日閲覧。
外部リンク
- archive.today(archiveteam.org)
- Archive.today よくある質問
- 「archive.today: インターネットの謎のゲリラ・アーキビストの足跡をたどる」、Gyrovague、2023年8月5日
