Anna's Archiveは、2022年にZ-Libraryを閉鎖しようとする法執行機関の取り組みの直後に、Annaという偽名で立ち上げられた、シャドウライブラリー向けのオープンソース検索エンジンです。このサイトは、Z-Library、Sci-Hub、Library Genesis (LibGen)などの情報源からレコードを集約しています。自らを「人類史上最大の真にオープンな図書館」[ † 1 ]と称し、「存在するすべての書籍をカタログ化すること」と「これらの書籍すべてをデジタル形式で容易に入手できるようにするための人類の進歩を追跡すること」を目指していると述べています。著作権で保護された作品のダウンロードについては、ファイルを直接ホストせず、サードパーティのダウンロードにリンクしているため責任を負わないと主張しています。しかしながら、大規模な著作権侵害に関与しているとして標的にされ、政府によるブロックや、権利者や出版業界団体からの法的措置に直面しています。
Anna's Archive はPirate Library Mirror ( PiLiMi ) プロジェクトから生まれました。これは、シャドウ ライブラリをミラーリングする匿名の取り組みで、 2022 年 9 月にZ-Libraryの完全なコピーを完成させました。PiLiMi は、「ほとんどの国で著作権法を意図的に違反した」ことを認めています。[ 3 ] [ 4 ]このプロジェクトの当初の焦点は、データを検索可能にすることではなく、保存でした。 [ 5 ] 2022 年 11 月に米国の法執行機関がいくつかの Z-Library ドメインを押収し、その運営者とされる人物を逮捕した数日後、PiLiMi メンバーの Anna (Anna Archivist としても知られる) が Anna's Archive を立ち上げ、最初は Z-Library とLibGenの結果を表示しました。[ 3 ] [ 4 ] [ 6 ] [ 7 ]
Anna's Archive は、検索エンジン[ 8 ] 、メタ検索エンジン[ 3 ]、シャドウライブラリ自体[ 4 ]などと様々に説明されています。異なるトップレベルドメインで複数のミラーサイトを運営しています。[ † 1 ]ソースコードはCC0ライセンスの下でパブリック ドメインに捧げられています。[ † 2 ]サイト自体はファイルをホストしていません (著作権で保護された作品のダウンロードに対して責任を負わないと主張しています) が、メタデータをインデックス化し、「サードパーティ」のダウンロードにリンクしています。[ † 1 ] [ 8 ] [ 9 ]また、IPFSプロトコルを介したダウンロードも提供しています。[ a ] [ 3 ] [ 10 ]
このサイトの「ソースライブラリ」には、LibGen、Sci-Hub、Z-Library、インターネットアーカイブ、DuXiu、MagzDB、Nexus/STC、HathiTrustが含まれます。Open Library、WorldCat、Google Booksはメタデータのみのソースとしてリストされています。[ †4 ]これらのデータセットの一部は既に公開されていますが、その他はスクレイピングまたは非公開で入手され、配布されています。[ †4 ] [ 11 ]その後、ウェブサイトの削除に耐えられるように、トレントファイルとともに一括でリリースされます。[ b ] [ †1 ] 2026年7月現在 、Anna's Archiveには65,680,735冊の本と95,694,578件の論文が含まれており[ †1 ]、統合されたトレントのリストは合計で約1.1ペタバイトのサイズになります[ †6 ] 。
2025年の研究では、従来の図書館データベースとさまざまな代替手段(学術検索エンジン、その他のウェブベースのデータベース、学術ソーシャルネットワーク、海賊版サイトなど)の網羅性を比較したところ、Anna's Archiveは最も包括的な全文網羅性を備えているものの、直感的でないインターフェースであると批判された。[ 12 ] 2025年3月には、1日平均65万件以上のダウンロードがあり、これはニューヨーク公共図書館の推定配布数の約10倍に相当する。[ 13 ]
Anna's Archive は、削除や障害に対する耐性を考慮して設計された多層サーバー アーキテクチャを使用しています。サイト運営者による 2023 年のブログ記事によると、バックエンドはFlask、MariaDB、Elasticsearch上で動作し、実際のホスティング インフラストラクチャを法的要求から保護するために、別のプロバイダーを介してプロキシされた安価なサーバーでホストされています。複数の冗長プロキシ サーバーとアプリケーション サーバーが維持されているため、いずれかのプロバイダーがサービスを終了しても、サイトは引き続き動作します。[ † 7 ]
当初、このサイトはCloudflareの無料ティアをキャッシュとDDoS保護の追加レイヤーとして使用し、Cloudflareがホスティングプロバイダーではなくユーティリティとして機能しているため、DMCA削除要求に直接対象とならないという法的立場を利用していました。[ † 7 ]しかし、2026年1月のSpotify訴訟に関連する裁判所命令を受けて、CloudflareはAnna's Archiveのいくつかのドメインのネームサーバーを無効にしました。[ 14 ]その後、サイトのドメインの少なくとも一部は、ロシアのDDoS保護およびコンテンツ配信プロバイダーであるDDoS-Guardに移行しました。[ 15 ]
Anna's Archive は、複数の管轄区域にわたるさまざまなレジストラを通じてドメインを登録しています。そのドメインのいくつか(.liおよびドメインを含む)は、コスタリカの Njalla SRL [ 17 ]が運営するプライバシー重視のドメイン登録サービスであるNjalla [ 16 ].glを通じて登録されています。Njalla は、顧客の身元を保護するために、顧客に代わって自社名義でドメインを登録します。
サイトのデータは、増分リリースを可能にするために 2023 年 8 月に導入された Anna's Archive Containers (AAC) フォーマットで標準化されています。各コンテナはメタデータと、オプションで関連付けられたバイナリデータで構成されています。メタデータファイルはZstandardで圧縮された行区切りの JSONを使用し、バイナリデータファイルは構造化されたディレクトリに一緒に保存されます。このフォーマットは、機械可読で、トレント経由で簡単に配布でき、サイトの既存のMariaDB、Elasticsearch、およびPythonスタックと互換性があるように設計されています。[ † 8 ]
Anna's Archive は自らを非営利団体と称し、会員費や寄付金は主にサーバーインフラに費やされ、サイト運営者が個人的に使用することはないと述べている。[ † 1 ]一部のボランティア貢献者には会員権や金銭的な「報奨金」が授与される。[ 18 ]
このサイトは段階的なダウンロードシステムを採用しています。Anna's Archive の高速ダウンロードは有料会員のみが利用でき、24 時間あたりの高速ダウンロード回数は会員ティアによって異なります。複数の会員資格を合算して利用できます。[ † 1 ]非会員は、ボットによる悪用を防ぐため、ブラウザ認証 付きの低速オプションを使用する必要があります。待機リスト方式により、同時ダウンロード数を制限することで、無料ユーザーでもやや高速なサーバーにアクセスできます。
Anna's Archive は、多額の資金またはデータの提供と引き換えに、大規模言語モデル(LLM)をトレーニングするグループにSFTP経由で全コレクションへの高速アクセスを提供しています。 [ 19 ] [ 20 ] 2025 年 1 月の時点で、LLM 企業とデータブローカーの両方を含む約 30 社 (主に中国に拠点を置く) にそのようなアクセスを提供していると述べています。[ 21 ] DeepSeekの VL モデルは、このサイトの電子書籍データで部分的にトレーニングされています。[ 22 ]一部の弁護士は、これが米国の著作権法の下でフェアユースに該当するという主張を批判し、市場への損害の重要性に関する判例を挙げています。[ 23 ]
法的な立場上、このサイトは従来の銀行チャネルを通じて直接支払いを受け付けることはできないと述べている。[ † 9 ]その代わりに、暗号通貨やAmazonギフトカード、Cash App、Alipayなどの代替手段に依存している。[ † 1 ]運営者は、匿名性を維持する必要性から従来の決済処理業者を避ける必要があり、暗号通貨で支払われる仮想デビットカードをサポートしている企業はごく少数であると述べている。[ † 7 ]
アンナのアーカイブは、2つの目標を持つ非営利プロジェクトです。
1.保存:人類のあらゆる知識と文化をバックアップする。
2.アクセス:この知識と文化を世界中の誰もが利用できるようにすること。
アンナズ・アーカイブは、その目的を「現存するすべての書籍をカタログ化すること」と「これらの書籍すべてをデジタル形式で容易に利用できるようにするための人類の進歩を追跡すること」と述べている。[ 6 ]可能な限り多くの書籍を保存する「普遍的な図書館」というビジョンにより、以前のシャドウライブラリーの野望を継続し、大幅に拡張したものと評されている。また、分散化技術の台頭をもたらした2008年の金融崩壊とウォール街占拠運動から始まったと思われる、「企業、機関、政府、法律に対する不信感の文化」の高まりの一部として解釈されている。[ 13 ]
アンナは、著作権への反対を倫理的な根拠に基づいて正当化し、「これらのファイルを保存およびホストすることは道徳的に正しいと信じている」[ 13 ]、また、自分たちや他のシャドウライブラリアンは「情報は自由であることを望んでいる」と信じている[ 24 ]と述べている。彼らは、著作権法は国家安全保障の問題として改革されるべきだと示唆し、西側諸国はAI軍拡競争で優位に立つために、テキストおよびデータマイニングの法的例外を設けるべきだと提案している[ 21 ]。
アンナは、プログラマーで情報活動家のアーロン・スワルツが、このプロジェクトのメタデータ収集のきっかけになったと述べている。[ † 1 ]このサイトでは、スワルツの著作のほか、スティーブン・ウィットの『How Music Got Free』、ミシェル・ボルドリンとデビッド・K・レヴィンの『Against Intellectual Monopoly』を推奨している。これらは既存の著作権法を批判し、コピーレフト運動と関連付けられている。[ 13 ]

2023 年以降、Anna's Archive ドメインは、大規模な知的財産権侵害に関与しているとされるデジタルおよび物理的な市場を強調する米国通商代表部による年次悪名高い市場リストに掲載されている。これらのレポートでは、このサイトは Sci-Hub および LibGen に関連していると説明されている。[ 25 ] [ 26 ] [ 27 ] 2023 年のリストに関する米国通商代表部からのコメント要請に対し、米国出版社協会はAnna's Archive を侵害サイトとして特定し、その暗号通貨ウォレットを分析した結果、2023 年 7 月時点で 29,000 ドルを超える資金を受け取っていたことが判明した。[ 28 ] [ 29 ]
2023年10月、Anna's Archiveが世界最大の書誌データベースであるWorldCatの全データをスクレイピングし、その独自のデータを無料で公開したと報じられた。Annaはこれを「世界中のすべての書籍をマッピングする上での大きなマイルストーン」と表現した。[ 11 ] WorldCatの管理者であるOCLCは、2024年1月にオハイオ州の連邦裁判所で同サイトを提訴し、スクレイピングはサーバーへのサイバー攻撃によって行われたと主張した。 [ 9 ] OCLCは、合計500万ドル以上の損害賠償と、Anna's Archiveがデータをスクレイピングまたは共有することを阻止する差止命令を求めた。 [ 30 ] OCLCは、内部システムは侵害されていないものの、同サイトの行為は法的にハッキングに該当すると考えていると明言した。[ 31 ]唯一の被告は、スクレイピングやAnna's Archiveとの関与を否定した。[ 32 ]テクノロジーライターのグリン・ムーディは、この訴訟を「費用がかかり無意味」だと批判し、OCLCが掲げる情報へのアクセスを可能にするという使命に反すると述べた。[ 33 ]
2024年7月、訴訟を受けて、.orgアンナズ・アーカイブのミラーは.gs米国の管轄下に入ることを避けるために新しいミラーに置き換えられましたが、その後すぐに.gsドメインが停止され、ミラーは元の.orgドメインに戻りました。[ 30 ] [ 34 ]
2025年3月、裁判所は、この訴訟の法的新規性に関する懸念から、訴訟の一部に関する判決をオハイオ州最高裁判所に延期し、 OCLCからの欠席判決の申し立てと被告人からの訴訟却下の申し立ての両方を却下した。 [ 35 ] 4月、OCLCは被告人と合意に達し、彼女を訴訟から外し、代わりにサイト自体に対する判決を得ることに注力した。[ 36 ] 11月、OCLCは損害賠償の請求を取り下げ、第三者仲介業者にデータの共有を停止させる差止命令を得ることに注力した。[ 37 ]
2026年1月、連邦地方裁判所判事マイケル・H・ワトソンはOCLCに有利な欠席判決を下し、アンナズ・アーカイブにWorldCatデータの削除と、今後WorldCatのスクレイピングや共有を禁止するよう命じた。アンナズ・アーカイブはこの判決に従うとは予想されておらず、OCLCは「この判決をウェブサイトホスティングサービスに持ち込みたい」と述べている。[ 38 ]
2025年2月、Meta社が著作権で保護された作品でAIモデルを訓練したとしてカリフォルニア州の裁判所で起こされた訴訟で、社内メールが公開され、同社がLibGenから以前にダウンロードしたデータに加えて、Anna's Archiveのトレントを通じて81テラバイト以上のデータをダウンロードしていたことが明らかになった。この訴訟の原告であるリチャード・カドリー、サラ・シルバーマン、クリストファー・ゴールデンを含む著者グループは、 CEOのマーク・ザッカーバーグがシャドウライブラリの使用を個人的に承認したと主張した。同社は、AIトレーニングにおける著作権で保護されたデータの使用はフェアユースに該当すると主張した。[ 39 ] [ 40 ] [ 41 ]
2025 年 6 月、裁判所は Meta に一部有利な判決を下し、トレーニングは「非常に変容的」であり、したがってフェアユースであると判断した。この訴訟を担当したヴィンス チャブリア判事は、この判決は Meta の行為が実際に正当であることを意味するものではないと強調したが、原告は強力な主張を展開できなかったと述べた。同判事は、原告が追求しなかった金銭的損害の説得力のある主張として「市場の希薄化」を挙げた。これは、「著作権で保護された作品で生成 AI モデルをトレーニングすることにより、企業はそれらの作品の市場を劇的に損なうものを作り出している」という考えである。[ 42 ] [ 43 ] [ 44 ]
2025年12月、Anna's Archiveは音楽ストリーミングサービスSpotifyから約300テラバイトのデータをスクレイピングし、2億5600万行のトラックメタデータを公開し、8600万のオーディオファイルを公開する計画を発表したと報じられた。[ 45 ]オーディオはSpotifyの全コレクションのわずか37%を占めるに過ぎなかったが、プラットフォーム上での再生回数の99.6%を占めていた。[ 46 ]これに対し、同社は「違法なスクレイピングに関与した悪質なユーザーアカウントを特定し、無効化した」と述べた。[ 45 ] [ 47 ]ストリーミング再生回数の少ない曲が含まれないという批判もあった。[ 48 ]メタデータの公開は、約500万曲を収録し、約37分の1の規模であるオープンデータベースMusicBrainzと比較された。 [ 45 ] [ 49 ]著作権擁護派は、流出した音楽がAIモデルのトレーニングに使用されると予測した。[ 47 ]
同月、Spotifyは、Universal Music Group、Sony Music、Warner Musicなどの大手レコードレーベルとともに、Anna's Archiveの正体不明の運営者を相手取り、ニューヨーク州南部地区連邦地方裁判所に訴訟を起こした。訴状では、著作権の大量侵害、契約違反、DMCA違反、コンピュータ詐欺および濫用法違反を主張し、同サイトがSpotifyのデジタル著作権管理システムを回避していると非難した。訴訟は当初、Anna's ArchiveがSpotifyが求める対抗措置を「先回りして妨害できないように」非公開で提起された。[ 14 ] [ 50 ]
2026 年 1 月、裁判所は一時的な差し止め命令を発令し、続いて 1 月 16 日に米国地方裁判所判事ジェド・ラコフにより予備的差止命令が発令された。この差止命令は、Anna's Archive に対し、著作権で保護された作品のホスティング、リンク、配布を停止するよう命じ、ドメイン登録機関、ホスティング会社、Cloudflare などの第三者仲介業者も対象とした。その結果、Public Interest Registry.orgが管理するドメインやドメインなど、Anna's Archive のドメイン名のいくつかが停止された。[ 14 ] [ 50 ] [ 51 ] Anna's Archive は当初、停止は自分たちの活動とは無関係だと考えていた。[ 52 ] [ 53 ]訴訟が明らかになった後、サイトは Spotify 専用のダウンロード セクションを削除し、「追って通知があるまで利用不可」と表示した。[ 14 ] 2026年4月15日、裁判所は欠席判決を下し、アンナズ・アーカイブに3億2200万ドルの支払いを命じ、ドメイン登録業者を含むサービスプロバイダーに対し、サイトへのサービス提供を停止するよう命じる永久差止命令を出した。[ 54 ].se
2024年3月にNvidiaがシャドウライブラリのデータでLLMを訓練したとして訴えられた訴訟[ 55 ]に対し、同社はAnna自身がその用語を使用しているにもかかわらず、Anna's Archiveや他のリポジトリを「シャドウライブラリ」と表現することに異議を唱えた。[ 56 ] [ 57 ] 2026年1月、NvidiaがAnna's Archiveに直接連絡を取り、そのデータに高速アクセスしたことを示唆する追加の証拠が訴訟で提示された。[ 58 ] Anna's ArchiveはNvidiaと直接取引したことはないと否定し、Nvidiaが法的問題を回避するために仲介者を使用した可能性を指摘した。[ 59 ] 2026年1月29日、Nvidiaは訴訟の却下を求める申し立てを行った。[ 60 ] [ 61 ] TorrentFreakによると、同社は原告の主張を「憶測的で曖昧で、法的に不十分」と表現した。[ 59 ]
2026年3月に13の出版社グループが起こした訴訟を受け、2026年5月19日、ニューヨーク南部地区連邦地方裁判所は、ウェブサイトが違法にダウンロードした数百万のファイルのコピーと配布を直ちに停止するよう命じる欠席判決を下した。出版社には1950万ドルの欠席判決が認められ、裁判官はグローバルドメインの削除を命じた。[ 62 ] [ 63 ]
2024年1月、イタリアの国家通信庁は、イタリア出版社協会からの著作権侵害の申し立てを受けて、国内の主要インターネットサービスプロバイダー(ISP)に対し、アンナのアーカイブをブロックするよう命じた。[ 64 ]デジタルサービス局の調査により、同サイトに著作権で保護された作品が存在することが確認され、サーバーの一部はウクライナのホスティングプロバイダーが所有している可能性が高いことが判明したが、運営者の身元は特定できなかった。[ 4 ]
2024年3月、ロッテルダム地方裁判所は、擁護団体BREINの要請により、オランダの主要ISPに対しAnna's ArchiveとLibGenをブロックするよう命じた。この命令は「動的」であり、ブロックされたサイトが将来ドメインやIPアドレスを変更した場合、ISPはブロックを更新する義務を負うことになる。[ 65 ] [ 66 ] [ 67 ] [ 68 ]
2024年12月、英国出版社協会は高等法院から、主要なISPに対しAnna's Archiveやその他の著作権侵害サイトをブロックするよう命じる判決を獲得し、著作権・意匠・特許法第97A条に基づき2015年以来ブロックされているサイトのリストを拡大した。同協会は、Anna's Archiveドメイン上に100万件以上の著作権で保護された書籍や雑誌記事の記録を確認したと述べた。[ 69 ] [ 70 ]
2025 年 7 月、ベルギーの著者および著作権者を代表する団体グループ ( ベルギー出版社協会 (ADEB)、マルチメディア著者市民協会 (La Scam)、ベルギー出版社の認識と補償のための協同組合 (Copiebel)、Librius、教育科学出版社グループ (GEWU)、総合出版社グラウンド (GAU)、フランドル著者協会 (VAV) を含む)は、商事裁判所に申し立てを行い、海賊版サイトとされる 5 つ (Anna's Archive、LibGen、Sci-Hub、Z-Library、 OceanofPDF ) に対して判決を下すことに 成功した。裁判官は、FPS Economyの海賊版対策サービスに、これらのサイトを一時的にブロックするよう命じた。従わない場合は、これらのサイトは最大 50 万ユーロの罰金に直面する。[ 71 ] [ 72 ] [ 73 ] [ 74 ]
2025年10月11日、TorrentFreakは、ドイツの主要ISPがAnna's Archiveの主要ドメインへのアクセスをブロックしたと報じた。このブロックは、自主的なサイトブロック措置を調整する権利者とISPの連合体であるインターネット著作権クリアリング機関(CUII)によって開始された。 [ 75 ]
Anna's Archive は、2024 年 6 月までにGoogle 検索でDMCA 削除要請が最も多く報告されたドメイン 10 件のうちの 1 つでした。 [ 76 ] 2025 年 11 月までに、Google は Anna's Archive の URL を 7億4900 万件検索結果から削除しました。これは、2012 年以降検索エンジンに送信された削除要請全体の 5 % に相当します。これらの要請は、1,000 人以上の著者と出版社から寄せられました。[ 8 ]これは、大手出版社に代わって Google や他の検索エンジンに削除要請を送信するオランダの著作権侵害対策サービスLink-Bustersが最も標的にしているサイトの 1 つです。[ 77 ] [ 78 ] [ 79 ]
2025年1月、メッセージングアプリのTelegramは、著作権侵害を理由にAnna's Archiveチャンネルを停止した。運営者はアプリ上で著作権侵害の投稿を避けるための予防措置を講じていたと報じられている。Z -LibraryのTelegramチャンネルも同じ週に停止されたが、どちらにもこの措置について通知はなかった。これらの削除は、デリー高等裁判所による法的措置に関連していると推測された。[ 80 ]
{{cite web}}: CS1 maint: url-status (リンク)