ウェブビーコン[注1 ]は、ウェブページや電子メールで使用される技術で、ユーザーがコンテンツにアクセスしたことを目立たないように(通常は目に見えないように)確認できるようにするものです。[ 1 ]ウェブビーコンは通常、第三者がウェブ分析やページタグ付けの目的でウェブサイト上のユーザーの活動を監視するために使用されます。[ 2 ]また、電子メールの追跡にも使用できます。[ 3 ] JavaScriptを使用して実装されている場合は、 JavaScriptタグと呼ばれることがあります。[ 4 ]ウェブビーコンは、ウェブページの閲覧を追跡する目に見えないHTML要素です。ユーザーがウェブページを再訪すると、これらのビーコンはサーバーによって設定されたCookieに接続され、ユーザーの追跡を非公開で行うことができます。[ 5 ]
こうしたビーコンを利用することで、企業や組織はウェブユーザーのオンライン行動を追跡できる。当初、こうした追跡を行っていたのは主に広告会社やウェブ分析会社だったが、その後、ソーシャルメディアサイトも、例えば追跡ビーコンとして機能するボタンなどを利用することで、同様の追跡技術を用いるようになった。
2017年、W3CはWeb開発者がWebビーコンを作成するために使用できるインターフェースの候補仕様を公開した。[ 6 ]

ウェブビーコンは、ウェブページを訪問した人物を追跡するために使用されるいくつかの技術のいずれかです。メールが読まれたか転送されたか、またはウェブページが別のウェブサイトにコピーされたかどうかを確認するためにも使用できます。[ 7 ]
最初のウェブビーコンは、ウェブページやメールに埋め込まれた小さなデジタル画像ファイルでした。画像は1ピクセル(「トラッキングピクセル」)ほど小さく、背景と同じ色にすることも、完全に透明にすることもできました。[ 8 ]ユーザーがそのような画像が埋め込まれたページやメールを開くと、画像自体は見えないかもしれませんが、ウェブブラウザやメールリーダーが自動的に画像をダウンロードし、ユーザーのコンピュータがソース画像が保存されているホスト企業のサーバーにリクエストを送信する必要があります。このリクエストによりコンピュータの識別情報が提供され、ホストはユーザーを追跡できるようになります。
この基本的な技術はさらに発展し、様々な種類の要素をビーコンとして利用できるようになりました。現在では、グラフィック、バナー、ボタンなどの視覚的な要素だけでなく、メールやウェブページのフレーム、スタイル、スクリプト、入力リンク、埋め込み、オブジェクトなどの非画像的なHTML要素もビーコンとして利用できます。
ユーザーのコンピュータから提供される識別情報には、通常、IPアドレス、リクエストが行われた時刻、リクエストを行ったWebブラウザまたは電子メールリーダーの種類、およびホストサーバーによって以前に送信されたCookieの有無が含まれます。ホストサーバーはこれらの情報をすべて保存し、セッション識別子またはトラッキングトークンと関連付けることで、そのやり取りを一意に識別できます。
企業が特定のユーザーを識別できるようになれば、そのユーザーが複数のウェブサイトやウェブサーバーとやり取りする際の行動を追跡できるようになります。例えば、ウェブサイトのネットワークを所有する企業を考えてみましょう。この企業は、すべての画像を1つのサーバーに保存し、ウェブページのその他のコンテンツをさまざまなサーバーに保存することができます。たとえば、各サーバーは特定のウェブサイト専用であり、異なる都市に設置されている場合もあります。しかし、この企業は、1つの画像サーバーからデータを要求するウェブビーコンを使用して、さまざまなウェブサイトを訪問する個々のユーザーをカウントし、認識することができます。各サーバーごとに統計情報を収集したり、Cookieを個別に管理したりする代わりに、企業はこれらのデータをすべてまとめて分析し、さまざまなウェブサイト全体にわたる個々のユーザーの行動を追跡し、ユーザーがこれらの異なる環境をナビゲートする際の各ユーザーのプロファイルを構築することができます。
メールに埋め込まれたウェブビーコンは、ウェブページに埋め込まれたビーコンよりもプライバシーへの影響が大きい。埋め込まれたビーコンを使用することで、メールの送信者、あるいは第三者が、ウェブサイトの広告主と同様の情報、すなわちメールが読まれた時刻、メールの閲覧に使用されたコンピュータのIPアドレス(または閲覧者が経由したプロキシサーバーのIPアドレス)、メールの閲覧に使用されたソフトウェアの種類、および以前に送信されたCookieの有無を記録できる。このようにして、送信者、あるいは第三者は、各受信者がいつ、どこでメールを読んだかに関する詳細な情報を収集できる。メールメッセージがその後表示されるたびに、同じ情報が送信者または第三者に再度送信される可能性がある。
「Return-receipt-to」(RRT)メールヘッダーも情報の送信をトリガーすることができ、これらはウェブビーコンの別の形態と見なすことができる。[ 9 ]
ウェブビーコンは、メールマーケティング業者、スパマー、フィッシング詐欺師がメールが読まれたことを確認するために使用します。このシステムを利用することで、彼らは多数のアドレスに類似のメールを送信し、どのアドレスが有効かをチェックできます。ここでいう「有効」とは、そのアドレスが実際に使用されており、メールがスパムフィルターを通過し、メールの内容が実際に閲覧されたことを意味します。
ある程度は、メール閲覧ソフトの設定でリモート画像へのアクセスを回避することで、このようなメール追跡を防ぐことができる。
このようなメール追跡を無効にする一つの方法は、メールをダウンロードした後、ダウンロードしたメッセージを読む前にインターネット接続を切断することです。(ただし、これは自分のコンピュータにインストールされたメールリーダーを使用し、メールサーバーから自分のコンピュータにメールをダウンロードすることを前提としています。)この場合、ビーコンを含むメッセージはビーコンのホストサーバーへのリクエストをトリガーすることができず、追跡は防止されます。しかし、ビーコンが含まれていると思われるメッセージはすべて削除しなければならず、そうしないとコンピュータがインターネットに再接続された際にビーコンが再びアクティブになるリスクがあります。
ウェブビーコンはサーバーレベルでフィルタリングすることも可能で、エンドユーザーに届かないようにすることができます。
Beacon API(アプリケーションプログラミングインターフェース)は、Webの標準化団体であるWorld Wide Web Consortiumの推奨候補です。 [ 10 ]これは、 Webクライアントが追跡データをサーバーに静かに送信するように指示する標準化されたAPIであり、ユーザーに警告することなく、つまりユーザーエクスペリエンスを妨げません。
このビーコンAPIを使用すると、エンドユーザーには見えないため、エンドユーザーに気づかれることなく、またサイト内またはサイト外のナビゲーションを遅延させたり妨害したりすることなく、ユーザーの追跡とプロファイリングが可能になります。[ 11 ]ビーコンAPIのサポートは、2014年2月にMozillaのFirefoxブラウザに導入され[ 12 ]、 2014年11月にはGoogleのChromeブラウザに導入されました。 [ 13 ]
スパイピクセルまたはトラッカーピクセルは、 HTML メールメッセージ内のリモート画像ファイルへのハイパーリンクであり、画像がダウンロードされると、メールを読んだ人を監視する効果があります。これらは通常、小さく、目に見えない透明なグラフィック ファイルとしてメールの HTML に埋め込まれています。[ 14 ]スパイピクセルはマーケティングでよく使用されており、メール追跡ピクセルをブロックすることを目的とした対策がいくつかあります。しかし、メール追跡手法を効果的に保護する規制はほとんどありません。
ネットワークメールは1971年にレイ・トムリンソンによって開拓され、従来の郵便に比べてメッセージの送受信がはるかに便利になりました。[ 15 ] 2020年には、世界中で40億人のメールユーザーがおり、1日に約3060億通のメールが送受信されました。[ 16 ]しかし、メール送信者は、メッセージが届いたことを確認するために、受信者からの返信メールを待つ必要があります。受信者がメールを読んだにもかかわらず送信者に返信しない状況もあり、そのためメール追跡方法が登場しました。ほとんどのメールサービスは、メールが読まれたかどうかを示すインジケーターを提供していないため、サードパーティのアプリケーションやプラグインがメール追跡の利便性を提供しています。最も一般的な方法は、メール追跡ビーコンまたはスパイピクセルです。[ 15 ]
スパイピクセルは2021年2月に「蔓延している」と表現された。BBCニュースが取材したメールサービス「Hey」は、1日あたり100万通のメールのうち約60万通でスパイピクセルをブロックしていると推定した。
HTML 電子メールメッセージには、通常、オンラインリソースへのハイパーリンクが含まれています。電子メールの受信者が使用する一般的なソフトウェアは、デフォルトで、ユーザーに確認を求めることなく、ハイパーリンクからリモート画像ファイルを自動的にダウンロードする場合があります。画像ファイルをダウンロードした後、ソフトウェアは受信者に画像を表示します。スパイピクセルとは、意図的に小さく、多くの場合 1 ピクセルで、肉眼では「どこを見るべきかを知っていても見つけることができない」色をした画像ファイルのことです。電子メールのオープンな性質により、電子メール追跡によって電子メールのユーザーに連絡を取ることができます。[ 17 ]
トラッキングプロセスは、送信者が <img> で表される画像タグを HTML ベースのメールに挿入したときに開始されます。画像タグは、参照Uniform Resource Locator (URL) を介して送信者のサーバーに保存されているトラッキングオブジェクトにリンクされます。メールクライアントが開かれると、受信者はメールユーザーエージェント(MUA) が受信者のメッセージ転送エージェント(MTA) からの更新をローカルメールリポジトリと同期するプロセスを通じてメールを受信します。受信者がメールを開くと、メールクライアントは画像タグによって参照されるファイルを要求します。その結果、ファイルが保存されているWeb サーバーは要求をログに記録し、画像を受信者に返します。個々の行動を追跡するために、トラッキングオブジェクトまたは参照 URL には、各メール受信者に固有のタグが含まれている必要があります。多くの場合、受信者のメールのハッシュが使用されます。対照的に、トラッキングされていない画像から収集された IP アドレスとデバイス情報は、特定のユーザーのメールアドレスを明らかにしません。[ 18 ]
1通のメールが複数の受信者に送信された場合、追跡レポートには通常、開封されたメールの数は表示されますが、開封した特定の受信者は表示されません。[ 15 ]
ウェブ追跡とメール追跡は、追跡画像やクッキーの使用など、類似したメカニズムを採用しています。メール追跡では、メールアドレスから特定の組織への所属、閲覧履歴、オンラインのソーシャルメディアのプロフィール、その他の個人情報が明らかになることが多いため、同意なしに個人を追跡することがはるかに容易になります。[ 18 ]これにより、サードパーティのサービスがIPアドレス、ローカルネットワーク、ログイン情報などの共通の属性を共有するデバイスをリンクすることで、デバイス間のクロス追跡につながる可能性があります。[ 19 ] [ 20 ]ウェブ追跡ではこれがより困難になるかもしれませんが、より高度なウェブトラッカーには、Meta Pixelの高度なマッチング機能のようなデータ収集機能があり、フォームページでメールアドレスやその他の個人情報を送信することで個人を特定できます。[ 21 ]
個人やビジネスオーナーは、リード獲得、イベント招待、プロモーション、ニュースレター、ワンクリック投票、教師と保護者間のコミュニケーションなど、さまざまな理由でメール追跡を使用したい場合があります。Google スプレッドシートのアドオンである Yet Another Mail Merge (YAMM) などのサービスを使用して、Gmailからパーソナライズされたメールマージキャンペーンを作成して送信できます。送信者はトラッカーを有効にして、メールの開封率、クリック、返信、バウンスを確認するオプションがあります。[ 22 ] YAMM の Web サイトによると、「YAMM は、各メッセージの内容内に、目に見えない小さな追跡画像 (1 ピクセルの GIF、Web ビーコンと呼ばれることもあります) を埋め込みます。受信者がメッセージを開くと、追跡画像がスキャンされ、参照され、システムに記録されます。」[ 23 ]
メールニュースレターやその他のマーケティングコミュニケーションなどの媒体を通じてユーザーの行動を追跡することは、オンラインマーケティングにおける競争上の優位性となります。実際、その価値は非常に高く、Bananatag、Mailtrack.io、Yet Another Mail Mergeなどのように、オンラインユーザーデータを販売したり、メール追跡サービスを提供したりする企業も存在します。[ 24 ] [ 15 ]これは、ウェブサイトや企業がユーザーのクリック履歴や人口統計に基づいてユーザーについてより深く理解することで、各ユーザーに合わせたメッセージを配信できるためです。ユーザーの個人レベルの嗜好に関する情報が多ければ多いほど良いのです。マーケティングにおけるカスタマイズされたコミュニケーションは、顧客ロイヤルティ、囲い込み、満足度の向上につながり、キャッシュフローと収益性の増加につながります。[ 25 ]データを使用して競争環境をマッピングすることは、企業が競争戦略を策定し、競争上の優位性を獲得するのにも役立ちます。[ 26 ]ただし、行動マーケティングの悪影響には、価格差別などの差別が含まれる場合があります。[ 27 ] [ 28 ]
一部のメールには悪意のあるコンテンツや添付ファイルが含まれており、メール追跡はこれらのウイルスや悪意のあるプログラムがどれだけ速く拡散するかを検出するために使用されます。[ 24 ]同時に、一般的に、追跡されたメールの配信率は最大85%低下します。これは、企業のサーバーのファイアウォールが疑わしいコンテンツを含むメールをフィルタリングするアルゴリズムを組み込んでいるためです。[ 15 ]
ウェブ追跡と追跡ソフトウェアは、特に情報探索研究において、研究のためにデータを収集する必要のある研究者によって使用されています。実際、追跡技術は、ウェブサイト、ポータル、デジタルライブラリの開発に貴重な情報を提供するなど、良い目的にも使用できます。また、ユーザーインターフェース、検索エンジン、メニュー項目、ナビゲーション機能、オンラインヘルプ、インテリジェントソフトウェアエージェント、情報アーキテクチャ、コンテンツ記述、メタデータなどを改善するためにも使用できます。これらの発見は、マーケティングや電子商取引に役立つ可能性があり、図書館情報専門家、教育者、データベース設計者などの人々にとって重要になる可能性があります。[ 29 ]
スパイ効果とは、メールの受信者が選択しなくても、自動ダウンロードの結果として、メールの送信者に、メールが読まれたかどうか、いつ読まれたか、メールを読むのに使用されたコンピュータまたはスマートフォンのIP アドレスやその他の識別情報、そして後者から受信者の地理的位置が報告されることです。この情報は、ユーザーのメール閲覧行動、オフィスや移動時間、および環境の詳細についての洞察を提供します。[ 18 ] IP アドレスの逆引き検索を行うことで、ログエントリからユーザーがどの組織に所属しているかについての情報を得ることができます。[ 30 ]例えば、大手テクノロジー企業の役員が、メールのログエントリ、IP アドレス、および位置情報を同時に調べた結果、機密情報を転送していたことが発覚しました。さらに、スパマーがランダムなメールアドレスにメールを送信すると、この方法でアクティブなアカウントを特定できます。[ 18 ]
送信者向けにメール追跡サービスを提供する企業は数多く存在します。プリンストン大学の3人の研究者による調査によると、分析したメールの約30%が、埋め込みピクセルなどの方法によって受信者のメールアドレスを第三者に漏洩しており、その大部分は意図的なものでした。ウェブクローラーを使用して収集した12,618件のメールのうち、85%に第三者のコンテンツが埋め込まれており、そのうち70%がトラッカーに分類されました。上位の第三者ドメインには、「doubleclick.net」、「mathtag.com」、「dotomi.com」、「adnxs.com」などがあり、漏洩したメールアドレスを収集する上位組織には、The Acxiom、Conversant Media、LiveIntent、Neustar、Litmus Softwareなどがあります。[ 15 ] [ 19 ]メールを再読み込みすると、受信者の情報が第三者に漏洩する可能性が高まります。この調査では、追跡保護が有効であることも判明しました。追跡保護により、漏洩するメールアドレスの数が87%減少します。[ 19 ]
別の調査では、分析された 44,449 通のメールのうち 24.7% に少なくとも 1 つのトラッキング ビーコンが埋め込まれていることがわかりました。旅行、ニュース/メディア、健康に分類されたメールはトラッキングの発生率が最も高く、それぞれ 57.8%、51.9%、43.4% に少なくとも 1 つのトラッキング ビーコンが含まれていました。一方、メール クライアント、ソーシャル ネットワーク、教育に分類されたメールはトラッキングの発生率が最も低く、それぞれ 0.6%、1.6%、3.8% に少なくとも 1 つのトラッキング ビーコンが含まれていました。調査を通じて、著者らは、メールを頻繁にチェックする参加者の 52.1% が、メールを開くだけでトラッキングされる可能性があることに気づいていないことも発見しました。参加者の 86% は、メール トラッキングを深刻なプライバシーの脅威と考えています。[ 17 ]
Zogby Internationalの世論調査結果によると、消費者の80%がオンライン追跡について「やや」または「非常に」懸念している。[ 14 ]企業や政府による規制が不十分だと感じる消費者は、個人情報の捏造、プライバシー強化技術の使用、購入拒否など、さまざまな対応を通じて力を取り戻そうとするだろう。 [ 24 ]同時に、プライバシーに関する人々の認識は時代とともに変化してきたと主張する人もいる。例えば、Facebookの創設者であるマーク・ザッカーバーグは、「人々は、より多くの情報やさまざまな種類の情報を共有するだけでなく、よりオープンに、より多くの人々と共有することに本当に慣れてきた。その社会規範は、単に時間の経過とともに進化してきたものだ」と述べている。[ 14 ]
Cambridge Analytica は、「thisisyourdigitallife」というサードパーティ アプリを使用して、5,000 万人を超える Facebook ユーザーから情報を収集しました。ユーザーのメールへのアクセスは、データ漏洩のリスクにさらされる可能性があります。アイオワ大学とラホール経営科学大学の 4 人の研究者は、オンライン ソーシャル ネットワーク上のサードパーティ アプリによるデータ不正使用を特定する CanaryTrap を設計し、展開しました。これは、ハニー トークンをユーザーのソーシャル ページにリンクし、認識されていない使用を監視することによって行われます。具体的には、著者らはメールアドレスをハニー トークンとして共有し、それらのメールアドレスの認識されていない使用を監視しました。1,024 の Facebook ページで実験を行った後、著者らは複数のデータ不正使用を発見しました。20 の Facebook アプリと共有されたハニー トークンで 422 通の認識されていないメールが受信されました。これらの 422 通のメールのうち、76 通は悪意のあるメールまたはスパムに分類されました。[ 31 ]さらに、サードパーティのトラッカーは、 HTTP Cookie、Flash Cookie、DOMストレージの使用により、ユーザーとユーザーがやり取りするWebサイト間のデータ機密性が損なわれるため、インターネットユーザーにとって「敵対者」とみなされる可能性があります。[ 32 ]
全体として、カーネギーメロン大学とクアルコムの研究者たちは、多くのユーザーがトラッキングを白黒はっきりとしたものとは考えていないことを発見した。多くのユーザーはトラッキングをコントロールしたいと考えており、メリットもあると考えているが、トラッキングをコントロールする方法が分からなかったり、現在のツールを信用していなかったりする。調査に参加した35人のうち、14人がトラッキングを条件付きで肯定的、8人が概ね中立的、9人が概ね否定的、残りの4人が複雑な感情を抱いていた。12人の参加者はトラッキングを受け入れざるを得ないと感じていた。[ 33 ]
対策としては、プレーンテキストのメールクライアントを使用する、画像の自動ダウンロードを無効にする、またはブラウザでメールを読む場合はアドオンやブラウザ拡張機能をインストールするなどが挙げられます。
メール追跡のプロセスはクッキーを必要としないため、ユーザーエクスペリエンスに影響を与えずにブロックすることは困難です。[ 34 ]例えば、画像の自動ダウンロードを無効にすることは簡単に実装できますが、その代償として、情報の損失、フォーマットの誤り、ユーザーエクスペリエンスの低下、理解不能または混乱が生じることがよくあります。[ 18 ]
プリンストン大学の研究者3名が16種類のメールクライアントを分析したところ、既存の設定ではメール追跡の脅威からユーザーを完全に保護できるものはないことがわかった。uBlock Origin、Privacy Badger、Ghosteryなどのブロック拡張機能は追跡要求をフィルタリングできる。[ 19 ]
他の4人の研究者は、目に見えないピクセルの挙動を分析することに焦点を当ててトラッカーを検出することを目指しました。8,744のドメインから84,658のウェブページをクロールした後、目に見えないピクセルが94.51%以上のドメインに存在し、すべてのサードパーティ画像の35.66%を占めていることがわかりました。EasyList、EasyPrivacy、Disconnectなどのフィルタリストは、トラッキングを検出する一般的な方法です。これらは「ブラックリスト」を保持することで、既知のトラッキングおよび広告リクエストを検出します。しかし、研究者が検出したトラッカーの約30%を見逃しています。さらに、3つのフィルタリストをすべて組み合わせると、8,744のドメインからの379,245のリクエストが、Webサイトの68.70%でユーザーを追跡していました。[ 35 ]
最近の研究では、エンドユーザー向けのアンチトラッキングソフトウェアを開発するために機械学習を使用することに焦点が当てられています。[ 18 ] [ 24 ]
メールフローと集計統計データを分析することで、悪意のあるメール添付ファイルのウイルス的拡散、スパムメール、メールポリシー違反などの異常なメール動作を検出して、ユーザーアカウントを保護することができます。[ 36 ]
プライバシーツールにはユーザビリティ上の欠陥があり、ユーザーが十分な情報に基づいた有意義な意思決定を行うことが困難になる場合があります。たとえば、ある研究の参加者は、実際にはインストールも設定もできていなかったにもかかわらず、ツールを正常にインストールして設定したと思い込んでいました。[37] さらに、広告ブロッカーや同様のプライバシーツールの台頭により、広告ブロッカーを探し出してさまざまな方法で無効化しようとするアンチ広告ブロッカーが登場し、広告ブロッカー軍拡競争が激化しています。[ 24 ]
ユーザーをメール追跡から保護するための規制イニシアチブはほとんど存在しない。[ 24 ] Gmail、Yahoo!メール、Thunderbirdなどの多くのメールクライアントのヘルプページでは、メール追跡に関連するプライバシーリスクは限定的であるとユーザーに誤解させる可能性がある。これは、脅威は受信者の情報を受け取るメール送信者のみに限定され、第三者もその情報にアクセスできるわけではないと述べているためである。[ 19 ]
米国には現在、包括的なプライバシー権が整備されていません。合衆国憲法修正第4条は、「国民は、その身体、住居、書類及び財産について、不当な捜索及び押収から保護される権利を有し、この権利は侵害されてはならない」と保障していますが、民間企業や個人には明示的に適用されません。しかし、カリフォルニア州憲法は、政府と民間の両方の行為から個人に明確なプライバシー権を付与しています。金融サービス部門を対象とした1999年のグラム・リーチ・ブライリー金融近代化法、医療部門を対象とした1996年の医療保険の携行性と説明責任に関する法律、EUのデータ保護指令への米国企業の準拠を支援する米国商務省のセーフハーバー・フレームワークなど、特定の分野を対象とした規制があります。[ 14 ]
欧州連合は1995年にデータ保護指令(指令95/46/EC)を採択し、加盟国に対し、消費者保護を重点とした特定のプライバシー保護法を遵守することを義務付けました。この指令は、EU加盟国と指令に準拠していない国との間でのデータ交換を禁止しています。個人データは特定の状況下でのみ収集でき、収集される情報の対象となる個人に開示されなければなりません。さらに、個人識別情報(PII)は、当初の目的で使用される期間のみ保持できます。[ 14 ]
EUは2002年にトラッキング技術に関する一連の規制を初めて導入しました。2009年には、EU指令により、ウェブサイトはクッキーなどのあらゆる種類のプロファイリング技術を使用する前に同意を求めることが義務付けられました。その結果、ほとんどのヨーロッパのウェブサイトは「クッキーバー」を導入しました。しかし、トリノ工科大学の4人の研究者は、CookieCheckと呼ばれるツールを使用して35,000のウェブサイトで実験を行い、これらのウェブサイトの49%がEUクッキー指令に従っておらず、ユーザーが同意する前にプロファイリングクッキーをインストールしていることを発見しました。結論として、著者らは、EUの規制枠組みは規則の執行に効果がなく、ユーザーのトラッキング技術への曝露を減らすのにあまり役立っていないと主張しています。[ 38 ]