Googleで「noindex」タグがないため、Claude AIの会話が公開された

7月25日、Redditユーザーが、数百件のプライベートなClaude AIの会話がGoogleで公開検索可能になっていることを発見し、暗号資産ウォレットの認証情報、見かけ上の米国の社会保障番号、および法的な議論などの機密データが露出したことが判明した。露出の原因は、Anthropicのリンク共有機能にnoindexメタタグが欠落していたためで、robots.txtファイルが存在していても、検索エンジンが共有された会話リンクをインデックスできる状態になっていた。この事故は、11か月前にChatGPTでも同様のデータ露出が起きた件と似ている。OpenAIの会話共有機能がうっかりして、検索エンジン経由で数千件のチャットが発見可能になっていた。

Reddit User Exposes Indexed Claude Conversations on July 25

7月25日、Redditユーザーはクエリ「site:claude.ai/share」を使って、サイト指定のGoogle検索を実行したところ、完全に読み取れるClaudeの会話が数百件返ってきた。この検索結果により、機密性の高い内容が幅広く露出した。弁護士が、専門職としての倫理違反を自己申告する必要があるかどうかを尋ねるケース、暗号資産ウォレットのシードフレーズを貼り付けたユーザー、そしてさまざまな個人的なやり取りが含まれていた。発見を記録したRedditスレッドには4,000のアップボートが付いた。

同じインデックスの穴は、Claudeの公開アーティファクト機能にも影響していた。「site:claude.ai/public/artifacts」を検索すると、給与のスプレッドシート(従業員名)、社内の顧客関係管理のチャット書き出し、未公開のプロダクトロードマップが見つかった。共有された各Claudeリンクには「Anyone with the link」というラベルが付いていたが、インデックスされていたためGoogleもアクセスできてしまった。

Missing Noindex Tag Enabled Search Engine Indexing

この露出は、Anthropicが共有機能にnoindexメタタグを追加していなかったために発生した。この1つのHTML指示により、検索エンジンが検索結果にページを掲載しないようにできる。Anthropicの共有機能は、非公開のYouTube動画のように「直接リンクでのみアクセス可能」な仕組みとして設計されていたが、noindexタグがないため、公開フォーラム、ツイート、Slackワークスペースに投稿されたあらゆる共有リンクが、完全にインデックスされたWebページになってしまった。

Anthropicのrobots.txtファイルは既に用意されており、クロールによるClaudeの共有URLへのアクセスをブロックしていた。しかしGoogleのドキュメントでは、クロールのブロックはURLがWeb上のどこかに表示されていればインデックスを妨げないと説明されている。クロールはブロックされたページを開けないため、ページ内のnoindex指示も確認できない。その結果、会話はGoogleの検索結果で「このページの情報は利用できません」とラベル付けされて表示された。Googleはサードパーティの投稿からリンクを特定したものの、内容を説明できなかった。

Anthropic Removed Results and Added Noindex Tags by July 26

Anthropicが設定を更新し、noindexタグを追加したことで、Googleは7月26日までにClaudeの結果を取り下げ始めた。しかし、本稿の公開時点ではBingは引き続き共有リンクを表示していた。Anthropicは、公開時点までに公式声明を出していなかった。

GitHubのリポジトリ「Shared-Claude-Chats」は、削除前に、露出していたリンクから453件のClaude会話と519件のGrokチャットをアーカイブした。平文テキストとして11,241メッセージが保存されている。アーカイブされたデータは、インデックス修正後も引き続きアクセス可能だ。

Users Can Revoke Shared Links Through Privacy Settings

Anthropicのユーザーは、設定から「Settings → Privacy → Shared Chats」を開くことで、自分が共有した会話を取り消せる。この操作により、共有リンクへの今後のアクセスが停止する。ただし、サードパーティが既に保存したコピーや、アーカイブされたリポジトリの内容は削除されない。

ChatGPTでも同様の事故が11か月前に起きている。OpenAIの「Make this chat discoverable」チェックボックスは、OpenAIのCISOであるDane Stuckeyがこの機能を削除するまでの間、数千件の会話をGoogle、Bing、DuckDuckGoに送信した。Stuckeyはそれを「有用な会話を見つけられるようにするための短期間の実験」と呼んだ。これらの会話の多くは、OpenAIが削除できる前にインターネット・アーカイブに保存され、その後もアクセス可能な状態になった。

FAQ

What did the Reddit user discover on July 25? 7月25日、Redditユーザーは、Googleで「site:claude.ai/share」を検索すると、完全に読み取れるClaude AIの会話が数百件返り、暗号資産ウォレットの認証情報、見かけ上の社会保障番号、そして法的な議論などの機密データが露出していることを発見した。

Why were Claude conversations indexed by Google? Claudeの会話は、Anthropicが共有機能にnoindexメタタグを追加していなかったためにインデックスされた。Anthropicのrobots.txtファイルはクロールへのアクセスをブロックしていたが、Googleは公開Webサイト、フォーラム、またはSNS投稿に掲載されているURLを引き続きインデックスできた。

How can users revoke their shared Claude conversations? ユーザーは、Claudeアカウントで「Settings → Privacy → Shared Chats」に移動することで、共有された会話を取り消せる。これにより共有リンクへの今後のアクセスは停止するが、サードパーティが既に保存したコピーは削除されない。

免責事項:本ページの情報には第三者提供の内容が含まれる場合があり、参考目的のみで提供されています。これらはGateの見解や意見を示すものではなく、金融、投資、または法律上の助言を構成するものでもありません。暗号資産取引には高いリスクが伴います。意思決定を行う際には、本ページの情報のみに依存しないでください。詳細については、免責事項をご確認ください。
コメント
0/400
コメントなし