Конверсії Claude AI, розкриті в Google через відсутність тега noindex

Користувач Reddit виявив 25 липня, що сотні приватних AI-розмов Claude можна було публічно шукати в Google, через що розкрилися чутливі дані користувачів, зокрема облікові дані для криптогаманців, схожі на номери соціального страхування, а також юридичні обговорення. Розкриття сталося через відсутній meta-тег noindex у функції обміну посиланнями Anthropic, що дозволило пошуковим системам індексувати посилання на спільні розмови, попри вже наявний robots.txt. Інцидент повторює подібне розкриття даних, яке сталося з ChatGPT 11 місяців раніше, коли функція обміну розмовами OpenAI випадково зробила тисячі чатів доступними для пошуку через пошукові системи.

Користувач Reddit оприлюднив індексовані розмови Claude 25 липня

Користувач Reddit виконав 25 липня пошук у Google з прив’язкою до сайту за запитом "site:claude.ai/share", який повернув сотні повністю читабельних розмов Claude. Результати пошуку розкрили широкий спектр чутливого контенту: адвокат запитував, чи потрібно йому самостійно повідомити про порушення професійної етики, користувач вставляв seed-фразу криптогаманця, а також були різні приватні обговорення. Тред у Reddit, який документував виявлення, зібрав 4,000 upvote.

Такий самий пробіл в індексації вплинув на функцію опублікованих артефактів Claude. Пошук за "site:claude.ai/public/artifacts" показав платіжні відомості з іменами працівників, експорти чатів із внутрішньої CRM, а також незапущені дорожні карти продуктів. Кожне спільне посилання Claude містило позначку "Anyone with the link", але через індексацію Google також отримав доступ до вмісту.

Відсутній noindex-тег увімкнув індексацію пошуковими системами

Експозиція сталася тому, що Anthropic не додала noindex meta-тег до своєї функції share. Ця проста HTML-інструкція підказує пошуковим системам не включати сторінку до результатів пошуку. Функція share Anthropic була задумана працювати як unlisted-відео на YouTube — доступна лише за прямим посиланням — але без noindex-тега кожне share-посилання, опубліковане на публічних форумах, у твітах або робочих просторах Slack, ставало повноцінною індексованою вебсторінкою.

Файл robots.txt Anthropic уже був на місці й блокував URL-адреси share Claude від доступу для сканерів. Однак документація Google пояснює, що блокування сканування не заважає індексації, якщо URL з’являється в іншому місці в інтернеті. Сканер не може відкрити заблоковану сторінку, тож він також не може побачити в ній інструкцію noindex. Розмови з’являлися в результатах пошуку Google з маркуванням "No information is available for this page" — Google визначав посилання з публікацій третіх сторін, не маючи змоги описати вміст.

До 26 липня Anthropic прибрала результати й додала noindex-теги

Google почав вилучати результати Claude до 26 липня після того, як Anthropic оновила конфігурацію та додала noindex-теги. Втім, на момент публікації Bing продовжував показувати спільні посилання. Публічної заяви Anthropic до часу публікації не робила.

GitHub-репозиторій під назвою Shared-Claude-Chats заархівував 453 розмови Claude і 519 чатів Grok із оприлюднених посилань до видалення — 11,241 повідомлення у вигляді звичайного тексту. Заархівовані дані залишаються доступними попри виправлення індексації.

Користувачі можуть відкликати спільні посилання через налаштування приватності

Користувачі Anthropic можуть відкликати власні спільні розмови, перейшовши до Settings → Privacy → Shared Chats. Ця дія зупиняє майбутній доступ до спільних посилань. Відкликання не видаляє копії, вже збережені третіми сторонами або архівними репозиторіями.

З ChatGPT сталася схожа історія 11 місяців тому. Прапорець OpenAI "Make this chat discoverable" відправив тисячі розмов у Google, Bing і DuckDuckGo, доки CISO OpenAI Дані Стоуккі не прибрав цю функцію, назвавши її "a short-lived experiment to help people discover useful conversations." Багато з тих чатів опинилися в Internet Archive до того, як OpenAI встигла їх прибрати, і залишаються доступними.

Поширені запитання

Що користувач Reddit виявив 25 липня?
Користувач Reddit виявив 25 липня, що Google-пошук за "site:claude.ai/share" показував сотні повністю читабельних AI-розмов Claude, розкривши чутливі дані, зокрема облікові дані криптогаманця, схожі на номери соціального страхування, та юридичні обговорення.

Чому розмови Claude індексувалися Google?
Розмови Claude індексувалися, бо Anthropic не додала noindex meta-тег до своєї share-функції. Хоча robots.txt Anthropic блокував доступ сканерам, Google все одно міг індексувати URL, які з’являлися на публічних вебсайтах, форумах або в дописах у соцмережах.

Як користувачі можуть відкликати свої спільні розмови Claude?
Користувачі можуть відкликати спільні розмови, перейшовши в Settings → Privacy → Shared Chats у своєму акаунті Claude. Це зупиняє майбутній доступ до спільних посилань, але не видаляє копії, уже збережені третіми сторонами.

Застереження: інформація на цій сторінці може походити зі сторонніх джерел і надається виключно для ознайомлення. Вона не відображає позицію чи думку Gate і не є фінансовою, інвестиційною чи юридичною консультацією. Торгівля віртуальними активами пов’язана з високим ризиком. Будь ласка, не покладайтеся лише на інформацію з цієї сторінки під час прийняття рішень. Детальніше дивіться у Застереженні.
Прокоментувати
0/400
Немає коментарів