Користувач Reddit виявив уразливість, завдяки якій можна було знаходити приватні діалоги. Anthropic додала мітку та виправила проблему

Key Takeaways
  • Розмови Claude від Anthropic було розкрито внаслідок пошуку Google після того, як користувач Reddit виявив уразливість «site:claude.ai/share».
  • Понад 200 розмов містили чутливі дані, зокрема облікові дані криптовалют, інформацію про пацієнтів клінічних досліджень і плани корпоративних продуктів, які ще не були випущені.
  • У Anthropic не додали теги noindex, а Google вилучив результати до 26 липня. Водночас GitHub назавжди заархівував 453 розмови Claude у вигляді відкритого тексту.

Один користувач Reddit нещодавно виявив, що в Google під час пошуку за командою «site:claude.ai/share» можна викликати сотні записів діалогів із Claude, які вже були оприлюднені: розкривши понад 200 діалогів. Їх відображення охоплює щонайменше 25 сторінок результатів пошуку, причому частина діалогів сталася кілька тижнів тому. Anthropic додала тег noindex, а Google 26 липня прибрав відповідні результати пошуку.

Типи витоку: криптовалютні облікові дані, дані пацієнтів клінічних досліджень і плани продуктів компаній, які ще не були випущені

用戶和Claude私密對話曝光 (Джерело: Reddit)

Після перевірки користувачами з’ясувалося, що виток діалогів Claude охоплює різні типи чутливої персональної та корпоративної інформації:

· облікові дані криптогаманців

· ймовірні номери соціального страхування

· юридичні консультації та медичні записи (зокрема повні імена, вік, стать, расова приналежність і дати лікування пацієнтів у клінічних випробуваннях)

· внутрішні документи компаній (таблиці зарплат, журнали діалогів у системі CRM, плани продуктів, які ще не були оприлюднені)

· імена дітей і номери телефонів

· геолокаційні дані (ймовірно містять дані з бази «збирання геолокаційних даних», яка включає адреси та коди домофонів у квартирах)

Om Patel (засновник BigIdeasDB) додав, що витік стосується не лише записів діалогів: він також охоплює інтерактивні мініпрограми та документи, згенеровані функцією Claude «Artifacts».

Технічна першопричина: відсутність noindex і обмеження robots.txt

Безпосередньою причиною витоку стало те, що сторінки зі спільними посиланнями на Claude не містили тегу «noindex». Anthropic від вересня 2025 року вже застосовує в robots.txt інструкції для пошукових роботів не отримувати доступ до сторінок зі спільними посиланнями, але цього недостатньо: згідно з поясненнями Google для розробників, якщо вебсторінку пов’язують інші сайти, то для того, щоб Google насправді не включав її в індекс, потрібен тег noindex на самій сторінці або додавання x-robots-tag у відповідь заголовка.

Після огляду витоків редакція The Wired підтвердила, що на цих сторінках справді не було тегу noindex; це також пояснює, чому деякі результати показували повідомлення на кшталт «немає релевантної інформації для цієї сторінки»: Google знав про існування посилання, але не міг прочитати вміст сторінки. Така сама проблема виникла й на публічних сторінках Claude для Artifacts.

Прогрес виправлення та проблеми з незворотним «вічним» збереженням: 453 діалоги вже заархівовано

Shared-Claude-Chats (Джерело: Claude)

Anthropic додала тег noindex, а приблизно 26 липня Google почав прибирати відповідні результати пошуку про Claude; однак Bing станом на момент здачі матеріалу все ще давав змогу знайти частину контенту. Що вже неможливо виправити — на GitHub репозиторій під назвою «Shared-Claude-Chats» уже назавжди заархівував 453 діалоги Claude та 519 діалогів Grok, разом 11 241 повідомлення, усі збережені у вигляді звичайного тексту.

Ця подія не є першою: ChatGPT за 11 місяців до того також мав майже ідентичну ситуацію («зробити цей діалог доступним для виявлення» призводило до того, що тисячі діалогів потрапляли в індекс пошукових систем; функцію згодом прибрали); минулого року в Anthropic теж зафіксували подібний випадок — близько 600 діалогів було заіндексовано Google.

Поширені запитання

Яка безпосередня технічна причина витоку діалогів Claude?

Безпосередня причина — відсутність тегу «noindex» на сторінках зі спільним доступом до Claude. Хоча Anthropic із вересня 2025 року вже застосовує robots.txt, за поясненнями Google для розробників, для сторінок, на які є посилання з інших сайтів, Google потрібен тег noindex на самій сторінці, щоб повністю заблокувати індексацію в результатах пошуку; редакція The Wired після огляду витоків підтвердила, що ці сторінки не містили цього тегу. Anthropic після події виправила проблему, додавши тег noindex.

Навіть якщо Anthropic уже виправила, чи були витягнуті раніше діалоги назавжди збережені?

Так. Репозиторій на GitHub під назвою «Shared-Claude-Chats» заархівував 453 діалоги Claude та 519 діалогів Grok, разом 11 241 повідомлення, зберігши їх у вигляді звичайного тексту назавжди; також станом на момент публікації Bing все ще міг знаходити частину контенту. Користувачі можуть керувати тим, які діалоги були поділені, у розділі конфіденційності в налаштуваннях Claude, але заархівований контент неможливо видалити таким способом.

Як Anthropic і Google відреагували на цю подію?

Зі слів речника Anthropic Amie Rotherham, посилання для спільного доступу не є на тлікуванні: якщо користувач обирає ділитися, це означає публікування — так само, як інший публічний контент в інтернеті може бути збережений третіми сторонами. Речник Google Ned Adriance заявив, що пошукові системи не можуть контролювати, які сторінки опиняються у відкритому доступі в інтернеті, і що Google надає власникам сайтів чіткі інструменти, щоб вирішувати, чи слід включати сторінки в індекс, та вони завжди дотримуються цих налаштувань.

Застереження: інформація на цій сторінці може походити зі сторонніх джерел і надається виключно для ознайомлення. Вона не відображає позицію чи думку Gate і не є фінансовою, інвестиційною чи юридичною консультацією. Торгівля віртуальними активами пов’язана з високим ризиком. Будь ласка, не покладайтеся лише на інформацію з цієї сторінки під час прийняття рішень. Детальніше дивіться у Застереженні.
Прокоментувати
0/400
Немає коментарів