Публичные ссылки на чаты и проекты Claude индексировались Google. Это происходило после использования функции Share, хотя пользователи, вероятно, рассчитывали открыть доступ только коллегам или знакомым. В результате материалы с личной и корпоративной информацией можно было найти через поиск.

Как чаты Claude попадали в Google
Компания Anthropic изменила работу функции совместного доступа в Claude после сообщений об индексации опубликованных материалов. До внесения изменений некоторые чаты и проекты можно было обнаружить через Google, хотя многие пользователи рассчитывали, что доступ к ним получат только обладатели ссылок.
Проблема возникала при использовании кнопки Share, которая создаёт публичную ссылку на чат или проект. В интерфейсе Claude указывалось, что просматривать содержимое сможет любой, у кого есть ссылка. Однако пользователи не получали предупреждения о возможности индексации таких страниц поисковиками.
Какие данные оказались в поиске
По данным Futurism, через поисковую выдачу удалось найти материалы с конфиденциальной информацией. Среди них – медицинские заключения, результаты клинических исследований с персональными данными пациентов, списки школьников с контактными данными, а также внутренние корпоративные документы и оценки сотрудников. Издание не публиковало ссылки на найденные страницы, чтобы не раскрывать личную информацию.

В Anthropic заявили, что механизм совместного доступа изначально был рассчитан именно на публикацию контента. В компании подчеркнули, что не создают карты сайта и не передают поисковым системам каталоги таких страниц. Однако если ссылка становится общедоступной, поисковые роботы могут обнаружить и проиндексировать её так же, как любой другой открытый веб-ресурс.
Подобные случаи происходили и раньше
Это уже не первый скандал, связанный с индексацией материалов, доступных по публичным ссылкам. В 2024 году Forbes сообщал, что поисковые системы проиндексировали сотни чатов Claude. Тогда компания удалила их из открытого доступа. Аналогичные ситуации затрагивали сервисы OpenAI и xAI: ссылки на отдельные чаты ChatGPT и Grok также появлялись в результатах поиска.
Похожая история произошла в 2018 году с Google Docs. Тогда пользователи обнаружили в выдаче «Яндекса» документы, которые выглядели предназначенными для ограниченного круга лиц, но содержали персональные данные, пароли и внутреннюю информацию. В Google объяснили, что поисковики могли индексировать только файлы, намеренно сделанные публичными, либо документы, ссылки на которые были размещены в открытом доступе.
Anthropic запретила индексацию страниц
После появления новых публикаций Anthropic без официального анонса обновила механизм публикации. На страницы с чатами и Artifacts начали автоматически добавлять метатег noindex, запрещающий поисковым системам включать их в поисковую выдачу. Ранее такая защита отсутствовала, из-за чего часть опубликованных материалов успела попасть в индекс Google.

Одновременно Google начал удалять уже проиндексированные страницы из результатов поиска. Однако специалисты отмечают, что деиндексация занимает время, поэтому некоторые ссылки ещё некоторое время оставались доступными. В других поисковых системах, включая Bing, отдельные страницы продолжали отображаться даже после начала их удаления из Google.
Почему robots.txt недостаточно
Причиной ситуации стал не взлом и не техническая уязвимость Claude. Пользователи сами создавали публичные ссылки и размещали в открытом доступе материалы, которые не следовало публиковать. Однако интерфейс сервиса недостаточно ясно объяснял, что такие страницы могут обнаружить и проиндексировать поисковые системы.
Основная проблема заключалась в отсутствии ограничений на индексацию публичных страниц. Одного файла robots.txt недостаточно, чтобы исключить URL из поисковой выдачи, особенно если на него ведут открытые ссылки. Именно поэтому использование метатега noindex считается более надёжным способом защиты подобных страниц.
Под угрозой оказались и Artifacts
Индексации подвергались не только переписки пользователей, но и Artifacts – созданные в Claude документы, веб-приложения, панели управления, программный код и другие рабочие проекты.
Это значительно повышало потенциальный риск утечки данных, поскольку в открытом доступе могли оказаться не только диалоги с ИИ, но и готовые материалы, предназначенные для внутреннего использования.