Витік діалогів із Claude: як приватні розмови з ШІ опинилися у відкритому доступі
У центрі уваги фахівців із кібербезпеки опинився чат-бот Claude від компанії Anthropic. Як з’ясувалося, приватні розмови користувачів із нейромережею стали доступними для перегляду через звичайні пошукові системи. Достатньо було ввести специфічний запит, щоб отримати посилання на логи діалогів, які індексувалися Google, Bing та іншими сервісами. Хоча розробники оперативно вжили заходів для приховання сторінок із видачі, інцидент знову підняв гостру дискусію про межі конфіденційності в епоху генеративного штучного інтелекту.
Проблема виникла через функцію «Поділитися» (Share), яка дозволяє генерувати пряме посилання на історію чату. В Anthropic стверджують, що процес повністю контролюється користувачем: посилання неможливо підібрати випадково, поки власник акаунту сам не вирішить надіслати його третім особам. Проте розробники не врахували нюанс — варто такому посиланню бодай раз з’явитися у відкритому сегменті інтернету (на форумі, у соціальних мережах чи коментарях), як пошукові роботи миттєво додають його до своїх баз даних. У результаті «приватні» обговорення стають загальним надбанням.
Користувачі платформи Reddit першими вдарили на сполох, виявивши сотні активних посилань на діалоги. Тематика витоків виявилася надзвичайно строкатою: від філософських роздумів бота про лояльність до компанії-розробника до наївних запитів про те, як людині «перетворитися на магічного лиса». В останньому випадку ШІ навіть підкріплював ілюзію візуалізаціями, переконуючи співрозмовника у набутті надприродних здібностей.
Ризики конфіденційності та корпоративні загрози
Найбільшу небезпеку становлять не курйозні запити, а витік персональних і корпоративних даних. Серед проіндексованих сторінок знайшлися чернетки резюме з детальними контактними даними, планами кар’єрного розвитку та описом попередніх місць роботи. Ще серйознішим виглядає використання Claude для робочих цілей: аналізу конфіденційних медичних досліджень або підготовки звітів з хмарної безпеки для великих корпорацій. Опинившись у пошуковій видачі, така інформація стає легкою здобиччю для конкурентів або зловмисників.
Представники Google у коментарях журналістам наголосили, що пошукова система лише дзеркально відображає доступний у мережі контент. Відповідальність за те, щоб технічні сторінки не потрапляли в індекс, лежить на власниках платформи. Anthropic, імовірно, використала спеціальний протокол, що забороняє сканування (robots.txt), аби виправити ситуацію, проте частина діалогів могла залишитися в кешованих версіях менш популярних пошукових систем.
Історія повторюваних помилок
Інцидент з Anthropic не є унікальним явищем для індустрії. Минулого року з аналогічною проблемою зіткнулася компанія OpenAI. Тоді через особливості індексації у відкритому доступі з’явилися посилання на діалоги з ChatGPT. Ситуація була настільки резонансною, що розробникам довелося терміново переглядати політику створення публічних посилань, впроваджуючи додаткові атрибути, які блокують доступ пошуковим роботам.
Ще масштабніший скандал розгорнувся навколо чат-бота Grok від соцмережі X (колишній Twitter). Через інтеграцію з платформою Ілона Маска сотні тисяч діалогів фактично стали частиною публічного контенту, який індексується автоматично. Ці випадки демонструють системну ваду в архітектурі сучасних ШІ-інструментів: функція зручного шерингу часто конфліктує з базовими принципами безпеки даних.
Сучасні системи штучного інтелекту, такі як Claude, сприймаються користувачами як «безпечні співрозмовники». Це створює ілюзію повної приватності, що спонукає людей ділитися з ботом інтимними подробицями життя або комерційними секретами. Фахівці з безпеки нагадують: будь-яка інформація, передана хмарному сервісу, технічно перестає бути приватною, а будь-яка кнопка «поділитися» перетворює закриту розмову на веб-сторінку, доступну для всього світу.
Наразі Anthropic намагається мінімізувати репутаційні втрати, підкреслюючи, що доступ до чужих чатів не був наслідком зламу системи. Це було лише «необачне використання стандартної функції». Проте для корпоративного сектору це чергове нагадування про те, що використання зовнішніх ШІ-інструментів для обробки чутливих даних залишається зоною високого ризику, незалежно від того, наскільки просунутою чи етичною вважається компанія-розробник.