Переписки с DeepSeek оказались в открытом доступе. Как пользователям обезопасить себя
Сейчас нет подтверждений взлома DeepSeek или получения доступа к закрытым чатам пользователей. Стало известно, что в поисковые сервисы попали диалоги, для которых сами пользователи создали публичные ссылки с помощью функции "Поделиться". Обнаружено, что такие страницы индексировались Google и поэтому могли быть найдены не только теми людьми, которым пользователь непосредственно отправил ссылку.
Технически это могло произойти потому, что страница, доступная любому обладателю ссылки, фактически является публичной веб-страницей, объясняет заведующий лабораторией доверенного искусственного интеллекта РТУ МИРЭА Юрий Силаев. "Если сервис не запрещает индексацию страницы техническими средствами, поисковый робот может добавить ее в выдачу. Главная проблема здесь заключается именно в проектировании самой функции: формулировка "доступно всем, у кого есть ссылка" многими воспринимается как ограниченное распространение, хотя фактически ссылка может стать общедоступной", - говорит эксперт.
DeepSeek предупреждает о риске получения опубликованных диалогов веб-краулерами в политике конфиденциальности, но такое предупреждение не прописано в максимально явном виде непосредственно в момент создания ссылки, поэтому многие пользователи могут просто не обратить на это внимание.
Силаев добавляет, что заранее однозначно определить, что публичный ИИ-сервис полностью безопасен невозможно, можно лишь оценить уровень риска. При общении в ИИ-чате, по словам эксперта, следует выяснить, использует ли сервис запросы и загруженные файлы для обучения моделей, как долго хранит информацию, можно ли ее удалить, где физически обрабатываются данные, кому они могут передаваться и какие гарантии предусмотрены для корпоративных клиентов. Важны также наличие независимого аудита, прозрачная история реагирования на инциденты и понятное управление публичными ссылками.
Важно, что отдельные технические признаки, например поддержка SAML или современного шифрования соединения, еще не означают, что содержимое диалогов надежно защищено на всех этапах обработки. Для организаций принципиальное значение имеют договорные гарантии, разграничение доступа, журналирование действий, запрет использования данных для обучения и возможность размещения решения в контролируемом контуре.
"Сотрудники компаний и обычные пользователи воспринимают чат-боты как личные сервисы и загружают туда внутренние документы, персональные данные, переписку с коллегами и близкими людьми. Несмотря на соответствующие предупреждения, они не думают или упускают из виду, что информация сохраняется на сторонних серверах и может быть использована для дообучения моделей. Вторая распространенная ошибка - слепое доверие к сгенерированным ИИ ответам. То, что нейросети совершают фактические и логические ошибки, делают неверные выводы - это общеизвестная информация", - рассказал ведущий менеджер продукта в Content AI Антон Фролов.
Он предполагает, что пользователи станут по-настоящему осторожными только после столкновения с реальным ущербом, например, после утечки и публикации закрытых данных компании или использования персональных сведений мошенниками для финансовых махинаций.
По словам Фролова, в корпоративном сегменте этот процесс уже идет. Компании постепенно отказываются от использования публичных ИИ-сервисов для работы с чувствительной информацией в пользу локально развернутых LLM, работающих в закрытом контуре. Такой подход позволяет сохранить полный контроль над данными и исключить их передачу внешним поставщикам сервисов. Одновременно все шире применяются технологии автоматического обезличивания данных: перед отправкой запроса нейросети из документов удаляются или заменяются персональные данные, коммерчески чувствительная информация и другие идентификаторы.

