Конфиденциальность в эпоху ИИ: какие чат-боты лучше всего защищают ваши данные
Вы можете задавать ИИ-чат-ботам любые вопросы, но что ваши запросы говорят о вас? И, что более важно, какой объем конфиденциальных данных вы раскрываете, общаясь с ChatGPT или Claude? Исследовательская группа Incogni, известного поставщика услуг по удалению персональных данных, оценила риски конфиденциальности при использовании популярных больших языковых моделей (LLM), чтобы определить, какие из них лучше всего защищают данные пользователей.
Для анализа были отобраны 13 платформ, включая специализированные ИИ-сервисы и продукты технологических гигантов, таких как Microsoft и Meta:
* ChatGPT (OpenAI)
* Claude (Anthropic)
* Copilot (Microsoft)
* DeepSeek (DeepSeek)
* Gemini (Google)
* Grok (xAI)
* Kimi (Moonshot AI)
* Meta AI (Meta)
* Perplexity (Perplexity AI)
* Pi (Inflection AI)
* Qwen (Alibaba)
* Vibe (Mistral AI)
* Z.ai (Z.ai)
В отчете уточняется, что некоторые критерии анализа относятся к конкретному приложению, а другие — к провайдеру. Данные собирались с 15 июня по 6 июля текущего года; авторы отмечают, что с тех пор некоторые политики конфиденциальности могли обновиться.
Исследователи разработали 11 тестов, разделенных на три группы. Первая группа касалась обработки вводимой информации: используются ли запросы для обучения модели, можно ли запретить это и насколько легко отключить данную функцию, а также передаются ли данные третьим лицам.
Вторая группа оценивала доступность и прозрачность политик конфиденциальности. Исследователи проверяли, насколько легко найти эти документы и насколько ясно в них изложена информация.
Третья группа показателей касалась использования извлеченных данных. Выяснялось, связывает ли платформа данные пользователя с информацией из интернета для создания профиля (по аналогии с брокерами данных), продает ли она информацию и какие данные собирает мобильное приложение.
За каждый из 11 критериев платформа могла получить штрафные баллы. С помощью системы весовых коэффициентов был рассчитан итоговый счет: чем он ниже, тем выше уровень защиты конфиденциальности.
Результаты разделили платформы на три группы. Лучшие показатели продемонстрировали Vibe и ChatGPT. Последний получил особенно высокие оценки за прозрачность и ясность своих политик.
Худшие результаты показал Copilot, за ним следуют Meta AI и Kimi. Эти сервисы, принадлежащие крупным корпорациям, не смогли обеспечить четкую политику конфиденциальности, специфичную для LLM. Kimi получила максимум штрафных баллов за использование данных для обучения, а Copilot — за прямую обработку персональных данных.
В промежуточную группу вошли Claude, DeepSeek, Gemini, Grok, Perplexity, Pi, Qwen и Z.ai.
Особое внимание в отчете уделено возможности отказаться от сбора данных. В ChatGPT, Claude, Copilot, DeepSeek, Grok, Perplexity AI, Pi и Vibe предусмотрен простой переключатель для отключения использования диалогов в обучении. В Gemini такая функция есть, но она отключает и возможность запоминания контекста диалогов. Z.ai не предлагает такой возможности, а Meta, Moonshot AI и Qwen упоминают процесс отключения лишь формально, не делая его доступным.
Важно понимать: отказаться можно только от будущего сбора данных. Удалить то, что модель уже «поглотила», невозможно. Даже Центр конфиденциальности ChatGPT предлагает лишь подать запрос на удаление личной информации из ответов, но это не означает полное удаление данных из системы, а лишь попытку предотвратить их появление в будущих ответах.
Большинство ИИ-платформ при подготовке использовали весь интернет, включая публичные профили в соцсетях и маркетинговые данные. Чат-боты с худшими оценками (особенно Microsoft Copilot и Meta AI) связывают эти данные с запросами пользователей для создания персональных профилей. Inflection AI, Meta, Microsoft и Perplexity AI также были отмечены за использование данных для прогнозирования поведения и предпочтений пользователей, что является шагом к таргетированной рекламе.
Даже при удалении аккаунтов ваши данные остаются внутри модели. Кроме того, многие используют ИИ неосознанно — например, через функцию «AI Overview» в поиске Google.
Чтобы минимизировать риски, рекомендуется:
1. Выбирать платформы с наименьшим количеством утечек согласно исследованиям.
2. Изучать настройки и отключать использование запросов для обучения. Если такой настройки нет — смените сервис.
3. Критически оценивать содержимое запроса. Не передавайте ИИ медицинские диагнозы, секретную информацию или любые данные, которые вы не хотели бы видеть в открытом доступе.
***
*Об авторе: Эксперт по безопасности, конфиденциальности и защите личности, многолетний сотрудник PCMag. Член консультативного совета Anti-Malware Testing Standards Organization (AMTSO). Автор книг по программированию и сотен обзоров программного обеспечения.*
