Безопасен ли ChatGPT для конфиденциальных данных?
С исходными конфиденциальными данными — нет; но да, если сначала их обезличить. Всё, что вы вставляете, отправляется на серверы провайдера, хранится там, а на личных аккаунтах используется для обучения модели. В этом материале мы на конкретных инцидентах разбираем реальные риски, даём быструю памятку «рискованно или допустимо» и показываем безопасный способ всё-таки получить помощь ИИ по чувствительным файлам.
Что происходит, когда вы вставляете конфиденциальные данные
Ваш текст передаётся провайдеру и хранится на его серверах, а на личных аккаунтах (Free, Go, Plus, Pro) по умолчанию используется для обучения моделей. (Источник: OpenAI, по состоянию на июль 2026.) Как именно устроены хранение, обучение и удаление, мы подробно разбираем в материале хранит ли ChatGPT ваши данные? — здесь же вопрос проще: с учётом всего этого, безопасно ли это?
Реальные риски, по убыванию значимости
- Случайные утечки (теневой ИИ, «shadow AI»). Сотрудники вставляют конфиденциальные материалы в личные аккаунты — незаметно для ИТ-службы.
- Передача данных на обучение модели. На личных аккаунтах ваш текст по умолчанию используется для обучения модели.
- Взлом провайдера и его подрядчиков. Взломать могут как самого провайдера, так и любого из его подрядчиков.
- Раскрытие в суде и обязанность сохранять данные. Запросы могут храниться по судебному предписанию и приобщаться к делу как доказательство.
- Случайная публикация в открытом доступе. Ошибка в настройках или общедоступная ссылка могут вывести переписку в открытый интернет.
Это уже случалось — конкретные инциденты
- Samsung (2023). Всего через несколько недель после того, как ChatGPT разрешили, инженеры вставили в него конфиденциальный исходный код и внутренние заметки с совещаний; в итоге Samsung запретила генеративный ИИ на корпоративных устройствах.
- Ошибка ChatGPT в марте 2023 года. Из-за уязвимости в библиотеке redis-py часть пользователей могла видеть заголовки чатов и первые сообщения других людей; кроме того, оказались раскрыты платёжные данные — имя, email, адрес для выставления счёта, срок действия карты и последние четыре цифры (полный номер карты — ни в одном случае) — у 1,2% подписчиков ChatGPT Plus, активных в промежутке около 9 часов. (Источник: OpenAI.)
- Общедоступные чаты в Google (середина 2025 года). Из-за опции «сделать этот чат доступным для поиска» переписки ChatGPT, к которым открыли доступ, начали индексироваться поисковиками; OpenAI убрала эту функцию буквально за несколько дней, сочтя её слишком рискованной. (Источник: TechCrunch.)
- Взлом подрядчика Mixpanel (ноябрь 2025 года). Взлом аналитического подрядчика OpenAI раскрыл у части клиентов API имена, email, приблизительное местоположение и идентификаторы организаций — наглядное подтверждение того, что даже подрядчики надёжного провайдера остаются поверхностью атаки. (Источник: OpenAI.)
Это не редкость — цифры по теневому ИИ
Разрозненные вставки складываются в системную утечку. Анализ безопасности по 1,6 млн работников показал, что около 11% того, что сотрудники вставляют в ChatGPT, — конфиденциальные данные, и что менее 1% персонала создают 80% утечек. (Источник: Cyberhaven.) По данным отчёта 2025 года, 68% сотрудников пользуются бесплатным ИИ через личные аккаунты, а 57% вводят в него чувствительные данные; (Источник: Menlo Security); а по данным другого, генеративный ИИ стал каналом №1 для утечки данных из корпоративного контура в личный. (Источник: LayerX.)
Когда это рискованно, а когда относительно допустимо?
| Что вы хотите ввести | Вердикт |
|---|---|
| Имена, данные клиентов или пациентов, любые персональные данные | Не вставляйте в исходном виде — сначала обезличьте |
| Коммерческая тайна, исходный код, ещё не выпущенные планы | Не вставляйте |
| Данные под защитой профессиональной тайны или под регулированием (юридические, медицинские, финансовые) | Не вставляйте — здесь особенно высока обязанность проявлять осмотрительность |
| Информация, которая уже находится в открытом доступе | Как правило, допустимо |
| Общие вопросы без реальных данных внутри | Допустимо |
| Обезличенная копия, где вместо реальных значений подставлены плейсхолдеры | Допустимо — это и есть безопасный способ |
Все строки выше с вердиктами «сначала обезличьте» и «допустимо» описывают один и тот же приём: локально убрать идентификаторы, а затем вставлять. Именно это и делает Occlira — обезличивает прямо на вашем компьютере, даёт работать с копией и восстанавливает оригиналы, когда вы закончите.
Три вопроса для быстрой самопроверки перед вставкой:
- Не поставит ли утечка этих данных вас в неловкое положение и не нарушит ли ваши обязательства (перед клиентом, пациентом или работодателем)?
- Смогли бы вы решить задачу столь же хорошо на обезличенной версии?
- Вы работаете на личном аккаунте (где обучение включено по умолчанию) или на корпоративном тарифе?
Делает ли корпоративный тариф это безопасным?
Он снимает один из рисков: данные на тарифах Business, Enterprise, Edu и API по умолчанию не используются для обучения, а сами тарифы сопровождаются соглашением об обработке данных — полный разбор тарифов см. в материале хранит ли ChatGPT ваши данные? Но данные всё равно покидают ваше устройство и всё равно могут быть раскрыты при взломе подрядчика, а само по себе DPA не делает обработку законной — об этом в материале используйте ИИ, не нарушая GDPR. Корпоративный тариф снижает риск, но не устраняет его.
Безопасный рабочий сценарий
Главный принцип — минимизация данных: не отправляйте того, что для задачи не нужно:
- Обезличьте или уберите конфиденциальные части до того, как что-либо будет отправлено.
- Поработайте с ИИ-инструментом над обезличенной копией.
- Отдавайте предпочтение тарифу без обучения и никогда не вставляйте учётные данные или данные под регулированием.
- Оставляйте человека в контуре и проверяйте результат, прежде чем на него полагаться.
Как Occlira делает это безопасным
Occlira — это и есть тот самый первый шаг. Он находит и убирает персональные данные из документов, таблиц, электронной почты, аудио и изображений прямо на вашем компьютере — без облака и без учётной записи. Вы обезличиваете файл локально, работаете с любым ИИ-инструментом над обезличенной копией, а затем восстанавливаете реальные значения у себя на компьютере. Так нейтрализуются все перечисленные выше риски: нечего вставить по ошибке, нечем питать обучение, нечему утечь при взломе и нечего запросить по суду.
Одна честная оговорка: обезличивание в Occlira обратимо, а в терминах GDPR это псевдонимизация — мощный инструмент локальной минимизации данных, однако карта соответствий (она хранится на вашем устройстве) по-прежнему остаётся персональными данными, поэтому относитесь к ней как к средству контроля, а не как к лазейке. Пошаговый разбор — в материале обезличивание перед ChatGPT.
Часто задаваемые вопросы
В исходном виде — нет. Всё, что вы вставляете, передаётся провайдеру и хранится у него, а на личных аккаунтах по умолчанию ещё и используется для обучения модели; кроме того, эти данные могут быть раскрыты при взломе или сохранены по судебному предписанию. А вот если сначала обезличить конфиденциальные части и работать с ИИ уже над версией с плейсхолдерами, это безопасно.
Да. В марте 2023 года из-за ошибки у части пользователей на короткое время оказались видны заголовки чужих чатов и платёжные данные; в ноябре 2025 года взлом аналитического подрядчика OpenAI — компании Mixpanel — раскрыл контактные данные части клиентов API; а в середине 2025 года из-за опции «сделать чат доступным для поиска» общедоступные чаты стали индексироваться в Google, пока OpenAI не убрала эту опцию. Каждый случай подтверждает одно: как только данные отправлены, они выходят из-под вашего контроля.
В 2023 году, всего через несколько недель после того, как пользоваться ChatGPT разрешили, инженеры Samsung вставили в него конфиденциальный исходный код и внутренние заметки с совещаний. В ответ Samsung запретила инструменты генеративного ИИ на корпоративных устройствах — классический поучительный пример «теневого ИИ».
Как правило, нет, но такое уже случалось. Из-за ошибки 2023 года были видны заголовки чужих чатов, а общедоступные ссылки какое-то время индексировались поисковиками. В более обыденных ситуациях переписку могут увидеть сотрудники, которые проверяют помеченный контент, а в судебном разбирательстве — противоположная сторона. Исходите из того, что всё вставленное выходит из-под вашего контроля.
Он снижает один из рисков: данные на тарифах Business, Enterprise, Edu и API по умолчанию не используются для обучения, а сами тарифы сопровождаются соглашением об обработке данных (DPA). Но данные всё равно покидают ваше устройство и всё равно могут быть раскрыты при взломе подрядчика — как показал случай с Mixpanel. Риск снижается, но не устраняется.
Теневой ИИ — это использование сотрудниками личных ИИ-аккаунтов для рабочих задач, в обход контроля ИТ-службы и без её ведома. Явление широко распространено: по данным отчётов, значительная часть обращений к ИИ идёт через личные аккаунты, и в немалой их доле фигурируют чувствительные данные, — поэтому разрозненные вставки складываются в системную утечку.
Персональные данные клиентов или пациентов, коммерческую тайну и исходный код, материалы под защитой профессиональной тайны или под регулированием, учётные данные, а также всё, раскрытие чего нарушило бы ваши обязанности или поставило бы вас в неловкое положение. Если по такому документу нужна помощь ИИ, сначала обезличьте его.
Уберите конфиденциальные части ещё до отправки: обезличьте файл локально с помощью Occlira, поработайте с любым ИИ-инструментом над обезличенной копией, а затем восстановите реальные значения на своём компьютере. Тогда просто нечему утекать, попадать на обучение или подпадать под судебный запрос.
Используйте ИИ по чувствительным файлам — безопасно
Обезличьте данные локально, а затем работайте с копией в любом ИИ-инструменте. Бесплатно 14 дней на Windows и macOS.
Ещё: что такое персональные данные (PII)? · для юридических фирм · удаление данных из Word, PDF и Excel · как обрабатываются ваши данные