Что именно происходит с текстом, который вы отправили
Когда вы вставляете текст в чат, он уходит на серверы сервиса — как правило, за пределами России. Дальше многое зависит от того, каким именно инструментом вы пользуетесь, и различия здесь принципиальные.
- Бесплатные версии обычно оставляют за собой право использовать переписку для обучения моделей. Это значит, что фрагменты вашего текста в каком-то виде остаются у поставщика.
- Платные и корпоративные тарифы чаще всего обучение на данных клиента отключают — но это надо проверять в условиях конкретного сервиса, а не предполагать.
- Обращение через API, как правило, даёт самый строгий режим: данные обрабатываются для ответа и не идут в обучение.
- Локальные модели на своём сервере не отправляют наружу ничего вообще. Качество ниже, чем у ведущих облачных, но для части задач его достаточно.
Отсюда первый практический вывод: разговор «можно ли грузить данные в ИИ» бессмыслен без уточнения, в какой именно инструмент. Один и тот же текст в бесплатном чате и в корпоративном тарифе — это две разные истории с точки зрения рисков.
Три категории данных
Практичнее всего разложить рабочие материалы на три корзины и научить сотрудников различать их за пару секунд.
| Можно свободно | Можно после обезличивания | Нельзя |
|---|---|---|
| Тексты для сайта и рекламы | Письмо клиента — убрав имя, телефон, компанию | Паспортные данные, сканы документов |
| Описания товаров и услуг | Договор — заменив стороны и реквизиты | Банковские реквизиты и данные карт |
| Открыто опубликованные материалы | Таблица продаж — обезличив контрагентов | Медицинские сведения о людях |
| Внутренние инструкции без секретов | Расшифровка встречи — убрав фамилии | Пароли, ключи доступа, токены |
| Учебные и тренировочные тексты | Отзыв клиента — без подписи и контактов | Данные, закрытые договором о неразглашении |
Отдельная строка — коммерческая тайна: себестоимость, маржинальность, условия работы с ключевыми поставщиками, планы развития. Формально это не персональные данные и закон о них молчит, но утечка бьёт по компании больнее многого другого. Такие сведения либо не выносятся наружу вовсе, либо только в инструмент с корпоративным режимом.
Обезличивание: приём, который решает большинство задач
Ключевое наблюдение: для качества ответа ИИ почти никогда не нужны настоящие имена. Чтобы составить ответ на претензию, модели нужна суть претензии, а не фамилия автора. Значит, персональные данные можно просто заменить.
Вместо «Иванов Иван Петрович, ООО Ромашка, договор 47/2025 на 1 340 000 ₽» пишем «клиент, компания-заказчик, договор на крупную сумму». Ответ получаете тот же, а наружу не ушло ничего. Подставить настоящие данные в готовый текст — дело пятнадцати секунд.
- Имена и должности → «клиент», «руководитель отдела», «поставщик».
- Названия компаний → «заказчик», «подрядчик», «конкурент».
- Телефоны, адреса, почта → удалить целиком, они на ответ не влияют.
- Точные суммы → оставить порядок величины, если он важен для тона: «крупная сумма», «небольшой заказ».
- Номера договоров и счетов → убрать или заменить на условный номер.
Если задача требует именно массовой обработки настоящих данных — выгрузки заказов, базы обращений, реестра договоров — обезличивание вручную не годится. Здесь нужен либо корпоративный инструмент с подписанными условиями, либо модель, развёрнутая на своём сервере.
Что говорит российское законодательство
Персональные данные граждан России регулируются законом 152-ФЗ, и он требует, в частности, чтобы их сбор и обработка велись в базах на территории страны. Передача таких данных в зарубежный облачный сервис — это трансграничная передача со своими условиями и, как правило, необходимостью согласия человека.
Не берусь давать юридическое заключение — его должен давать ваш юрист применительно к вашей ситуации. Но практический ориентир простой и надёжный: персональные данные клиентов и сотрудников не отправляются в зарубежные чаты. Обезличивание снимает вопрос полностью, потому что то, что нельзя связать с конкретным человеком, персональными данными уже не является.
Правила, которые стоит записать одной страницей
Запреты работают, только если сотрудник понимает, что именно ему нельзя, и видит разрешённый способ сделать работу. Минимальный набор правил выглядит так:
- Каким инструментом пользуемся. Один-два согласованных сервиса, а не «кто что нашёл». Разнобой — главный источник утечек.
- Что никогда не вставляем. Короткий и конкретный список: паспорта, карты, пароли, медицина, данные под NDA.
- Как обезличиваем. С примером до и после — это лучше любого объяснения.
- Что делать с результатом. Ответ ИИ — черновик; отправляет и отвечает за него человек.
- К кому идти с вопросом. Конкретный человек, а не «в IT-отдел».
Такую страницу можно составить за час, и она снимает большую часть рисков — просто потому, что до неё сотрудники действовали наугад.
Если данные уже загрузили
Ситуация обычная: инструмент начали использовать раньше, чем задумались о правилах. Паниковать не нужно, но и делать вид, что ничего не было, тоже.
- Проверьте настройки аккаунта — во многих сервисах обучение на ваших диалогах отключается одним переключателем.
- Удалите переписки с чувствительными данными: у большинства сервисов есть удаление истории.
- Перейдите на тариф, где обучение на данных клиента исключено условиями.
- Введите правила и объясните их команде — это важнее, чем разбор прошлых случаев.
Коротко
Вопрос «безопасно ли отдавать данные ИИ» решается не запретом и не смелостью, а сортировкой: обезличенное — свободно, чувствительное — в корпоративный контур, запрещённое — никогда. Это третий из четырёх навыков ИИ-грамотности, о которых мы писали в статье «четыре навыка работы с ИИ».
Помогаем компаниям выстроить это на практике: выбрать инструмент под ваши требования к данным, написать правила и обучить сотрудников. Разбираем на ваших реальных документах, а не на абстрактных примерах.