Что именно происходит с текстом, который вы отправили

Когда вы вставляете текст в чат, он уходит на серверы сервиса — как правило, за пределами России. Дальше многое зависит от того, каким именно инструментом вы пользуетесь, и различия здесь принципиальные.

  • Бесплатные версии обычно оставляют за собой право использовать переписку для обучения моделей. Это значит, что фрагменты вашего текста в каком-то виде остаются у поставщика.
  • Платные и корпоративные тарифы чаще всего обучение на данных клиента отключают — но это надо проверять в условиях конкретного сервиса, а не предполагать.
  • Обращение через API, как правило, даёт самый строгий режим: данные обрабатываются для ответа и не идут в обучение.
  • Локальные модели на своём сервере не отправляют наружу ничего вообще. Качество ниже, чем у ведущих облачных, но для части задач его достаточно.

Отсюда первый практический вывод: разговор «можно ли грузить данные в ИИ» бессмыслен без уточнения, в какой именно инструмент. Один и тот же текст в бесплатном чате и в корпоративном тарифе — это две разные истории с точки зрения рисков.

Три категории данных

Практичнее всего разложить рабочие материалы на три корзины и научить сотрудников различать их за пару секунд.

Можно свободноМожно после обезличиванияНельзя
Тексты для сайта и рекламыПисьмо клиента — убрав имя, телефон, компаниюПаспортные данные, сканы документов
Описания товаров и услугДоговор — заменив стороны и реквизитыБанковские реквизиты и данные карт
Открыто опубликованные материалыТаблица продаж — обезличив контрагентовМедицинские сведения о людях
Внутренние инструкции без секретовРасшифровка встречи — убрав фамилииПароли, ключи доступа, токены
Учебные и тренировочные текстыОтзыв клиента — без подписи и контактовДанные, закрытые договором о неразглашении

Отдельная строка — коммерческая тайна: себестоимость, маржинальность, условия работы с ключевыми поставщиками, планы развития. Формально это не персональные данные и закон о них молчит, но утечка бьёт по компании больнее многого другого. Такие сведения либо не выносятся наружу вовсе, либо только в инструмент с корпоративным режимом.

Обезличивание: приём, который решает большинство задач

Ключевое наблюдение: для качества ответа ИИ почти никогда не нужны настоящие имена. Чтобы составить ответ на претензию, модели нужна суть претензии, а не фамилия автора. Значит, персональные данные можно просто заменить.

Вместо «Иванов Иван Петрович, ООО Ромашка, договор 47/2025 на 1 340 000 ₽» пишем «клиент, компания-заказчик, договор на крупную сумму». Ответ получаете тот же, а наружу не ушло ничего. Подставить настоящие данные в готовый текст — дело пятнадцати секунд.

  • Имена и должности → «клиент», «руководитель отдела», «поставщик».
  • Названия компаний → «заказчик», «подрядчик», «конкурент».
  • Телефоны, адреса, почта → удалить целиком, они на ответ не влияют.
  • Точные суммы → оставить порядок величины, если он важен для тона: «крупная сумма», «небольшой заказ».
  • Номера договоров и счетов → убрать или заменить на условный номер.

Если задача требует именно массовой обработки настоящих данных — выгрузки заказов, базы обращений, реестра договоров — обезличивание вручную не годится. Здесь нужен либо корпоративный инструмент с подписанными условиями, либо модель, развёрнутая на своём сервере.

Что говорит российское законодательство

Персональные данные граждан России регулируются законом 152-ФЗ, и он требует, в частности, чтобы их сбор и обработка велись в базах на территории страны. Передача таких данных в зарубежный облачный сервис — это трансграничная передача со своими условиями и, как правило, необходимостью согласия человека.

Не берусь давать юридическое заключение — его должен давать ваш юрист применительно к вашей ситуации. Но практический ориентир простой и надёжный: персональные данные клиентов и сотрудников не отправляются в зарубежные чаты. Обезличивание снимает вопрос полностью, потому что то, что нельзя связать с конкретным человеком, персональными данными уже не является.

Правила, которые стоит записать одной страницей

Запреты работают, только если сотрудник понимает, что именно ему нельзя, и видит разрешённый способ сделать работу. Минимальный набор правил выглядит так:

  • Каким инструментом пользуемся. Один-два согласованных сервиса, а не «кто что нашёл». Разнобой — главный источник утечек.
  • Что никогда не вставляем. Короткий и конкретный список: паспорта, карты, пароли, медицина, данные под NDA.
  • Как обезличиваем. С примером до и после — это лучше любого объяснения.
  • Что делать с результатом. Ответ ИИ — черновик; отправляет и отвечает за него человек.
  • К кому идти с вопросом. Конкретный человек, а не «в IT-отдел».

Такую страницу можно составить за час, и она снимает большую часть рисков — просто потому, что до неё сотрудники действовали наугад.

Если данные уже загрузили

Ситуация обычная: инструмент начали использовать раньше, чем задумались о правилах. Паниковать не нужно, но и делать вид, что ничего не было, тоже.

  • Проверьте настройки аккаунта — во многих сервисах обучение на ваших диалогах отключается одним переключателем.
  • Удалите переписки с чувствительными данными: у большинства сервисов есть удаление истории.
  • Перейдите на тариф, где обучение на данных клиента исключено условиями.
  • Введите правила и объясните их команде — это важнее, чем разбор прошлых случаев.

Коротко

Вопрос «безопасно ли отдавать данные ИИ» решается не запретом и не смелостью, а сортировкой: обезличенное — свободно, чувствительное — в корпоративный контур, запрещённое — никогда. Это третий из четырёх навыков ИИ-грамотности, о которых мы писали в статье «четыре навыка работы с ИИ».

Помогаем компаниям выстроить это на практике: выбрать инструмент под ваши требования к данным, написать правила и обучить сотрудников. Разбираем на ваших реальных документах, а не на абстрактных примерах.