Контур защиты вокруг данных внутри рабочего процесса с ИИ
ai.pm

Часть 4. Сквозные темы

Безопасность и проверка

Какие данные нельзя вставлять в публичную модель и как проверять ответы.

Ошибка здесь стоит дороже сэкономленных часов. В промпт легко уходит то, что не должно покидать компанию: записи интервью с пользователями, выгрузки из CRM, непубличные метрики, материалы под NDA. Отдать ИИ черновик документа — нормальный рабочий приём; отдать ему базу пользователей целиком — инцидент.

Что нельзя вставлять в публичную модель

Публичный потребительский чат — инструмент для обезличенных задач. Перед тем как вставить что-либо, вспомните четыре категории:

  • Персональные данные пользователей. Имена, почта, телефоны, идентификаторы, выгрузки из CRM и аналитики, записи интервью, по которым человека можно опознать.
  • Материалы под NDA. Документы партнёров, непубличные договоры, планы релизов и дорожная карта до анонса.
  • Непубличные финансовые метрики. Выручка по сегментам, юнит-экономика, маржа, цены до публикации.
  • Доступы. Пароли, API-ключи, токены — никогда и ни в каком виде, даже «просто чтобы модель поправила код».

Условия зависят от сервиса и типа тарифа, и они меняются. В потребительских версиях ChatGPT ваши сообщения по умолчанию могут использоваться для улучшения моделей — OpenAI позволяет отключить это в настройках Data Controls. У Anthropic коммерческие продукты (API, Claude for Work) по умолчанию не используются для обучения моделей, а в потребительских версиях Claude правила с сентября 2025 года изменились: диалоги могут идти в обучение, если пользователь не отключил это в настройках. Вывод простой: перед тем как вставить что-то чувствительное, проверьте актуальные правила вашего тарифа у провайдера и внутренние правила компании — публичная подписка сама по себе не делает обработку данных согласованной.

Регуляторная рамка тоже формализуется. Европейский регламент об ИИ (Regulation (EU) 2024/1689, известный как EU AI Act) — первый горизонтальный закон об ИИ с риск-ориентированным подходом: часть практик запрещена вовсе; для систем высокого риска (включая сферу занятости) обязательны меры контроля; у отдельных сценариев — свои требования прозрачности (например, маркировка дипфейков или уведомление, что вы говорите с ИИ); большинство систем попадает в категорию минимального риска без специальных обязанностей. Для повседневной работы с ассистентом это означает одно: данные и ответственность остаются в компании, а если вы выпускаете собственную ИИ-фичу для пользователей — требования регламента проверяются отдельно и заранее.

Обезличивание перед отправкой

Обезличивание — не удаление одного имени. Телефон, почта, ID устройства, название редкой компании, сочетание должности, города и дат могут снова указать на человека. Рабочие правила:

  • заменяйте имена на роли: «Пользователь 7», «СМБ-клиент из логистики»;
  • убирайте контакты, идентификаторы и прямые цитаты, по которым виден источник;
  • агрегируйте выгрузки: не отдельные заказы, а суммы и доли;
  • отправляйте минимальный фрагмент под конкретную задачу: для проверки структуры PRD не нужны реальные названия клиентов.

Псевдоним не делает данные анонимными, если человека можно опознать по сочетанию признаков. Если фрагмент всё же опознаваем — это уже передача персональных данных, и она должна идти по правилам компании.

Галлюцинации: проверяйте факты и цифры

Модель предсказывает правдоподобный текст, а не проверяет факты. Самые опасные места для продакта:

  • цифры — «по исследованиям, видео на лендинге повышает конверсию на 23%»: исследования может не существовать, цифра сгенерирована как правдоподобная;
  • факты о конкурентах — несуществующая функция, устаревшая цена, выдуманный клиент;
  • цитаты и нормы — неточная ссылка на закон, лицензию магазина приложений или условия API-провайдера.

Практики проверки из официальных руководств Anthropic переносятся на продуктовые задачи напрямую. Разрешайте модели отвечать «не знаю» — это заметно снижает количество выдумок. Просите опираться на ваши документы и приводить дословные цитаты, из которых сделан вывод. Просите помечать, чего нет в данных. И держите жёсткое правило: ни одна цифра из ответа модели не попадает в PRD, отчёт или письмо без источника, который вы лично открыли. Факты о конкурентах проверяйте только по первоисточникам: сайт, документация, релизы, независимые обзоры.

Проверяйте SQL и код перед запуском

Модель не видит вашу базу данных. Она не знает, что означает статус 5 в вашей системе, и не заметит, что после join таблица задвоится. Черновик запроса — это черновик, а не готовый инструмент:

  1. Прочитайте запрос целиком и убедитесь, что понимаете каждый блок.
  2. Проверьте соединения таблиц: лишний или неверный join искажает метрики задвоением строк.
  3. Проверьте фильтры: период, статусы, исключения — часто именно там модель упрощает реальность.
  4. Выполните запрос сначала на тестовом окружении или read-only реплике, ограничив период выборки. LIMIT ограничивает только выдачу, но не объём работы запроса: соединения и агрегации он не удешевляет.
  5. Никогда не запускайте UPDATE и DELETE, сгенерированные моделью, без ревью и резервной копии.
  6. Учитывайте стоимость: тяжёлый запрос по всем таблицам может поднять счёт за хранилище данных.

Модель пишет — человек отвечает. Запрос к базе выполняете вы, письмо стейкхолдерам отправляете вы, PRD защищаете вы. «Так сказал ИИ» не аргумент ни для команды, ни для руководства.

Что можно отправлять в ИИ

Тип данных Можно ли отправлять в ИИ Как обезопасить
Публичная информация: опубликованные материалы, открытая документация Да, в любой сервис Проверить факты и не вставлять защищённый контент без права
Внутренние документы без ПДн и тайны: шаблон PRD, регламент работы Да, в согласованный корпоративный сервис Убедиться, что в документе нет непубличных метрик и планов
Обезличенные заметки интервью, фидбек пользователей Только после качественного обезличивания Убрать имена, контакты, идентификаторы; проверить на опознаваемость
Данные пользователей: выгрузки CRM, записи, профили Нет, в публичный чат Только в согласованном сервисе компании и по её правилам
Непубличные финансовые метрики, юнит-экономика Нет, в публичный чат Работать с долями и агрегатами либо в корпоративном контуре
Материалы под NDA, дорожная карта до анонса Нет Описывать задачу словами без документа либо согласованный сервис
Пароли, API-ключи, токены Никогда Хранить в менеджере секретов, не вставлять в промпт даже частично

Памятка, а не юридическая консультация. Конкретные правила для вашей компании определяют её политика конфиденциальности, договоры с провайдерами и юрист. Когда правила неясны — это вопрос к ним, а не к модели.

Источники