
Часть 4. Сквозные темы
Безопасность и проверка
Какие данные нельзя вставлять в публичную модель и как проверять ответы.
Ошибка здесь стоит дороже сэкономленных часов. В промпт легко уходит то, что не должно покидать компанию: записи интервью с пользователями, выгрузки из CRM, непубличные метрики, материалы под NDA. Отдать ИИ черновик документа — нормальный рабочий приём; отдать ему базу пользователей целиком — инцидент.
Что нельзя вставлять в публичную модель
Публичный потребительский чат — инструмент для обезличенных задач. Перед тем как вставить что-либо, вспомните четыре категории:
- Персональные данные пользователей. Имена, почта, телефоны, идентификаторы, выгрузки из CRM и аналитики, записи интервью, по которым человека можно опознать.
- Материалы под NDA. Документы партнёров, непубличные договоры, планы релизов и дорожная карта до анонса.
- Непубличные финансовые метрики. Выручка по сегментам, юнит-экономика, маржа, цены до публикации.
- Доступы. Пароли, API-ключи, токены — никогда и ни в каком виде, даже «просто чтобы модель поправила код».
Условия зависят от сервиса и типа тарифа, и они меняются. В потребительских версиях ChatGPT ваши сообщения по умолчанию могут использоваться для улучшения моделей — OpenAI позволяет отключить это в настройках Data Controls. У Anthropic коммерческие продукты (API, Claude for Work) по умолчанию не используются для обучения моделей, а в потребительских версиях Claude правила с сентября 2025 года изменились: диалоги могут идти в обучение, если пользователь не отключил это в настройках. Вывод простой: перед тем как вставить что-то чувствительное, проверьте актуальные правила вашего тарифа у провайдера и внутренние правила компании — публичная подписка сама по себе не делает обработку данных согласованной.
Регуляторная рамка тоже формализуется. Европейский регламент об ИИ (Regulation (EU) 2024/1689, известный как EU AI Act) — первый горизонтальный закон об ИИ с риск-ориентированным подходом: часть практик запрещена вовсе; для систем высокого риска (включая сферу занятости) обязательны меры контроля; у отдельных сценариев — свои требования прозрачности (например, маркировка дипфейков или уведомление, что вы говорите с ИИ); большинство систем попадает в категорию минимального риска без специальных обязанностей. Для повседневной работы с ассистентом это означает одно: данные и ответственность остаются в компании, а если вы выпускаете собственную ИИ-фичу для пользователей — требования регламента проверяются отдельно и заранее.
Обезличивание перед отправкой
Обезличивание — не удаление одного имени. Телефон, почта, ID устройства, название редкой компании, сочетание должности, города и дат могут снова указать на человека. Рабочие правила:
- заменяйте имена на роли: «Пользователь 7», «СМБ-клиент из логистики»;
- убирайте контакты, идентификаторы и прямые цитаты, по которым виден источник;
- агрегируйте выгрузки: не отдельные заказы, а суммы и доли;
- отправляйте минимальный фрагмент под конкретную задачу: для проверки структуры PRD не нужны реальные названия клиентов.
Псевдоним не делает данные анонимными, если человека можно опознать по сочетанию признаков. Если фрагмент всё же опознаваем — это уже передача персональных данных, и она должна идти по правилам компании.
Галлюцинации: проверяйте факты и цифры
Модель предсказывает правдоподобный текст, а не проверяет факты. Самые опасные места для продакта:
- цифры — «по исследованиям, видео на лендинге повышает конверсию на 23%»: исследования может не существовать, цифра сгенерирована как правдоподобная;
- факты о конкурентах — несуществующая функция, устаревшая цена, выдуманный клиент;
- цитаты и нормы — неточная ссылка на закон, лицензию магазина приложений или условия API-провайдера.
Практики проверки из официальных руководств Anthropic переносятся на продуктовые задачи напрямую. Разрешайте модели отвечать «не знаю» — это заметно снижает количество выдумок. Просите опираться на ваши документы и приводить дословные цитаты, из которых сделан вывод. Просите помечать, чего нет в данных. И держите жёсткое правило: ни одна цифра из ответа модели не попадает в PRD, отчёт или письмо без источника, который вы лично открыли. Факты о конкурентах проверяйте только по первоисточникам: сайт, документация, релизы, независимые обзоры.
Проверяйте SQL и код перед запуском
Модель не видит вашу базу данных. Она не знает, что означает статус 5 в вашей системе, и не заметит, что после join таблица задвоится. Черновик запроса — это черновик, а не готовый инструмент:
- Прочитайте запрос целиком и убедитесь, что понимаете каждый блок.
- Проверьте соединения таблиц: лишний или неверный join искажает метрики задвоением строк.
- Проверьте фильтры: период, статусы, исключения — часто именно там модель упрощает реальность.
- Выполните запрос сначала на тестовом окружении или read-only реплике, ограничив период выборки. LIMIT ограничивает только выдачу, но не объём работы запроса: соединения и агрегации он не удешевляет.
- Никогда не запускайте UPDATE и DELETE, сгенерированные моделью, без ревью и резервной копии.
- Учитывайте стоимость: тяжёлый запрос по всем таблицам может поднять счёт за хранилище данных.
Модель пишет — человек отвечает. Запрос к базе выполняете вы, письмо стейкхолдерам отправляете вы, PRD защищаете вы. «Так сказал ИИ» не аргумент ни для команды, ни для руководства.
Что можно отправлять в ИИ
| Тип данных | Можно ли отправлять в ИИ | Как обезопасить |
|---|---|---|
| Публичная информация: опубликованные материалы, открытая документация | Да, в любой сервис | Проверить факты и не вставлять защищённый контент без права |
| Внутренние документы без ПДн и тайны: шаблон PRD, регламент работы | Да, в согласованный корпоративный сервис | Убедиться, что в документе нет непубличных метрик и планов |
| Обезличенные заметки интервью, фидбек пользователей | Только после качественного обезличивания | Убрать имена, контакты, идентификаторы; проверить на опознаваемость |
| Данные пользователей: выгрузки CRM, записи, профили | Нет, в публичный чат | Только в согласованном сервисе компании и по её правилам |
| Непубличные финансовые метрики, юнит-экономика | Нет, в публичный чат | Работать с долями и агрегатами либо в корпоративном контуре |
| Материалы под NDA, дорожная карта до анонса | Нет | Описывать задачу словами без документа либо согласованный сервис |
| Пароли, API-ключи, токены | Никогда | Хранить в менеджере секретов, не вставлять в промпт даже частично |
Памятка, а не юридическая консультация. Конкретные правила для вашей компании определяют её политика конфиденциальности, договоры с провайдерами и юрист. Когда правила неясны — это вопрос к ним, а не к модели.
Источники
- OpenAI: How your data is used to improve model performance — как OpenAI использует контент потребительских версий и как отключить обучение на нём.
- Anthropic Privacy Center: Is my data used for model training (commercial products) — по умолчанию Anthropic не обучает модели на данных коммерческих продуктов.
- Anthropic: Updates to Consumer Terms and Privacy Policy — изменение правил для потребительских версий Claude с сентября 2025 года и опция отказа.
- EU AI Act: Regulation (EU) 2024/1689 — официальный текст европейского регламента об ИИ: риск-ориентированный подход, запреты и требования прозрачности.