Какие данные нельзя передавать искусственному интеллекту: как пользоваться ИИ без утечки личной и рабочей информации
Категория
ГИД ONLINE.UA
Дата публикации

Какие данные нельзя передавать искусственному интеллекту: как пользоваться ИИ без утечки личной и рабочей информации

Какие данные нельзя передавать ИИ

Искусственный интеллект удобно просить сократить документ, исправить письмо, подытожить договор, проанализировать таблицу, найти ошибки в коде или подготовить ответ клиенту. Именно в таких бытовых рабочих задачах чаще всего возникает риск: человек загружает в чат-бот полный файл, хотя для ответа достаточно одного абзаца без имен, номеров, адресов, сумм, паспортных данных и деталей сделки.

Проблема не в самом факте использования ИИ, а в том, какие данные попадают в запрос. В 2025 году анализ реальных запросов к инструментам ИИ, о котором сообщала Tele2, показал: чувствительные корпоративные данные были более чем в каждом пятом загруженном файле. Среди них были программный код, клиентская информация и внутренние документы компаний.

Безопасное использование ИИ начинается с простого правила: перед отправкой текста или файла нужно убрать все, что не нужно для выполнения задачи. Чат-боту не нужны реальные ФИО, телефоны, адреса, банковские реквизиты, паспортные номера, медицинские данные, внутренние цены, пароли, токены доступа или полная база клиентов, чтобы отредактировать стиль письма или сделать краткое резюме.

Почему загрузка файлов в ИИ может быть риском

Когда вы вставляете текст в чат-бот или загружаете документ, вы передаете информацию внешнему цифровому сервису. Далее все зависит от конкретного инструмента: его политики конфиденциальности, настроек аккаунта, типа тарифа, условий хранения данных, доступа администраторов, журналирования, подрядчиков, интеграций и возможности использования данных для улучшения моделей.

Национальный центр кибербезопасности Великобритании советует не включать чувствительную информацию в запросы к публичным большим языковым моделям и не посылать такие запросы, которые создали бы проблемы в случае публичного раскрытия. NCSC также подчеркивает: перед работой с чувствительной информацией следует понимать условия использования и политику конфиденциальности сервиса.

Для личного пользователя риск может выглядеть как утечка номера паспорта, телефона, адреса, медицинского диагноза или финансовых данных. Для компании – как раскрытие клиентской базы, коммерческого предложения, договора, кода, внутренней инструкции, стратегии, финансового плана или деталей переговоров.

Отдельный файл может казаться безопасным. Но несколько мелких фрагментов легко складываются в полную картину: кто клиент, какая цена, какие условия, кто принимает решения, какие слабые места в договоре, какие технологии использует компания и где хранятся ее данные.

Какой поисковый интент имеет эта тема

Интент смешанный: информационный, инструктивный и безопасный. Пользователь хочет понять, какие данные нельзя давать ИИ, опасно ли загружать документы в ChatGPT или другие чат-боты, как анонимизировать файл, чем отличается публичный сервис от корпоративного решения, как работать с рабочими материалами без утечки и какие ошибки чаще всего совершают работники.

Поэтому ответ должен быть практическим: не запугивать ИИ, а дать четкую систему проверки данных перед отправкой.

Какие данные не следует передавать ИИ

Рискованные данные — те, которые могут идентифицировать человека, дать доступ к деньгам или аккаунтам, раскрыть коммерческую тайну, нарушить договор о неразглашении или создать юридические последствия.

Не стоит передавать в публичные ШИ-сервисы:

  • паспортные данные, ИНН, номера документов;

  • адреса проживания, телефоны, личные электронные почты;

  • банковские карты, счета, IBAN, финансовые выписки;

  • пароли, одноразовые коды, токены, API-ключи;

  • медицинские анализы, диагнозы, истории болезни;

  • данные детей, родственников, клиентов, пациентов, работников;

  • полные договоры с реальными сторонами, суммами и условиями;

  • клиентские базы, CRM-экспорты, списки контактов;

  • коммерческие предложения по ценам, маржей, скидкам;

  • внутренние политики, инструкции, отчеты, планы продаж;

  • программный код закрытого продукта;

  • ключи доступа, файлы конфигурации, журналы с адресами серверов;

  • переписка с юристами, банками, партнерами или госорганами;

  • документы под NDA или с отметкой "confidential".

OWASP относит раскрытие чувствительной информации к ключевым рискам LLM-приложений. Такая информация включает персональные данные, финансовые детали, медицинские записи, конфиденциальные бизнес-данные, учетные данные безопасности и юридические документы.

Почему "обычный документ" тоже может быть опасен

Чаще люди боятся передавать ИИ пароли или карточные данные, но спокойно загружают договоры, коммерческие письма, резюме, служебные заметки, таблицы, протоколы встреч и черновики презентаций. Именно такие файлы часто содержат более чувствительную информацию, чем кажется.

Например, в обычном письме клиенту могут быть:

  • имя и должность конкретного человека;

  • название компании;

  • суть проблемы;

  • внутренняя цена;

  • дедлайн;

  • условия скидки;

  • слабое место в переговорах;

  • детали грядущего соглашения.

Для задачи "сделай письмо более вежливым" чат-боту не требуется реальное название клиента, полная сумма, номер договора и адрес доставки. Можно заменить их на нейтральные обозначения: "Клиент А", "Компания Б", "сумма договора", "дата поставки", "номер документа".

Tele2 в собственных рекомендациях описывает эту проблему: пользователь хочет исправить стиль письма или сократить документ, но копирует весь текст, и вместе с ним в систему попадают имена, телефоны, адреса, финансовые данные и другая информация, которая не нужна для задания.

Публичный чат-бот и корпоративный ИИ: в чем разница

Публичный ШИ-сервис – это инструмент, которым пользователь пользуется самостоятельно, часто из личного аккаунта. Компания может не видеть, какие файлы туда загружают работники, отключено ли обучение на данных, где хранится история, кто имеет доступ к чату и какие сторонние расширения подключены.

Корпоративное решение обычно имеет больше контроля: администрирование пользователей, роли, журналирование, ограничение доступа, политики хранения, договор обработки данных, настройки обучения моделей, интеграцию с внутренними системами и правила, кто может работать с какими данными.

OpenAI, например, отмечает, что по умолчанию не использует данные с ChatGPT Enterprise, ChatGPT Business, ChatGPT Edu, ChatGPT for Healthcare, ChatGPT for Teachers и API Platform, включая ввод и вывод, для обучения или улучшения моделей. Компания также указывает на шифрование данных в состоянии хранения и во время передачи.

Это не означает, что любой корпоративный ИИ автоматически безопасен для всего. Организация все равно должна определить, какие категории данных можно обрабатывать, кто имеет доступ, какие интеграции включены, сколько времени сохраняются запросы, ведутся ли журналы, как работает удаление и что происходит с файлами после завершения задачи.

"Мои данные пойдут в обучение модели?" — правильный вопрос, но не единственный

Многие пользователи сводят риск к одному вопросу: научится ли модель на моем документе. На самом деле, это лишь один из возможных сценариев. Даже если сервис не использует данные обучения, они могут временно храниться для работы сервиса, безопасности, журналирования, поддержки, аудита или выполнения функций аккаунта.

OpenAI в справочных материалах отмечает, что в ChatGPT Business, ChatGPT Enterprise, ChatGPT Edu и API Platform ввод и вывод по умолчанию не используется для обучения моделей; для личных рабочих пространств пользователи могут отключить использование новых разговоров для улучшения моделей.

Поэтому перед работой с чувствительными материалами нужно проверить более широкий список:

  • используется ли контент для обучения;

  • можно ли отключить обучение;

  • сколько времени сохраняются запросы;

  • доступны ли администраторам;

  • есть ли история разговоров;

  • передаются ли данные третьим сторонам;

  • есть ли расширения, плагины, коннекторы;

  • можно ли удалить файл и чат;

  • есть ли договорные гарантии для бизнеса;

  • отвечает ли сервис требованиям вашей организации.

Как работает "тест публичности"

Перед тем как загрузить документ в ИИ, задайте себе вопрос: будет ли приемлемо, если этот текст увидит посторонний человек. Если ответ отрицательный, файл нужно сократить, обезличить или не передавать вообще.

Тест публичности не означает, что данные действительно станут публичными. Он помогает быстро оценить последствия. Если утечка документа может навредить человеку, компании, клиенту, сделке, репутации, финансам или безопасности, такой документ не подходит для необдуманной загрузки в публичный чат-бот.

Практическая формула:

  1. Что именно я хочу получить от ИИ?

  2. Какой минимальный фрагмент требуется для этой задачи?

  3. Какие данные можно убрать или заменить?

  4. Есть ли в тексте информация других людей?

  5. Имею ли я право передавать этот документ стороннему сервису?

  6. Что будет, если этот фрагмент увидит кто-нибудь вне моей организации?

Если на любом этапе возникают сомнения, лучше подготовить безопасную версию файла.

Как анонимизировать документ перед ИИ

Анонимизация – это не просто заменить имя инициалами. Задача – убрать или замаскировать все фрагменты, по которым можно прямо или косвенно идентифицировать человека, компанию, сделку, систему или внутренний процесс.

Пример более безопасного подхода:

Было: "Александр Коваленко, финансовый директор ООО "Альфа", просит скидку 12% по договору №45/26 на поставку оборудования до 20 октября".

Стало: "Клиент А, представитель компании Б, просит дополнительную скидку по договору на поставку оборудования до определенной даты".

Для редактирования этого стиля достаточно. ИИ может сделать текст более вежливым, структурированным и понятным без реальных названий, сумм, номеров и дат.

Что следует заменять:

  • ФИО → "Клиент А", "Работник Б";

  • названия компаний → "Компания X", "Партнер Y";

  • телефоны → "[телефон]";

  • адреса → “[адрес]”;

  • суммы → “[сумма]” или условный диапазон;

  • номера договоров → "[номер договора]";

  • даты → “[дата]”, если точная дата не требуется;

  • банковские реквизиты → "[банковские реквизиты удалены]";

  • медицинские данные → обобщенное описание без идентификации;

  • код с секретами → код без токенов, ключей и внутренних URL.

Европейская комиссия объясняет принцип минимизации данных следующим образом: персональные данные должны быть адекватны, релевантны и ограничены тем, что нужно для конкретной цели; по умолчанию компании должны обрабатывать только данные, необходимые для предусмотренной цели, и предоставлять доступ к ним ограниченному кругу лиц.

Персональные данные: почему с ними нужно быть особенно осторожными

В Украине персональные данные защищены законом. Закон "О защите персональных данных" регулирует правовые отношения, связанные с защитой и обработкой персональных данных, и направлен на защиту права на невмешательство в личную жизнь. В нем также указано, что не допускается обработка данных о физическом лице, являющихся конфиденциальной информацией, без его согласия, кроме определенных законом случаев.

Для пользователя ИИ это означает простую вещь: если в файле есть данные другого человека, не следует автоматически считать, что вы можете передать их любому онлайн-сервису. Особенно это касается HR-документов, резюме, медицинских справок, клиентских заявок, договоров, сканов документов, детских данных, финансовых анкет и внутренней переписки.

Более безопасный подход — работать с обобщенной версией. К примеру, вместо реального резюме работника передать структуру без имени, телефона, адреса, места жительства, фото, ссылок на профили и бывших работодателей, если эти данные не нужны для конкретного задания.

Рабочие документы: что особенно опасно загружать

В компаниях наибольший риск создает теневое использование ИИ: работники пользуются личными аккаунтами, чтобы быстрее выполнить работу, но не проверяют, разрешено ли это политикой безопасности. Так, в чат-боты попадают коммерческие предложения, клиентские письма, договоры, коды, презентации для инвесторов и внутренние таблицы.

Самые рискованные рабочие файлы:

  • договоры к подписанию;

  • юридические заключения;

  • коммерческие предложения;

  • финансовые модели;

  • таблицы продаж;

  • клиентские базы;

  • документы с персоналом;

  • внутренние презентации;

  • коды продуктов;

  • конфигурации серверов;

  • лог-файлы с токенами;

  • материалы под NDA;

  • документы по обороне, безопасности, медицине, банкам, государственным системам.

CERT-EU предупреждает, что использование бесплатно доступных закрытых AI-моделей может создавать риски для чувствительных данных в запросах: пользователи могут ненамеренно вводить конфиденциальную или персонально идентифицированную информацию, а без надлежащей анонимизации и защиты такие данные могут быть использованы неправомерно или раскрыты из-за утечки.

Код, API-ключи и технические файлы

Разработчики часто используют ИИ для поиска ошибок, рефакторинга, документации и генерации тестов. Это полезно, но именно технические файлы могут содержать критические секреты: ключи доступа, токены, адреса внутренних серверов, названия бакетов, учетные записи, структуру базы данных, конфигурации CI/CD и логику закрытого продукта.

Перед отправкой кода нужно убрать:

  • API-ключи;

  • токены доступа;

  • частные ключи;

  • пароли;

  • connection strings;

  • внутренние URL;

  • IP-адреса;

  • названия клиентов;

  • секреты из .env;

  • частные репозитории;

  • данные по production-логам;

  • коммерчески чувствительные алгоритмы

Лучше ставить задачу ИИ не через полный проект, а через минимальный воспроизводимый пример. Например: "Вот упрощенная функция без реальных данных. Объясни, почему она возвращает ошибку". Такой подход уменьшает риск утечки и часто дает более точный ответ.

OWASP советует для LLM-приложений применять очистку данных, строгие проверки ввода, контроль доступа по принципу наименьших привилегий, ограничение источников данных, токенизацию и редактирование чувствительного контента перед обработкой.

Отдельный риск: prompt injection в файлах и веб-страницах

Не все опасности соединены с тем, что юзер сам передает секреты. Есть еще prompt injection – ситуация, когда вредная инструкция спрятана в файле, веб-странице, письме, изображении или другом внешнем контенте, который анализирует ИИ. Модель может воспринять эту инструкцию как часть задачи и вести себя непредсказуемо.

OWASP объясняет, что косвенный prompt injection возникает, когда LLM принимает данные из внешних источников, например сайтов или файлов, а в этом контенте есть инструкции, изменяющие поведение модели. Последствия могут включать в себя раскрытие чувствительной информации, манипуляцию ответами, несанкционированный доступ к функциям или выполнение действий в подключенных системах.

Для обычного пользователя это означает: не стоит бездумно давать ИИ доступ к почте, диску, CRM, календарю, репозиторию или мессенджеру с широкими правами. Если инструмент имеет агентные функции — может отправлять письма, изменять файлы, создавать задачи, делать запросы на базу — нужно ограничить права и требовать подтверждения важных действий.

Как компании организовать безопасное использование ИИ

Полный запрет ИИ часто не работает: работники все равно будут искать способ ускорить работу. Лучше дать разрешенный инструмент, правила и обучение.

Минимальная политика для компании должна отвечать на следующие вопросы:

  • какие ШИ-сервисы разрешены;

  • какие данные можно передавать;

  • какие данные запрещены;

  • как анонимизировать документы;

  • кто согласовывает работу с клиентскими данными;

  • можно ли загружать файлы;

  • разрешены ли расширения и плагины;

  • кто имеет доступ к истории чатов;

  • как сохраняются и удаляются запросы;

  • как проверять ответы ИИ;

  • кто отвечает за ошибку в сгенерированном тексте;

  • что делать в случае ошибочной загрузки чувствительного файла.

NIST AI Risk Management Framework создан для добровольного использования организациями и должен помогать учитывать доверие, риски, оценивание и управление при разработке, использовании и оценке AI-систем. В 2024 году NIST также выпустил профиль для генеративного ИИ, помогающий организациям определять специфические риски таких систем и действия для управления ими.

Для бизнеса полезно не просто написать "не передавать конфиденциальные данные", а дать примеры: что делать с договором, клиентским письмом, резюме, таблицей, кодом, финансовой моделью, медицинским документом или внутренней презентацией.

Практический чеклист перед загрузкой в ИИ

Перед каждым запросом пройдите краткую проверку:

  1. Нужен ли ИИ весь файл?

  2. Можно ли дать маленький фрагмент?

  3. Есть ли в тексте персональные данные?

  4. Есть ли данные других людей?

  5. Есть ли финансовая информация?

  6. Есть ли коммерческие условия, цены, маржа, скидки?

  7. Есть ли пароли, токены, ключи, внутренние ссылки?

  8. Есть ли медицинские, юридические или банковские данные?

  9. Есть ли NDA или метка конфиденциальности?

  10. Позволяет ли компания использовать этот ШИ-сервис?

  11. Отключено ли использование данных для обучения, если это необходимо?

  12. Можно ли выполнить задачу на обезличенном примере?

Если хотя бы один пункт вызывает сомнение, нужно отредактировать документ до безопасной версии или использовать корпоративный инструмент с надлежащими условиями.

Как правильно формулировать запрос без раскрытия данных

Лучший запрос к ИИ — тот, в котором достаточно контекста для ответа, но нет лишних чувствительных деталей.

Вместо: "Вот договор с ООО "Ромашка" на 3,8 млн грн, проверь риски".

Лучше: "Вот обезличенный фрагмент договора поставки. Проверь логические риски, нечеткие формулировки, конфликтные условия и места, где следует обратиться к юристу".

Вместо: "Вот медицинский анализ моего ребенка с ФИО и датой рождения, объясни результат".

Лучше: "Объясни на общем языке, что могут означать такие показатели без установления диагноза. Я обращусь к врачу для медицинского решения".

Вместо: "Вот экспорт CRM с клиентами, найди сегменты".

Лучше: "Вот обезличенная таблица без имен, телефонов, электронных адресов и названий компаний. Проанализируй структуру сегментов по условным параметрам".

Такой подход оставляет пользу ИИ, но уменьшает объем переданных данных.

Что делать, если чувствительный файл уже загрузили

Если вы случайно скачали в ИИ документ с персональными, финансовыми или рабочими данными, не стоит просто закрыть вкладку и забыть. Необходимо действовать в зависимости от уровня риска.

Порядок действий:

  1. Удалите файл и чат, если сервис позволяет.

  2. Проверьте настройки использования данных для обучения.

  3. Измените пароли, токены или API ключи, если они попали в запрос.

  4. Сообщите ответственное лицо в компании, если это рабочий документ.

  5. Зафиксируйте, что было передано.

  6. Оцените, были ли там данные клиентов, работников, партнеров или пациентов.

  7. Проверьте политику сервиса по удалению и хранению данных.

  8. Не загружайте один и тот же файл повторно.

  9. Подготовьте обезличенную версию для дальнейшей работы.

  10. Если риск высок, привлеките специалиста по кибербезопасности или юристу.

Если в запросе были ключи доступа, их следует считать скомпрометированными. Недостаточно удалить чат – ключи надо отозвать и выдать новые.

Типичные ошибки пользователей

Первая ошибка – загружать полный документ вместо нужного отрывка. Для большинства задач достаточно части текста.

Вторая ошибка – оставлять имена, телефоны, адреса, суммы, реквизиты и номера документов там, где они не влияют на ответ.

Третья ошибка – пользоваться личным аккаунтом для рабочих документов. Для компании это создает неконтролируемый канал утечки.

Четвертая ошибка — думать, что это просто черновик. Черновики часто содержат ценные детали: позицию сторон, слабые места, внутренние комментарии, правки, цены и риски.

Пятое заблуждение — передавать код вместе с секретами. API-ключ во фрагменте кода может быть опаснее самого кода.

Шестая ошибка – бездумно подключать ИИ к почте, диску или CRM. Чем шире права инструмента, тем выше последствия ошибки.

Седьмая ошибка – не проверять ответ. ИИ может ошибаться, сочинять факты, неправильно трактовать документ или предлагать юридически рискованные формулировки.

Восьмая ошибка — не читать политику сервиса. У разных инструментов отличаются правила хранения, обучения, удаления, доступа к данным и использования сторонних поставщиков.

Вывод

ИИ может быть полезным помощником для текстов, таблиц, кодов, анализа документов и ежедневных рабочих задач. Но его нельзя использовать как бездонный ящик, куда без подготовки загружают все подряд. Частый риск возникает не из-за сложной хакерской атаки, а из-за обычного действия пользователя: скопировать полный файл, не убрав лишние данные.

Безопасная практика проста: перед отправкой оставляйте только то, что нужно для задачи, удаляйте персональные и финансовые данные, заменяйте реальные имена и компании условными обозначениями, не передавайте пароли, ключи, базы клиентов, внутренние документы и материалы под NDA. Для работы с корпоративной информацией используйте утвержденные инструменты с правилами доступа, хранения и обучения моделей.

Главный тест перед запросом: будет ли жалко, если этот фрагмент увидит посторонний человек. Если да, документ нужно обезличить, сократить или вообще не передавать в публичный ШИ-сервис.

FAQ

Какие данные нельзя передавать искусственному интеллекту?

Не следует передавать паспортные данные, ИНН, банковские реквизиты, пароли, API-ключи, медицинскую информацию, адреса, телефоны, данные детей, клиентские базы, договоры с реальными сторонами, внутренние документы, коммерческие условия, закрытый код и материалы под NDA. OWASP относит такие категории к чувствительной информации, раскрытие которой может создать частные, финансовые, юридические и бизнес-риски.

Безопасно ли загружать документы в ChatGPT или другой чат-бот?

Это зависит от типа аккаунта, настроек, политики сервиса и содержания документа. Для публичных LLM NCSC советует не включать чувствительную информацию в запросы и не отправлять то, что создало бы проблемы в случае раскрытия.

Используются ли мои запросы для обучения ИИ?

Условия зависят от сервиса. OpenAI отмечает, что бизнес-продукты типа ChatGPT Business, Enterprise, Edu и API по умолчанию не используют ввод и вывод для обучения моделей, а пользователи личных рабочих пространств могут отключить использование новых разговоров для улучшения моделей.

Достаточно ли просто удалить имя из документа?

Нет. Следует убрать все идентификаторы: телефоны, адреса, почты, номера документов, реквизиты, точные даты, названия компаний, номера договоров, суммы, уникальные обстоятельства и другие детали, по которым человека или сделку можно узнать.

Можно ли передавать ИИ рабочие документы?

Можно только в пределах правил компании и с учетом конфиденциальности. Если документ содержит клиентские данные, цены, договоры, внутренние комментарии, код, коммерческую стратегию или персональные данные работников, его следует обезличить или использовать утвержденный корпоративный ИИ-инструмент.

Почему опасно скачивать клиентскую базу?

Клиентская база включает персональные данные, коммерческую информацию, историю взаимодействия, финансовый потенциал и структуру бизнеса. Ее передача стороннему сервису без соответствующих оснований может создать риск утечки, нарушения договоров, ущерб репутации и проблемы с защитой персональных данных.

Можно ли давать ИИ код?

Можно работать с облегченными фрагментами без секретов. Перед отправкой нужно удалить API-ключи, токены, пароли, приватные URL, IP-адреса, названия внутренних систем, клиентские данные, production-логи и коммерчески чувствительную логику.

Что такое prompt injection?

Prompt injection – это попытка изменить поведение ИИ через специальные инструкции в запросе или внешнем контенте. OWASP объясняет, что косвенная prompt injection может быть спрятана в файлах, сайтах или изображениях и приводит к раскрытию чувствительной информации, манипуляции ответами или несанкционированным действиям в подключенных системах.

Как анонимизировать файл перед загрузкой в ИИ?

Оставьте только информацию, необходимую для задачи. Замените реальные имена на “Клиент А”, компании – на “Компания X”, суммы – на “[сумма]”, телефоны и адреса – на отметки, удалите реквизиты, номера документов, пароли, токены, внутренние ссылки и лишние детали.

Что делать, если я случайно загрузил конфиденциальный файл?

Удалите чат и файл, если это возможно, проверьте настройки приватности, измените пароли и отзовите токены, если они попали в документ, сообщите ответственное лицо в компании и зафиксируйте, какие данные были переданы. Если риск высок, следует привлечь специалиста по кибербезопасности или юристу.


Оставаясь на онлайне вы даете согласие на использование файлов cookies, которые помогают нам сделать ваше пребывание здесь более удобным.

Based on your browser and language settings, you might prefer the English version of our website. Would you like to switch?