Что нельзя передавать нейросетям
Легкость взаимодействия с чат-ботами создает опасную иллюзию приватного диалога. На самом деле все, что мы отправляем в окно чата, уходит в огромные дата-центры, где сохраняется, обрабатывается и анализируется.
В погоне за быстрым решением мы часто забываем, что платим за удобство не только деньгами, но и своей цифровой идентичностью. Нейросети — мощный инструмент, который требует строгих правил безопасности. И первое правило здесь — четко знать, какие данные никогда, ни при каких обстоятельствах не должны покидать пределы вашего устройства.
Существует информация, которую вообще нельзя передавать нейросетям, даже если кажется, что вы просто проверяете гипотетический сценарий и это безопасно
В первую очередь, это любые идентификационные номера и данные документов. Паспортные данные, ИНН, СНИЛС, номера банковских карт — эти цифры являются ключами к вашей финансовой и юридической жизни.
Многие ошибочно полагают, что если они замаскируют часть цифр звездочками или отправят данные не целиком, а фрагментарно, риск снижается. Это опасное заблуждение. Нейросеть, даже самая продвинутая, не является субъектом персональных данных и не несет юридической ответственности за их хранение.
Ее базы данных — это огромные массивы информации, которые привлекательны для хакеров не меньше банковских хранилищ. Если злоумышленники получат доступ к логам сервиса, они найдут там и ваш ИНН, и номер банковской карты, даже если вы «просто попросили проверить расчет налогов».
Сканы договоров, доверенностей, актов выполненных работ — также золотая жила для мошенников. Современные алгоритмы генерации контента, помимо текста, способны воспроизводить еще и элементы графики. Один загруженный скан с четкой подписью и круглой печатью может стать основой для создания фальшивых документов. Вы даже не узнаете об этом, пока судебные приставы не предъявят вам договор, который вы якобы подписали, но на самом деле никогда не видели.
Третий пункт — это логины и пароли. Как вы описываете проблему, здесь имеет решающее значение. Мы часто пишем: «У меня не работает вход, логин Ivanov, пароль неправильный, что делать?» или вставляем строку конфигурации, где зашит секретный ключ доступа к базе данных.
Нейросеть не запоминает ваш пароль в том смысле, в каком это делает менеджер паролей, но она фиксирует весь контекст диалога. Эти логи сохраняются для улучшения модели, и даже если вам кажется, что вы удалили историю, резервные копии могут существовать долгое время.
Базы данных крупных моделей становятся все более лакомой целью для кибератак, и утечка промтов с сотнями тысяч паролей — это лишь вопрос времени и желания злоумышленников.
Пожалуй, самый опасный рубеж, который мы бездумно сдаем, — это биометрия. Фотографии с четким изображением лица, голосовые записи, видеообращения.
Генеративные сети сегодня способны создать дипфейк вашего лица и синтезировать голос с невероятной точностью на основе всего нескольких минут аудио. Передавая такой материал нейросети для «улучшения фото» или «анализа речи», вы даете ей шаблон для создания вашего цифрового двойника.
Мошенники могут использовать это для звонков вашим родственникам с просьбой о помощи, для подтверждения операций в банках, которые используют голосовую биометрию, или для создания фейковых новостей с вашим участием.
Добавим сюда данные о геолокации, особенно в привязке к вашему полному имени. Если вы просите нейросеть спланировать маршрут или порекомендовать услуги в вашем районе, указывая домашний или рабочий адрес вместе с фамилией, вы формируете точную карту ваших передвижений и мест проживания.
В совокупности с другими данными создается идеальный профиль для слежки или целенаправленной кражи
И последний пункт в этом тревожном списке — информация о детях. Фотографии несовершеннолетних, их имена, названия школ, номера классов. Даже в безобидном запросе «придумай сценарий на день рождения ребенка» не следует указывать реальные данные.
Что можно передавать относительно безопасно
Существует обширный пласт задач, которые можно решать с помощью ИИ, не опасаясь за свою приватность. В безопасную зону входят все общие, неспецифические вопросы.
Если вы спрашиваете, как сварить борщ, перевести абстрактный текст без упоминания реальных контрагентов или объяснить разницу между звездами и планетами, вы ничем не рискуете.
Это знания, которые не привязаны к личности. Сюда же относятся анонимные технические задачи, например, работа с фрагментами кода, где вы тщательно вырезали все токены доступа, ключи шифрования и адреса внутренних серверов.
Если вы описываете проблему в общем виде — «как оптимизировать функцию, которая тормозит» без названия вашей компании и структуры проекта, это абсолютно безопасно.
Передавайте нейросети только обезличенные данные
Безопасным полем также считается генерация идей на основе вымышленных или полностью обезличенных данных. Если вы пишете книгу и просите придумать имена для персонажей или предлагаете нейросети сгенерировать концепции вымышленных миров — действуйте смело.
То же самое касается информации, которая уже находится в открытом доступе. Если вы копируете текст из своего публичного блога или общедоступной статьи с просьбой отредактировать его стилистически, вы ничего не нарушаете, поскольку эти данные уже принадлежат общественному полю.
Как безопасно работать с нейросетями — 5 правил
Чтобы взаимодействие с нейросетями оставалось продуктивным и безопасным, достаточно придерживаться пяти простых правил.
- Первое — принцип минимальной необходимости. Давайте алгоритму ровно столько информации, сколько требуется для решения текущей задачи, и ни битом больше. Если вам нужно исправить ошибку в письме, не прикладывайте к нему свою подпись и паспортные данные.
- Второе правило — тотальная анонимизация. Прежде чем скопировать текст, потратьте немного времени на замену реальных имен, адресов и названий компаний на вымышленные. Иванов превращается в Петрова, улица Ленина — в улицу Солнечную, а ООО «Ромашка» — в ООО «Василек».
- Третье правило касается конфиденциальных документов. Если уж вам крайне необходимо обработать внутренний отчет или служебную записку, вырежьте все идентифицирующие признаки — цифры, имена, уникальные коды проектов. Оставьте только суть, с которой работает нейросеть: логику расчетов или структуру предложений.
- Обязательно изучите политику конфиденциальности конкретного сервиса. Узнайте, хранят ли они историю диалогов, используют ли ваши промты для дообучения моделей. У многих крупных ИИ-моделей есть опция отказа от использования данных в обучении.
- И наконец, пятое, самое надежное правило — по возможности используйте локальные модели. Такие ИИ устанавливаются на ваш компьютер и работают без подключения к облаку. Они могут уступать по мощности сетевым гигантам, но зато все данные остаются исключительно на вашем жестком диске, что гарантирует абсолютную приватность.
Обнуляйте связь между запросом и вашей реальной жизнью
Что делать, если уже передали нейросети «опасные» данные
Но что делать, если вы уже нарушили эти правила и потом осознали, что отправили в черный ящик нечто опасное?
- Первое, что действительно стоит сделать, — это удалить историю диалогов в сервисе. Работает это далеко не всегда, так как компания-разработчик могла уже использовать ваш промт для обучения или сохранить его в бэкапе, но попытаться стоит. Так вы удалите историю из интерфейса и, возможно, запустите процесс ее удаления из активных баз.
- Второй шаг — если вы случайно упомянули пароли или логины, немедленно смените их в соответствующих сервисах.
- И третье, для самых серьезных случаев, когда речь идет о паспортных данных или банковских реквизитах, у вас есть право требовать удаления информации на основании законов о защите персональных данных, будь то европейский GDPR или российский 152-ФЗ. Составьте официальное обращение в службу поддержки сервиса с требованием удалить конкретные данные и зафиксируйте факт вашего запроса. Это не гарантирует мгновенного удаления, но создает юридическую основу для дальнейших действий в случае утечки персональных данных.


