Маскирование данных

Маскирование данных — это когда личные данные заменяют меткой перед отправкой в модель, а после ответа возвращают на место.

Что это

Маскирование данных — это когда телефон, почту, номер карты или другие личные данные заменяют условной меткой перед тем, как отправить текст в языковую модель, а после ответа возвращают на место. Модель работает с меткой вроде {ТЕЛЕФОН}, а не с настоящим номером, и никогда не видит исходные цифры.

Смысл в том, что языковые модели чаще всего работают на серверах за границей, и отправка туда реальных персональных данных — лишний риск и отдельный юридический вопрос, который называют трансграничной передачей. Метка снимает часть этого риска технически, а не только на бумаге в политике конфиденциальности: даже если что-то пойдёт не так на стороне модели, утекать будет нечему.

Пример

>

Отдельная ловушка

Даже с маскированием остаётся риск, о котором редко думают: кэш ответов. Сервисы кэшируют одинаковые вопросы, чтобы не платить за них дважды, и если в кэш случайно попадёт ответ с чьими-то данными, следующий посетитель с похожим вопросом теоретически может его увидеть. Правильное поведение — не переиспользовать между разными людьми ответы, где данные уже вернулись на место, и об этом стоит спросить любой сервис, которым пользуетесь, даже если вопрос выглядит въедливым.

Маскирование — только часть того, что нужно знать про личные данные в чате: согласие, политика на сайте, уведомление в Роскомнадзор и трансграничная передача разобраны в статье чат на сайте и 152-ФЗ.

Читайте дальше