«Я же убрала имя» — самая частая фраза, которую я слышу от коллег, когда захожу разговор про безопасность данных. И почти всегда одного имени мало. Обезличивание клиента — это не замазать ФИО, а сделать так, чтобы по тексту нельзя было узнать человека ни напрямую, ни по сумме мелких деталей. Разберу, что здесь работает идентификатором, какими приёмами я обезличиваю материал и зачем это нужно с точки зрения закона.
Зачем это вообще нужно
Две причины, и обе практические. Первая — конфиденциальность как ядро терапевтического контракта: любой фрагмент, по которому клиента можно опознать, покидая мой стол, покидает и границы согласия, которое он давал. Вторая — обработка данных инструментами. Как только я хочу расшифровать запись, попросить помощи с формулировкой или отдать текст любому внешнему сервису, вопрос «что именно уходит наружу» становится юридическим.
По 152-ФЗ данные о психическом здоровье клиента относятся к специальной категории персональных данных (ст. 10) и требуют отдельных мер защиты. Точные границы — что именно из вашей практики попадает в спецкатегорию, будь то факт записи на приём, ФИО или контакт, — лучше уточнить у юриста по персональным данным. Важная оговорка: обезличивание снижает риск, но само по себе не отменяет ни необходимости законного основания, ни согласия клиента. Это мера гигиены, а не индульгенция.
Что считается идентификатором
Ошибка — думать только про имя и телефон. Идентификаторы удобно разложить на три слоя, и опаснее всего третий.
- Прямые. ФИО, номер телефона, адрес, почта, аккаунты в соцсетях. Их убирают в первую очередь, и про них помнят все.
- Косвенные (квазиидентификаторы). Профессия, город, точный возраст, должность супруга, место работы, редкое заболевание, необычное хобби. По отдельности каждый выглядит безобидно.
- Комбинация признаков. Самое коварное. «34 года, стоматолог, муж — депутат местного совета» не содержит ни имени, ни контакта, но в небольшом городе указывает на одного человека. Деанонимизирует именно их сочетание.
Клиента выдаёт не имя, а редкая комбинация обычных деталей. Обезличивать нужно именно сумму признаков, а не только строчку с ФИО.
Как обезличивать: рабочие приёмы
У меня сложился короткий набор действий, который я прогоняю по тексту, прежде чем он куда-то уходит.
- Убрать прямые идентификаторы полностью. Не заменять имя на инициалы (они всё ещё указывают), а на роль: «клиентка», «клиент N». Инициалы — половинчатая мера, я от неё отказалась.
- Огрублять квазиидентификаторы. Точный возраст перевожу в диапазон («около 45»), конкретную профессию — в сектор («работает в медицине»), город — в масштаб («небольшой город»). Смысл для клинической задачи сохраняется, узнаваемость падает.
- Резать редкие детали. Уникальное заболевание, публичная должность родственника, экзотическая профессия. Если деталь не нужна для задачи — она уходит. Если нужна — обобщается до неопознаваемого уровня.
- Проверять на совокупность. Финальный шаг: перечитать глазами постороннего и спросить, можно ли по оставшемуся набору вычислить человека в его окружении. Если близкий круг узнал бы — обезличивание не завершено.
На практике это выглядит так. Было: «Ирина, 34, стоматолог из Пскова, муж — депутат горсовета, запрос: тревога после выкидыша». Стало: «клиентка около 35, работает в медицине, живёт в небольшом городе, запрос: тревога после перинатальной потери». Второй вариант сохраняет всё, что мне нужно для работы, и больше не показывает пальцем на конкретного человека.
Обезличивание и инструменты
Отдельно проговорю связку с ИИ, потому что здесь коллеги ошибаются чаще всего. Обычный публичный чат — не место для клиентских данных, и обезличивание тут первый барьер: в него я отдаю только текст, уже прошедший чистку. Почему я вообще не кладу расшифровки и имена в общий сервис, подробно разобрано в статье когда я не кладу данные клиента в ChatGPT. И в промптах для ИИ у меня железное правило: сначала обезличивание, потом запрос.
Здесь же важно не перепутать два разных инструмента. Публичный чат общего назначения и специализированный сервис с защищённым контуром и хранением данных в РФ — не одно и то же. Для первого обезличивание обязательно всегда. Второй сделан под работу с клиентскими данными по договору обработки, но и там разумно не хранить лишнего и обезличивать то, что для задачи не нужно. А что не отдавать никуда и как долго вообще держать записи — в разборе про срок хранения записей сессии.
Как это устроено в Provizor AI
Provizor AI я строила так, чтобы снять с психолога ручное обезличивание перед каждым обращением к внешней модели: данные сессии не уходят в общий публичный чат, а обрабатываются в защищённом контуре с хранением в РФ. По записи формируется черновик DAP-заметки. Это не отменяет дисциплины — в итоговых документах я всё равно держу ровно столько персональных данных, сколько нужно для работы, и обезличиваю то, что можно обезличить без потери смысла. Инструмент закрывает канал утечки во внешнюю модель; решение, что именно фиксировать про клиента, остаётся за мной.
И последнее, что помогает не запутаться в разговоре с клиентом о его данных: обезличивание — часть того же уважения к границам, что и всё остальное в терапии. Как объяснить это человеку простыми словами, не пугая технологиями, я разбирала в заметке как объяснить клиенту про ИИ.