Сравнение анонимизации / деидентификации и псевдонимизации. Помогает понять разницу между снижением идентифицируемости и заменой идентификаторов при сохранении возможности повторной идентификации через отдельную информацию.
Краткий вердикт: Используйте «анонимизация / деидентификация», когда обсуждаете сниженные или устранённые возможности идентификации; используйте «псевдонимизация», когда персональные данные всё ещё могут быть отнесены к человеку с помощью защищённой дополнительной информации.
Anonymisation and De-identification summarizes techniques used to reduce the risk that individuals can be identified from a dataset.
Контекст: Наиболее релевантно при оценке того, можно ли использовать набор данных с пониженным риском приватности или рассматривать его как неперсональный.
Pseudonymisation describes processing of personal data so it can no longer be attributed to a specific individual without separate additional information.
Контекст: Наиболее релевантно, когда организациям нужно снизить идентифицируемость, сохраняя контролируемое повторное связывание или непрерывность записей.
| Аспект | Anonymisation / De-identification | Pseudonymisation |
|---|---|---|
| Категория данных | Анонимизация и деидентификация описывают техники, которые снижают риск идентификации людей по набору данных. | Псевдонимизация описывает обработку персональных данных таким образом, чтобы их нельзя было отнести к конкретному лицу без отдельной дополнительной информации. |
| Правовой эффект | Настоящая анонимизация может вывести данные из режима персональных данных, если повторная идентификация не является разумно возможной; деидентификация может не достигать этого порога. | Псевдонимизированные данные обычно остаются персональными данными, когда повторная идентификация остаётся возможной. |
| Риск идентифицируемости | Центральный риск — могут ли люди всё ещё быть идентифицированы прямо, косвенно или через связывание с другой информацией. | Центральный риск — может ли отдельная информация или таблица сопоставления повторно связать данные с человеком. |
| Контроли | Контроли фокусируются на силе преобразования, тестировании связывания, остаточном риске повторной идентификации и документации заявления об анонимизации. | Контроли фокусируются на отделении и защите дополнительной информации с помощью технических и организационных мер. |
| Распространённая ошибка | Распространённая ошибка — называть деидентифицированные данные анонимными без тестирования реалистичного риска повторной идентификации. | Распространённая ошибка — обращаться с псевдонимизацией так, будто она выводит данные из обязанностей приватности. |
| Использование в ИИ | Анонимизация или деидентификация может снижать риск приватности для разработки, тестирования и аналитики моделей, если выполнена надёжно. | Псевдонимизация может поддерживать контролируемую обработку ИИ, сохраняя возможность связывать записи для валидации, мониторинга или исправления. |
На практике псевдонимизация часто является сильным операционным контролем, тогда как анонимизация — юридический и технический вывод, который нужно заслужить. Команды должны избегать использования слова «анонимный» как разговорного синонима маскированного или деидентифицированного.
Называть псевдонимизированные данные анонимными.
Игнорировать атаки связывания при оценке анонимизации.
Не защищать ключ псевдонимизации или таблицу сопоставления.
Предполагать, что деидентификация снимает все обязанности GDPR или приватности.
Используйте «анонимизация / деидентификация», когда речь идёт о снижении или устранении возможности идентифицировать людей в наборе данных. Используйте термин осторожно, потому что деидентификация может снижать риск, не достигая более сильного порога настоящей анонимизации.
Используйте «псевдонимизация», когда персональные данные были преобразованы так, что отнесение к лицу требует отдельной дополнительной информации. Термин уместен, когда организация сохраняет защищённую таблицу сопоставления, ключ или иной путь повторной идентификации.
В privacy-анализе в стиле GDPR псевдонимизация является мерой защиты, но обычно не устраняет статус персональных данных, когда повторная идентификация остаётся возможной. Записи управления ИИ должны документировать метод преобразования, анализ повторной идентификации и остаточный риск до того, как полагаться на заявления об анонимизации.
Обычно да, если повторная идентификация возможна через отдельную дополнительную информацию. Псевдонимизация снижает риск, но не обязательно меняет правовую категорию.
Не всегда. Деидентификация снижает идентифицируемость, тогда как настоящая анонимизация требует, чтобы повторная идентификация не была разумно возможной.
Наборы данных ИИ могут связываться, обогащаться или раскрываться через выходы и логи. Слабое преобразование может создавать риск приватности даже там, где прямые идентификаторы были удалены.
No recently viewed comparisons yet.