Pseudonymisation RGPD
conformiteDéfinition
La pseudonymisation est définie à l'article 4 §5 du RGPD comme le traitement de données à caractère personnel de telle façon que celles-ci ne puissent plus être attribuées à une personne concernée précise sans avoir recours à des informations supplémentaires, à condition que ces informations supplémentaires soient conservées séparément et soumises à des mesures techniques et organisationnelles afin de garantir que les données à caractère personnel ne sont pas attribuées à une personne physique identifiée ou identifiable. La pseudonymisation est un outil de réduction des risques, mais pas une forme d'anonymisation. Les données pseudonymisées restent des données à caractère personnel au sens du RGPD, puisqu'il est possible de réidentifier les personnes en combinant les données pseudonymisées avec la « table de correspondance » ou les informations supplémentaires conservées séparément. Le RGPD encourage cependant la pseudonymisation comme mesure de sécurité et comme moyen de faciliter certains traitements ultérieurs. Techniquement, la pseudonymisation peut prendre plusieurs formes : le hachage cryptographique (remplacement d'un identifiant par son empreinte cryptographique, avec salt), le chiffrement déterministe (permettant de retrouver les données avec la clé), la tokenisation (remplacement par un token aléatoire via un vault de tokens), et les techniques plus avancées comme le chiffrement préservant le format (FPE) ou les pseudonymes probabilistes. Le RGPD reconnaît plusieurs bénéfices à la pseudonymisation : elle réduit les risques en cas de violation de données (les données exposées ne permettent pas directement d'identifier les personnes), elle peut faciliter les traitements à des fins de recherche et de statistiques, et elle constitue une mesure de sécurité appropriée au sens de l'article 32. Une violation de données portant sur des données pseudonymisées avec une table de correspondance sécurisée peut ne pas nécessiter de notification aux personnes concernées si le risque est jugé non élevé. Il est crucial de distinguer pseudonymisation et anonymisation : les données anonymisées ne sont plus des données personnelles et sortent du champ du RGPD, tandis que les données pseudonymisées restent soumises à toutes ses obligations.
Définition et distinction avec l'anonymisation
La pseudonymisation (art. 4 §5 RGPD) consiste à remplacer les identifiants directs d'une personne par un pseudonyme (token, hash, code), tout en conservant séparément la table de correspondance permettant la réidentification. Les données pseudonymisées restent des données personnelles soumises au RGPD, puisque la réidentification reste possible pour qui possède la clé ou la table de correspondance.
L'anonymisation, à l'inverse, supprime toute possibilité de réidentification directe ou indirecte. Le G29 (avis 05/2014) et le CEPD ont précisé que l'anonymisation véritable doit résister à trois attaques : singling out (isoler un individu), linkability (relier des enregistrements), et inference (déduire des informations sur un individu). Des techniques comme k-anonymat, l-diversité, différentielle privacy sont nécessaires pour atteindre un anonymat robuste.
Techniques de pseudonymisation
Les principales techniques incluent : le hachage avec salt (SHA-256, SHA-3 avec salt aléatoire unique par individu, évitant les attaques par table de correspondance précalculée), la tokenisation (remplacement par un token aléatoire géré dans un vault sécurisé), le chiffrement déterministe (AES en mode ECB ou autre, permettant la recherche dans les données chiffrées), et le format-preserving encryption (FPE) pour maintenir la structure des données (ex. : numéros de carte bancaire pseudonymisés conservant le même format).
La qualité de la pseudonymisation dépend de la sécurité de la table de correspondance ou des clés cryptographiques. Une pseudonymisation réussie exige : clés stockées séparément des données pseudonymisées, rotation périodique des clés, contrôles d'accès stricts à la table de correspondance ou aux clés, journalisation des accès à ces ressources.
Bénéfices réglementaires de la pseudonymisation
Le RGPD encourage la pseudonymisation en lui accordant plusieurs avantages : elle peut réduire l'obligation de réaliser une DPIA (ou en simplifier les conclusions), faciliter les traitements ultérieurs à des fins de recherche (art. 89), et réduire la gravité d'une violation de données (données pseudonymisées exposées sans la clé → risque faible → pas de notification aux personnes).
Dans le domaine de la santé, la pseudonymisation est quasi-systématique pour les données transmises à des organismes de recherche ou à des entrepôts de données de santé (EDS). Le Health Data Hub et les plateformes des données de santé (PDS) reposent sur des pseudonymisations robustes pour permettre la recherche tout en protégeant l'identité des patients.
Articles liés
Expert en cybersécurité offensive et intelligence artificielle. Pentest, audit et développement IA sur-mesure.
Services
- Audit Infrastructure
- Audit Kubernetes
- Audit Microsoft 365
- Audit Sécurité Réseau
- Analyse de Risques
- Audit Active Directory
- Audit Application Web
- Audit Cloud (AWS/Azure/GCP)
- Audit Messagerie
- Audit API (OWASP Top 10)
- Audit DevSecOps & CI/CD
- Audit Code Source (SAST)
- Audit Postes de Travail
- Audit Sauvegarde & Résilience
- Audit OT/SCADA (IEC 62443)
- Développement IA
- Formations
Ressources
Projets & Outils
© 2026 Ayi NEDJIMI Consultants. Tous droits réservés.
Un projet cybersécurité ?
Expert dispo · Réponse 24h