Aller au contenu

Ce qu'est une donnée personnelle

Presque tout le monde se trompe sur ce point, et l’erreur est toujours dans le même sens : on croit qu’une donnée personnelle, c’est un nom, une adresse, un numéro. C’est beaucoup plus large.

Une donnée personnelle, c’est toute information se rapportant à une personne physique identifiée ou identifiable.

Le mot qui compte, c’est identifiable. Pas identifiée. Une information qui ne nomme personne mais qui permet de retrouver quelqu’un, seule ou en la croisant avec autre chose, est une donnée personnelle.

C’est ce qui rend l’anonymisation plus difficile qu’il n’y paraît, et c’est le sujet d’une fiche entière du module 2.

Les évidences, d’abord : nom, prénom, adresse postale, adresse électronique, numéro de téléphone, date de naissance, numéro de sécurité sociale, photo, enregistrement de voix.

Puis ce à quoi on pense moins. Un identifiant de dossier, s’il permet de remonter à la personne. Une adresse IP. Un matricule salarié. Une plaque d’immatriculation. Un historique d’achats. Des coordonnées de localisation. Un enregistrement de caméra.

Et enfin ce à quoi on ne pense jamais : une appréciation sur quelqu’un. Une note d’entretien annuel (« manque de rigueur »), une remarque sur un élève, un commentaire sur un client difficile. Ce sont des données personnelles au même titre qu’un numéro de téléphone, et souvent plus sensibles.

Certaines informations bénéficient d’une protection renforcée parce que leur divulgation cause des préjudices particulièrement graves. Le vocabulaire officiel parle de catégories particulières de données.

Ce sont les informations qui révèlent la santé, l’origine raciale ou ethnique, les opinions politiques, les convictions religieuses ou philosophiques, l’appartenance syndicale, la vie sexuelle ou l’orientation sexuelle. S’y ajoutent les données génétiques et les données biométriques utilisées pour identifier quelqu’un.

Les infractions et condamnations relèvent d’un régime à part, également strict.

Pour ce qui te concerne, la règle pratique est simple : ces informations ne se collent pas dans un outil d’IA généraliste. Pas anonymisées à moitié, pas « juste pour reformuler ». Pas du tout.

C’est le mécanisme qui piège tout le monde.

Prise isolément, une information peut sembler anodine. Combinée à deux ou trois autres, elle identifie une personne unique.

Un exemple, sur une commune de trois mille habitants. « Un homme », ça ne dit rien. « Un homme d’une cinquantaine d’années », toujours rien. « Un homme d’une cinquantaine d’années, artisan plombier, qui a repris l’entreprise de son père » : tout le monde sait de qui il s’agit.

Aucune de ces informations n’est un nom. L’ensemble est une donnée personnelle.

Le test à appliquer : est-ce que quelqu’un qui connaît le contexte pourrait remonter à la personne ? Si oui, tu manipules une donnée personnelle, quel que soit le nombre de noms que tu as retirés.

Question fréquente, et la réponse surprend.

L’adresse prenom.nom@entreprise.fr est une donnée personnelle. Le fait qu’elle soit professionnelle n’y change rien : elle se rapporte à une personne physique identifiable.

En revanche, contact@entreprise.fr ou le chiffre d’affaires d’une société ne sont pas des données personnelles, parce qu’ils ne se rapportent à aucune personne physique en particulier.

La frontière n’est donc pas « personnel contre professionnel ». Elle est « se rapporte à une personne physique, ou non ».

Trois conséquences directes.

Le périmètre à surveiller est plus large que tu ne le pensais. Ce n’est pas seulement le fichier clients, c’est aussi le compte rendu de réunion qui cite des collègues, la note d’évaluation, le courrier de réclamation.

Retirer les noms ne suffit pas toujours. C’est nécessaire, ce n’est pas suffisant.

Et certaines catégories ne se traitent pas du tout de cette manière, même anonymisées, parce que le contenu lui-même révèle ce qu’on cherchait à protéger.

Prends l’un des trois documents que tu as mis de côté. Surligne tout ce qui, selon la définition ci-dessus, est une donnée personnelle. Compte.

Cherche ensuite le faisceau d’indices. Si tu retirais tous les noms, resterait-il assez d’éléments pour que quelqu’un de ton service reconnaisse la personne ? Presque toujours, oui.

Puis regarde si une catégorie protégée s’y trouve, même en filigrane. Santé, syndicat, religion, origine, orientation. Beaucoup de gens en trouvent une là où ils ne l’attendaient pas.

Vérifie ta compréhension

Question : tu retires tous les noms d’un compte rendu d’entretien annuel avant de le faire reformuler. Manipules-tu encore des données personnelles ?

Réponse : oui, très probablement. D’abord parce que le poste, l’ancienneté et les faits décrits suffisent souvent à identifier la personne dans son service. Ensuite parce que le contenu lui-même, une appréciation sur quelqu’un, est une donnée personnelle par nature. Retirer le nom réduit le risque, il ne fait pas disparaître la qualification.

Fiche suivante : ce qui se passe réellement quand tu colles un texte.

Une formationBaxIA