L'initiative du Canada visant à restreindre l'accès aux médias sociaux pour les utilisateurs de moins de 16 ans a poussé Google et Meta à déployer des outils de vérification de l'âge pilotés par l'IA sur l'ensemble de leurs plateformes. En surface, cela ressemble à une mesure simple de protection de l'enfance. En dessous, cela soulève une question plus difficile pour chaque utilisateur, pas seulement les adolescents : combien de données personnelles ces systèmes collectent-ils et déduisent-ils simplement pour deviner votre âge ?

Comme nous l'avons abordé dans notre rapport précédent sur les contrôles d'âge par IA de Google et Meta au Canada, le gouvernement fédéral a introduit une législation sur la sécurité numérique visant à tenir les enfants de moins de 16 ans à l'écart des plateformes de médias sociaux. Pour se conformer, les entreprises se tournent vers l'estimation automatisée de l'âge plutôt que de se fier uniquement à la déclaration de la date de naissance par les utilisateurs. C'est ce changement qui fait entrer en jeu les préoccupations liées à la confidentialité de la vérification de l'âge par IA.

Comment fonctionne réellement l'IA d'estimation de l'âge de Google et Meta

Plutôt que de demander aux utilisateurs de télécharger une pièce d'identité officielle, les deux entreprises s'appuient sur des modèles d'apprentissage automatique qui analysent les signaux comportementaux et liés au compte pour estimer l'âge. Cela peut inclure la façon dont un compte est utilisé, le type de contenu avec lequel il interagit et les schémas qui diffèrent entre le comportement des utilisateurs adultes et celui des plus jeunes. L'objectif est de signaler les comptes qui semblent appartenir à une personne de moins de 16 ans afin que les restrictions de la plateforme puissent être appliquées automatiquement, sans exiger que chaque utilisateur prouve son âge manuellement.

Cette approche séduit autant les régulateurs que les entreprises car elle évite la friction liée au téléchargement obligatoire de documents pour l'ensemble de la base d'utilisateurs. Mais cela signifie aussi que la précision du système dépend entièrement de la quantité de données dont l'IA dispose et de sa capacité à interpréter ces données.

Quelles données ces systèmes collectent au-delà de votre date de naissance

La tension centrale dans les débats sur la confidentialité de la vérification de l'âge par IA réside dans le fait qu'estimer l'âge à partir du comportement nécessite souvent plus de données que la simple vérification d'un champ de date de naissance. Au lieu d'un seul point de données, ces systèmes peuvent s'appuyer sur une activité de compte et des schémas d'utilisation plus larges pour établir une inférence. Cela signifie que le processus d'estimation de l'âge lui-même peut devenir une nouvelle voie de collecte de données, fonctionnant en continu en arrière-plan plutôt que comme une vérification ponctuelle.

Pour les utilisateurs soucieux de leur vie privée, c'est la partie de l'histoire qui mérite plus d'attention qu'elle n'en reçoit habituellement. Une date de naissance est statique et limitée. Le profilage comportemental est continu et peut révéler bien plus sur une personne que son seul âge. Lorsque les plateformes construisent des systèmes conçus pour déduire quelque chose d'aussi sensible que la tranche d'âge d'un utilisateur, le pipeline de données sous-jacent a souvent la capacité d'en déduire d'autres choses également.

Précision, biais et risques de faux positifs dans les algorithmes de devinette de l'âge

Tout système d'IA conçu pour estimer un attribut personnel à partir de signaux indirects comporte un risque de se tromper. L'estimation de l'âge ne fait pas exception. Les utilisateurs pourraient être classés à tort comme plus jeunes ou plus âgés qu'ils ne le sont réellement, entraînant l'application de restrictions incorrectes à des comptes adultes ou, inversement, des utilisateurs mineurs passant inaperçus. Parce que ces modèles sont entraînés sur des schémas plutôt que sur des faits vérifiés, les erreurs ne sont pas seulement possibles, elles sont une caractéristique structurelle du fonctionnement de cette technologie.

Cela crée un compromis bien réel. Resserrer l'algorithme pour détecter davantage d'utilisateurs mineurs augmente le risque de signaler à tort des adultes. L'assouplir pour réduire les faux positifs augmente le risque de manquer les utilisateurs mineurs que le système était censé identifier au départ. À mesure que les restrictions canadiennes sur les médias sociaux progressent, cet exercice d'équilibre restera probablement un défi permanent plutôt qu'un problème résolu.

Comment les utilisateurs soucieux de leur vie privée peuvent limiter l'exposition des données liée aux contrôles d'âge

Bien que les utilisateurs individuels ne puissent pas réécrire la façon dont Google ou Meta construisent leurs systèmes d'estimation de l'âge, certaines mesures peuvent réduire l'exposition inutile des données. Examiner régulièrement les paramètres de confidentialité du compte est un bon point de départ, en particulier les paramètres liés au suivi de l'activité, à la personnalisation des publicités et au partage de données entre services. Limiter la quantité de données comportementales qu'une plateforme peut collecter en premier lieu réduit la matière première avec laquelle ces systèmes d'IA doivent travailler.

Les utilisateurs particulièrement préoccupés par le profilage devraient également réfléchir à la façon dont leur activité en ligne plus large, y compris les habitudes de navigation liées aux mêmes comptes ou appareils, pourrait alimenter ces systèmes. Un VPN ne changera pas le fonctionnement du modèle interne d'estimation de l'âge d'une plateforme, mais il peut aider à limiter la quantité de données au niveau du réseau, telles que les signaux de localisation et basés sur l'IP, qui sont liées à l'empreinte numérique plus large d'un utilisateur à travers différents services.

Ce que cela signifie pour vous

Si vous utilisez des produits Google ou Meta au Canada, vous êtes peut-être déjà soumis à une estimation automatisée de l'âge sans qu'une invite spécifique ne vous demande de vérifier votre âge. Cela constitue une rupture avec le modèle traditionnel des dates de naissance autodéclarées, et cela transfère davantage de contrôle sur la vérification de l'identité à des algorithmes opaques. Même si vous n'êtes pas mineur et n'avez rien à craindre concernant les restrictions de la plateforme, il vaut la peine de comprendre que les systèmes qui prennent ces décisions reposent sur une collecte de données comportementales qui va bien au-delà d'un simple champ d'âge.

Points clés à retenir

La confidentialité de la vérification de l'âge par IA devient un enjeu de plus en plus important à mesure que les gouvernements poussent les plateformes vers une conformité automatisée plutôt que vers des contrôles manuels. Le déploiement de Google et Meta au Canada est un aperçu de ce qui pourrait devenir une tendance mondiale plus large. Lisez notre analyse complète des contrôles d'âge par IA de Google et Meta au Canada pour le contexte réglementaire, prenez quelques minutes pour examiner vos paramètres de confidentialité et de personnalisation des publicités sur les principales plateformes, et gardez à l'esprit que les outils d'estimation de l'âge dépendent souvent des mêmes données comportementales qui alimentent la publicité ciblée. Rester informé sur le fonctionnement de ces systèmes est le meilleur moyen de garder le contrôle sur ce que vous partagez, quel que soit l'âge que l'algorithme vous attribue.