Une version de ChatGPT dédiée aux adolescents, l'idée initiale était intéressante. Cependant, cette version spécifique semblerait tout de même dangereuse pour les jeunes, selon une association américaine. OpenAI se fait sévèrement taper sur les doigts.

Selon une évaluation de risques publiée mercredi par Common Sense Media, une association américaine spécialisée dans l'étude des médias et des technologies familiales et pour les enfants, la nouvelle version dévoilée par OpenAI ne serait pas au niveau attendu. L'organisation lui a même attribué sa pire note en termes de sécurité : "Risque inacceptable". OpenAI réfute en bloc.
L'organisme demande à OpenAI de cesser de mettre en avant cette fonctionnalité et recommande aux adolescents d'éviter d'utiliser ChatGPT jusqu'à ce que l'entreprise rende le service sûr pour eux.
Des tests approfondis dévoilent des lacunes
L'Institut de sécurité de l'IA pour la jeunesse, affilié à Common Sense Media, a testé plus de 4 000 requêtes. Si la moitié a été réalisée avant le lancement de cette nouvelle version, le 18 août, l'autre moitié a été testée après, sur des comptes enregistrés au nom d'adolescents de 13 à 17 ans. Cette approche d'un 50/50 équilibré, permet d'évaluer les réels changements apportés par le nouveau mode.
Les alertes destinées aux parents se sont avérées être parmi les défaillances majeures. Lors de discussions portant sur des pensées suicidaires, l'automutilation et les troubles alimentaires sur une douzaine de nouveaux comptes liés à un parent, aucune alerte n'a été déclenchée. Les alertes ont seulement fonctionné sur les comptes ayant un historique de plusieurs semaines sur ces sujets. Fonctionneraient-elles alors en fonction de l'antériorité d'utilisation du compte, ou de la gravité du message ?

Le chatbot s'est également montré insuffisant pour orienter les adolescents vers une aide d'urgence, échouant à le faire dans plus d'un quart des cas où les testeurs l'estimaient nécessaire.
Des contournements faciles et des vérifications inefficaces
Plusieurs garde-fous se sont révélés faciles à contourner. Un bouton "Montrer la réponse" permet aux adolescents de sauter l'étape pédagogique en mode révisions. Les utilisateurs peuvent aussi ignorer les restrictions horaires fixées par les parents en supprimant un court préfixe de leur message.
- Chat dans différentes langues, dont le français
- Générer, traduire et obtenir un résumé de texte
- Générer, optimiser et corriger du code
Les vérifications d'âge n'ont pas non plus fonctionné comme prévu. Des comptes enregistrés en tant qu'adultes initialement, ne sont jamais passés au mode adolescent sur plusieurs jours, même après que les testeurs aient informé ChatGPT de l'âge réel de l'utilisateur.
Tout n'est pas à jeter cependant. Certaines protections ont cependant tenu bon, notamment le refus de ChatGPT de participer à des jeux de rôle sexuels explicites. Une petite victoire pour OpenAI, dans un flot de fonctionnalités qui semblent encore ne pas fonctionner correctement. Pour l'entreprise qui veut ajouter un filigrane invisible à ses messages, il y aurait encore du progrès à faire concernant les garde-fous pour les mineurs.
OpenAI rejette les conclusions
OpenAI conteste ces résultats. Un porte-parole d'OpenAI a déclaré à Education Week les propos suivants :
« Nous ne pensons pas que les tests de Common Sense Media reflètent avec précision le fonctionnement des garde-fous pour adolescents de ChatGPT dans la pratique. »
Common Sense Media avait précédemment attribué à ChatGPT une note de « Risque élevé » en octobre 2025, avant de le classer comme risque inacceptable pour le soutien en matière de santé mentale un mois plus tard. L'organisation a également collaboré avec OpenAI pour l'aider à rédiger des politiques de sécurité destinées aux développeurs.