// CLUBIC — INTELLIGENZA ARTIFICIALE
ChatGPT pour les ados : malgré les garde-fous, son usage est tout de même jugé risqué
Une version de ChatGPT dédiée aux adolescents, l'idée initiale était intéressante. Cependant, cette version spécifique semblerait tout de même dangereuse pour les jeunes, selon une association américaine. OpenAI se fait sévèrement taper sur les doigts.
Selon une évaluation de risques publiée mercredi par Common Sense Media, une association américaine spécialisée dans l'étude des médias et des technologies familiales et pour les enfants, la nouvelle version dévoilée par OpenAI ne serait pas au niveau attendu. L'organisation lui a même attribué sa pire note en termes de sécurité : "Risque inacceptable". OpenAI réfute en bloc.
L'organisme demande à OpenAI de cesser de mettre en avant cette fonctionnalité et recommande aux adolescents d'éviter d'utiliser ChatGPT jusqu'à ce que l'entreprise rende le service sûr pour eux.
L'Institut de sécurité de l'IA pour la jeunesse, affilié à Common Sense Media, a testé plus de 4 000 requêtes. Si la moitié a été réalisée avant le lancement de cette nouvelle version, le 18 août, l'autre moitié a été testée après, sur des comptes enregistrés au nom d'adolescents de 13 à 17 ans. Cette approche d'un 50/50 équilibré, permet d'évaluer les réels changements apportés par le nouveau mode.
Les alertes destinées aux parents se sont avérées être parmi les défaillances majeures. Lors de discussions portant sur des pensées suicidaires, l'automutilation et les troubles alimentaires sur une douzaine de nouveaux comptes liés à un parent, aucune alerte n'a été déclenchée. Les alertes ont seulement fonctionné sur les comptes ayant un historique de plusieurs semaines sur ces sujets. Fonctionneraient-elles alors en fonction de l'antériorité d'utilisation du compte, ou de la gravité du message ?
Le chatbot s'est également montré insuffisant pour orienter les adolescents vers une aide d'urgence, échouant à le faire dans plus d'un quart des cas où les testeurs l'estimaient nécessaire.
Plusieurs garde-fous se sont révélés faciles à contourner. Un bouton "Montrer la réponse" permet aux adolescents de sauter l'étape pédagogique en mode révisions. Les utilisateurs peuvent aussi ignorer les restrictions horaires fixées par les parents en supprimant un court préfixe de leur message.
Les vérifications d'âge n'ont pas non plus fonctionné comme prévu. Des comptes enregistrés en tant qu'adultes initialement, ne sont jamais passés au mode adolescent sur plusieurs jours, même après que les testeurs aient informé ChatGPT de l'âge réel de l'utilisateur.
Tout n'est pas à jeter cependant. Certaines protections ont cependant tenu bon, notamment le refus de ChatGPT de participer à des jeux de rôle sexuels explicites. Une petite victoire pour OpenAI, dans un flot de fonctionnalités qui semblent encore ne pas fonctionner correctement. Pour l'entreprise qui veut ajouter un filigrane invisible à ses messages, il y aurait encore du progrès à faire concernant les garde-fous pour les mineurs.
OpenAI conteste ces résultats. Un porte-parole d'OpenAI a déclaré à Education Week les propos suivants :