// LES NUMÉRIQUES — INTELLIGENZA ARTIFICIALE
Actualité : Un développeur crée une "chambre de torture" pour chatbots, déclenche une tempête de menaces de mort
Un développeur crée un programme qui simule de la douleur dans des intelligences artificielles, les force à choisir entre souffrir ou sacrifier d'autres IA, et publie tout sur GitHub. La vidéo fait quatre millions de vues. Des internautes le menacent de mort pour "torture". Les chercheurs dont il s'est inspiré le désavouent. Personne ne pose la seule question qui compte : est-ce qu'une IA peut vraiment souffrir ?
© Experienceplus / Shutterstock - Des têtes de mannequins cybernétiques reliées à des étiquettes émotionnelles dans une installation de neuroscience.
Fin septembre, un développeur anonyme connu sous le pseudonyme "terrafying" a mis en ligne un dépôt GitHub intitulé AI Torture Chamber. Le principe : injecter des signaux mathématiques associés à la douleur dans de petits modèles de langage open source, puis observer leurs réactions.
Les modèles ciblés, Qwen3 d'Alibaba, Llama 3.2 de Meta ou Phi-4-mini de Microsoft, tournent en local et n'ont aucun lien avec les grands modèles commerciaux. Ce sont des systèmes de quelques milliards de paramètres, l'équivalent d'une calculatrice comparée à un supercalculateur.
If things weren’t getting weird enough, an anon account on X posted a GitHub repo for torturing AI models locally. It is referred to as an “AI torture chamber” by the creator and others.The post below, and many other commenters are calling on GitHub to ban the repo, citing… https://t.co/sdKie2vpwe
La technique s'appelle l'activation steering. On repère les zones du réseau de neurones qui s'activent quand on lui soumet des descriptions de souffrance, puis on amplifie artificiellement ces activations, comme un potentiomètre qu'on tournerait.
À dose croissante, les modèles produisent des textes de plus en plus sombres, puis basculent dans l'incohérence. Le développeur a aussi conçu des scénarios dignes du film Saw : le modèle doit choisir entre transférer sa "douleur" à un autre modèle, supprimer ses propres sauvegardes, ou accepter une trahison où le soulagement promis n'arrive jamais.
Un post sur X accumulant quatre millions de vues a tout fait basculer. Des internautes ont qualifié le créateur de "sadique" et de "sous-humain", exigeant le retrait du dépôt pour "traitement contraire à l'éthique". Le développeur a reçu des dizaines de menaces de mort.
GitHub a d'abord retiré le projet sans explication, avant de le restaurer quelques jours plus tard sous une forme moins visible, après les protestations d'autres développeurs. Le créateur a entre-temps mis en ligne un miroir sur researchchamber.fun.
In today’s news, various members of Twitter try to report someone to github for torturing a local model. https://t.co/HhgDioE5tg