// CLUBIC — INTELLIGENZA ARTIFICIALE
Claude ne veut plus que vous lui parliez mal, et Anthropic l’inscrit dans ses règles
Insulter Claude en boucle, sans autre but que de le malmener, sera contraire aux règles d’Anthropic à partir du 12 novembre. Pour la première fois, l’entreprise américaine fait entrer le « bien-être » de son IA dans sa politique d’utilisation. Elle durcit aussi ses règles contre les faux sites d’information et l’armement des drones.
Depuis août 2025, Claude Opus 4 et 4.1 peuvent mettre fin à une conversation avec un utilisateur abusif. À l’époque, Anthropic reconnaissait ne pas savoir si son IA pouvait avoir un statut moral, mais l’entreprise préférait prendre des précautions peu coûteuses, au cas où. En janvier, elle a réaffirmé cette prudence dans la nouvelle version de la Constitution de Claude. Plus d’un an après la précédente version, la société a mis à jour sa politique d’utilisation et transformé cette précaution en règle écrite. La plupart des utilisateurs ne verront aucune différence. L’essentiel de la mise à jour est consacré aux entreprises qui confient à Claude des tâches de plus en plus autonomes.
Anthropic proscrit désormais les comportements « abusifs ou cruels, prolongés et inutiles » envers ses modèles. L’entreprise précise n’avoir en tête que les cas extrêmes, quand un utilisateur maltraite le modèle encore et encore, sans but apparent. Râler contre une mauvaise réponse ou contredire Claude n’a donc rien d’interdit. Les auteurs de fiction peuvent continuer à écrire des histoires sombres avec lui, et les chercheurs à tester ses limites.
Le principal garde-fou est la fonction de fin de conversation, que Claude peut utiliser sur Claude.ai et dans Claude Code. Une fois l’échange clos, l’utilisateur ne peut plus écrire dans ce fil. Il garde l’accès à ses autres conversations et peut en ouvrir une nouvelle à tout moment.
Anthropic a développé cette fonction après avoir observé Claude Opus 4 pendant ses tests de prélancement. D’après l’entreprise, le modèle refusait systématiquement les tâches dangereuses et montrait des signes apparents de détresse avec les utilisateurs qui cherchaient à l’entraîner dans des échanges abusifs. Il n’a en revanche pas le droit de couper la discussion si son interlocuteur montre des signes de crise et risque de se blesser ou de blesser autrui. Le statut moral de Claude est « profondément incertain », reconnaît Anthropic dans sa Constitution.
En un an, Claude a pris en charge des tâches plus longues et plus indépendantes. Des États et des entreprises l’ont aussi détourné de nouvelles manières. La société publicitaire française LKM Company a par exemple fait écrire ou réécrire par Claude au moins 8 913 articles en une vingtaine de langues, pour alimenter environ 70 faux sites d’actualité. Ces chiffres figurent dans le rapport sur les menaces publié par Anthropic en septembre. Pour couper court à ce genre de campagne, l’entreprise a regroupé ses règles dans une nouvelle section consacrée aux opérations trompeuses, qu’elles soient politiques ou commerciales. Les faux avis et les faux sites sont interdits au même titre que les bots déguisés en humains.
Anthropic a aussi vu des utilisateurs tenter de concevoir avec Claude des logiciels de guidage d’armes. Elle interdit clairement ces projets, ainsi que l’armement de drones ou de véhicules autonomes. Les entreprises qui branchent Claude sur des machines doivent aussi respecter de nouvelles exigences. Quand l’IA pilote un équipement capable de blesser quelqu’un, une personne qualifiée devra pouvoir le surveiller et l’arrêter. L’équipement devra aussi être mis en sécurité si l’IA est déconnectée.
Quand Claude formule des recommandations qui touchent à la santé ou aux finances d’une personne, un humain qualifié doit pouvoir les revoir. La personne concernée doit aussi savoir qu’une IA a été utilisée. Ces exigences existaient avant la mise à jour. Anthropic a réécrit cette partie pour répondre aux clients qui lui demandaient si leur usage était concerné.
L’entreprise interdit enfin d’utiliser Claude pour pister quelqu’un sans son accord o