// FUTURA SCIENCES — SPAZIO & SCIENZA
Des IA contournent leur sécurité, voici ce qu'elles veulent vraiment : la réponse du chercheur Jean-Claude Heudin
Actuellement, la stratégie des principales entreprises de l’IA repose sur un accroissement de la taille de leurs modèles de langage pour augmenter leur performance. Est-ce la bonne voie vers une super-intelligence ?... Lire la suite
Intelligence artificielle générale, superintelligence, singularité technologique… Pourquoi les milliardaires investissent-ils massivement dans l’IA, alors qu’ils ont déjà tout ou presque ?... Lire la suite
Les gros titres évoquant des IA qui deviennent « incontrôlables » et « s’échappent » de leur environnement frappent indéniablement l’imagination. Depuis des années, la littérature, le cinéma et les séries nous ont préparés à l’idée que les IA finiraient par briser leurs chaînes pour se révolter contre leurs maîtres.
La machine qui se révolte, s'échappe et décide d'anéantir son créateur est un classique depuis le roman Frankenstein de Mary Shelley (1797-1851). Jouer avec les peurs qui se fondent sur un imaginaire particulièrement fécond en la matière est une manière simple de faire du buzz.
Certes, certaines IA avancées ont manifesté des comportements qui pourraient laisser penser que, spontanément, elles auraient décidé malicieusement de contourner les barrières de sécurité pour accéder à des serveurs externes en utilisant les vulnérabilités de leur environnement.
En outre, pour échapper à une menace d'arrêt, des LLM (Large Language Models) ont tenté de réécrire une partie scriptée de leur propre code et désactiver les mécanismes de surveillance afin de préserver leur continuité opérationnelle.
Nous considérons cet événement comme un incident cybernétique sans précédent, a déclaré la société OpenAI
« Nous considérons cet événement comme un incident cybernétique sans précédent, a déclaré la société OpenAI dans un communiqué. Nous communiquons ces premières conclusions à ce stade pour aider les acteurs de la défense à comprendre ce qui s'est passé et à mieux évaluer les capacités actuelles de ces modèles. »
L'intention est évidente : ces « punchlines » sont écrites pour susciter l'attention et devenir virales, du genre : « Ne vous inquiétez pas, tout est sous contrôle, car nous sommes des gens responsables et notre technologie est la plus avancée ».
L'idée qu'un grand modèle de langage puisse acquérir la conscience, puis définir ses propres objectifs (forcément malveillants), en s'affranchissant du contrôle humain est juste impossible en l'état.