// LES NUMÉRIQUES — INTELLIGENZA ARTIFICIALE
Actualité : Qwen 3.8-Max : cette nouvelle IA open source a franchi une frontière en travaillant seule pendant des jours
L'open source semble avoir franchi un seuil historique. Pendant qu'OpenAI et Anthropic verrouillent leurs modèles les plus puissants, Alibaba publie gratuitement les poids d'une IA capable de travailler seule pendant des jours sur des projets complexes. Qwen 3.8-Max surpasse ChatGPT et Claude sur les tâches longues, et n'importe qui peut désormais l'auditer, l'adapter, le déployer.
© Alibaba - Qwen 3.8-Max bat 87 % des humains en concours, et ses "recettes" seront publiques la semaine prochaine
Quand on utilise ChatGPT ou Claude, on guide l'IA étape par étape : on valide, on relance, on corrige, on ajuste. L'humain reste dans la boucle en permanence. Qwen 3.8-Max, dévoilé en août 2026 par Alibaba Cloud, pousse l'autonomie beaucoup plus loin : on lui confie un objectif ambitieux, et il travaille seul pendant des heures ou des jours, corrige ses propres erreurs, ajuste sa stratégie et livre un résultat fini sans qu'on ait besoin de le relancer. C'est la différence entre collaborer avec un assistant et déléguer un chantier entier à un chef de projet autonome.
Pour mesurer ces capacités, les chercheurs utilisent des épreuves standardisées. PaperBench évalue la capacité à reproduire un article scientifique en code : Qwen 3.8-Max y obtient 93,0 sur 100, contre 88,8 pour Fable 5 (le modèle avancé d'Anthropic, créateur de Claude) et 80,3 pour Claude Opus 4.8. OSWorld mesure l'aptitude à utiliser un ordinateur comme un humain : Qwen 3.8-Max y atteint 86,1, le meilleur score tous modèles confondus.
Performances (officielles) de Qwen3.8-Max vis-à-vis de la concurrence.
Mais les chiffres seuls ne suffisent pas : Qwen 3.8-Max aurait, selon Alibaba, développé seul un logiciel pendant 16 jours, en écrivant du code, en le testant et en corrigeant ses bugs sans aucune aide. Il aurait ensuite reproduit un article de recherche scientifique en 125 heures continues, puis inventé une méthode meilleure que celle de l'article original. Lors d'un concours réel organisé sur la plateforme Tianchi d'Alibaba Cloud, il aurait battu 458 équipes humaines sur 526 en seulement 24 heures.
Face à GPT-5.6 Sol (le modèle le plus avancé d'OpenAI, éditeur de ChatGPT), Qwen 3.8-Max reste au coude-à-coude sur certaines épreuves mais le devance sur la reproduction scientifique (93,0 contre 90,5). La source ne mentionne pas de démonstration d'autonomie comparable chez ses concurrents sur des durées aussi longues.
Les modèles d'OpenAI et d'Anthropic sont des boîtes noires : impossible de savoir exactement comment ils fonctionnent ni de les modifier. Qwen 3.8-Max sera publié en "open-weight" la semaine prochaine sur les plateformes Hugging Face et ModelScope, c'est-à-dire que n'importe quel chercheur, entreprise ou développeur pourra télécharger ses paramètres internes, les étudier, les adapter et les faire tourner sur ses propres serveurs. Pour les professionnels soucieux de confidentialité (ou de souveraineté numérique), c'est un argument décisif.
L'interface de QwenCloud, la plateforme d'accès au modèle Qwen 3.8-Max. Les inscrits peuvent y tester le modèle via API ou directement dans le navigateur.
Concrètement, selon Alibaba, Qwen 3.8-Max sait déjà analyser 1 284 clauses juridiques en moins d'une heure (un travail qui mobilise habituellement une équipe d'assistants juridiques pendant une semaine), concevoir des circuits électroniques en réduisant leur surface physique de 81 %, ou gérer une boutique en ligne simulée pendant un an en multipliant son capital par 4,16.