// FUTURA SCIENCES — SPAZIO & SCIENZA
Ils ont laissé des IA faire tourner une entreprise, le résultat est bien pire que prévu
L’intelligence artificielle pourrait-elle bientôt avoir son mot à dire dans la gestion des entreprises ? Mark Zuckerberg tente de créer une IA capable de faire son travail à sa place, tout en préparant un plan de licenciement massif.... Lire la suite
L'avènement de l'intelligence artificielle a bouleversé le monde du travail et démontré la possibilité d'automatiser des séries de tâches complexes en utilisant ChatGPT comme base. Découvrez ici quelques exemples de missions pouvant être confiées à ces agents d'IA...... Lire la suite
Des chercheurs ont créé une fausse entreprise peuplée d’agents d’intelligence artificielle afin de voir s’ils étaient capables de remplacer les employés. Les résultats devraient rassurer ceux qui s’inquiètent de perdre leur travail face à l’IA.
L'intelligence artificielle est-elle sur le point de nous voler notre travail à tous ? Certaines boîtes n'hésitent pas à parier dessus, tandis que d'autres ne veulent rien savoir, la jugeant incapable. Mais qu'en est-il vraiment ? Dans un article en prépublication sur Arxiv, des chercheurs de l'université Carnegie Mellon ont simulé une entreprise et engagé des agents d'intelligence artificielle pour la faire tourner. Et le résultat était loin d'être positif.
Les employés virtuels étaient des agents basés sur Claude d'Anthropic, GPT-4o d'OpenAI, Google Gemini, Amazon Nova, Meta Llama, et Qwen d'Alibaba.
L’intelligence artificielle pourrait-elle bientôt avoir son mot à dire dans la gestion des entreprises ? Mark Zuckerberg tente de créer une IA capable de faire son travail à sa place, tout en préparant un plan de licenciement massif.... Lire la suite
Ils se sont vu attribuer différents postes, comme analyste financier, chef de projet ou encore ingénieur logiciel. En même temps, les chercheurs ont utilisé une autre plateforme pour simuler des collègues qu'ils devaient contacter pour certaines tâches, comme un département des relations humaines.
Les agents ont reçu différentes tâches, comme naviguer parmi différents fichiers pour analyser une base de données, ou encore effectuer plusieurs visites virtuelles pour choisir de nouveaux locaux.
Claude 3.5 Sonnet a fini largement en tête, mais cet agent n'a réussi à terminer que 24 % des tâches. Même en prenant en compte les tâches partiellement complétées, son score n'arrive qu'à 34,4 %.
Gemini 2.0 Flash se trouve en seconde position, mais n'est parvenu à compléter que 11,4 % des tâches. Aucun autre agent n'a dépassé 10 %. Toutefois, en matière de coût de fonctionnement, Claude 3.5 Sonnet a coûté 6,34 dollars, contre seulement 0,79 dollar pour Gemini 2.0 Flash.