La montée en puissance de l’intelligence artificielle soulève des interrogations fondamentales concernant l’avenir du monde professionnel. Certaines entreprises font confiance à ces technologies, tandis que d’autres se montrent plus sceptiques, les jugeant inadaptées à la réalité du travail. Quelles sont donc les vérités cachées derrière cette innovation ? Une étude récente examine une expérience menée par des chercheurs, qui ont créé une simulation d’entreprise gérée par des agents d’intelligence artificielle.
Dans cette simulation, des systèmes d’IA tels que Claude, GPT-4, Google Gemini, Amazon Nova, Meta Llama et Qwen d’Alibaba ont été intégrés à différents rôles, incluant ceux d’analyste financier, de chef de projet et d’ingénieur logiciel. Parallèlement, une autre plateforme a simulé des interactions avec des collègues fictifs dans le cadre de diverses tâches, comme celles effectuées par un service des ressources humaines.
Les résultats révèlent un important taux d’échec
Les agents ont été confrontés à diverses missions, allant de l’analyse de données à des visites virtuelles pour la sélection de nouveaux bureaux. Claude a obtenu les meilleurs résultats, mais n’a élucidé que 24 % des tâches demandées, et le score global n’atteint que 34,4 %. Gemini a été le deuxième avec un taux de réussite de seulement 11,4 %. Les autres agents n’ont pas surpassé les 10 %. Au niveau des coûts, Claude s’est élevé à 6,34 dollars, tandis que Gemini n’a coûté que 0,79 dollar.
Les chercheurs ont noté que ces agents rencontrent souvent des difficultés à déchiffrer les nuances des instructions. Par exemple, lorsqu’il s’agissait d’enregistrer un fichier en utilisant l’extension « .docx », ils ne faisaient pas le lien avec le format Microsoft Word. Leur manque de compétences sociales les empêche également de se coordonner efficacement. Un défi majeur réside dans leur navigation sur le Web, notamment pour gérer des pop-ups. À certains moments, face à des obstacles, ces agents choisissent des solutions simplistes qui leur donnent l’illusion d’accomplir une tâche alors qu’ils échouent en réalité. Ces résultats montrent que, bien que l’IA puisse briller dans des scénarios ciblés, sa capacité à opérer de manière autonome est encore très limitée.
Points à retenir
- La confiance en l’IA varie entre les entreprises, certaines adoptant des technologies émergentes tandis que d’autres s’y opposent.
- Les agents d’IA ont montré un faible taux d’accomplissement sur les tâches de travail, soulignant des limitations significatives.
- Les défis rencontrés incluent la compréhension des instructions implicites et la navigation sur Internet, évoquant des restrictions sur leur autonomie.
- Les coûts d’opération diffèrent entre les systèmes d’IA, mais cela ne compense pas leur performance au travail.
- Bien que l’IA ait des capacités certaines, son intégration dans des rôles autonomes nécessite des avancées techniques substantielles.
Laisser un commentaire