• 22 Juin 2026 - 7:20 PM

Soutenez Bonjour

Soutien Journalisme indépendant

Accessible à tous, financé par les lecteurs

Soutenez-nous

1 500 tâches mettent l'IA avancée à l'épreuve : l'écart entre promesses et réalité se creuse


Par Joe Wilkins .Publié le 2026/07/22 19:21
1 500 tâches mettent l'IA avancée à l'épreuve : l'écart entre promesses et réalité se creuse
Juin. 22, 2026
  1. 0
  2. 4

Malgré des investissements mondiaux dépassant désormais les 1 600 milliards de dollars dans les technologies d'intelligence artificielle, l'écosystème économique reste partagé entre enthousiasme, scepticisme et prudence. Une étude récente menée par le Center for Responsible, Decentralized Intelligence de l'Université de Californie à Berkeley met en évidence un fossé important entre les promesses commerciales des géants de la technologie et les performances réelles de ces outils dans les environnements professionnels.

Un test grandeur nature de l'aptitude au travail


Les chercheurs ont élaboré un protocole d'évaluation rigoureux baptisé Agents' Last Exam (ALE) afin de mesurer la capacité des modèles d'intelligence artificielle les plus avancés à accomplir des tâches jusqu'ici réalisées par des humains.

L'évaluation comprend plus de 1 500 tâches complexes réparties sur 55 professions, couvrant des domaines variés allant du génie logiciel et du design graphique à des secteurs spécialisés comme l'ingénierie maritime, l'agriculture, la production audio ou encore la gestion de la santé publique.

L'étude a porté sur plusieurs modèles d'IA avancés, notamment :

GPT-5.5 d'OpenAI
Gemini 3.1 Pro de Google
Fable 5 d'Anthropic
Composer 2.5 de Cursor


Des performances encore éloignées des attentes et des coûts parfois élevés

Les résultats montrent que ces systèmes, malgré leurs progrès rapides, rencontrent encore d'importantes difficultés lorsqu'ils sont confrontés aux exigences concrètes du monde professionnel.

Le modèle GPT-5.5 arrive en tête de l'évaluation avec un taux de réussite global ne dépassant pas 24 %.

Le rapport souligne que les agents d'intelligence artificielle actuels peuvent accomplir certaines tâches limitées et clairement définies, mais qu'ils rencontrent davantage de difficultés face à des missions nécessitant un raisonnement prolongé, une expertise approfondie d'un secteur ou une capacité d'exécution fiable sur la durée.

Dans les catégories les plus difficiles de l'évaluation, l'ensemble des modèles testés n'a obtenu aucun résultat positif.

Au-delà des limites techniques, l'étude met également en lumière les défis économiques liés au déploiement massif de ces technologies. Le modèle Fable 5, par exemple, présente des performances comparables à celles de GPT-5.5 et Composer 2.5, tout en affichant un coût par tâche réalisée quatre à douze fois supérieur.

Une transformation progressive du marché de l'emploi

Malgré ces limites actuelles, les chercheurs estiment que l'impact de l'intelligence artificielle sur le monde du travail sera difficile à éviter.

La professeure Dawn Song, chercheuse en informatique à Berkeley et coauteure de l'étude, explique que la vulnérabilité des emplois ne dépend pas uniquement du secteur d'activité, mais surtout de la nature des tâches effectuées.

Selon elle, les métiers reposant sur des procédures répétitives, standardisées et facilement définissables seront les premiers concernés par ces transformations. À l'inverse, les fonctions impliquant une prise de décision complexe, un jugement humain, de la créativité ou des arbitrages stratégiques devraient conserver une plus grande résistance face à l'automatisation.

Ainsi, l'étude ne marque pas la fin de la révolution de l'intelligence artificielle, mais souligne plutôt un changement de perspective : les capacités spectaculaires démontrées par les modèles d'IA doivent désormais être confrontées aux contraintes du monde réel.

Notez ce sujet



sport

Référendum

Les principaux obstacles auxquels sont confrontés les immigrants

  1. 83%
  2. 16%
  3. 0%

6 Votes

DESSUS