Thèse 2
Les objections
Les agents ratent la plupart des tâches du banc de 2025
Un collègue à qui l'on confie une tâche doit la réussir la plupart du temps. Or le banc d'essai TheAgentCompany, conçu à Carnegie Mellon, simule une petite entreprise de logiciel avec des collègues fictifs, des messageries et des tâches de gestion de projet, de finance ou de développement. Le meilleur système testé, Gemini 2.5 Pro avec OpenHands, réussit complètement 30,3 % des 175 tâches S6. Environ sept tâches sur dix restent incomplètes. C'est un fait mesuré au printemps 2025, sans comparaison mesurée avec des salariés ni preuve du taux actuel des agents.
Beaucoup de projets d'agents seront abandonnés
Le cabinet Gartner projette que plus de 40 % des projets d'IA agentique seront annulés d'ici fin 2027 à cause de coûts croissants, d'une valeur incertaine ou de contrôles de risque insuffisants S4. Il dénonce aussi l'« agent washing » : selon lui, seuls environ 130 des milliers de fournisseurs d'agents en seraient réellement S4. Le même cabinet prévoit pourtant qu'au moins 15 % des décisions de travail quotidiennes seront prises de façon autonome par des agents en 2028 S4 : ces projections ne permettent pas de trancher la thèse. Note : le communiqué original de Gartner n'a pas pu être ouvert (accès refusé) ; nous citons une reprise de presse.
Travailler avec l'IA peut ralentir
L'essai randomisé de METR, mené entre février et juin 2025 S14, avec 16 développeurs expérimentés sur 246 tâches, a mesuré que les développeurs autorisés à utiliser l'IA mettaient 19 % de temps en plus S7. Ils s'attendaient pourtant à gagner 24 %, et même après coup pensaient avoir gagné 20 % S7. Leçon pour la thèse : un « collègue » qui produit vite mais qu'il faut relire et corriger peut coûter plus qu'il ne rapporte, et l'impression de gain trompe. Limite : petit échantillon, experts sur leur propre code, sans extrapolation aux juniors. En février 2026, METR juge ses nouvelles données trop biaisées pour mesurer sûrement le gain actuel S14.
Le retour de l'humain chez Klarna
Klarna, souvent citée comme pionnière du service client par IA, a recommencé en mai 2025 à recruter des conseillers humains S9. Selon la presse, ses chatbots étaient moins chers mais donnaient une qualité « inférieure » S9. Le PDG souhaite alors garantir un interlocuteur humain S9. Cette déclaration n'est pas un audit des cas complexes.
L'adoption reste minoritaire en Europe
En France, 82 % des entreprises du champ Insee n'utilisaient pas l'IA en 2025 : complément calculé de 18 %, pour les secteurs principalement marchands hors agriculture, finance et assurance, à partir de 10 salariés S8. L'enquête Microsoft ne mesure pas séparément l'arrivée d'agents chez les juniors français S1.
Les limites des preuves favorables
Plusieurs sources favorables viennent d'entreprises qui vendent des agents : Microsoft S1, Anthropic S2 S3, Salesforce S13. Les chiffres de Salesforce sont une déclaration de PDG, non vérifiée. L'expérience P&G S5 porte sur une journée d'idéation, sans mesurer des équipes d'agents autonomes. Enfin, la plupart des données sont américaines ; les mesures françaises disponibles S8 S11 portent sur l'usage d'IA en général, pas sur des agents travaillant en équipe.