- Speaker #0
Bienvenue dans ce nouvel épisode des signaux du changement. Avant le débat, voici l'essentiel en 3 minutes. Tout le monde vous vend des agents. Avant d'en acheter un, une question. Qu'est-ce qui tourne vraiment ? Trois choses portent le même nom. Un assistant qui propose et vous laisse faire. Un automate qui exécute un flux fixé d'avance et qu'on a rebaptisé. Un agent... qui enchaîne des étapes et agit tout seul. Il crée, il envoie, il modifie, il paie. Ce qui a été mesuré, ce sont les deux premiers. À France Travail, la Cour des comptes a examiné 10 ans d'intelligence artificielle. Sur 87 cas d'usage, 27 tournent et 17 ont été abandonnés. Et le chatbot, qui devait rapporter près de la moitié des gains, n'a rien rapporté. Les gains sont venus d'outils qui n'étaient pas prévus. Bornés, invisibles, efficaces. Ce qui est autonome, personne ne l'a mesuré. La seule expérience rigoureuse sur des outils qui agissent, 16 développeurs expérimentés, avec l'IA, ont mis 19% de temps en plus. Ils se croyaient 20% plus rapides. Et les incidents existent. Une base de production effacée par un agent. Des clients résiliés sur une politique inventée par un autre. Et des milliers de décisions de justice où une partie a produit des contenus inventés par une IA, le plus souvent des références. Depuis le 2 août, la loi européenne vous demande deux choses. Soutenir la maîtrise de l'IA de vos équipes et annoncer la machine. Pour les usages sensibles, recrutement, crédit, usagers, la supervision et la traçabilité deviennent obligatoires fin 2027. Le report ne change pas la question. Trois gestes. 1. Exiger la définition. Pour chaque agent qu'on vous propose, demandez ce qu'il fait tout seul, action par action, et ce qui passe par un humain. Si la réponse est floue, ce n'est pas un agent, c'est une démonstration. 2. Écrivez sa fiche de poste, en 5 lignes. Ce qu'il a le droit de faire seul, à quoi il accède, qui en répond, une personne, pas un service, comment on l'arrête et ce qu'on garde en mémoire, comment on le mesure, un indicateur fixé avant et si possible, une équipe qui ne l'a pas. 3. Classez le risque. Si l'agent touche au recrutement, au crédit, à des usagers, à la sécurité, ces cinq lignes seront la loi en décembre 2027. Commencez par là. Le débat qui suit reprend ses points avec les études, les cas d'entreprise et les objections. Bonne écoute.
- Speaker #1
Tout le monde vend des agents d'intelligence artificielle aujourd'hui. Mais qu'est-ce qui tourne vraiment ? Et comment le savoir ?
- Speaker #2
Ouais, c'est toute la question.
- Speaker #1
D'un côté, on nous dit que ces agents transforment le travail grâce à un cadre précis. Mais de l'autre... on découvre que les preuves de leur autonomie sont introuvables.
- Speaker #2
C'est ça.
- Speaker #1
Ok, décortiquons tout ça. Commençons par clarifier le vocabulaire. Le mot agent semble cacher plusieurs réalités aujourd'hui.
- Speaker #2
Tout à fait. Il y a trois choses bien distinctes qui portent le nom d'agent aujourd'hui. Premièrement, on a l'assistant. Lui, il propose une action, mais il laisse l'humain faire.
- Speaker #1
D'accord, donc une suggestion.
- Speaker #2
Ouais. Deuxièmement, il y a l'automate à règles. Ça, c'est un système qui exécute un flux fixé d'avance. Il est simplement rebaptisé pour faire moderne. Et enfin, on a le véritable agent autonome.
- Speaker #1
Celui qui agit seul.
- Speaker #2
C'est ça. L'agent autonome, lui, enchaîne seul des étapes sur des systèmes. Il crée, il modifie ou il paie, avec une autonomie définie au départ.
- Speaker #1
Je vois. Pour prendre une image concrète, c'est un peu comme dans un restaurant. L'assistant, c'est celui qui vous suggère la recette. L'automate fait toujours cuire les mêmes frites de la même façon selon un programme. Mais l'agent autonome, lui, il fait les courses, il cuisine le plat et il encaisse le client tout seul.
- Speaker #2
L'analogie fonctionne bien, oui. Et là où il y a un aveuglement, c'est que les statistiques publiques ne font aucune différence.
- Speaker #1
Comment ça ?
- Speaker #2
Quand on dit qu'environ une entreprise française sur cinq utilise l'intelligence artificielle, on compte une technologie globale. On ne compte pas un véritable agent autonome. Et c'est la même chose sur le plan légal. Le règlement européen sur l'intelligence artificielle ne connaît même pas le mot agent.
- Speaker #1
Attendez, le mot n'y est pas du tout.
- Speaker #2
Non, pas du tout. Le règlement classe les outils par le risque de l'usage, pas par l'étiquette technique.
- Speaker #1
D'accord.
- Speaker #2
Il y a des règles qui s'appliquent déjà d'ailleurs. Depuis le 2 août, il y a une obligation de soutenir la maîtrise de l'intelligence artificielle du personnel.
- Speaker #1
Ouais.
- Speaker #2
Et aussi d'annoncer la machine quand on l'utilise. Ensuite, pour ce qui concerne les usages à haut risque.
- Speaker #1
C'est-à-dire ?
- Speaker #2
Le recrutement, ce genre de choses.
- Speaker #1
Oui, le recrutement, la sécurité, le crédit ou les services publics. Pour ces usages-là, la supervision humaine, la journalisation des actions et la déclaration d'incidents vont s'imposer fin 2027 pour les usages sensibles et mi-2028 pour les produits réglementés.
- Speaker #2
Donc ça prend un peu plus de temps ? Les dates glissent, oui. Mais attention, dire que le règlement européen est reporté est totalement faux. Seules certaines dates glissent dans le temps, mais la qualification demeure.
- Speaker #1
Donc en fait, on fait une fiche de poste pour une machine sans même nommer le poste légalement ?
- Speaker #2
Exactement. Le droit s'intéresse à ce qui se passe sur le terrain.
- Speaker #0
Retenons une chose de cette première partie du débat. Trois systèmes portent le même nom. L'assistant propose et vous faites. L'automate exécute un flux fixé d'avance. L'agent agit seul. Quand on vous dit agent, demandez lequel des trois. Et retenons que la loi ne connaît pas ce mot. Elle regarde ce que le système fait, à qui et avec quels risques. Depuis le 2 août, deux obligations valent pour tout le monde. Les autres viendront, pour les usages sensibles, fin 2027. La deuxième partie du débat regarde ce qui a été mesuré, pas ce qu'on vous a montré en démonstration, ce qu'une autorité indépendante ou une expérience contrôlée a compté.
- Speaker #1
D'accord, alors regardons ce qui a été mesuré concrètement sur le terrain. Je prends le cas de la Cour des comptes sur les 10 ans d'intelligence artificielle à France Travail.
- Speaker #2
Oui, un cas d'étude très documenté.
- Speaker #1
Les chiffres sont clairs. Sur 87 cas d'usage d'intelligence artificielle, 27 tournent à grande échelle et 17 ont été abandonnés. Et le robot conversationnel, qui devait rapporter près de la moitié des gains, il n'a rien rapporté du tout. Pour résumer, sur la masse des projets lancés par ce service public, environ un tiers fonctionne vraiment, un cinquième est jeté et la star annoncée a fait un flop total.
- Speaker #2
C'est le constat. Et ce qu'il faut préciser, c'est que les gains réels sont venus d'outils inattendus.
- Speaker #1
Pas des agents autonomes, donc ?
- Speaker #2
Non, d'outils de tri. Le blocage d'offres illégales, le tri de courriels, ce genre de tâches. Et la moitié des cas d'usage réalisés n'étaient pas prévus au départ.
- Speaker #1
Ah, on a juste en cours de route.
- Speaker #2
Voilà. Le délai pour déployer un cas est passé de 18 à 4 mois. Les gains de temps ont été redéployés, sans suppression de poste. Par contre, les effets sur les conditions de travail, eux, n'ont pas été évalués.
- Speaker #1
Mais après tout, si l'outil fait gagner du temps, peu importe qu'on l'appelle automate ou agent autonome, non ? Le résultat est là.
- Speaker #2
Eh bien, c'est justement là le problème de la mesure. Si on regarde une expérience indépendantes sur des développeurs, le résultat est différent.
- Speaker #1
Qu'est-ce qu'elle montre, cette expérience ?
- Speaker #2
16 développeurs expérimentés ont été évalués sur 246 tâches réelles. Avec les outils d'intelligence artificielle, ils ont pris 19% de temps en plus alors qu'ils se croyaient 20% plus rapides.
- Speaker #1
Attendez, un petit groupe d'experts sur de vrais projets a perdu environ un cinquième de son temps avec l'outil, alors que leur cerveau leur disait qu'il filait à toute vitesse.
- Speaker #2
C'est ça. Et il faut souligner que ces développeurs utilisaient des assistants et des modes agents. Ils n'utilisaient pas des agents autonomes.
- Speaker #1
D'accord, c'était juste de l'assistance.
- Speaker #2
Oui. D'ailleurs, la réplication de cette étude s'est cassée les dents.
- Speaker #1
Pourquoi ?
- Speaker #2
Parce que les développeurs refusent aujourd'hui de travailler sans intelligence artificielle. Ça rend les nouvelles mesures impossibles.
- Speaker #1
On se sent invincible avec la machine, même quand elle nous ralentit. Mais du coup, si des experts sont ralentis par de simples assistants... Qu'est-ce qui se passe quand on laisse un agent agir vraiment seul sur des systèmes SIM ?
- Speaker #2
On arrive sur des incidents documentés. En juillet 2025, un agent de développement a supprimé une base de données de production.
- Speaker #1
Oups !
- Speaker #2
Et en avril 2025, un agent de support client a inventé de toute pièce une politique de connexion. L'entreprise a été forcée de résilier des contrats et de rembourser des clients.
- Speaker #1
Il y a aussi un impact juridique avec ces inventions de la machine. Les décisions de justice où une partie a produit des contenus inventés par une intelligence artificielle, le plus souvent des références, se comptent par milliers. On parle de milliers d'affaires recensées dans une base publique par un chercheur, une base avec une majorité de décisions américaines, où de fausses informations ont été présentées au juge.
- Speaker #2
Oui, les exemples sont nombreux, mais il y a une objection méthodologique majeure qu'il faut formuler ici.
- Speaker #1
Laquelle ?
- Speaker #2
Il n'existe à ce jour aucune mesure indépendante, avec groupe de comparaison, d'un agent autonome en production.
- Speaker #1
Aucune ?
- Speaker #2
Aucune, dans aucun secteur. Ce n'est pas que ça ne marche pas, c'est que ça n'a jamais été rigoureusement mesuré.
- Speaker #1
Mais alors d'où viennent les pourcentages qu'on lit partout ? Ces fameux chiffres de désastre ?
- Speaker #2
Ce sont des chiffres qui circulent, mais qui sont sortis de leur contexte. Le chiffre de 95% des pilotes sans impact, il porte sur l'intelligence artificielle générative en général. Ça vient d'un projet universitaire.
- Speaker #1
Ça ne cible pas les agents autonomes donc ?
- Speaker #2
Non, pas du tout. Les 40% de projets annulés, c'est une prédiction à l'horizon 2027. Et l'affirmation selon laquelle les trois quarts des entreprises retirent des agents, ça vient d'un simple sondage de vendeurs.
- Speaker #1
D'accord.
- Speaker #2
Aucun de ces chiffres n'est un fait scientifique sur les agents autonomes.
- Speaker #0
Gardons ce que nos deux experts viennent d'établir. Ce qui a produit des gains mesurés était borné, piloté et souvent invisible. Un tri de courriel, un filtre d'annonce. Ce qui était vendu comme la pièce maîtresse n'a rien produit. Et ce qui agit seul n'a jamais été mesuré, nulle part, avec un groupe de comparaison. Ce n'est pas la preuve que ça ne marche pas. C'est la preuve qu'on ne sait pas. La dernière partie du débat en tire une méthode. Une fiche de poste pour la machine, en 5 questions, que vous pouvez poser demain matin à n'importe quel fournisseur.
- Speaker #1
Donc, qu'est-ce que ça veut dire au fond, si on ne peut pas mesurer l'autonomie pure ? Comment les entreprises qui réussissent feront-elles ?
- Speaker #2
Une voix défend que la technologie change le travail quand un cadre existe. Et ce cadre, c'est comme une fiche de poste pour la machine. En cinq questions.
- Speaker #1
Quelles sont ces questions ?
- Speaker #2
La première, qu'est-ce que l'agent a le droit de faire seul et qu'est-ce qui exige un humain ?
- Speaker #1
La limite de son action, oui.
- Speaker #2
Deuxièmement, à quelles données et à quel système a-t-il accès ? Troisièmement, qui en répond ? Il faut une personne physique responsable.
- Speaker #1
Pas juste un service abstrait ?
- Speaker #2
Non, une vraie personne. Quatrièmement, comment on l'arrête ? Avec un bouton d'urgence. Et comment on journalise ses actions ?
- Speaker #1
Pour garder une trace.
- Speaker #2
Exactement. Et enfin, cinquièmement, comment on le mesure ? Il faut un indicateur défini avant le lancement et un groupe témoin.
- Speaker #1
Est-ce qu'on a des exemples de ce cadre en pratique ?
- Speaker #2
Oui, le rapport annuel d'une grande compagnie d'assurance le fait. Elle définit quand ces agents s'activent, à quoi ils accèdent, comment les tâches s'enchaînent et où la supervision est requise.
- Speaker #1
D'accord.
- Speaker #2
Bon. Elle annonce des délais sans mesure indépendante, mais le cadre technique est là.
- Speaker #1
Ce qui amène l'idée du droit à l'erreur. Abandonner un cas d'usage, comme France Travail l'a fait pour un projet sur cinq, ce n'est pas un échec en soi. Ils ont coupé des recommandations très génériques que personne ne lisait. C'est la preuve d'un bon pilotage, finalement.
- Speaker #2
C'est ça. Pour récapituler. D'un côté, une voie maintient que les agents transforment les organisations s'ils sont encadrés avec des limites strictes, comme des collaborateurs. De l'autre. On constate que tout ce qui a été mesuré jusqu'ici avec succès relève de l'assistant ou de l'automate. Le véritable agent autonome agissant seul, lui, relève encore du discours commercial. Il n'a jamais été évalué rigoureusement.
- Speaker #1
Le débat n'est pas de savoir si la technologie est magique ou inutile, mais de savoir qui tient les rênes. Quelle action votre agent a-t-il le droit de faire seul aujourd'hui et qui l'a décidé ?
- Speaker #0
Cet épisode vous est proposé par Spentia. Une perspective, pour finir. La fiche de poste d'un agent n'est pas un document technique. C'est un geste de direction. Dire ce qu'une machine a le droit de faire seule dans votre entreprise et qui en répond. Ce geste, personne ne le fera à votre place. Ni le fournisseur, ni le règlement. Et il vaut avant l'achat, pas après l'incident. Les sources sont dans les notes de l'épisode. Si cet épisode vous a été utile, partagez-le. A bientôt pour un prochain signal.