- Speaker #0
Bienvenue dans ce nouvel épisode des signaux du changement. Les entreprises n'ont jamais autant investi dans l'intelligence artificielle, et les retours démontrés restent introuvables. Alors la question de cet épisode se pose à la racine. Peut-on mesurer le retour du NIA sans mesurer le travail réel ? Deux analystes passent trois idées reçues au peigne fin. Le ressenti des équipes, la réduction des effectifs, les tables de bord. Bonne écoute !
- Speaker #1
Imaginez l'organisation multinationale classique. Les budgets viennent d'être votés, les serveurs tournent à plein régime, les licences logicielles sont déployées partout et le conseil d'administration applaudit cette vision très moderne. L'investissement dans l'intelligence artificielle est massif.
- Speaker #2
Oui, l'enthousiasme général.
- Speaker #1
Voilà. Mais quelques trimestres plus tard, la direction financière ouvre ses registres pour chercher la trace concrète, le retour mesurable. de cet investissement.
- Speaker #2
Absolument rien.
- Speaker #1
C'est ça, le vide total. Ce qui nous amène directement à notre question centrale pour cette exploration. Est-ce qu'on peut vraiment mesurer le retour du NIA sans mesurer le travail réel ?
- Speaker #2
C'est vraiment la question de fonds qui hante les couloirs des directions générales en ce moment. Et cette scène du registre financier vide qu'on vient de décrire, ce n'est pas une exception. C'est même devenu la norme.
- Speaker #1
Le paradoxe est assez net. en observe une pression importante sur les organisations pour adopter ces capacités autonomes, par peur de rater le virage technologique.
- Speaker #2
Exactement.
- Speaker #1
Donc on valide des dépenses conséquentes en infrastructures, en formation. L'effort financier crève le plafond, mais les résultats tangibles sur le compte de résultats restent introuvables. Le décalage est disant très profond.
- Speaker #2
C'est une situation d'une gravité inédite. Quand on regarde les données institutionnelles qui documentent ça, la RAND par exemple. à analyser la trajectoire de ces initiatives.
- Speaker #1
Et le constat est sévère, non ?
- Speaker #2
Il est sans appel. La grande majorité de ces projets échouent. Et ce qui doit alerter les dirigeants, c'est que la fréquence de ces échecs dépasse largement tout ce que l'industrie a connu avec les projets informatiques classiques.
- Speaker #1
D'accord, on n'est pas juste sur de la friction d'adoption habituelle.
- Speaker #2
Non, pas du tout. Déployer un logiciel traditionnel, ça coince toujours un peu au début, certes. Mais là, les projets s'enlisent ou s'effondrent à un rythme assez alarmant.
- Speaker #1
Ce qui rejoint, je crois, la récente étude préliminaire du MIT. Même si elle fait l'objet de débats, son observation centrale reste incontournable. Les pilotes expérimentaux réussissent bien en laboratoire, mais presque aucun ne survit au passage à l'échelle.
- Speaker #2
Tout à fait. En environnement contrôlé, sur des données parfaitement nettoyées, la technologie brille. Mais dès qu'on essaie d'intégrer ce pilote dans le désordre de la réalité opérationnelle, le retour sur investissement s'évapore.
- Speaker #1
Et la conséquence directe, on la voit sur le terrain, c'est l'abandon pur et simple. Les organisations débranchent massivement leurs expérimentations en cours de route. La direction finit par couper les vivres pour limiter la casse.
- Speaker #2
Ce qui nous amène vraiment au cœur de notre échange. Pourquoi les directions se retrouvent systématiquement dans cette impasse ? La faille n'est pas forcément dans la technologie elle-même.
- Speaker #1
Elle est dans la manière de l'évaluer.
- Speaker #2
Exactement. Les organisations pilotent ces transformations avec des outils inadaptés.
- Speaker #1
Alors, explorons justement ces instruments classiques. Traditionnellement, les directions s'appuient sur le ressenti des équipes. sur l'évolution de la masse salariale et sur les tableaux de bord numériques. Analysons pourquoi ces instruments renvoient une image déformée de la réalité, en commençant par l'objection du ressenti. Si les projets échouent, pourquoi les équipes interrogées en interne affirment souvent se sentir plus productives avec ces nouveaux outils ?
- Speaker #2
C'est une illusion d'optique redoutable. L'outil génère du contenu de manière extrêmement fluide et ça, ça masque complètement l'effort global requis pour finaliser une tâche.
- Speaker #1
J'aime beaucoup utiliser une analogie pour ce phénomène. Se fier au ressenti des équipes pour mesurer l'IA, c'est un peu comme conduire un véhicule sans regarder le compteur de vitesse.
- Speaker #2
Ouais, on se fie en juste à l'accélération.
- Speaker #1
C'est ça, l'outil génère un texte ou du code instantanément. La personne devant son écran ressent une forte accélération parce que la page se remplit sans effort de framp. Mais cette impression de vélocité, ça ne dit absolument rien de la justesse de la direction prise.
- Speaker #2
L'essai contrôlé du laboratoire MITR vient... objectiver cette sensation de manière assez implacable. Ils ont mesuré ça avec une précision clinique.
- Speaker #1
Dans quel contexte exactement ?
- Speaker #2
Le contexte est crucial, ouais. L'étude portait sur des développeurs travaillant sur des projets open source, c'est-à-dire des professionnels très expérimentés manipulant leurs propres codes avec des outils génératifs récents.
- Speaker #1
Attends, je t'arrête sur ce point. Ce sont des experts techniques de haut niveau sur un environnement qu'ils maîtrisent parfaitement. S'ils utilisent un outil pour accélérer, leur ressenti devrait être fiable, non ?
- Speaker #2
C'est là que le... Le constat devient fascinant. Chronomètre en main, sous observation stricte, ces développeurs étaient environ 20% plus lents lorsqu'ils utilisaient l'intelligence artificielle.
- Speaker #1
20% plus lents, d'accord.
- Speaker #2
Mais... Et c'est la donnée fondamentale. Quand on les interrogeait sur leur propre perception, ils se croyaient 20% plus rapides.
- Speaker #1
Ah oui, le décalage entre la réalité chronométrée et la perception psychologique est absolu. Mais comment le cerveau humain peut-il se tromper à ce point ?
- Speaker #2
Tout s'explique par le changement de la nature de la charge cognitive. Le cerveau enregistre avec grand soulagement la fin de l'effort de création initiale. Le syndrome de la page blanche disparaît, tu vois.
- Speaker #1
L'effort musculaire ou intellectuel de départ n'est plus là.
- Speaker #2
Voilà. Sauf que l'effort ne s'évapore pas, il se déplace. Ce qui était de la production active devient de la supervision passive. Le développeur doit débuguer, comprendre une logique générée par une machine. Et l'esprit humain est très mal équipé pour évaluer le temps passé à chercher des erreurs dans un raisonnement qu'il n'a pas lui-même construit.
- Speaker #1
Je comprends mieux. Quand on rédige soi-même, on sent le temps passé. Mais lire un texte ou un code qui semble correct à première vue, ça plonge le cerveau dans un état d'attention un peu flottante. On perd la notion du temps.
- Speaker #2
C'est exactement le mécanisme. La relecture critique fatigue le jugement de manière insidieuse. L'outil supprime la friction de la création, mais introduit une friction importante dans l'intégration et la validation.
- Speaker #1
On pourrait quand même soulever une limite méthodologique sur l'étude Métitre. Elle cible des ingénieurs logiciels, un profil ou une simple virgule mal placée ruine tout le système. Est-ce que ce constat s'applique à d'autres professions ?
- Speaker #2
La nature du travail varie, c'est sûr, mais la leçon de fond reste universelle. Quand on observe un analyse financier, un juriste ou un marketer, la perception humaine échoue à mesurer le vrai travail.
- Speaker #1
Le confort de l'interface soulage l'anxiété en fait.
- Speaker #2
Exactement. Le ressenti mesure un soulagement psychologique, absolument pas une performance de production.
- Speaker #0
Ce qu'on vient d'entendre tient en une phrase. Quand on demande aux équipes s'il y a les rangs plus productives, leurs réponses mesurent leur confort, pas leur production. Le chronomètre, lui, dit souvent l'inverse. Deuxième idée reçue, celle des directions financières. Si l'intelligence artificielle remplace des postes, l'économie réalisée serait le retour sur investissement. Voyons ce que les enquêtes en disent.
- Speaker #1
Fermons donc la porte du ressenti subjectif, mais mettons-nous un instant à la place d'une direction financière. L'objection mécanique tombe souvent si l'organisation coupe des postes, parce que l'IA absorbe des tâches. Ça crée un retour sur investissement. Les dépenses diminuent, le profit augmente.
- Speaker #2
Difficile à attaquer en théorie, oui.
- Speaker #1
C'est très intuitif sur un tableau Excel.
- Speaker #2
Sauf que c'est systématiquement démenti par le terrain. Les enquêtes auprès des décideurs déconstruisent cette équation simpliste. Regardons l'enquête Gartner, qui a interrogé des dirigeants mondiaux au sein de très grandes entreprises.
- Speaker #1
Celles qui pilotent des capacités autonomes, c'est bien ça ?
- Speaker #2
Tout à fait. Et le mouvement de réduction des coûts est bien là. 8 organisations sur 10 ont effectivement réduit leurs effectifs en lien avec ces déploiements technologiques.
- Speaker #1
La réduction des effectifs est donc une réalité brute. Pourquoi Gartner affirme que cette stratégie ne fonctionne pas alors que l'argent est économisé ?
- Speaker #2
Parce que couper un budget, ce n'est pas synonyme de création de valeur. L'analyste de Gartner souligne une distinction capitale. Réduire les effectifs crée de la marge budgétaire, pas du retour sur investissement. Ces réductions de personnel ne sont absolument pas corrélées à un retour sur investissement élevé.
- Speaker #1
Il faut creuser ça, c'est très contre-intuitif. Supprimer des postes allège les dépenses opérationnelles, donc le bilan s'améliore à court terme.
- Speaker #2
À très court terme, oui. Mais le véritable retour exige qu'un capital déployé génère une capacité globale de production supérieure. L'organisation doit faire plus ou faire mieux durablement. Or, on vient de voir que l'outil exige un travail très lourd de supervision. Si l'organisation supprime des postes, cette charge de correction retombe sur qui ? Sur les collaborateurs restants.
- Speaker #1
Ah, le piège se referme. Les employés qui restent font leur part. C'est ça.
- Speaker #2
L'organisation ne gagne aucune capacité supplémentaire, elle épuise juste ses équipes.
- Speaker #1
Donc la réduction aveugle des effectifs détruit la capacité de production réelle. Mais les organisations qui sortent gagnantes, elles font quoi ?
- Speaker #2
Le constat paradoxal de Gartner, c'est que les gagnants ne soustraient pas de la main-d'œuvre. Ils investissent dans les personnes.
- Speaker #1
D'accord.
- Speaker #2
Ils réallouent le temps gagné pour élever le niveau d'exigence. Traiter des problèmes plus complexes, c'est cette montée en compétences qui justifie l'investissement initial.
- Speaker #1
L'objection financière est donc écartée. Mais si je suis un dirigeant qui cherche des certitudes, il me reste la mesure technique, les tableaux de bord, la télémétrie. On analyse les connexions, les requêtes au serveur.
- Speaker #2
L'attrait de la télémétrie est très puissant. Ça offre une illusion de contrôle. Les graphiques sont rassurants, mais il y a un angle mort majeur.
- Speaker #1
Lequel ?
- Speaker #2
La télémétrie capte l'exécution technique de la machine, mais elle est totalement avable au temps de vérification humaine qui suit. L'enquête Adaptavist documente ça clairement.
- Speaker #1
Auprès de qui ?
- Speaker #2
Une vaste cohorte de travailleurs du savoir en Europe et en Amérique du Nord. Et ça révèle l'ampleur du travail invisible. Plus de 4 sur 10 passent par l'enquête. plus de temps à vérifier ce que produit l'intelligence artificielle qu'il n'en gagne lors de la création.
- Speaker #1
Plus de temps à vérifier qu'à créer. Prenons un scénario du quotidien pour ancrer ça. Imagine la rédaction d'un cahier des charges complexe. L'outil génère un brouillon structuré, instantanément. Du point de vue de la direction, le voyant de productivité clignote au vert. L'opération est un succès technique.
- Speaker #2
Mais sur le terrain, le vrai travail commence à peine. Il faut reprendre tout le document. Chasser les hallucinations de la machine, s'assurer de la cohérence logique, il faut adapter la tonalité au standard de l'entreprise.
- Speaker #1
Et vérifier les enjeux de confidentialité aussi.
- Speaker #2
Exactement, s'assurer qu'aucune information stratégique n'a été exposée ou mal interprétée.
- Speaker #1
Et tout ce temps passé à réparer la sortie générée, ça échappe aux métriques officielles. Le système compte la matière première produite, mais ignore l'effort d'usinage. Sans parler de l'informatique fantôme, le Shadow IT.
- Speaker #2
Ah oui, l'informatique fantôme fausse encore plus la mesure. Une part importante des usages réels se déroule hors des clous.
- Speaker #1
Sur des navigateurs personnels, des outils grand public.
- Speaker #2
Ouais, pour contourner les lenteurs des systèmes internes. Donc les tableaux de bord ne voient même pas une grande partie de l'usage réel.
- Speaker #1
Si on combine l'angle mort de la réparation et l'invisibilité de l'informatique fantôme, le temps passé à rendre une information exploitable annule purement et simplement le temps gagné à la produire.
- Speaker #2
C'est l'échec fondamental de la télémétrie pure. C'est comme mesurer parfaitement la vitesse de rotation du moteur Tout en ignorant si les roues patinent dans le vide.
- Speaker #0
Les trois premiers instruments viennent de montrer leurs limites. Il en reste un à examiner, le plus délicat. Mesurer le travail lui-même, directement. Délicat parce que la frontière est fine entre mesurer ce que les équipes font et surveiller les personnes qui le font. Toute la dernière partie tient dans cette différence.
- Speaker #1
Faisons le point sur le chemin parcouru. Les instruments classiques sont inopérants. Le ressentiment, la réduction des effectifs confond marge budgétaire éphémère et vrai retour. Et la télémétrie ignore la réparation humaine. La question revient donc, comment mesure-t-on le vrai travail ?
- Speaker #2
Il faut comparer de manière critique les grandes approches disponibles, observer ce qu'elles voient et surtout ce qu'elles ratent. D'abord, l'observation directe.
- Speaker #1
L'étude des temps et des clics, sa cartographie, l'activité physique.
- Speaker #2
Oui, mais ça rate l'intégralité de la cherche cognitive. Observer un analyste fixer un écran ne dit rien de la complexité du problème qu'il résout.
- Speaker #1
Ensuite, on a l'exploration des processus virtuels, le process mining.
- Speaker #2
Qui aspire les traces numériques dans les logiciels métiers. Le système voit l'ouverture du dossier, la transmission, la clôture.
- Speaker #1
Je ne suis pas certaine de l'efficacité de ça, ça me fait penser au suivi d'un colis postal.
- Speaker #2
Comment ça ?
- Speaker #1
Ben, le système t'indique quand le colis quitte l'entrepôt et quand il est livré. Sur l'écran, c'est parfait, mais ça ignore totalement... que le livreur a dû appeler le client à plusieurs reprises, contourner une barrière, négocier avec un voisin sous la pluie. L'exploration des processus reconstruit une version ibéalisée. Elle ignore les micro-adaptations humaines réelles.
- Speaker #2
C'est une analogie redoutablement précise. C'est exactement son angle mort. Reste alors l'ultime approche, la télémétrie comportementale avancée. Capture d'écran automatisé, analyse du clavier, surveillance de la fenêtre active.
- Speaker #1
L'approche qui ambitionne de tout voir.
- Speaker #2
Et c'est justement sa faille mortelle. En voulant scruter chaque micro-comportement, la mesure glisse irrémédiablement vers la surveillance généralisée des personnes.
- Speaker #1
Ce qui s'auto-détruit en fait. Dès qu'un comportement humain se sait surveillé par un algorithme, il se modifie pour satisfaire à l'indicateur.
- Speaker #2
Les collaborateurs vont simuler de l'activité, générer des mouvements de souris, juste pour garder la jauge dans le verre. La pression détruit la validité de l'information. Le thermomètre fausse la température.
- Speaker #1
Alors si l'observation est aveugle au mental, Si l'exploration des processus vit dans le déni, et si la surveillance détruit l'authenticité, quelle est la voie alternative ?
- Speaker #2
Le changement de paradigme, c'est d'arrêter de traquer la machine ou d'espionner le comportement, et d'écouter directement la source de la friction. Un principe d'écoute basé sur les collaborateurs eux-mêmes.
- Speaker #1
Leur demander ce que pèse réellement leur tâche.
- Speaker #2
Voilà. Interroger la lourdeur des processus, l'effort d'intégration, la difficulté à superviser les erreurs. Reconnaître que la connaissance intime de la réalité opérationnelle réside chez la personne qui exécute la tâche.
- Speaker #1
La démarche est logique, mais soyons pragmatiques. Poser des questions, c'est pas nouveau et personne n'a envie de critiquer ouvertement l'investissement phare du conseil d'administration.
- Speaker #2
Non, bien sûr.
- Speaker #1
Donc l'écoute ne peut fonctionner qu'à une condition technique inflexible. L'anonymat ne doit en aucun cas reposer sur une simple promesse managériale ou une charte.
- Speaker #2
C'est vital. Si le système repose sur la courbe, confiance envers la hiérarchie pour ne pas regarder qui a dit quoi, c'est un échec garanti. L'anonymat doit être garanti par conception.
- Speaker #1
Par conception ou par l'architecture même du système de collecte. La rupture entre l'identité et le retour d'expérience doit être ancrée dans la structure technique.
- Speaker #2
Exactement. Si l'anonymat n'est pas assuré par l'architecture, on bascule dans les travers de la surveillance. Les collaborateurs vont lisser leur retour pour ne froisser personne, la friction redeviendra invisible, L'organisation perdra sa boussole. C'est un prérequis absolu pour une donnée juste.
- Speaker #1
Nous arrivons au terme de notre analyse. Les dirigeants qui nous écoutent et s'interrogent sur leurs investissements doivent tirer une conclusion de ces constats. Un retour calculé sans mesurer le travail brut tel qu'il est vécu sur le terrain ne mesure en fait qu'une dépense. L'organisation empile les coûts de licence, les frais d'infrastructure, mais elle gère uniquement son budget, elle ne pilote absolument pas sa capacité de production.
- Speaker #2
Cette conclusion impose vraiment un changement de posture profond. Il y a des exigences fondamentales pour piloter ces transformations. D'abord, cibler impérativement les tâches et s'interdire de mesurer les personnes.
- Speaker #1
Mesurer l'humain déclenche l'autodéfense et la dissimulation.
- Speaker #2
Tout à fait, ça instaille une compétition toxique. Mesurer la tâche permet d'isoler objectivement les processus cassés et le temps gaspillé à corriger les machines. L'objectif, c'est d'optimiser le système, pas d'évaluer l'individu.
- Speaker #1
L'autre exigence concerne les instruments choisis par les organisations. Il faut sélectionner des approches qui préservent le contrat de confiance avec les équipes.
- Speaker #2
C'est systémique. Un instrument qui érode la confiance faussera inéluctablement la réalité qu'il tente de capter. La donnée devient artificielle juste là pour assurer le management intermédiaire.
- Speaker #1
Et la boucle de l'échec technologique s'auto-alimente indéfiniment.
- Speaker #2
Au final, cette exploration des rouages de la productivité soulève une question beaucoup plus large. Une question un peu philosophique qui dépasse l'évaluation des budgets pour toucher aux fondations de l'entreprise moderne. Qui décide de ce qu'une organisation a le droit de mesurer ?
- Speaker #0
Les signaux du changement est un podcast de Spentia. Mesurer ce que pèsent les tâches et ce à quoi les équipes tiennent, sans jamais mesurer les personnes, c'est notre travail auprès des directions, avec une méthode d'écoute anonyme, par conception. Le lien est dans les notes de l'épisode. Si cette analyse vous a été utile, elle se partage bien avec un dirigeant qui calcule un retour sur investissement en ce moment. A bientôt pour un prochain signal.