Guide · Mesure et pilotage
Mesurer le gain d’une automatisation, avant de l’avoir promis.
« ROI de 318 % en six mois. » Ce genre de chiffre circule dans tous les articles sur l’automatisation et ne vous apprend rien : vous ignorez ce qu’il mesure, sur quel flux et contre quelle référence. Ce guide fait l’inverse. Quatre relevés à prendre avant de toucher au processus, puis la même règle appliquée après.
Demander un diagnostic
Ce que ce guide établit
- 01
La mesure précède l’outil
Quatre relevés sur une période représentative, pris avant la moindre configuration.
- 02
Le temps actif n’est pas le délai
Une tâche de dix minutes peut attendre trois jours. Les deux gains n’ont pas la même valeur.
- 03
Un pourcentage sans dénominateur ne vaut rien
Trente pour cent de quoi, sur combien de dossiers, mesurés sur quelle période ?
- 04
Le gain doit se voir quelque part
Capacité, délai ou fiabilité. Si aucun des trois ne bouge, il n’y a pas eu de gain.
« On a gagné du temps » n’est pas une mesure.
Réunion de direction, un jeudi. Le dirigeant demande à sa responsable ADV combien de temps prend le traitement des commandes reçues par e-mail. Réponse : « beaucoup ». Personne dans la pièce n’a le chiffre, et personne ne l’a jamais eu. Six mois plus tard, après l’installation d’un outil, la question devient « qu’est-ce qu’on a gagné ? » et la réponse ne change pas de nature. Elle reste une impression.
Cette absence de chiffre coûte plus cher qu’on ne le croit, et elle se mesure. L’Insee relève qu’en 2025, 18 % des entreprises de dix salariés ou plus utilisent au moins une technologie d’intelligence artificielle, soit trois fois plus qu’en 2023. La proportion tombe à 15 % sous cinquante salariés, là où se trouve la majorité des PME du Loiret et d’Indre-et-Loire. Chez celles qui n’y vont pas, le premier frein cité n’est ni le prix ni la technique : 71 % déclarent n’y voir aucune utilité.
Une utilité qu’on n’a jamais mesurée est difficile à percevoir. C’est tout le sujet de ce guide, qui ne propose aucun barème de gains à espérer. Il donne le relevé qui rend votre propre gain vérifiable. Nous appliquons la même règle sur nos pilotes : les indicateurs sont fixés avant, mesurés après sur la même définition, et un résultat décevant est présenté tel quel.
Les quatre relevés à prendre avant de toucher au processus.
Le relevé de départ ne demande aucun outil. Une semaine représentative, un tableur, quatre colonnes. Ce qui le rend difficile n’est pas la technique mais la discipline : il faut le faire avant, quand le sujet n’intéresse encore personne, parce qu’après il est trop tard pour l’inventer.
Choisissez la période avec soin. Une semaine de rentrée et une semaine du 15 août ne décrivent pas la même entreprise. Si votre activité connaît des pics, relevez deux semaines contrastées plutôt qu’une moyenne fabriquée. Notez aussi qui traite les dossiers pendant la période : un flux tenu par la personne qui le connaît depuis dix ans ne ressemble pas au même flux confié à un remplaçant.
Le quatrième relevé est celui qu’on oublie systématiquement, et c’est souvent le plus parlant. Comptez les dossiers repris, corrigés, relancés ou repassés dans le circuit. Une automatisation IA qui traite plus vite en produisant deux fois plus de reprises a dégradé le processus, et seul ce compteur le montre.
Volume
Nombre de dossiers entrés sur la période, avec leur canal d’arrivée et leur type.
Temps actif
Minutes réellement passées sur un dossier, hors attente. Chronométré sur quelques cas, pas estimé de mémoire.
Délai de bout en bout
Écart entre l’arrivée du dossier et sa sortie. C’est souvent lui que le client perçoit.
Reprises
Dossiers corrigés, relancés ou repassés une seconde fois dans le circuit, avec leur motif.
Quatre indicateurs qui tiennent, deux qui mentent.
Le temps actif par dossier est le plus honnête, à condition d’être chronométré sur des cas réels. Le délai se suit en médiane, jamais en moyenne : un seul dossier bloqué quarante jours déplace une moyenne et fait disparaître le comportement habituel du flux. La part de dossiers traités sans reprise dit la fiabilité. La part de dossiers sortis en exception dit ce que le système ne sait pas faire, et c’est l’indicateur qui pilote la suite du projet.
Deux indicateurs très populaires ne mesurent rien d’utile. Le « nombre de clics supprimés » décrit une interface, pas un travail : on supprime dix clics sur une tâche qui durait deux minutes pendant que le dossier attend deux jours une pièce manquante. Le « taux d’automatisation » pris seul est pire, parce qu’il se manipule sans effort. Un flux automatisé à 100 % sur les 3 % de dossiers les plus simples affiche un chiffre magnifique et n’a rien changé.
La règle qui protège de tout ça tient en une question posée à chaque chiffre : trente pour cent de quoi, sur combien de dossiers, mesurés sur quelle période et selon quelle définition ? Un pourcentage sans dénominateur est une opinion présentée en gras.
Le gain brut moins les reprises, et rien d’autre.
Le quatrième relevé de la section précédente n’est pas décoratif : c’est lui qui transforme un gain brut en gain net. La soustraction tient en une ligne. Les heures que le flux vous rend, moins les heures passées à relire, corriger et refaire ce qu’il a produit. Cette seconde colonne manque dans presque tous les calculs de rentabilité, parce qu’elle apparaît après la démonstration et jamais pendant.
L’écart entre ce qu’on croit gagner et ce qu’on gagne a été mesuré proprement, une fois, dans des conditions qui méritent d’être citées. En juillet 2025, l’organisme d’évaluation METR a publié un essai randomisé mené auprès de seize développeurs expérimentés sur deux cent quarante-six tâches réelles, dans des dépôts qu’ils connaissaient depuis plusieurs années. Avant de commencer, ils estimaient que l’assistance IA les ferait gagner 24 % de temps. Après coup, ils déclaraient avoir gagné 20 %. La mesure objective montre qu’ils ont mis 19 % de temps en plus.
Ce résultat se cite avec ses limites, sans quoi il devient le pourcentage de brochure que ce guide combat. Les auteurs écrivent eux-mêmes qu’il ne se généralise pas au-delà du développement logiciel, et METR a ajouté en février 2026 que l’effet est probablement plus favorable aujourd’hui, sans pouvoir le chiffrer faute de données fiables. Ce qui se transpose à votre flux administratif n’est donc pas le chiffre de 19 %, c’est l’écart de trente-neuf points entre le ressenti et la mesure. Une équipe convaincue d’avoir gagné du temps est une information sur son moral, pas sur son processus.
La conséquence pratique est simple et elle coûte une semaine. Comptez les reprises avant, comptez-les après, sur la même définition. Un flux qui traite deux fois plus vite en produisant trois fois plus de corrections a consommé votre gain sans que personne ne s’en aperçoive, parce que la correction est diluée dans la journée de quelqu’un d’autre que celui qui a acheté l’outil.
Heures brutes rendues
Ce que le flux traite désormais sans intervention, mesuré sur des cas réels.
Heures de reprise
Relecture, correction, dossier refait. La colonne qui manque aux business cases.
Gain net
La soustraction des deux. C’est le seul chiffre qui se présente à une direction.
Taux de première passe
Part des dossiers utilisables sans retouche. Il dit si le gain net va tenir.
Le gain qui n’existe que dans le tableur.
Voici le calcul que tout le monde fait : dix minutes économisées sur trois cents dossiers, cela donne cinquante heures libérées. Le chiffre est juste et pourtant il ne se traduit par rien. Étalées sur vingt personnes et quatre mois, ces cinquante heures ne libèrent personne, ne suppriment aucune embauche et n’apparaissent dans aucun compte. Le gain a été calculé, il n’a pas été récolté.
Un gain ne devient réel que s’il prend l’une de trois formes. La capacité : la même équipe absorbe plus de volume sans recruter, ce qui compte dans une région où le recrutement administratif qualifié prend des mois. Le délai : vous répondez en deux heures au lieu de deux jours, et le taux de transformation bouge. La fiabilité : moins d’avoirs, moins de litiges, moins de dossiers rouverts.
Écrivez laquelle des trois vous visez avant de lancer quoi que ce soit. Si aucune ne peut être nommée, l’automatisation n’a pas de destinataire, et le projet produira une démonstration élégante que personne ne réclamera au bout de six mois. C’est la question que nous posons en premier, et elle nous conduit parfois à répondre qu’un meilleur statut dans l’outil existant suffirait.
Faire le calcul avec des prix réels plutôt qu’un ROI de brochure.
Nos prix sont publics, ce qui permet un calcul honnête plutôt qu’un pourcentage. Le premier échange n’est pas facturé. Un pilote démarre à 3 900 € HT et la phase d’autonomie à 1 200 € HT. Ajoutez les abonnements des outils que vous choisissez : Flux45 n’édite aucune plateforme et ne facture aucune licence, donc ces coûts restent à votre nom et vous pouvez les arrêter.
Le reste du calcul se fait avec vos chiffres. Si votre relevé montre 240 dossiers par mois et 9 minutes de temps actif, le flux consomme 36 heures mensuelles. Un pilote qui en retire la moitié rend 18 heures par mois. Reste à décider ce que vous en faites et à quel taux horaire chargé vous les valorisez. Ce montant est le vôtre : nous ne le remplaçons pas par une moyenne de marché, et un cabinet qui vous annonce un pourcentage avant d’avoir vu le flux vous vend une intuition.
N’oubliez pas la colonne des coûts récurrents, celle qui manque dans la plupart des business cases. La CNIL invite à examiner les données, le fournisseur, les coûts et les utilisateurs avant tout déploiement, ce qui inclut la maintenance : une interface qui change chez un éditeur, un droit d’accès qui expire, un cas métier nouveau à intégrer. Une automatisation sans budget d’entretien devient une dette au troisième trimestre.
Le calcul ci-dessous est l’arithmétique de ces trois paragraphes, rien de plus. Il est prérempli avec l’exemple des 240 dossiers ; remplacez les six valeurs par les vôtres. Deux seulement viennent de nous, et ce sont nos prix publics — le taux horaire proposé est un point de départ neutre, pas une moyenne de marché, et le résultat ne vaut que ce que vaut votre relevé.
Calculer le point mort sur vos chiffres
- Temps consommé aujourd’hui
- 36 h par mois
- Heures rendues par le pilote
- 18 h par mois
- Valeur mensuelle nette
- 550 €
- Point mort
- 9,3 mois
Ce résultat n’est un gain que si les heures sont récoltées quelque part : en capacité, en délai ou en fiabilité. Dix-huit heures mensuelles réparties sur douze personnes ne libèrent personne et n’apparaissent dans aucun compte. Cette question se tranche avant le pilote, pas après.
Mesurer après, sans se mentir.
La mesure d’après n’a de valeur que si elle reprend la définition d’avant, sur une durée comparable et sur le même périmètre. Changer d’indicateur en cours de route est la manière la plus courante de fabriquer un succès, et c’est rarement malhonnête : le nouvel indicateur paraît simplement meilleur, parce qu’il est plus favorable.
Trois biais suffisent à ruiner une comparaison. L’effet nouveauté : pendant six semaines, l’équipe soigne les dossiers parce qu’on la regarde. Le tri silencieux : les cas faciles passent dans le nouveau circuit et les cas pénibles restent dans l’ancien, ce qui améliore les deux moyennes sans améliorer le travail. La période non comparable : octobre contre août ne démontre rien.
Si le résultat est mauvais, il doit rester lisible. Les indicateurs sont fixés avant le pilote et mesurés sur la même règle après, donc un résultat décevant se voit. La procédure de retour arrière est écrite avant la mise en route et fait partie du périmètre, pas d’un avenant. Vous conservez dans tous les cas la cartographie, les tests et la documentation.
Une semaine de relevé, dix dossiers, une décision.
Commencez cette semaine, sans nous attendre. Choisissez un flux, ouvrez un tableur, notez les quatre colonnes pour chaque dossier qui passe. Prenez ensuite dix dossiers terminés, dont trois qui ont mal tourné, et suivez-les dans leur ordre réel. Vous saurez à la fin de la semaine si votre problème est un volume, un délai d’attente, une donnée introuvable ou une décision que personne ne veut prendre. Ces quatre diagnostics n’appellent pas la même réponse, et un seul relève d’un agent IA.
C’est aussi ce relevé qui rend une consultation utile. Un intégrateur qui arrive devant des chiffres réels cadre un périmètre en une séance ; devant des impressions, il propose un catalogue. L’Insee note d’ailleurs que plus de la moitié des entreprises utilisatrices d’IA se disent freinées par un manque d’expertise interne, et 54 % des non-utilisatrices citent la même raison. C’est exactement le point où un tiers sert à quelque chose, à condition qu’il travaille sur vos mesures et non sur les siennes.
Flux45 travaille depuis Orléans et se déplace sur le Centre-Val de Loire, à Tours comme à Chartres, lorsque l’observation sur site accélère le relevé, sans agence locale ailleurs. Tours Métropole se présente comme le premier bassin d’emploi et le premier pôle universitaire de la région : les PME tourangelles y sont souvent déjà équipées, et la question n’est alors pas d’acheter un outil de plus mais de mesurer ce que les outils en place font réellement gagner.
Questions fréquentes.
Les points à trancher avant de lancer un pilote.
Comment déduire le temps de correction du gain annoncé ?
En comptant les reprises avant et après, sur la même définition : un dossier relu, corrigé ou refait est une reprise, quel que soit celui qui s’en charge. Le gain net est la différence entre les heures que le flux vous rend et les heures passées à rattraper ce qu’il produit. Cette seconde colonne est celle qui manque aux business cases, parce que la correction est souvent diluée dans la journée de quelqu’un d’autre que l’acheteur de l’outil.
Peut-on se fier à l’impression de l’équipe sur le temps gagné ?
Non, et c’est mesuré. Dans un essai randomisé publié par METR en juillet 2025, seize développeurs expérimentés estimaient avoir gagné 20 % de temps grâce à l’assistance IA, alors que la mesure objective montre 19 % de temps en plus. Les auteurs précisent que ce résultat ne se généralise pas hors du développement logiciel, et METR estime en février 2026 que l’effet est probablement plus favorable depuis. Ce qui se transpose n’est pas le pourcentage, c’est l’écart entre le ressenti et la mesure.
Combien de temps faut-il pour établir une mesure de départ ?
Une semaine représentative suffit dans la plupart des cas, deux si l’activité connaît des pics marqués. Le relevé porte sur quatre colonnes : volume, temps actif, délai de bout en bout et reprises. Ce qui prend du temps n’est pas la mesure elle-même mais la décision de la prendre avant le projet plutôt qu’après.
Peut-on mesurer un gain sans outil de suivi dédié ?
Oui, et c’est même préférable pour commencer. Un tableur tenu une semaine donne une base plus fiable qu’un tableau de bord installé après coup, qui ne pourra jamais reconstituer la situation d’avant. Les outils de suivi deviennent utiles ensuite, pour maintenir la mesure dans la durée.
Quels indicateurs faut-il éviter ?
Le nombre de clics supprimés, qui décrit une interface et pas un travail, et le taux d’automatisation pris isolément : un flux automatisé à 100 % sur les 3 % de dossiers les plus simples affiche un excellent chiffre sans rien avoir changé. Tout pourcentage cité sans son dénominateur et sa période appartient à la même catégorie.
Que se passe-t-il si le pilote ne montre aucun gain ?
Il se voit, parce que les indicateurs ont été fixés avant et mesurés après sur la même règle. La procédure de retour arrière est écrite avant la mise en route et fait partie du périmètre. Vous conservez la cartographie, les tests et la documentation produits pendant le pilote.
Combien coûte un pilote et à partir de quand devient-il rentable ?
Le premier échange n’est pas facturé, le pilote démarre à 3 900 € HT et la phase d’autonomie à 1 200 € HT. Le point mort dépend de votre relevé : volume mensuel, temps actif par dossier et valeur que vous donnez aux heures rendues. Nous ne publions pas de délai de rentabilité type, parce qu’il varierait du simple au triple d’un flux à l’autre.
Faites établir la mesure avant de choisir l’outil.
Le diagnostic suit un flux réel, chiffre son coût actuel et fixe les indicateurs qui jugeront le pilote. Il produit son livrable avant toute connexion à vos systèmes, et ce livrable vous reste.
Demander un diagnosticUn exemple réel vaut mieux qu’une liste d’outils.
Apportez un dossier, un e-mail ou un passage entre deux logiciels. Nous le transformons en périmètre testable, exceptions comprises.
Premier échange non facturé. Le devis précède toute connexion à vos systèmes.