Mesurer le retour d'un cas d'usage : les quatre indicateurs à relever avant de commencer
Avant de confier un processus à l'IA, relevez quatre nombres sur la manière dont il tourne aujourd'hui : le volume traité, le temps passé par unité, la part de travail à reprendre et le délai de bout en bout. Trois semaines de relevé suffisent. Sans ce point de départ, vous mesurerez un ressenti, et les essais publiés montrent qu'il peut se tromper jusque sur le sens du résultat.
En juillet 2025, l'institut de recherche METR a publié un essai randomisé mené auprès de seize développeurs expérimentés, sur 246 tâches réelles tirées de projets qu'ils connaissaient bien. Avant de commencer, ils s'attendaient à aller 24 % plus vite avec des outils d'IA. Après coup, ils estimaient avoir gagné 20 %. Le chronomètre disait l'inverse : avec l'IA, ils avaient mis 19 % de temps en plus.
Ce résultat ne dit pas que l'IA ralentit tout le monde : il porte sur un métier précis et des outils de début 2025. Il dit que des professionnels chevronnés se sont trompés sur le sens de l'effet, pas seulement sur son ampleur.
La question devient pressante en Suisse. D'après l'étude PME 2026 d'AXA, menée par l'institut Sotomo auprès de 336 PME romandes et alémaniques en mars 2026, 35 % des PME ont intégré l'IA à leurs processus et 39 % sont en train de la tester. Ces dernières devront bientôt décider si elles continuent. Il leur faudra un chiffre pour trancher, et ce chiffre se prépare avant l'essai.
Le ressenti n'est pas une mesure
METR n'est pas un cas isolé. Le ministère britannique des Affaires et du Commerce a distribué 1 000 licences Microsoft 365 Copilot à ses agents d'octobre à décembre 2024, puis publié son évaluation en août 2025. Les utilisateurs étaient contents : 72 % satisfaits ou très satisfaits. Leurs journaux de bord signalaient des gains sur la rédaction, les synthèses et les comptes rendus de réunion.
Mais le ministère a aussi fait passer des tâches observées, en comparant utilisateurs et non-utilisateurs. Les courriels étaient mieux écrits, avec un gain de temps « extrêmement faible ». Les présentations sortaient plus de sept minutes plus vite, mais de moins bonne qualité. Les analyses dans Excel étaient plus lentes et moins justes. Conclusion du rapport : aucune preuve solide que les gains de temps se traduisent par une meilleure productivité.
À plus grande échelle, Anders Humlum et Emilie Vestergaard ont interrogé 25 000 salariés de 7 000 établissements danois, fin 2023 puis en 2024, et croisé leurs réponses avec les registres officiels de salaires et d'heures. Les utilisateurs déclarent gagner en moyenne 2,8 % de leur temps de travail, soit environ une heure par semaine. Dans les registres, en revanche, rien ne bouge : ni les heures ni les salaires, les chercheurs excluant tout effet supérieur à 2 % deux ans après l'adoption. Le temps gagné existe peut-être. Il n'est allé nulle part où on puisse le retrouver.
Si vous ne relevez rien avant, vous n'aurez après que l'avis des utilisateurs : sincère, favorable, et pas fiable.
Les quatre indicateurs
Un cas d'usage porte sur un processus : les offres commerciales, les demandes de clients, les notes de frais, les comptes rendus. Pour ce processus, et pour lui seul, on relève quatre nombres.
| Indicateur | Ce qu'on compte | Où le trouver | Le piège |
|---|---|---|---|
| 1. Le volume | Le nombre d'unités traitées par semaine : offres envoyées, tickets fermés, factures saisies | Messagerie, CRM, logiciel de tickets, comptabilité | Oublier que le volume varie avec la saison |
| 2. Le temps par unité | Les minutes de travail effectif pour une unité, relecture comprise | Chronométrage sur un échantillon de dix à vingt unités | Demander une estimation au lieu de chronométrer |
| 3. Le taux de reprise | La part des unités à corriger, compléter ou refaire après coup | Retours de la relecture, réclamations, avoirs | Ne pas compter les corrections faites par quelqu'un d'autre |
| 4. Le délai de bout en bout | Le temps entre la demande et la livraison, attentes comprises | Horodatage des courriels ou des tickets | Le confondre avec le temps de travail |
Chacun protège contre une illusion précise. Le volume donne l'échelle : trente minutes gagnées sur une tâche faite deux fois par mois ne justifient aucun projet. Le temps par unité se chronomètre, parce que l'essai METR montre ce que valent les estimations. Le taux de reprise attrape le cas britannique des présentations plus rapides et moins bonnes : le temps gagné en amont se reperd en aval, souvent sur le bureau d'un collègue. Le délai, enfin, est souvent le seul chiffre que voit le client. Une offre rédigée en vingt minutes au lieu d'une heure part toujours dans trois jours si elle attend deux jours une signature.
Un exemple chiffré
Prenons une PME qui envoie douze offres par semaine. Chacune demande 90 minutes, une sur dix revient pour correction, et le client reçoit sa réponse en trois jours ouvrés. Pour convertir les heures en francs, nous reprenons le coût horaire de notre article sur le coût réel de l'IA : CHF 39 bruts, tiré du salaire médian suisse publié par l'Office fédéral de la statistique. Les chiffres qui suivent sont une hypothèse de travail, pas une mesure.
Après trois mois, chaque offre prend 60 minutes, relecture comprise. Sur le temps seul, le gain est de six heures par semaine, soit CHF 10 764 sur 46 semaines. Mais trois offres sur dix reviennent désormais pour correction, contre une auparavant. Si chaque reprise coûte 45 minutes, cela fait 1 h 48 de plus par semaine. Le gain net tombe à 4,2 heures, soit CHF 7 535 par an. Et si le délai reste de trois jours parce que l'offre attend toujours la validation du directeur, le client ne voit aucune différence.
Sans le relevé initial, cette entreprise aurait retenu « on gagne une demi-heure par offre » et se serait arrêtée là. Avec lui, elle sait trois choses : le gain est réel mais inférieur de près d'un tiers à l'impression, la qualité doit être reprise en main, et le vrai goulet d'étranglement se trouve dans la validation, pas dans la rédaction.
Comment relever sans y passer ses journées
- Trois semaines, pas trois jours. Une semaine peut être atypique. Trois lissent les absences et les pics. Si le processus est saisonnier, notez-le et comparez à période équivalente.
- Les traces avant le chronomètre. Le volume et le délai se lisent presque toujours dans les outils existants : horodatage des courriels, dates d'ouverture et de clôture des tickets, numéros de facture. Personne n'a besoin de remplir une grille.
- Un échantillon pour le temps. Chronométrer dix à vingt unités, réparties entre plusieurs personnes, suffit à donner un ordre de grandeur honnête.
- Une définition écrite de la reprise. Une faute de frappe corrigée n'en est pas une, un chiffre faux renvoyé au client en est une. Écrivez la règle avant de compter, sinon vous comparerez deux choses différentes.
- Un groupe témoin si c'est possible. C'est ce qu'a fait le ministère britannique : une partie de l'équipe travaille avec l'outil, l'autre sans, sur les mêmes tâches. À partir de six personnes sur un même processus, c'est faisable.
- Décider d'avance où va le temps gagné. L'étude danoise montre qu'un gain de temps dispersé ne se retrouve nulle part. Écrivez avant l'essai ce que deviendront les heures libérées : plus d'offres, moins d'heures supplémentaires, un dossier en retard enfin traité.
Les erreurs courantes
- Mesurer après seulement. Une fois l'outil installé, le point de départ ne se reconstitue plus. Personne ne se souvient du temps que prenait une offre il y a trois mois.
- Remplacer la mesure par un sondage. La satisfaction se mesure aussi, et c'est utile pour l'adoption. Mais 72 % de satisfaits au ministère britannique ne disaient rien de la productivité.
- Oublier la relecture dans le temps par unité. Le texte généré en trente secondes et relu en vingt minutes prend vingt minutes et demie.
- Changer deux choses à la fois. Si l'on réorganise l'équipe le même mois que l'on déploie l'outil, on ne saura jamais lequel des deux a produit l'effet.
À retenir. Le retour d'un cas d'usage se prouve avec quatre nombres relevés avant de commencer : volume, temps par unité, taux de reprise, délai de bout en bout. Le ressenti des utilisateurs est sincère et souvent faux, parfois jusque sur le sens de l'effet. Trois semaines de relevé, tirées pour l'essentiel des outils que vous avez déjà, suffisent à savoir dans trois mois si l'IA vous rapporte, combien, et où.
Ce que vous pouvez faire cette semaine
Choisissez le processus sur lequel vous comptez essayer l'IA. Si vous hésitez encore, l'article sur les trois processus qu'une PME automatise en premier vous aidera à trancher. Ouvrez une feuille de calcul avec quatre colonnes, une par indicateur, et écrivez en une ligne ce qui compte comme une reprise.
Puis demandez aux deux ou trois personnes qui traitent ce processus de chronométrer leurs cinq prochaines unités, relecture comprise. Extrayez le volume et le délai des trois dernières semaines depuis votre messagerie ou votre CRM. Vendredi, vous avez votre point de départ. L'essai peut commencer lundi, et dans trois mois, vous aurez un chiffre à la place d'une impression.
Sources : METR, Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity, juillet 2025 · Department for Business and Trade, évaluation de Microsoft 365 Copilot, août 2025 · The Register, septembre 2025 · Humlum et Vestergaard, Large Language Models, Small Labor Market Effects, 2025 · AXA et Sotomo, étude PME 2026, via thebrokernews, septembre 2026 · Office fédéral de la statistique, enquête sur la structure des salaires 2024
Former votre équipe, sur vos propres dossiers
Huit semaines, douze participants par atelier, un cas d'usage de votre entreprise déployé puis mesuré. Le programme complet est envoyé par courriel, sans rendez-vous commercial.
Demander le programme