L'usage de l'IA suit une courbe assez prévisible dans les entreprises. On commence par des demandes larges, on obtient des réponses correctes mais inutilisables, on reformule, on recommence. Chaque cycle consomme du temps humain et de la ressource machine, et le résultat final est souvent obtenu au quatrième essai.
Pourquoi une demande large coûte cher
Demander « rédige-moi une stratégie de communication » produit un texte plausible, générique, applicable à n'importe qui. Il faudra ensuite tout reprendre. Demander « propose trois accroches pour cette page, pour cette cible, en tenant compte de ces trois contraintes » produit quelque chose d'exploitable immédiatement.
La différence entre les deux n'est pas la puissance du modèle : c'est la quantité de décisions que vous avez prises avant de demander.
L'IA ne devine pas ce que vous n'avez pas décidé. Elle comble le vide par de la moyenne.
Les trois sources de gaspillage
- Le contexte inutile. Renvoyer l'intégralité d'un dossier à chaque échange alors que trois paragraphes suffisent multiplie la consommation sans améliorer la réponse.
- Le travail refait. Ne pas conserver un résultat déjà obtenu, et le redemander parce qu'on ne sait plus où il est.
- La tâche non découpée. Demander en une fois ce qui aurait dû être demandé en trois étapes contrôlées produit un résultat moyen partout, bon nulle part.
Découper, ici aussi
Le réflexe qui fait la différence est le même que pour une liste de tâches : découper. Une demande large devient une suite d'étapes vérifiables : cadrer, produire, vérifier, mettre en forme. Chaque étape est courte, contrôlable et bon marché ; l'ensemble coûte moins que la version « tout d'un coup » qu'il faut refaire.
Mesurer, sinon rien
Sans mesure, une équipe ne sait pas ce qu'elle consomme ni pour quoi. Deux indicateurs suffisent : combien de demandes par tâche traitée, et combien de fois la réponse a dû être reprise. Quand ces deux chiffres baissent, l'usage devient rentable ; tant qu'ils montent, on paye des allers-retours.
Concrètement
Avant votre prochaine demande, écrivez en une phrase le résultat attendu et ce qui le rendrait inutilisable. Ces deux lignes suppriment l'essentiel des allers-retours, et c'est là, bien plus que dans le choix du modèle, que se jouent les économies.
Le coût de l'IA se joue avant la demande, pas pendant.


