/ EN CLAIR
Les modèles se facturent au token, à l'entrée comme à la sortie, et rarement au même tarif : ce que tu envoies coûte généralement moins cher que ce que le modèle produit.
Ce qui surprend, c'est l'entrée. Dans une conversation, l'historique est renvoyé à chaque tour : au vingtième message, tu repaies les dix-neuf précédents. Dans un traitement par lots, c'est le contexte répété mille fois qui pèse, pas la réponse.
Les trois leviers sont toujours les mêmes : envoyer moins de contexte, demander des sorties plus courtes, et mettre un modèle plus léger sur les étapes qui n'ont pas besoin du gros.
/ EN BREF
- COMMENT C'EST FACTURÉ
- Au token, à l'entrée comme à la sortie, et rarement au même tarif pour les deux.
- CE QUI SURPREND
- L'entrée. Dans une conversation, l'historique est renvoyé à chaque tour : tu le repaies à chaque tour.
- LES TROIS LEVIERS
- Envoyer moins de contexte, demander des sorties plus courtes, mettre un modèle plus léger sur les étapes simples.
- COMMENT ESTIMER
- Compter une page A4 autour de 700 à 900 tokens, et multiplier par le volume avant de lancer.


