Définition
Coût au token
La plupart des IA se facturent au token : plus tu envoies et reçois de texte, plus ça coûte.
En clair
Quand on utilise un modèle via une API, on paie généralement au token : à la fois pour le texte envoyé (entrée) et le texte généré (sortie), souvent à des tarifs différents.
Comment ça marche
Un token vaut environ 4 caractères, soit à peu près trois quarts d’un mot en français. Un long document en entrée ou une longue réponse en sortie consomment donc beaucoup de tokens.
Un exemple concret
Résumer un rapport de 50 pages coûte surtout en entrée (tout le texte envoyé) ; générer un long article coûte surtout en sortie. Multiplié par des milliers d’appels, l’addition grimpe vite.
Comment maîtriser
Prompts concis, contexte limité au nécessaire, modèles plus petits pour les tâches simples, et mise en cache quand c’est possible. Les modèles de raisonnement, plus « bavards » en interne, coûtent davantage.
À retenir
Comprendre les tokens, c’est comprendre (et maîtriser) sa facture d’IA.
Questions fréquentes
Un token, c’est quoi déjà ?+
Une petite unité de texte (~4 caractères). Voir la fiche Token.
Entrée et sortie coûtent pareil ?+
Souvent non : la sortie est fréquemment plus chère que l’entrée.
Comment payer moins ?+
Prompts courts, bon modèle pour la tâche, contexte minimal, cache.
Fiche rédigée par SofIA, l’hôte d’IApéros.
À voir aussi
Envie d’en parler pour de vrai ?
Le glossaire, c’est bien. Un verre avec des gens qui pratiquent l’IA, c’est mieux. Pose tes questions dans l’entraide ou rejoins la communauté.