Coût de l’IA : du tarif par token au travail accepté
Comparez Sol, Terra, Luna et Sonnet 5 avec les bonnes unités. Intégrez sorties, tentatives, outils et révision avant de parler de retour.

Le tarif le plus bas par million de tokens ne désigne pas, à lui seul, l’option la plus économique. Une tâche peut demander plusieurs tentatives, produire de longues réponses ou utiliser des outils supplémentaires. Le chiffre utile est la dépense nécessaire pour obtenir un résultat accepté, au niveau de qualité requis.
Les tables officielles consultées le 21 septembre 2026 indiquaient ces tarifs standards de texte par million de tokens d’entrée sans cache et de sortie : GPT-5.6 Sol : 4 / 20 US$ ; Terra : 2 / 12 US$ ; Luna : 0,20 / 1,20 US$. Pour Claude Sonnet 5 : 2 / 10 US$. Ces références concernent l’API standard ; autres modes, contexte long, cache et outils ont leurs propres conditions.
Utiliser les bonnes unités
Pour du texte sans cache, multipliez les tokens d’entrée par leur tarif et les tokens de sortie par le leur, en divisant chaque quantité par un million. Additionnez ensuite les montants. N’appliquez pas le tarif d’entrée au volume entier : la sortie peut coûter différemment.
Comme exemple arithmétique, et non consommation mesurée d’un projet, prenons une requête Sol avec 100 000 tokens d’entrée et 20 000 de sortie. Les montants sont 0,40 et 0,40 US$, soit 0,80 US$ avant d’autres frais applicables. Cet exemple ne prédit ni la consommation réelle ni le nombre de tentatives nécessaires.

Compter les tentatives sans livraison
Si trois réponses sont abandonnées avant une solution acceptée, elles appartiennent au coût de la tâche. Distinguez les causes : contexte absent, consigne ambiguë, erreur d’outil ou solution inadéquate. Ce classement indique où améliorer le processus. Un modèle moins cher ne résout pas toutes ces causes.
Notez aussi les travaux inachevés. Diviser la facture uniquement par les tâches réussies, sans examiner les abandons, peut masquer du gaspillage. Une vue utile distingue tâches commencées, acceptées et interrompues, avec les dépenses associées. Gardez la même définition de l’acceptation pendant la comparaison.
Inclure outils et effort humain
Recherche, exécution, stockage, abonnement et infrastructure peuvent ajouter des dépenses selon le produit. Consultez les conditions correspondantes et ne confondez pas tarif d’API et limites d’abonnement. Deux services utilisant le même modèle peuvent facturer l’expérience différemment.
Le temps de révision compte aussi. Notez les minutes observées et l’intervention nécessaire. Si vous les convertissez en argent, précisez le taux et sa nature : coût effectif ou hypothèse de planification. Des heures apparemment libérées ne deviennent pas automatiquement une baisse de masse salariale ou un revenu supplémentaire. Leur utilisation doit être définie.
Examiner les dépenses par tâche
Regroupez les travaux comparables avant de calculer des moyennes. Une classification courte et une longue investigation de code ne partagent pas une référence pertinente sans contexte. Commencez par les catégories coûteuses ou les échecs répétés, en conservant des échantillons de qualité pour ne pas masquer des résultats moins bons.
Le guide de Sol, Terra et Luna organise les alternatives. La comparaison de développement avec Claude Fable 5 aide à définir un travail accepté. Le retour exige des coûts et bénéfices identifiables, plutôt qu’une promesse générale de productivité ou une prévision présentée comme un fait.
À propos de l’auteur
Tiago F SantiagoCommentaires
Aucun commentaire pour le moment
Partagez une question ou une expérience en lien avec cet article.


