Calculateur de coût API IA
Estimez le coût d'un appel ou d'un usage mensuel d'une API IA à partir du nombre de tokens et du modèle choisi.
0.15 $ / M tokens entrée · 0.6 $ / M tokens sortie
En moyenne, 1 token représente environ 4 caractères ou 0,75 mot en anglais/français (comptez le texte de votre prompt et de votre réponse attendue pour estimer ces nombres).
Comment les API IA facturent-elles un appel ?
La plupart des API de modèles de langage (OpenAI, Anthropic, Google...) facturent chaque appel au nombre de tokens traités — une unité de texte proche d'un mot ou d'un fragment de mot. Deux compteurs distincts entrent en jeu : les tokens d'entrée (le prompt envoyé, y compris l'historique de conversation et les instructions système) et les tokens de sortie (la réponse générée par le modèle). Chaque type de token a son propre prix, exprimé en dollars par million de tokens (US$ / M tokens), et le prix de la sortie est presque toujours plus élevé que celui de l'entrée.
Le coût d'un appel se calcule donc ainsi : coût = (tokens_entrée / 1 000 000) × prix_entrée + (tokens_sortie / 1 000 000) × prix_sortie . Pour estimer une facture mensuelle, il suffit de multiplier ce coût unitaire par le nombre d'appels effectués (par exemple, nombre d'appels par jour × nombre de jours).
Tarifs utilisés par l'outil
Tarifs saisis manuellement au 4 septembre 2026, en dollars US par million de tokens. Vérifiez toujours le tarif officiel du fournisseur avant toute décision engageante.
| Fournisseur | Modèle | Entrée ($/M) | Sortie ($/M) |
|---|---|---|---|
| OpenAI | GPT-4o | 2.5 | 10 |
| OpenAI | GPT-4o mini | 0.15 | 0.6 |
| OpenAI | GPT-4.1 | 2 | 8 |
| OpenAI | GPT-4.1 mini | 0.4 | 1.6 |
| OpenAI | o3 | 2 | 8 |
| OpenAI | o4-mini | 1.1 | 4.4 |
| Anthropic | Claude Opus 4.1 | 15 | 75 |
| Anthropic | Claude Sonnet 4.5 | 3 | 15 |
| Anthropic | Claude Haiku 4.5 | 1 | 5 |
| Gemini 2.5 Pro | 1.25 | 10 | |
| Gemini 2.5 Flash | 0.3 | 2.5 | |
| Gemini 2.0 Flash | 0.1 | 0.4 |
Générer du texte token par token demande davantage de calcul au modèle que de lire un prompt déjà fourni : les fournisseurs facturent donc en général la sortie 3 à 5 fois plus cher que l'entrée. C'est pourquoi limiter la longueur des réponses attendues (max_tokens) a souvent plus d'impact sur la facture que réduire le prompt.
Les prix affichés sont une donnée statique saisie manuellement dans le code de l'outil, avec une date de dernière mise à jour visible au-dessus du formulaire. Les fournisseurs changent leurs tarifs sans préavis : vérifiez toujours le prix officiel avant une décision engageante (budget, devis, contrat).
Le calcul lui-même est exact pour les tarifs saisis, mais le nombre de tokens réellement consommé par un appel dépend du tokenizer exact du modèle (ponctuation, mise en forme, tokens système, appels d'outils) et peut légèrement différer de ce que vous saisissez ici. Utilisez ce calculateur comme un ordre de grandeur, pas comme une facture exacte.
Non. Le calcul se fait entièrement dans votre navigateur, en JavaScript. Aucune donnée saisie n'est transmise à un serveur ni à un tiers.