Outils
Coût d'API LLM
Entrez le volume de tokens en entrée et en sortie, le nombre d'appels et la part de prompt servie par le cache : l'outil compare le coût entre modèles et détaille ce qui vient de l'entrée fraîche, des lectures de cache, des écritures et de la sortie. La table intégrée ne couvre que des tarifs vérifiables, avec leur date ; pour tout autre fournisseur, ajoutez vos propres prix plutôt qu'un chiffre inventé.
Tout ce que vous envoyez par appel : system prompt, définitions d'outils, historique de conversation et message utilisateur. C'est en général le terme dominant, et celui qu'on sous-estime.
Ce que le modèle génère par appel. La sortie coûte à peu près cinq fois l'entrée, donc une réponse bavarde fait plus mal qu'un long prompt.
Sert aux totaux journaliers et mensuels. Le chiffre mensuel suppose trente jours.
Portion de votre entrée qui est un préfixe stable servi par le cache de prompt. Une lecture de cache coûte environ un dixième d'un token frais ; l'écriture coûte un quart de plus, une fois par durée de vie du cache.
Le moins cher
$50.40
GPT-4o mini
Le plus cher
$1,800
Claude Opus 5
Écart
35.7×
plus cher / moins cher
Appels comptés
30 000
par mois
- GPT-4o miniOpenAI · $0.15/$0.6 par MTok$50.40
- Mistral Small 4Mistral · $0.15/$0.6 par MTok$50.40
- DeepSeek FlashDeepSeek · $0.3/$1.2 par MTok*$101
- Claude Haiku 4.5Anthropic · $1/$5 par MTok$360
- Grok 4.3xAI · $1.25/$2.5 par MTok*$360
- Gemini 3.5 FlashGoogle · $1.5/$9 par MTok$576
- Claude Sonnet 5Anthropic · $2/$10 par MTok$720
- GPT-5.6 TerraOpenAI · $2/$12 par MTok$768
- Claude Opus 5Anthropic · $5/$25 par MTok$1,800
Tarifs tels que publiés le 2026-09-10, API première partie, dollars US par million de tokens. Bedrock, Vertex et Foundry facturent séparément. Vérifiez chez le fournisseur avant de vous engager sur un budget.
La table intégrée ne couvre que des tarifs vérifiables. Pour tout autre fournisseur, saisissez ses prix publiés ici plutôt que de faire confiance à un chiffre inventé.