Tarifs d'entrée, de sortie et de cache pour 37 modèles de texte de 12 fournisseurs, plus les API de génération d'images, de vidéo et de voix. Chaque prix provient de la page tarifaire officielle du fournisseur.
Le prix API est par million de tokens. En gros : 1M tokens ≈ 750 000 mots. Les tokens de sortie coûtent 3–5× ceux d'entrée, et l'entrée en cache peut coûter jusqu'à 98 % de moins. Ci-dessous : chaque modèle utile aujourd'hui, groupé par fournisseur — flagships en premier.
« — » signifie que le fournisseur ne publie pas ce tarif. La lecture de cache est le prix réduit des tokens d'entrée récemment vus par le fournisseur. Seul Anthropic facture l'écriture en cache (+25 % de l'entrée, TTL de 5 minutes) ; OpenAI, Google, SpaceXAI et DeepSeek mettent en cache automatiquement sans surcoût d'écriture — le cache explicite de Google facture le stockage à l'heure.
Les API de génération ne facturent pas au token. Les modèles d'image facturent à l'image, les modèles vidéo à la seconde produite, les modèles vocaux à la minute ou au million de caractères.
Les prix image sont par image générée en qualité par défaut 1024×1024 — ≈ marque des estimations converties depuis une facturation par tokens. Les prix vidéo sont par seconde de sortie aux résolutions indiquées. Sources : pages de prix officielles d'OpenAI, Google et SpaceXAI et prix publics de Replicate, vérifié le 4 août 2026.
Traduire un essai de 2 500 mots (≈ 6 666 tokens, moitié entrée / moitié sortie) :
AstuceCommencez petit, montez en gamme uniquement si la sortie ne convient pas. Le modèle le moins cher est souvent 95% aussi bon pour les tâches simples.
Presque tous les fournisseurs facturent au million de tokens, avec des tarifs distincts pour l'entrée (ce que vous envoyez) et la sortie (ce que le modèle écrit). Un token vaut environ ¾ d'un mot anglais, donc 1M de tokens ≈ 750 000 mots. Les tokens de sortie coûtent généralement 3 à 5× plus cher que ceux d'entrée, et l'entrée que le fournisseur a vue récemment (lecture de cache) peut coûter jusqu'à 90 % de moins.
Ministral 3 14B est le modèle de texte le moins cher de cette page, à $0.20 / $0.20 par million de tokens (entrée / sortie). Parmi les modèles de niveau flagship, le moins cher est Grok 4.6, à $2.00 / $6.00. Le plus cher est GPT-5.5 pro, à $30.00 / $180.00.
Tarifs flagship par million de tokens en entrée / sortie : GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00. Chaque fournisseur propose aussi des modèles intermédiaires et économiques moins chers, suffisants pour la plupart des tâches courantes.
Le prompt caching permet au fournisseur de réutiliser une entrée déjà traitée : un long system prompt, un document, l'historique d'une conversation. L'entrée en cache est facturée au tarif de lecture de cache, généralement 50 à 90 % sous le prix d'entrée normal. Seul Anthropic facture l'écriture en cache (+25 % du prix d'entrée) ; OpenAI, Google, SpaceXAI et DeepSeek mettent en cache automatiquement sans frais supplémentaires.
Pour un usage léger, oui : quelques centaines d'échanges courts par mois sur un modèle intermédiaire coûtent des centimes, pas 20 $. Un usage quotidien intensif d'un modèle flagship peut dépasser le prix d'un abonnement. Utilisez le calculateur de coûts pour estimer votre facture mensuelle à partir du nombre de messages par jour et de leur longueur.