$ AI PriceCompare
← Retour au comparatif des forfaits
Tarifs API

Toutes les API d'IA, au prix du million de tokens.

Tarifs d'entrée, de sortie et de cache pour 37 modèles de texte de 12 fournisseurs, plus les API de génération d'images, de vidéo et de voix. Chaque prix provient de la page tarifaire officielle du fournisseur.

§ 01 — Modèles texte et raisonnement

37 modèles, groupés par fournisseur.

Le prix API est par million de tokens. En gros : 1M tokens ≈ 750 000 mots. Les tokens de sortie coûtent 3–5× ceux d'entrée, et l'entrée en cache peut coûter jusqu'à 98 % de moins. Ci-dessous : chaque modèle utile aujourd'hui, groupé par fournisseur — flagships en premier.

Vue
Modèle
Entrée / 1M
Sortie / 1M
Lect. cache / 1M
Écr. cache / 1M
Contexte
OpenAI
6 modèles
Le plus capable, le plus intelligent
$30.00
$180.00
1M
Baissé de 20 % le 21 août (promo jusqu'au 21 nov.) ; >272K tokens : 8 $/30 $, cache 0,80 $
$4.00
$20.00
$0.40
1M
5.6 équilibré ; baissé de 20 % le 30 juil.
$2.00
$12.00
$0.20
1M
Moins cher, tâches bien définies
$0.75
$4.50
$0.075
400K
Le plus rapide, le moins cher
$0.20
$1.25
$0.02
400K
Le palier 5.6 le plus rapide et économique ; baissé de 80 % le 30 juil.
$0.20
$1.20
$0.02
1M
Anthropic
4 modèles
Le plus puissant ; rétabli le 1er juil. après la pause de contrôle d'export
$10.00
$50.00
$1.00
$12.50
1M
Nouveau flagship Opus (24 juil.) ; proche de Fable 5 à moitié prix
$5.00
$25.00
$0.50
$6.25
1M
2 $/10 $ est désormais permanent (hausse du 1er sept. à 3 $/15 $ annulée)
$2.00
$10.00
$0.20
$2.50
1M
Rapide, proche de Sonnet 4
$1.00
$5.00
$0.10
$1.25
200K
Google
7 modèles
Multimodal de pointe (>200K : 4 $/18 $)
$2.00
$12.00
$0.20
1M
Long contexte (1M) ; >200K : 2,50 $/15 $
$1.25
$10.00
$0.125
1M
Nouveau modèle de référence (13 août 2026) pour code et agents ; prix d'intro jusqu'au 31 déc., repasse à 1,50 $/7,50 $ le 1er janv.
$0.75
$3.75
$0.075
1M
Baissé pour s'aligner sur le prix d'intro de 3.7 Flash jusqu'au 31 déc. 2026 ; repasse à 1,50 $/7,50 $ le 1er janv.
$0.75
$3.75
$0.075
1M
Palier Flash le plus rapide (~350 tok/s) ; succède à 3.1 Flash-Lite
$0.30
$2.50
$0.03
1M
Meilleur rapport prix/perf.
$0.30
$2.50
$0.03
1M
Rapide, abordable
$0.10
$0.40
$0.01
1M
Mistral
5 modèles
Mistral Medium 3.5
Multimodal de pointe ; axé agents et code
$1.50
$7.50
256K
Flagship Mistral
$0.50
$1.50
256K
Génération de code
$0.30
$0.90
128K
Milieu de gamme général ; remplace Small 3.1
$0.15
$0.60
256K
Multimodal budget ; remplace Pixtral 12B
$0.20
$0.20
256K
SpaceXAI
3 modèles
Nouveau flagship (12 août 2026) ; remplace 4.5 au même prix ; >200K tokens : 4 $/12 $
$2.00
$6.00
$0.50
500K
Modèle de raisonnement de référence ; remplace Grok 4 ; >200K tokens : 2,50 $/5 $
$1.25
$2.50
$0.20
1M
Tâches de code ; remplace Grok Code Fast 1 ; >200K tokens : 2 $/4 $
$1.00
$2.00
$0.20
256K
DeepSeek
3 modèles
Tarif hors pointe ; en pointe (01h00-04h00 et 06h00-10h00 UTC en semaine) c'est 2x : 1,32 $/3,96 $
$0.66
$1.98
$0.022
1M
Tarif hors pointe ; en pointe (01h00-04h00 et 06h00-10h00 UTC en semaine) c'est 2x : 0,44 $/1,32 $
$0.22
$0.66
$0.007
1M
DeepSeek V4-Flash-Vision-Exp
Variante multimodale/vision expérimentale de V4-Flash (21 août 2026) ; mêmes tarifs
$0.22
$0.66
$0.007
1M
Meta
Le premier modèle payant de Meta, agentique ; 1.2 remplace 1.1 au même prix
$1.25
$4.25
$0.15
1M
Alibaba
3 modèles
Qwen3.8-Max
Nouveau flagship Alibaba (3 août 2026) ; MoE 2,4T
$2.00
$6.00
$0.17
1M
Qwen3.7-Max
Ancien flagship Qwen ; excellent multilingue
$1.25
$3.75
$0.13
1M
Qwen3.7-Plus
Modèle Qwen équilibré
$0.32
$1.28
Moonshot AI
Kimi K3
Top modèle agentique open-weights
$3.00
$15.00
$0.30
1M
Z.ai
GLM-5.3
Flagship GLM ; remplace 5.2 au même prix ; excellent rapport code/prix
$1.40
$4.40
$0.26
1M
Perplexity
2 modèles
Sonar Pro
Recherche web intégrée ; frais par requête en sus
$3.00
$15.00
200K
Sonar
Réponses web économiques ; frais par requête en sus
$1.00
$1.00
128K
Cohere
Command A+
Remplace Command A ; open-weight (Apache 2.0) ; l'accès hébergé via Cohere/Azure est réservé aux entreprises — pas de tarif public mesuré
256K

« — » signifie que le fournisseur ne publie pas ce tarif. La lecture de cache est le prix réduit des tokens d'entrée récemment vus par le fournisseur. Seul Anthropic facture l'écriture en cache (+25 % de l'entrée, TTL de 5 minutes) ; OpenAI, Google, SpaceXAI et DeepSeek mettent en cache automatiquement sans surcoût d'écriture — le cache explicite de Google facture le stockage à l'heure.

§ 02 — Au-delà du texte

API image, vidéo et voix.

Les API de génération ne facturent pas au token. Les modèles d'image facturent à l'image, les modèles vidéo à la seconde produite, les modèles vocaux à la minute ou au million de caractères.

API de génération d'images

Modèle
Prix
Les plus puissants
GPT-Image-2
OpenAI · Nouveau flagship OpenAI ; retouches photoréalistes
≈$0.032 / image
GPT-Image-1.5
OpenAI · Retiré le 1er déc. 2026 — migrer vers GPT-Image-2, désormais le mieux classé
≈$0.034 / image
Gemini 3.1 Flash Image
Google · Échelonné par résolution : 0,045 $ à 512px, 0,067 $ à 1024px, 0,151 $ à 4K
$0.045–0.151 / image
Gemini 3 Pro Image
Google · « Nano Banana Pro » ; palier premium au-dessus de Flash Image, jusqu'à 4K
$0.134–0.24 / image
Seedream 4.5
ByteDance · Réalisme fort et compréhension spatiale
$0.04 / image
FLUX 1.1 Pro
BFL · Favori de l'écosystème ouvert
$0.04 / image
Recraft V3
Recraft · Design, styles vectoriels et texte long
$0.04 / image
Rapides et économiques
Ideogram V3 Turbo
Ideogram · Rapide ; meilleur rendu de texte
$0.03 / image
GPT-Image-1-mini
OpenAI · Palier économique d'OpenAI
≈$0.008 / image
FLUX Schnell
BFL · Qualité correcte la moins chère ; poids ouverts
$0.003 / image

API de génération de vidéo

Modèle
Prix
Les plus puissants
Sora 2 Pro
OpenAI · Qualité cinéma maximale (720p–1080p)
$0.30–0.70 / s
Veo 3.1
Google · Qualité frontière avec audio (720p–4K)
$0.40–0.60 / s
Grok Imagine 1.5
SpaceXAI · Palier frontière le moins cher (480p–1080p)
$0.08–0.25 / s
Rapides et économiques
Sora 2
OpenAI · Palier standard, 720p
$0.10 / s
Veo 3.1 Fast
Google · Veo plus rapide et moins cher (720p–4K)
$0.10–0.30 / s
Veo 3.1 Lite
Google · Palier Veo le moins cher (720p–1080p)
$0.05–0.08 / s
Grok Imagine Video
SpaceXAI · L'API vidéo la moins chère (480p–720p)
$0.05–0.07 / s

API voix et audio

Modèle
Prix
Les plus puissants
GPT-Realtime-2.1
OpenAI · Agents voix-à-voix avec outils
$32 in / $64 out per 1M audio tok
Grok Voice Think Fast 2.0
SpaceXAI · Voix en temps réel avec raisonnement
$0.08 / min
Gemini 3.1 Flash TTS
Google · TTS contrôlable de haute qualité
$20 / 1M audio tok out
Rapides et économiques
TTS-1 HD
OpenAI · Synthèse vocale HD
$30 / 1M chars
TTS-1
OpenAI · Synthèse vocale standard
$15 / 1M chars
Grok Voice Think Fast 1.0
SpaceXAI · Voix temps réel économique
$0.05 / min
Whisper
OpenAI · Transcription pas chère (voix vers texte)
$0.006 / min

Les prix image sont par image générée en qualité par défaut 1024×1024 — ≈ marque des estimations converties depuis une facturation par tokens. Les prix vidéo sont par seconde de sortie aux résolutions indiquées. Sources : pages de prix officielles d'OpenAI, Google et SpaceXAI et prix publics de Replicate, vérifié le 4 août 2026.

Exemple concret

Traduire un essai de 2 500 mots (≈ 6 666 tokens, moitié entrée / moitié sortie) :

  • Gemini 2.5 Flash-Lite$0.002
  • GPT-5.6 Luna$0.005
  • Claude Haiku 4.5$0.020
  • Gemini 3.1 Pro$0.047
  • Claude Fable 5$0.200
  • GPT-5.5 pro$0.700

AstuceCommencez petit, montez en gamme uniquement si la sortie ne convient pas. Le modèle le moins cher est souvent 95% aussi bon pour les tâches simples.

§ 03 — FAQ

Les prix des API, expliqués.

Comment est calculé le prix d'une API d'IA ?

Presque tous les fournisseurs facturent au million de tokens, avec des tarifs distincts pour l'entrée (ce que vous envoyez) et la sortie (ce que le modèle écrit). Un token vaut environ ¾ d'un mot anglais, donc 1M de tokens ≈ 750 000 mots. Les tokens de sortie coûtent généralement 3 à 5× plus cher que ceux d'entrée, et l'entrée que le fournisseur a vue récemment (lecture de cache) peut coûter jusqu'à 90 % de moins.

Quelle est l'API d'IA la moins chère en 2026 ?

Ministral 3 14B est le modèle de texte le moins cher de cette page, à $0.20 / $0.20 par million de tokens (entrée / sortie). Parmi les modèles de niveau flagship, le moins cher est Grok 4.6, à $2.00 / $6.00. Le plus cher est GPT-5.5 pro, à $30.00 / $180.00.

Combien coûtent GPT, Claude et Gemini via l'API ?

Tarifs flagship par million de tokens en entrée / sortie : GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00. Chaque fournisseur propose aussi des modèles intermédiaires et économiques moins chers, suffisants pour la plupart des tâches courantes.

Qu'est-ce que le prompt caching et combien fait-il économiser ?

Le prompt caching permet au fournisseur de réutiliser une entrée déjà traitée : un long system prompt, un document, l'historique d'une conversation. L'entrée en cache est facturée au tarif de lecture de cache, généralement 50 à 90 % sous le prix d'entrée normal. Seul Anthropic facture l'écriture en cache (+25 % du prix d'entrée) ; OpenAI, Google, SpaceXAI et DeepSeek mettent en cache automatiquement sans frais supplémentaires.

L'API est-elle moins chère qu'un abonnement ChatGPT ou Claude ?

Pour un usage léger, oui : quelques centaines d'échanges courts par mois sur un modèle intermédiaire coûtent des centimes, pas 20 $. Un usage quotidien intensif d'un modèle flagship peut dépasser le prix d'un abonnement. Utilisez le calculateur de coûts pour estimer votre facture mensuelle à partir du nombre de messages par jour et de leur longueur.