$ AI PriceCompare
← Zurück zum Tarifvergleich
API-Tarife

Jede KI-API, bepreist pro Million Tokens.

Input-, Output- und Cache-Tarife für 37 Textmodelle von 12 Anbietern, plus APIs für Bild-, Video- und Sprachgenerierung. Jeder Preis stammt von der offiziellen Preisseite des Anbieters.

§ 01 — Text- & Reasoning-Modelle

37 Modelle, gruppiert nach Anbieter.

API-Preise sind pro Million Tokens. Grob: 1M Tokens ≈ 750.000 Wörter. Output-Tokens kosten 3–5× mehr als Input-Tokens, gecachter Input bis zu 98% weniger. Unten: jedes Modell, das gerade lohnenswert ist, gruppiert nach Anbieter — Flaggschiffe zuerst.

Ansicht
Modell
Input / 1M
Output / 1M
Cache-Lesen / 1M
Cache-Schreiben / 1M
Kontext
OpenAI
6 Modelle
Leistungsstärkster, intelligentester
$30.00
$180.00
1M
Am 21. Aug. um 20% gesenkt (Promo bis 21. Nov.); >272K Tokens: $8/$30, Cache $0,80
$4.00
$20.00
$0.40
1M
Ausgewogenes 5.6; am 30. Juli um 20% gesenkt
$2.00
$12.00
$0.20
1M
Günstiger, klar definierte Aufgaben
$0.75
$4.50
$0.075
400K
Schnellste, günstigste
$0.20
$1.25
$0.02
400K
Schnellste & günstigste 5.6-Stufe; am 30. Juli um 80% gesenkt
$0.20
$1.20
$0.02
1M
Anthropic
4 Modelle
Leistungsstärkster; am 1. Juli nach Exportkontroll-Pause wiederhergestellt
$10.00
$50.00
$1.00
$12.50
1M
Neues Opus-Flaggschiff (24. Juli); nahe Fable 5 zum halben Preis
$5.00
$25.00
$0.50
$6.25
1M
$2/$10 ist nun dauerhaft (Erhöhung auf $3/$15 am 1. Sep. entfällt)
$2.00
$10.00
$0.20
$2.50
1M
Schnell, nahe Sonnet-4-Qualität
$1.00
$5.00
$0.10
$1.25
200K
Google
7 Modelle
Frontier multimodal (>200K: $4/$18)
$2.00
$12.00
$0.20
1M
Langer Kontext (1M); >200K: $2,50/$15
$1.25
$10.00
$0.125
1M
Neues Arbeitspferd (13. Aug. 2026) für Coding & Agenten; Einführungspreis bis 31. Dez., ab 1. Jan. wieder $1,50/$7,50
$0.75
$3.75
$0.075
1M
Auf den Einführungspreis von 3.7 Flash gesenkt, gültig bis 31. Dez. 2026; ab 1. Jan. wieder $1,50/$7,50
$0.75
$3.75
$0.075
1M
Schnellste Flash-Stufe (~350 Tok/s); löst 3.1 Flash-Lite ab
$0.30
$2.50
$0.03
1M
Bestes Preis/Leistung
$0.30
$2.50
$0.03
1M
Schnell, günstig
$0.10
$0.40
$0.01
1M
Mistral
5 Modelle
Mistral Medium 3.5
Frontier-Klasse multimodal; Fokus auf Agenten & Coding
$1.50
$7.50
256K
Mistral Flaggschiff
$0.50
$1.50
256K
Code-Generierung
$0.30
$0.90
128K
Mittelklasse, allgemein; löst Small 3.1 ab
$0.15
$0.60
256K
Budget-Multimodal; löst Pixtral 12B ab
$0.20
$0.20
256K
SpaceXAI
3 Modelle
Neues Flaggschiff (12. Aug. 2026); löst 4.5 zum gleichen Preis ab; >200K Tokens: $4/$12
$2.00
$6.00
$0.50
500K
Reasoning-Arbeitspferd; löst Grok 4 ab; >200K Tokens: $2,50/$5
$1.25
$2.50
$0.20
1M
Code-Aufgaben; löst Grok Code Fast 1 ab; >200K Tokens: $2/$4
$1.00
$2.00
$0.20
256K
DeepSeek
3 Modelle
Nebenzeit-Tarif; zur Spitzenzeit (01:00-04:00 & 06:00-10:00 UTC werktags) 2x: $1,32/$3,96
$0.66
$1.98
$0.022
1M
Nebenzeit-Tarif; zur Spitzenzeit (01:00-04:00 & 06:00-10:00 UTC werktags) 2x: $0,44/$1,32
$0.22
$0.66
$0.007
1M
DeepSeek V4-Flash-Vision-Exp
Experimentelle multimodale/Vision-Variante von V4-Flash (21. Aug. 2026); gleiche Tarife
$0.22
$0.66
$0.007
1M
Meta
Metas erstes kostenpflichtiges Modell, agentisch; 1.2 löst 1.1 zum gleichen Preis ab
$1.25
$4.25
$0.15
1M
Alibaba
3 Modelle
Qwen3.8-Max
Neues Alibaba-Flaggschiff (3. Aug. 2026); 2,4T MoE
$2.00
$6.00
$0.17
1M
Qwen3.7-Max
Vorheriges Qwen-Flaggschiff; stark mehrsprachig
$1.25
$3.75
$0.13
1M
Qwen3.7-Plus
Ausgewogenes Qwen-Arbeitspferd
$0.32
$1.28
Moonshot AI
Kimi K3
Top-Agentenmodell mit offenen Gewichten
$3.00
$15.00
$0.30
1M
Z.ai
GLM-5.3
GLM-Flaggschiff; löst 5.2 zum gleichen Preis ab; starkes Coding-Preis-Leistungs-Verhältnis
$1.40
$4.40
$0.26
1M
Perplexity
2 Modelle
Sonar Pro
Websuche integriert; zzgl. Gebühren pro Anfrage
$3.00
$15.00
200K
Sonar
Günstige webgestützte Antworten; zzgl. Gebühren pro Anfrage
$1.00
$1.00
128K
Cohere
Command A+
Löst Command A ab; offene Gewichte (Apache 2.0); gehosteter Zugang über Cohere/Azure nur für Unternehmen — kein öffentlicher nutzungsbasierter Preis
256K

„—“ bedeutet, dass der Anbieter diesen Tarif nicht veröffentlicht. Cache-Lesen ist der rabattierte Preis für Input-Tokens, die der Anbieter kürzlich gesehen hat. Nur Anthropic berechnet eine Cache-Schreibgebühr (+25% des Inputs, 5-Minuten-TTL); OpenAI, Google, SpaceXAI und DeepSeek cachen automatisch ohne Schreibkosten — Googles explizites Caching berechnet stattdessen Speicher pro Stunde.

§ 02 — Jenseits von Text

Bild-, Video- & Sprach-APIs.

Generierungs-APIs rechnen nicht pro Token ab. Bildmodelle kosten pro Bild, Videomodelle pro erzeugter Sekunde, Sprachmodelle pro Minute oder pro Million Zeichen.

Bildgenerierungs-APIs

Modell
Preis
Die leistungsstärksten
GPT-Image-2
OpenAI · Neues OpenAI-Flaggschiff; fotorealistische Bearbeitung
≈$0.032 / image
GPT-Image-1.5
OpenAI · Wird am 1. Dez. 2026 eingestellt — Umstieg auf GPT-Image-2, jetzt bestbewertet
≈$0.034 / image
Gemini 3.1 Flash Image
Google · Gestaffelt nach Auflösung: $0,045 bei 512px, $0,067 bei 1024px, $0,151 bei 4K
$0.045–0.151 / image
Gemini 3 Pro Image
Google · „Nano Banana Pro"; Premium-Stufe über Flash Image, bis 4K
$0.134–0.24 / image
Seedream 4.5
ByteDance · Starker Realismus & räumliches Verständnis
$0.04 / image
FLUX 1.1 Pro
BFL · Favorit des offenen Ökosystems
$0.04 / image
Recraft V3
Recraft · Design, Vektor-Stile & langer Text
$0.04 / image
Schnell & günstig
Ideogram V3 Turbo
Ideogram · Schnell; klassenbeste Textdarstellung
$0.03 / image
GPT-Image-1-mini
OpenAI · Günstige OpenAI-Stufe
≈$0.008 / image
FLUX Schnell
BFL · Günstigste solide Qualität; offene Gewichte
$0.003 / image

Videogenerierungs-APIs

Modell
Preis
Die leistungsstärksten
Sora 2 Pro
OpenAI · Top-Kinoqualität (720p–1080p)
$0.30–0.70 / s
Veo 3.1
Google · Frontier-Qualität mit Audio (720p–4K)
$0.40–0.60 / s
Grok Imagine 1.5
SpaceXAI · Günstigste Frontier-Stufe (480p–1080p)
$0.08–0.25 / s
Schnell & günstig
Sora 2
OpenAI · Standard-Stufe, 720p
$0.10 / s
Veo 3.1 Fast
Google · Schnelleres, günstigeres Veo (720p–4K)
$0.10–0.30 / s
Veo 3.1 Lite
Google · Günstigste Veo-Stufe (720p–1080p)
$0.05–0.08 / s
Grok Imagine Video
SpaceXAI · Günstigste Video-API (480p–720p)
$0.05–0.07 / s

Sprach- & Audio-APIs

Modell
Preis
Die leistungsstärksten
GPT-Realtime-2.1
OpenAI · Sprach-zu-Sprach-Agenten mit Tool-Nutzung
$32 in / $64 out per 1M audio tok
Grok Voice Think Fast 2.0
SpaceXAI · Echtzeit-Stimme mit Reasoning
$0.08 / min
Gemini 3.1 Flash TTS
Google · Hochwertiges, steuerbares TTS
$20 / 1M audio tok out
Schnell & günstig
TTS-1 HD
OpenAI · HD-Text-zu-Sprache
$30 / 1M chars
TTS-1
OpenAI · Standard-Text-zu-Sprache
$15 / 1M chars
Grok Voice Think Fast 1.0
SpaceXAI · Günstige Echtzeit-Stimme
$0.05 / min
Whisper
OpenAI · Günstige Transkription (Sprache zu Text)
$0.006 / min

Bildpreise gelten pro generiertem Bild in Standardqualität 1024×1024 — ≈ markiert Schätzungen, umgerechnet aus tokenbasierter Abrechnung. Videopreise gelten pro Sekunde Ausgabe in den angegebenen Auflösungen. Quellen: offizielle Preisseiten von OpenAI, Google und SpaceXAI sowie Replicate-Listenpreise, geprüft am 4. August 2026.

Beispielrechnung

Übersetzen eines Aufsatzes mit 2.500 Wörtern (≈ 6.666 Tokens, halb In / halb Out):

  • Gemini 2.5 Flash-Lite$0.002
  • GPT-5.6 Luna$0.005
  • Claude Haiku 4.5$0.020
  • Gemini 3.1 Pro$0.047
  • Claude Fable 5$0.200
  • GPT-5.5 pro$0.700

TippGünstig anfangen, nur wechseln wenn die Qualität nicht reicht. Das billigste Modell ist meist 95% so gut für einfache Aufgaben.

§ 03 — FAQ

API-Preise, erklärt.

Wie werden KI-API-Preise berechnet?

Fast alle Anbieter rechnen pro Million Tokens ab, mit getrennten Tarifen für Input (was du sendest) und Output (was das Modell schreibt). Ein Token entspricht etwa ¾ eines englischen Wortes, 1M Tokens ≈ 750.000 Wörter. Output-Tokens kosten meist 3–5× mehr als Input-Tokens, und Input, den der Anbieter kürzlich schon gesehen hat (Cache-Lesen), kann bis zu 90 % günstiger sein.

Welche KI-API ist 2026 am günstigsten?

Ministral 3 14B ist das günstigste Textmodell auf dieser Seite mit $0.20 / $0.20 pro 1M Tokens (Input / Output). Unter den Flaggschiff-Modellen ist Grok 4.6 mit $2.00 / $6.00 am günstigsten. Am teuersten ist GPT-5.5 pro mit $30.00 / $180.00.

Was kosten GPT, Claude und Gemini über die API?

Flaggschiff-Tarife pro 1M Input- / Output-Tokens: GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00. Jeder Anbieter verkauft zudem günstigere Mittelklasse- und Budget-Modelle, die die meisten Alltagsaufgaben erledigen.

Was ist Prompt-Caching und wie viel spart es?

Prompt-Caching erlaubt dem Anbieter, bereits verarbeiteten Input wiederzuverwenden – einen langen System-Prompt, ein Dokument, einen Gesprächsverlauf. Gecachter Input wird zum Cache-Lese-Tarif abgerechnet, typischerweise 50–90 % unter dem normalen Input-Preis. Nur Anthropic berechnet eine Cache-Schreibgebühr (+25 % des Input-Preises); OpenAI, Google, SpaceXAI und DeepSeek cachen automatisch ohne Aufpreis.

Ist die API günstiger als ein ChatGPT- oder Claude-Abo?

Bei leichter Nutzung ja: Ein paar hundert kurze Anfragen im Monat auf einem Mittelklasse-Modell kosten Cent, nicht 20 $. Intensive tägliche Nutzung eines Flaggschiff-Modells kann ein Abo übersteigen. Nutze den Kostenrechner, um deine Monatsrechnung aus Nachrichten pro Tag und Nachrichtenlänge zu schätzen.