Input-, Output- und Cache-Tarife für 37 Textmodelle von 12 Anbietern, plus APIs für Bild-, Video- und Sprachgenerierung. Jeder Preis stammt von der offiziellen Preisseite des Anbieters.
API-Preise sind pro Million Tokens. Grob: 1M Tokens ≈ 750.000 Wörter. Output-Tokens kosten 3–5× mehr als Input-Tokens, gecachter Input bis zu 98% weniger. Unten: jedes Modell, das gerade lohnenswert ist, gruppiert nach Anbieter — Flaggschiffe zuerst.
„—“ bedeutet, dass der Anbieter diesen Tarif nicht veröffentlicht. Cache-Lesen ist der rabattierte Preis für Input-Tokens, die der Anbieter kürzlich gesehen hat. Nur Anthropic berechnet eine Cache-Schreibgebühr (+25% des Inputs, 5-Minuten-TTL); OpenAI, Google, SpaceXAI und DeepSeek cachen automatisch ohne Schreibkosten — Googles explizites Caching berechnet stattdessen Speicher pro Stunde.
Generierungs-APIs rechnen nicht pro Token ab. Bildmodelle kosten pro Bild, Videomodelle pro erzeugter Sekunde, Sprachmodelle pro Minute oder pro Million Zeichen.
Bildpreise gelten pro generiertem Bild in Standardqualität 1024×1024 — ≈ markiert Schätzungen, umgerechnet aus tokenbasierter Abrechnung. Videopreise gelten pro Sekunde Ausgabe in den angegebenen Auflösungen. Quellen: offizielle Preisseiten von OpenAI, Google und SpaceXAI sowie Replicate-Listenpreise, geprüft am 4. August 2026.
Übersetzen eines Aufsatzes mit 2.500 Wörtern (≈ 6.666 Tokens, halb In / halb Out):
TippGünstig anfangen, nur wechseln wenn die Qualität nicht reicht. Das billigste Modell ist meist 95% so gut für einfache Aufgaben.
Fast alle Anbieter rechnen pro Million Tokens ab, mit getrennten Tarifen für Input (was du sendest) und Output (was das Modell schreibt). Ein Token entspricht etwa ¾ eines englischen Wortes, 1M Tokens ≈ 750.000 Wörter. Output-Tokens kosten meist 3–5× mehr als Input-Tokens, und Input, den der Anbieter kürzlich schon gesehen hat (Cache-Lesen), kann bis zu 90 % günstiger sein.
Ministral 3 14B ist das günstigste Textmodell auf dieser Seite mit $0.20 / $0.20 pro 1M Tokens (Input / Output). Unter den Flaggschiff-Modellen ist Grok 4.6 mit $2.00 / $6.00 am günstigsten. Am teuersten ist GPT-5.5 pro mit $30.00 / $180.00.
Flaggschiff-Tarife pro 1M Input- / Output-Tokens: GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00. Jeder Anbieter verkauft zudem günstigere Mittelklasse- und Budget-Modelle, die die meisten Alltagsaufgaben erledigen.
Prompt-Caching erlaubt dem Anbieter, bereits verarbeiteten Input wiederzuverwenden – einen langen System-Prompt, ein Dokument, einen Gesprächsverlauf. Gecachter Input wird zum Cache-Lese-Tarif abgerechnet, typischerweise 50–90 % unter dem normalen Input-Preis. Nur Anthropic berechnet eine Cache-Schreibgebühr (+25 % des Input-Preises); OpenAI, Google, SpaceXAI und DeepSeek cachen automatisch ohne Aufpreis.
Bei leichter Nutzung ja: Ein paar hundert kurze Anfragen im Monat auf einem Mittelklasse-Modell kosten Cent, nicht 20 $. Intensive tägliche Nutzung eines Flaggschiff-Modells kann ein Abo übersteigen. Nutze den Kostenrechner, um deine Monatsrechnung aus Nachrichten pro Tag und Nachrichtenlänge zu schätzen.