Tarifas de entrada, salida y caché de 37 modelos de texto de 12 proveedores, además de APIs de generación de imagen, vídeo y voz. Cada precio procede de la página oficial de precios del proveedor.
El precio de API es por millón de tokens. Aproximadamente: 1M tokens ≈ 750.000 palabras ≈ una pila de libros. Los tokens de salida cuestan 3–5× más que los de entrada, y la entrada en caché puede costar hasta un 98% menos. A continuación: cada modelo que vale la pena usar ahora, agrupados por proveedor — primero los flagship.
«—» significa que el proveedor no publica esa tarifa. La lectura de caché es el precio con descuento de los tokens de entrada que el proveedor ya ha visto recientemente. Solo Anthropic cobra por escribir en caché (+25% de la entrada, TTL de 5 minutos); OpenAI, Google, SpaceXAI y DeepSeek cachean automáticamente sin coste extra de escritura — la caché explícita de Google factura almacenamiento por hora.
Las APIs de generación no cobran por token. Los modelos de imagen cobran por imagen, los de vídeo por segundo generado y los de voz por minuto o por millón de caracteres.
Los precios de imagen son por imagen generada con calidad predeterminada de 1024×1024 — ≈ marca estimaciones convertidas desde facturación por tokens. Los precios de vídeo son por segundo de salida en las resoluciones indicadas. Fuentes: páginas oficiales de precios de OpenAI, Google y SpaceXAI y precios de lista de Replicate, verificado el 4 de agosto de 2026.
Traducir un ensayo de 2.500 palabras (≈ 6.666 tokens, mitad entrada / mitad salida):
ConsejoEmpieza barato, sube solo si la salida no es buena. El modelo más barato suele ser 95% igual de bueno para tareas simples.
Casi todos los proveedores cobran por millón de tokens, con tarifas distintas para la entrada (lo que envías) y la salida (lo que escribe el modelo). Un token equivale a unas ¾ partes de una palabra en inglés, así que 1M de tokens ≈ 750.000 palabras. Los tokens de salida suelen costar 3–5× más que los de entrada, y la entrada que el proveedor ya ha visto recientemente (lectura de caché) puede costar hasta un 90% menos.
Ministral 3 14B es el modelo de texto más barato de esta página, a $0.20 / $0.20 por 1M de tokens (entrada / salida). Entre los modelos de nivel flagship, el más barato es Grok 4.6, a $2.00 / $6.00. El más caro es GPT-5.5 pro, a $30.00 / $180.00.
Tarifas flagship por 1M de tokens de entrada / salida: GPT-5.5 pro $30.00 / $180.00; GPT-5.6 Sol $4.00 / $20.00; Claude Fable 5 $10.00 / $50.00; Claude Opus 5 $5.00 / $25.00; Gemini 3.1 Pro $2.00 / $12.00. Cada proveedor vende además modelos intermedios y económicos más baratos que resuelven la mayoría de tareas cotidianas.
El prompt caching permite al proveedor reutilizar entrada que ya ha procesado: un system prompt largo, un documento, el historial de una conversación. La entrada en caché se factura a la tarifa de lectura de caché, normalmente un 50–90% por debajo del precio normal de entrada. Solo Anthropic cobra por escribir en caché (+25% del precio de entrada); OpenAI, Google, SpaceXAI y DeepSeek cachean automáticamente sin coste extra.
Para un uso ligero, sí: unos cientos de intercambios cortos al mes con un modelo intermedio cuestan céntimos, no 20 $. Un uso diario intensivo de un modelo flagship puede superar el precio de una suscripción. Usa la calculadora de costes para estimar tu factura mensual a partir de los mensajes por día y su longitud.