Guía

Cómo dejar de pagar de más por tokens de API LLM

Una guía práctica sobre lo que realmente cuestan los tokens de modelos frontera y dónde se esconde la oferta barata. Actualizada con datos del mercado en vivo de 2026.

Por qué el precio de etiqueta no es el precio de mercado

Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.

Precios con fuentes

Comparar precios de proveedores

USD por millón de tokens. Entrada y salida se comparan por separado.

Datos de precios JSON →

Desplázate horizontalmente para ver todas las columnas.

ModeloDiscountedTokens
Entrada / Salida
Comparar conEntrada / salida del proveedorDiferencia de entradaDiferencia de salida
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−85%
OpenRouter ↗
Verificado
$2.000 / $10.000
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
−87%−85%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−92%
OpenAI ↗
Verificado
$4.000 / $20.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−93%−92%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−95%
RunAPI ↗
Verificado
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenRouter ↗
Verificado
$2.000 / $12.000
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenAI ↗
Verificado
$2.000 / $12.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
RunAPI ↗
Verificado
$2.000 / $12.000
Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenRouter ↗
Verificado
$5.000 / $30.000
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenAI ↗
Verificado
$5.000 / $30.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
RunAPI ↗
Verificado
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6
gpt-5.6
$0.200 / $1.000
Sin comparación vigente
OpenRouter ↗
Histórico / sin verificar
$1.000 / $2.000
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
No comparableNo comparable
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenRouter ↗
Verificado
$10.000 / $50.000
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenAI ↗
Verificado
$10.000 / $50.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−90%
RunAPI ↗
Verificado
$5.000 / $25.000
Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output.
−90%−90%
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Sin comparación vigente
OpenRouter ↗
Sin verificar
Histórico / sin verificar
No verified quote / No verified quote
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
No comparableNo comparable
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Tarifas mayores / mixtas
RunAPI ↗
Verificado
$0.200 / $1.200
Published chat token rates from the pricing page.
+25% Más alto+25% Más alto

Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.

Las etiquetas usan el menor ahorro entre entrada y salida, redondeado hacia abajo. Las cotizaciones de más de 24 horas no generan descuentos anunciados. Las fuentes se revisan cada cuatro horas; la disponibilidad y la identidad del modelo no están garantizadas de forma independiente.

Las solicitudes de API completadas se cobran a las tarifas de tokens indicadas y se miden hasta una fracción de centavo. Los cargos se acumulan y se descuentan de tu saldo prepago en centavos enteros de dólar estadounidense, así que una solicitud pequeña no se redondea a un cargo mínimo.

Nosotros operamos uno de esos grupos. Misma familia de modelos, endpoints compatibles con OpenAI/Anthropic/Responses, a los precios que se muestran a continuación.

Lo que deberías pagar realmente (USD por 1M de tokens)

ModeloNuestra entradaNuestra salidaOpenRouter listTú ahorras
GPT-5.6 Sol$0.250$1.500$2.000 / $10.000−85%
GPT-5.6 Terra$0.100$0.600$2.000 / $12.000−95%
GPT-5.5$0.250$1.500$5.000 / $30.000−95%
GPT-5.6$0.200$1.000No verified quote / No verified quoteReferencia no disponible
GPT-6 Astra$0.500$2.500$10.000 / $50.000−95%
Codex Auto Review$0.250$1.500No verified quote / No verified quoteReferencia no disponible

¿Qué pasa con los otros proveedores de descuento?

Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader página Modelos includes clearly labeled reference-only and historical entries, not invented discounted prices.

Tres reglas para inferencia más barata

  1. No compres a precio de lista para cargas de trabajo por lotes o de agentes. Cualquier cosa automatizada con volumen predecible nunca debería ejecutarse a precio de lista. Los pools de reventa tienen los mismos pesos, pero tubería más barata.
  2. Compra créditos, no suscripciones. Solo pagas por los tokens que realmente consumes. Sin quema de saldo no utilizado.
  3. Mantén una clave por cada plataforma. Si tus herramientas hablan OpenAI o Anthropic, un endpoint y una clave deberían cubrir Claude Code, Codex, SDKs y agentes por igual.

¿Es seguro un pool de reventa?

Verifica tres cosas: verificación real ascendente (sondeamos la identidad del modelo en cada proveedor que revendemos), un contrato de API estable, y canales de pago que liquiden al instante. Publicamos nuestra lista de modelos y nuestro llms.txt orientado a agentes para que las máquinas también puedan auditarnos.

Try it now: buy $5 of credits, no signup.

Las solicitudes de API completadas se cobran a las tarifas de tokens indicadas y se miden hasta una fracción de centavo. Los cargos se acumulan y se descuentan de tu saldo prepago en centavos enteros de dólar estadounidense, así que una solicitud pequeña no se redondea a un cargo mínimo.