Cómo dejar de pagar de más por tokens de API LLM
Una guía práctica sobre lo que realmente cuestan los tokens de modelos frontera y dónde se esconde la oferta barata. Actualizada con datos del mercado en vivo de 2026.
Por qué el precio de etiqueta no es el precio de mercado
Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.
Comparar precios de proveedores
USD por millón de tokens. Entrada y salida se comparan por separado.
Desplázate horizontalmente para ver todas las columnas.
| Modelo | DiscountedTokens Entrada / Salida | Comparar con | Entrada / salida del proveedor | Diferencia de entrada | Diferencia de salida |
|---|---|---|---|---|---|
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −85% | OpenRouter ↗Verificado | $2.000 / $10.000 Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | −87% | −85% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −92% | OpenAI ↗Verificado | $4.000 / $20.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −93% | −92% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −95% | RunAPI ↗Verificado | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenRouter ↗Verificado | $2.000 / $12.000 Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenAI ↗Verificado | $2.000 / $12.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | RunAPI ↗Verificado | $2.000 / $12.000 Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenRouter ↗Verificado | $5.000 / $30.000 Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenAI ↗Verificado | $5.000 / $30.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | RunAPI ↗Verificado | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 gpt-5.6 | $0.200 / $1.000 Sin comparación vigente | OpenRouter ↗Histórico / sin verificar | $1.000 / $2.000 Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | No comparable | No comparable |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenRouter ↗Verificado | $10.000 / $50.000 Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenAI ↗Verificado | $10.000 / $50.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −90% | RunAPI ↗Verificado | $5.000 / $25.000 Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output. | −90% | −90% |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Sin comparación vigente | OpenRouter ↗ Sin verificar Histórico / sin verificar | No verified quote / No verified quote Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma. | No comparable | No comparable |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Tarifas mayores / mixtas | RunAPI ↗Verificado | $0.200 / $1.200 Published chat token rates from the pricing page. | +25% Más alto | +25% Más alto |
Solo tarifas base de tokens; se excluyen caché, lotes, herramientas, contexto largo y comisiones de plataforma.
Las etiquetas usan el menor ahorro entre entrada y salida, redondeado hacia abajo. Las cotizaciones de más de 24 horas no generan descuentos anunciados. Las fuentes se revisan cada cuatro horas; la disponibilidad y la identidad del modelo no están garantizadas de forma independiente.
Las solicitudes de API completadas se cobran a las tarifas de tokens indicadas y se miden hasta una fracción de centavo. Los cargos se acumulan y se descuentan de tu saldo prepago en centavos enteros de dólar estadounidense, así que una solicitud pequeña no se redondea a un cargo mínimo.
Nosotros operamos uno de esos grupos. Misma familia de modelos, endpoints compatibles con OpenAI/Anthropic/Responses, a los precios que se muestran a continuación.
Lo que deberías pagar realmente (USD por 1M de tokens)
| Modelo | Nuestra entrada | Nuestra salida | OpenRouter list | Tú ahorras |
|---|---|---|---|---|
| GPT-5.6 Sol | $0.250 | $1.500 | $2.000 / $10.000 | −85% |
| GPT-5.6 Terra | $0.100 | $0.600 | $2.000 / $12.000 | −95% |
| GPT-5.5 | $0.250 | $1.500 | $5.000 / $30.000 | −95% |
| GPT-5.6 | $0.200 | $1.000 | No verified quote / No verified quote | Referencia no disponible |
| GPT-6 Astra | $0.500 | $2.500 | $10.000 / $50.000 | −95% |
| Codex Auto Review | $0.250 | $1.500 | No verified quote / No verified quote | Referencia no disponible |
¿Qué pasa con los otros proveedores de descuento?
Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader página Modelos includes clearly labeled reference-only and historical entries, not invented discounted prices.
Tres reglas para inferencia más barata
- No compres a precio de lista para cargas de trabajo por lotes o de agentes. Cualquier cosa automatizada con volumen predecible nunca debería ejecutarse a precio de lista. Los pools de reventa tienen los mismos pesos, pero tubería más barata.
- Compra créditos, no suscripciones. Solo pagas por los tokens que realmente consumes. Sin quema de saldo no utilizado.
- Mantén una clave por cada plataforma. Si tus herramientas hablan OpenAI o Anthropic, un endpoint y una clave deberían cubrir Claude Code, Codex, SDKs y agentes por igual.
¿Es seguro un pool de reventa?
Verifica tres cosas: verificación real ascendente (sondeamos la identidad del modelo en cada proveedor que revendemos), un contrato de API estable, y canales de pago que liquiden al instante. Publicamos nuestra lista de modelos y nuestro llms.txt orientado a agentes para que las máquinas también puedan auditarnos.