Guide

Comment arrêter de payer trop cher pour les tokens d'API LLM

Un guide pratique sur ce que coûtent réellement les tokens des modèles de pointe, et où se cache l'offre bon marché. Mis à jour à partir des données de marché en direct de 2026.

Pourquoi le prix affiché n'est pas le prix du marché

Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.

Prix sourcés

Comparer les prix des fournisseurs

USD par million de tokens. Entrée et sortie comparées séparément.

Données tarifaires JSON →

Faites défiler horizontalement pour voir toutes les colonnes.

ModèleDiscountedTokens
Entrée / Sortie
Comparer avecEntrée / sortie du fournisseurÉcart en entréeÉcart en sortie
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−85%
OpenRouter ↗
Vérifié
$2.000 / $10.000
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
−87%−85%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−92%
OpenAI ↗
Vérifié
$4.000 / $20.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−93%−92%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−95%
RunAPI ↗
Vérifié
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenRouter ↗
Vérifié
$2.000 / $12.000
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenAI ↗
Vérifié
$2.000 / $12.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
RunAPI ↗
Vérifié
$2.000 / $12.000
Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenRouter ↗
Vérifié
$5.000 / $30.000
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenAI ↗
Vérifié
$5.000 / $30.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
RunAPI ↗
Vérifié
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6
gpt-5.6
$0.200 / $1.000
Pas de comparaison à jour
OpenRouter ↗
Historique / non vérifié
$1.000 / $2.000
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
Non comparableNon comparable
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenRouter ↗
Vérifié
$10.000 / $50.000
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenAI ↗
Vérifié
$10.000 / $50.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−90%
RunAPI ↗
Vérifié
$5.000 / $25.000
Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output.
−90%−90%
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Pas de comparaison à jour
OpenRouter ↗
Non vérifié
Historique / non vérifié
No verified quote / No verified quote
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
Non comparableNon comparable
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Tarifs supérieurs / mixtes
RunAPI ↗
Vérifié
$0.200 / $1.200
Published chat token rates from the pricing page.
+25% Plus élevé+25% Plus élevé

Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.

Les badges utilisent la plus petite économie entre entrée et sortie, arrondie vers le bas. Aucun rabais n’est annoncé sur les prix de plus de 24 heures. Les sources sont vérifiées toutes les quatre heures ; disponibilité et identité du modèle ne sont pas garanties indépendamment.

Les requêtes API réussies sont facturées aux tarifs de tokens affichés et mesurées à une fraction de centime près. Les montants s’accumulent et sont déduits de ton solde prépayé en centimes de dollar américain entiers, donc une petite requête n’est pas arrondie à un montant minimum.

Nous exploitons l'un de ces pools. Même famille de modèles, points de terminaison compatibles OpenAI/Anthropic/Responses, aux prix indiqués ci-dessous.

Ce que vous devriez réellement payer (USD par 1M de tokens)

ModèleNotre entréeNotre sortieOpenRouter listVous économisez
GPT-5.6 Sol$0.250$1.500$2.000 / $10.000−85%
GPT-5.6 Terra$0.100$0.600$2.000 / $12.000−95%
GPT-5.5$0.250$1.500$5.000 / $30.000−95%
GPT-5.6$0.200$1.000No verified quote / No verified quoteRéférence indisponible
GPT-6 Astra$0.500$2.500$10.000 / $50.000−95%
Codex Auto Review$0.250$1.500No verified quote / No verified quoteRéférence indisponible

Qu'en est-il des autres fournisseurs de réduction ?

Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader page Modèles includes clearly labeled reference-only and historical entries, not invented discounted prices.

Trois règles pour une inférence moins chère

  1. N'achetez pas au prix catalogue pour les charges de travail par lots ou par agents. Tout ce qui est automatisé avec un volume prévisible ne devrait jamais fonctionner au prix catalogue. Les pools de revendeurs offrent les mêmes poids, un tuyau moins cher.
  2. Achetez des crédits, pas d'abonnements. Vous ne payez que pour les jetons que vous consommez réellement. Pas de perte de crédits inutilisés.
  3. Gardez une clé pour chaque harnais. Si vos outils parlent OpenAI ou Anthropic, un point d'accès et une clé devraient couvrir Claude Code, Codex, SDKs et agents de la même manière.

Un pool de revente est-il sûr ?

Vérifiez trois choses : une véritable vérification en amont (nous sondons l'identité du modèle chez chaque fournisseur que nous revendons), un contrat API stable, et des rails de paiement qui se règlent instantanément. Nous publions notre liste de modèles et notre llms.txt destiné aux agents afin que les machines puissent aussi nous auditer.

Try it now: buy $5 of credits, no signup.

Les requêtes API réussies sont facturées aux tarifs de tokens affichés et mesurées à une fraction de centime près. Les montants s’accumulent et sont déduits de ton solde prépayé en centimes de dollar américain entiers, donc une petite requête n’est pas arrondie à un montant minimum.