Comment arrêter de payer trop cher pour les tokens d'API LLM
Un guide pratique sur ce que coûtent réellement les tokens des modèles de pointe, et où se cache l'offre bon marché. Mis à jour à partir des données de marché en direct de 2026.
Pourquoi le prix affiché n'est pas le prix du marché
Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.
Comparer les prix des fournisseurs
USD par million de tokens. Entrée et sortie comparées séparément.
Faites défiler horizontalement pour voir toutes les colonnes.
| Modèle | DiscountedTokens Entrée / Sortie | Comparer avec | Entrée / sortie du fournisseur | Écart en entrée | Écart en sortie |
|---|---|---|---|---|---|
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −85% | OpenRouter ↗Vérifié | $2.000 / $10.000 Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | −87% | −85% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −92% | OpenAI ↗Vérifié | $4.000 / $20.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −93% | −92% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −95% | RunAPI ↗Vérifié | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenRouter ↗Vérifié | $2.000 / $12.000 Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenAI ↗Vérifié | $2.000 / $12.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | RunAPI ↗Vérifié | $2.000 / $12.000 Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenRouter ↗Vérifié | $5.000 / $30.000 Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenAI ↗Vérifié | $5.000 / $30.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | RunAPI ↗Vérifié | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 gpt-5.6 | $0.200 / $1.000 Pas de comparaison à jour | OpenRouter ↗Historique / non vérifié | $1.000 / $2.000 Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | Non comparable | Non comparable |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenRouter ↗Vérifié | $10.000 / $50.000 Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenAI ↗Vérifié | $10.000 / $50.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −90% | RunAPI ↗Vérifié | $5.000 / $25.000 Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output. | −90% | −90% |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Pas de comparaison à jour | OpenRouter ↗ Non vérifié Historique / non vérifié | No verified quote / No verified quote Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme. | Non comparable | Non comparable |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Tarifs supérieurs / mixtes | RunAPI ↗Vérifié | $0.200 / $1.200 Published chat token rates from the pricing page. | +25% Plus élevé | +25% Plus élevé |
Tarifs de base uniquement ; hors cache, traitement par lots, outils, contexte long et frais de plateforme.
Les badges utilisent la plus petite économie entre entrée et sortie, arrondie vers le bas. Aucun rabais n’est annoncé sur les prix de plus de 24 heures. Les sources sont vérifiées toutes les quatre heures ; disponibilité et identité du modèle ne sont pas garanties indépendamment.
Les requêtes API réussies sont facturées aux tarifs de tokens affichés et mesurées à une fraction de centime près. Les montants s’accumulent et sont déduits de ton solde prépayé en centimes de dollar américain entiers, donc une petite requête n’est pas arrondie à un montant minimum.
Nous exploitons l'un de ces pools. Même famille de modèles, points de terminaison compatibles OpenAI/Anthropic/Responses, aux prix indiqués ci-dessous.
Ce que vous devriez réellement payer (USD par 1M de tokens)
| Modèle | Notre entrée | Notre sortie | OpenRouter list | Vous économisez |
|---|---|---|---|---|
| GPT-5.6 Sol | $0.250 | $1.500 | $2.000 / $10.000 | −85% |
| GPT-5.6 Terra | $0.100 | $0.600 | $2.000 / $12.000 | −95% |
| GPT-5.5 | $0.250 | $1.500 | $5.000 / $30.000 | −95% |
| GPT-5.6 | $0.200 | $1.000 | No verified quote / No verified quote | Référence indisponible |
| GPT-6 Astra | $0.500 | $2.500 | $10.000 / $50.000 | −95% |
| Codex Auto Review | $0.250 | $1.500 | No verified quote / No verified quote | Référence indisponible |
Qu'en est-il des autres fournisseurs de réduction ?
Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader page Modèles includes clearly labeled reference-only and historical entries, not invented discounted prices.
Trois règles pour une inférence moins chère
- N'achetez pas au prix catalogue pour les charges de travail par lots ou par agents. Tout ce qui est automatisé avec un volume prévisible ne devrait jamais fonctionner au prix catalogue. Les pools de revendeurs offrent les mêmes poids, un tuyau moins cher.
- Achetez des crédits, pas d'abonnements. Vous ne payez que pour les jetons que vous consommez réellement. Pas de perte de crédits inutilisés.
- Gardez une clé pour chaque harnais. Si vos outils parlent OpenAI ou Anthropic, un point d'accès et une clé devraient couvrir Claude Code, Codex, SDKs et agents de la même manière.
Un pool de revente est-il sûr ?
Vérifiez trois choses : une véritable vérification en amont (nous sondons l'identité du modèle chez chaque fournisseur que nous revendons), un contrat API stable, et des rails de paiement qui se règlent instantanément. Nous publions notre liste de modèles et notre llms.txt destiné aux agents afin que les machines puissent aussi nous auditer.