Leitfaden

Wie Sie aufhören, für LLM-API-Token zu viel zu bezahlen

Ein praktischer Leitfaden dazu, was Frontier-Modell-Token tatsächlich kosten und wo sich das günstige Angebot versteckt. Aktualisiert mit Live-Marktdaten von 2026.

Warum der Listenpreis nicht der Marktpreis ist

Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.

Quellenbasierte Preise

Anbieterpreise vergleichen

USD pro Million Token. Ein- und Ausgabe werden getrennt verglichen.

Preisdaten JSON →

Seitlich scrollen, um alle Spalten zu sehen.

ModellDiscountedTokens
Eingabe / Ausgabe
Vergleichen mitAnbieter-Eingabe / AusgabeEingabepreis-DifferenzAusgabepreis-Differenz
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−85%
OpenRouter ↗
Geprüft
$2.000 / $10.000
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
−87%−85%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−92%
OpenAI ↗
Geprüft
$4.000 / $20.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−93%−92%
GPT-5.6 Sol
gpt-5.6-sol
$0.250 / $1.500
−95%
RunAPI ↗
Geprüft
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenRouter ↗
Geprüft
$2.000 / $12.000
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
OpenAI ↗
Geprüft
$2.000 / $12.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.6 Terra
gpt-5.6-terra
$0.100 / $0.600
−95%
RunAPI ↗
Geprüft
$2.000 / $12.000
Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenRouter ↗
Geprüft
$5.000 / $30.000
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
OpenAI ↗
Geprüft
$5.000 / $30.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-5.5
gpt-5.5
$0.250 / $1.500
−95%
RunAPI ↗
Geprüft
$5.000 / $30.000
Published chat token rates from the pricing page.
−95%−95%
GPT-5.6
gpt-5.6
$0.200 / $1.000
Kein aktueller Vergleich
OpenRouter ↗
Historisch / ungeprüft
$1.000 / $2.000
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
Nicht vergleichbarNicht vergleichbar
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenRouter ↗
Geprüft
$10.000 / $50.000
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−95%
OpenAI ↗
Geprüft
$10.000 / $50.000
Standard short-context token rates, not Batch, Flex or Fast mode.
−95%−95%
GPT-6 Astra
gpt-6-astra
$0.500 / $2.500
−90%
RunAPI ↗
Geprüft
$5.000 / $25.000
Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output.
−90%−90%
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Kein aktueller Vergleich
OpenRouter ↗
Nicht geprüft
Historisch / ungeprüft
No verified quote / No verified quote
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
Nicht vergleichbarNicht vergleichbar
Codex Auto Review
codex-auto-review
$0.250 / $1.500
Höhere / gemischte Preise
RunAPI ↗
Geprüft
$0.200 / $1.200
Published chat token rates from the pricing page.
+25% Höher+25% Höher

Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.

Einzelne Rabattangaben nutzen die kleinere Ersparnis bei Ein- und Ausgabe, abgerundet. Über 24 Stunden alte Preise erzeugen keine Rabattangaben. Quellen werden alle vier Stunden geprüft; Verfügbarkeit und Modellidentität sind nicht unabhängig garantiert.

Erfolgreiche API-Anfragen werden zu den angezeigten Tokenpreisen abgerechnet und auf Bruchteile eines Cents genau gemessen. Die Beträge sammeln sich an und werden in ganzen US-Cent von deinem Guthaben abgezogen, sodass eine kleine Anfrage nicht auf einen Mindestbetrag aufgerundet wird.

Wir betreiben einen dieser Pools. Gleiche Modellfamilie, OpenAI/Anthropic/Responses-kompatible Endpunkte, zu den unten stehenden Preisen.

Was Sie tatsächlich zahlen sollten (USD pro 1 Mio. Token)

ModellUnser InputUnser OutputOpenRouter listSie sparen
GPT-5.6 Sol$0.250$1.500$2.000 / $10.000−85%
GPT-5.6 Terra$0.100$0.600$2.000 / $12.000−95%
GPT-5.5$0.250$1.500$5.000 / $30.000−95%
GPT-5.6$0.200$1.000No verified quote / No verified quoteReferenz nicht verfügbar
GPT-6 Astra$0.500$2.500$10.000 / $50.000−95%
Codex Auto Review$0.250$1.500No verified quote / No verified quoteReferenz nicht verfügbar

Wie sieht es mit den anderen Rabattanbietern aus?

Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader Modelle-Seite includes clearly labeled reference-only and historical entries, not invented discounted prices.

Drei Regeln für günstigere Inferenz

  1. Kaufen Sie nicht zum Listenpreis für Batch- oder Agent-Workloads. Alles Automatisierte mit vorhersagbarem Volumen sollte niemals zum Listenpreis betrieben werden. Reseller-Pools haben die gleichen Gewichte, günstigere Leitungen.
  2. Kaufen Sie Guthaben, keine Abonnements. Sie zahlen nur für tatsächlich verbrauchte Tokens. Kein Verfall ungenutzten Guthabens.
  3. Behalten Sie einen Schlüssel für jede Umgebung. Wenn Ihre Werkzeuge mit OpenAI oder Anthropic kommunizieren, sollten ein Endpunkt und ein Schlüssel sowohl Claude Code, Codex, SDKs als auch Agenten abdecken.

Ist ein Reseller-Pool sicher?

Prüfen Sie drei Dinge: echte Upstream-Verifizierung (wir prüfen die Modellidentität bei jedem Anbieter, den wir weiterverkaufen), einen stabilen API-Vertrag und Zahlungswege, die sofort abwickeln. Wir veröffentlichen unsere Modellliste und unsere agent-facing llms.txt damit auch Maschinen uns prüfen können.

Try it now: buy $5 of credits, no signup.

Erfolgreiche API-Anfragen werden zu den angezeigten Tokenpreisen abgerechnet und auf Bruchteile eines Cents genau gemessen. Die Beträge sammeln sich an und werden in ganzen US-Cent von deinem Guthaben abgezogen, sodass eine kleine Anfrage nicht auf einen Mindestbetrag aufgerundet wird.