Wie Sie aufhören, für LLM-API-Token zu viel zu bezahlen
Ein praktischer Leitfaden dazu, was Frontier-Modell-Token tatsächlich kosten und wo sich das günstige Angebot versteckt. Aktualisiert mit Live-Marktdaten von 2026.
Warum der Listenpreis nicht der Marktpreis ist
Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.
Anbieterpreise vergleichen
USD pro Million Token. Ein- und Ausgabe werden getrennt verglichen.
Seitlich scrollen, um alle Spalten zu sehen.
| Modell | DiscountedTokens Eingabe / Ausgabe | Vergleichen mit | Anbieter-Eingabe / Ausgabe | Eingabepreis-Differenz | Ausgabepreis-Differenz |
|---|---|---|---|---|---|
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −85% | OpenRouter ↗Geprüft | $2.000 / $10.000 Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | −87% | −85% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −92% | OpenAI ↗Geprüft | $4.000 / $20.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −93% | −92% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −95% | RunAPI ↗Geprüft | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenRouter ↗Geprüft | $2.000 / $12.000 Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenAI ↗Geprüft | $2.000 / $12.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | RunAPI ↗Geprüft | $2.000 / $12.000 Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenRouter ↗Geprüft | $5.000 / $30.000 Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenAI ↗Geprüft | $5.000 / $30.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | RunAPI ↗Geprüft | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 gpt-5.6 | $0.200 / $1.000 Kein aktueller Vergleich | OpenRouter ↗Historisch / ungeprüft | $1.000 / $2.000 Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | Nicht vergleichbar | Nicht vergleichbar |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenRouter ↗Geprüft | $10.000 / $50.000 Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenAI ↗Geprüft | $10.000 / $50.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −90% | RunAPI ↗Geprüft | $5.000 / $25.000 Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output. | −90% | −90% |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Kein aktueller Vergleich | OpenRouter ↗ Nicht geprüft Historisch / ungeprüft | No verified quote / No verified quote Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen. | Nicht vergleichbar | Nicht vergleichbar |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 Höhere / gemischte Preise | RunAPI ↗Geprüft | $0.200 / $1.200 Published chat token rates from the pricing page. | +25% Höher | +25% Höher |
Nur Token-Basispreise; Cache, Batch, Tools, langer Kontext und Plattformgebühren sind ausgeschlossen.
Einzelne Rabattangaben nutzen die kleinere Ersparnis bei Ein- und Ausgabe, abgerundet. Über 24 Stunden alte Preise erzeugen keine Rabattangaben. Quellen werden alle vier Stunden geprüft; Verfügbarkeit und Modellidentität sind nicht unabhängig garantiert.
Erfolgreiche API-Anfragen werden zu den angezeigten Tokenpreisen abgerechnet und auf Bruchteile eines Cents genau gemessen. Die Beträge sammeln sich an und werden in ganzen US-Cent von deinem Guthaben abgezogen, sodass eine kleine Anfrage nicht auf einen Mindestbetrag aufgerundet wird.
Wir betreiben einen dieser Pools. Gleiche Modellfamilie, OpenAI/Anthropic/Responses-kompatible Endpunkte, zu den unten stehenden Preisen.
Was Sie tatsächlich zahlen sollten (USD pro 1 Mio. Token)
| Modell | Unser Input | Unser Output | OpenRouter list | Sie sparen |
|---|---|---|---|---|
| GPT-5.6 Sol | $0.250 | $1.500 | $2.000 / $10.000 | −85% |
| GPT-5.6 Terra | $0.100 | $0.600 | $2.000 / $12.000 | −95% |
| GPT-5.5 | $0.250 | $1.500 | $5.000 / $30.000 | −95% |
| GPT-5.6 | $0.200 | $1.000 | No verified quote / No verified quote | Referenz nicht verfügbar |
| GPT-6 Astra | $0.500 | $2.500 | $10.000 / $50.000 | −95% |
| Codex Auto Review | $0.250 | $1.500 | No verified quote / No verified quote | Referenz nicht verfügbar |
Wie sieht es mit den anderen Rabattanbietern aus?
Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader Modelle-Seite includes clearly labeled reference-only and historical entries, not invented discounted prices.
Drei Regeln für günstigere Inferenz
- Kaufen Sie nicht zum Listenpreis für Batch- oder Agent-Workloads. Alles Automatisierte mit vorhersagbarem Volumen sollte niemals zum Listenpreis betrieben werden. Reseller-Pools haben die gleichen Gewichte, günstigere Leitungen.
- Kaufen Sie Guthaben, keine Abonnements. Sie zahlen nur für tatsächlich verbrauchte Tokens. Kein Verfall ungenutzten Guthabens.
- Behalten Sie einen Schlüssel für jede Umgebung. Wenn Ihre Werkzeuge mit OpenAI oder Anthropic kommunizieren, sollten ein Endpunkt und ein Schlüssel sowohl Claude Code, Codex, SDKs als auch Agenten abdecken.
Ist ein Reseller-Pool sicher?
Prüfen Sie drei Dinge: echte Upstream-Verifizierung (wir prüfen die Modellidentität bei jedem Anbieter, den wir weiterverkaufen), einen stabilen API-Vertrag und Zahlungswege, die sofort abwickeln. Wir veröffentlichen unsere Modellliste und unsere agent-facing llms.txt damit auch Maschinen uns prüfen können.