如何停止为 LLM API 令牌多付钱
一份实用指南,介绍前沿模型令牌的实际成本以及廉价供应的隐藏之处。根据 2026 年实时市场数据更新。
为什么标价不是市场价
Published prices differ by provider and processing mode. Compare current source-linked token rates below rather than assuming every aggregator charges the model vendor's list price.
比较提供商价格
每百万令牌的美元价格。输入和输出分别比较。
横向滚动可查看所有列。
| 模型 | DiscountedTokens 输入 / 输出 | 比较对象 | 提供商输入 / 输出 | 输入价差 | 输出价差 |
|---|---|---|---|---|---|
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −85% | OpenRouter ↗已核查 | $2.000 / $10.000 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | −87% | −85% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −92% | OpenAI ↗已核查 | $4.000 / $20.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −93% | −92% |
| GPT-5.6 Sol gpt-5.6-sol | $0.250 / $1.500 −95% | RunAPI ↗已核查 | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenRouter ↗已核查 | $2.000 / $12.000 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | OpenAI ↗已核查 | $2.000 / $12.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.6 Terra gpt-5.6-terra | $0.100 / $0.600 −95% | RunAPI ↗已核查 | $2.000 / $12.000 Starting rates; context-dependent ranges: $2.00-$4.00 / 1M tokens input; $12.00-$18.00 / 1M tokens output. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenRouter ↗已核查 | $5.000 / $30.000 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | OpenAI ↗已核查 | $5.000 / $30.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-5.5 gpt-5.5 | $0.250 / $1.500 −95% | RunAPI ↗已核查 | $5.000 / $30.000 Published chat token rates from the pricing page. | −95% | −95% |
| GPT-5.6 gpt-5.6 | $0.200 / $1.000 暂无有效比较 | OpenRouter ↗历史价格 / 未验证 | $1.000 / $2.000 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | 无法比较 | 无法比较 |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenRouter ↗已核查 | $10.000 / $50.000 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −95% | OpenAI ↗已核查 | $10.000 / $50.000 Standard short-context token rates, not Batch, Flex or Fast mode. | −95% | −95% |
| GPT-6 Astra gpt-6-astra | $0.500 / $2.500 −90% | RunAPI ↗已核查 | $5.000 / $25.000 Starting rates; context-dependent ranges: $5.00-$10.00 / 1M tokens input; $25.00-$37.50 / 1M tokens output. | −90% | −90% |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 暂无有效比较 | OpenRouter ↗ 未核查 历史价格 / 未验证 | No verified quote / No verified quote 仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。 | 无法比较 | 无法比较 |
| Codex Auto Review codex-auto-review | $0.250 / $1.500 更高 / 部分更高 | RunAPI ↗已核查 | $0.200 / $1.200 Published chat token rates from the pricing page. | +25% 更高 | +25% 更高 |
仅比较基础令牌价格;不含缓存、批处理、工具、长上下文及平台费用。
单个折扣标记采用输入和输出中较小的节省比例,并向下取整。超过24小时的报价不用于折扣声明。每四小时检查来源;可用性和模型身份不作独立保证。
成功的 API 请求按所显示的 token 费率计费,计量精确到不足一分钱。费用会累计,并按整美分从你的预付费余额中扣除,因此小额请求不会被向上取整到最低收费。
我们运营其中一个池。相同的模型系列,兼容 OpenAI/Anthropic/Responses 的端点,定价如下。
您实际应支付的费用(每 100 万令牌的美元)
| 模型 | 我们的输入 | 我们的输出 | OpenRouter list | 您节省 |
|---|---|---|---|---|
| GPT-5.6 Sol | $0.250 | $1.500 | $2.000 / $10.000 | −85% |
| GPT-5.6 Terra | $0.100 | $0.600 | $2.000 / $12.000 | −95% |
| GPT-5.5 | $0.250 | $1.500 | $5.000 / $30.000 | −95% |
| GPT-5.6 | $0.200 | $1.000 | No verified quote / No verified quote | 参考价格不可用 |
| GPT-6 Astra | $0.500 | $2.500 | $10.000 / $50.000 | −95% |
| Codex Auto Review | $0.250 | $1.500 | No verified quote / No verified quote | 参考价格不可用 |
其他折扣提供商呢?
Compare source-linked RunAPI, OpenAI and OpenRouter quotes above. Published offers can conflict with a provider's pricing page; the table explains those differences. The broader 模型页面 includes clearly labeled reference-only and historical entries, not invented discounted prices.
降低推理成本的三个规则
- 不要为批量或代理工作负载购买列表价。 任何具有可预测量的自动化工作都不应以列表价运行。转售商池具有相同的权重,但管道更便宜。
- 购买积分,而不是订阅。 你只需为实际消耗的令牌付费。没有未使用额度的浪费。
- 为每个工具保留一个密钥。 如果你的工具支持OpenAI或Anthropic,一个端点和一把密钥应能覆盖Claude Code、Codex、SDK和代理等。
转售池安全吗?
检查三件事:真实的上游验证(我们对每个转售的提供商进行模型身份探测)、稳定的API合同以及即时结算的支付通道。我们发布我们的模型列表和我们的 agent-facing llms.txt 以便机器也能审计我们。