OpenAI: GPT-5.6 Luna
Pricing matrix USD per 1M tokens
| Field | Consensus | Evidence |
|---|---|---|
| Input | Unverified(未验证,不填 0) | disputed ×1.10 3 sources |
| Output | Unverified(未验证,不填 0) | disputed ×1.10 3 sources |
| Cache read | Unverified(未验证,不填 0) | disputed ×1.10 3 sources |
| Cache write (5m) | Unverified(未验证,不填 0) | disputed ×1.10 3 sources |
| Cache write (1h) | Unverified(未验证,不填 0) | not published |
| Reasoning tokens | Unverified(未验证,不填 0) | not published |
证据链:各源原值并列(audit trail,点击展开)
| Field | Source | Raw value (USD/1M) | Independent | Observed |
|---|---|---|---|---|
| input | openrouter | 0.2000 | yes | 2026-10-01 08:00 |
| input | litellm | 0.2000 | yes | 2026-10-01 08:00 |
| input | litellm | 0.2000 | yes | 2026-10-01 08:00 |
| input | litellm | 0.2000 | yes | 2026-10-01 08:00 |
| input | litellm | 0.2200 | yes | 2026-10-01 08:00 |
| input | litellm <span class="badge mute">mirror</span> | 0.2000 | no | 2026-10-01 08:00 |
| input | modelsdev | 0.2000 | yes | 2026-10-01 08:00 |
| input | modelsdev | 0.2200 | yes | 2026-10-01 08:00 |
| input | modelsdev | 0.2200 | yes | 2026-10-01 08:00 |
| input | modelsdev | 0.2000 | yes | 2026-10-01 08:00 |
| input | modelsdev | 0.2000 | yes | 2026-10-01 08:00 |
| output | openrouter | 1.2000 | yes | 2026-10-01 08:00 |
| output | litellm | 1.2000 | yes | 2026-10-01 08:00 |
| output | litellm | 1.2000 | yes | 2026-10-01 08:00 |
| output | litellm | 1.2000 | yes | 2026-10-01 08:00 |
| output | litellm | 1.3200 | yes | 2026-10-01 08:00 |
| output | litellm <span class="badge mute">mirror</span> | 1.2000 | no | 2026-10-01 08:00 |
| output | modelsdev | 1.2000 | yes | 2026-10-01 08:00 |
| output | modelsdev | 1.3200 | yes | 2026-10-01 08:00 |
| output | modelsdev | 1.3200 | yes | 2026-10-01 08:00 |
| output | modelsdev | 1.2000 | yes | 2026-10-01 08:00 |
| output | modelsdev | 1.2000 | yes | 2026-10-01 08:00 |
| cache_read | openrouter | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | litellm | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | litellm | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | litellm | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | litellm | 0.0220 | yes | 2026-10-01 08:00 |
| cache_read | litellm <span class="badge mute">mirror</span> | 0.0200 | no | 2026-10-01 08:00 |
| cache_read | modelsdev | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | modelsdev | 0.0220 | yes | 2026-10-01 08:00 |
| cache_read | modelsdev | 0.0220 | yes | 2026-10-01 08:00 |
| cache_read | modelsdev | 0.0200 | yes | 2026-10-01 08:00 |
| cache_read | modelsdev | 0.0200 | yes | 2026-10-01 08:00 |
| cache_write | openrouter | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | litellm | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | litellm | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | litellm | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | litellm | 0.2750 | yes | 2026-10-01 08:00 |
| cache_write | litellm <span class="badge mute">mirror</span> | 0.2500 | no | 2026-10-01 08:00 |
| cache_write | modelsdev | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | modelsdev | 0.2750 | yes | 2026-10-01 08:00 |
| cache_write | modelsdev | 0.2750 | yes | 2026-10-01 08:00 |
| cache_write | modelsdev | 0.2500 | yes | 2026-10-01 08:00 |
| cache_write | modelsdev | 0.2500 | yes | 2026-10-01 08:00 |
Long-context tier jumps ⚠
When prompt tokens cross a threshold, the entire request is re-priced at the higher tier — not just the excess. This is the #1 hidden cost on long-context workloads.
| Prompt ≥ tokens | input | output | cache read |
|---|---|---|---|
| 0 (base) | 未验证 | 未验证 | 未验证 |
| 272,000 | 未验证 | 未验证 | 未验证 |
Run this model through the real-bill calculator →
Sources
- OpenRouter — live API (primary)
- LiteLLM — model_prices_and_context_window.json (pinned to commit at fetch time)
- models.dev — api.json
This is an estimate based on public sticker prices, not your invoice. Machine-readable: /data/v1/pricing/openai-gpt-5-6-luna.json