Token Router
Every model, one endpoint
One OpenAI-compatible API for every model. Bring your own keys or use managed credits. Provider list price, no markup. Prompts are not stored by default.
Catalogue
Choose the model
Registry 2026-08-23.1 · observed 8/23/2026 · JSON
61 of 61 models · prices are provider list price per million tokens · some models cost more past a context threshold, shown under the rate
| Model | Vendor | Context | Input | Output | Images |
|---|---|---|---|---|---|
| Claude Fable 5 | Anthropic | 1,000K | $10 | $50 | |
| Claude Haiku 4.5 | Anthropic | 200K | $1 | $5 | |
| Claude Opus 4.5 | Anthropic | 200K | $5 | $25 | |
| Claude Opus 4.6 | Anthropic | 1,000K | $5 | $25 | |
| Claude Opus 4.7 | Anthropic | 1,000K | $5 | $25 | |
| Claude Opus 4.8 | Anthropic | 1,000K | $5 | $25 | |
| Claude Opus 5 | Anthropic | 1,000K | $5 | $25 | |
| Claude Sonnet 4.5 | Anthropic | 200K | $3 | $15 | |
| Claude Sonnet 4.6 | Anthropic | 1,000K | $3 | $15 | |
| Claude Sonnet 5 | Anthropic | 1,000K | $2 | $10 | |
| DeepSeek V4 Flash | DeepSeekopen | 1,024K | $0.09 | $0.18 | — |
| DeepSeek V4 Flash 0731 | DeepSeekopen | 1,024K | $0.08 | $0.18 | — |
| DeepSeek V4 Pro | DeepSeekopen | 1,048K | $1.3 | $2.6 | — |
| DeepSeek V4 Pro 0813 | DeepSeekopen | 1,024K | $1.3 | $2.6 | — |
| Gemini 2.5 Flash | 1,048K | $0.3 | $2.5 | ||
| Gemini 2.5 Flash-Lite | 1,048K | $0.1 | $0.4 | ||
| Gemini 2.5 Pro | 1,048K | $1.25$2.5 past 200K | $10$15 past 200K | ||
| Gemini 3.1 Flash-Lite | 1,048K | $0.25 | $1.5 | ||
| Gemini 3.1 Pro | 1,048K | $2$4 past 200K | $12$18 past 200K | ||
| Gemini 3.5 Flash | 1,048K | $1.5 | $9 | ||
| Gemini 3.5 Flash-Lite | 1,048K | $0.3 | $2.5 | ||
| Gemini 3.6 Flash | 1,048K | $1.5 | $7.5 | ||
| Gemini 3.7 Flash | 1,000K | $0.75 | $3.75 | ||
| Llama 3.1 8B | Metaopen | 131K | $0.02 | $0.04 | — |
| Llama 3.2 90B Vision | Metaopen | 32K | $0.35 | $0.4 | |
| Llama 3.3 70B | Metaopen | 131K | $0.1 | $0.32 | — |
| Llama 4 Maverick | Metaopen | 1,048K | $0.2 | $0.8 | |
| Llama 4 Scout | Metaopen | 327K | $0.1 | $0.3 | |
| Muse Glimmer 30B | Metaopen | 131K | $0.3 | $1.2 | |
| Muse Spark 1.1 | Meta | 1,048K | $1.25 | $4.25 | |
| Muse Spark 1.2 | Meta | 1,048K | $1.25 | $4.25 | |
| MiniMax M3 | MiniMaxopen | 524K | $0.3 | $1.2 | |
| Mistral Small 3.2 | Mistralopen | 128K | $0.075 | $0.2 | |
| Kimi K2.7 Code | Moonshotopen | 256K | $0.74 | $3.5 | — |
| Kimi K3 | Moonshotopen | 1,000K | $3 | $15 | |
| Nemotron 3 Ultra | NVIDIAopen | 1,000K | $0.5 | $2.2 | — |
| GPT-4.1 | OpenAI | 1,047K | $2 | $8 | |
| GPT-4o | OpenAI | 128K | $2.5 | $10 | |
| GPT-5.1 | OpenAI | 400K | $1.25 | $10 | |
| GPT-5.2 | OpenAI | 400K | $1.75 | $14 | |
| GPT-5.4 | OpenAI | 1,050K | $2.5 | $15 | |
| GPT-5.4 Mini | OpenAI | 400K | $0.75 | $4.5 | |
| GPT-5.4 Nano | OpenAI | 400K | $0.2 | $1.25 | |
| GPT-5.5 | OpenAI | 1,050K | $5 | $30 | |
| GPT-5.6 Luna | OpenAI | 1,050K | $0.2 | $1.2 | |
| GPT-5.6 Sol | OpenAI | 1,050K | $5 | $30 | |
| GPT-5.6 Terra | OpenAI | 1,050K | $2 | $12 | |
| gpt-oss 120B | OpenAIopen | 131K | $0.037 | $0.17 | — |
| gpt-oss 20B | OpenAIopen | 131K | $0.03 | $0.14 | — |
| Qwen3.5 397B | Qwenopen | 262K | $0.45 | $3 | |
| Qwen3.6 Plus | Qwen | 1,000K | $0.5 | $3 | — |
| Qwen3.7 Max | Qwen | 1,000K | $1.25 | $3.75 | — |
| Qwen3.7 Plus | Qwen | 1,000K | $0.32 | $1.28 | — |
| Qwen3.8 2.4T A95B | Qwenopen | 256K | $2 | $6 | — |
| Qwen3.8 27B | Qwenopen | 262K | $0.4 | $3 | |
| Inkling | Thinking Machinesopen | 524K | $1 | $4.05 | |
| Inkling Small | Thinking Machinesopen | 524K | $0.5 | $1.2 | |
| Grok 4.3 | xAI | 1,000K | $1.25$2.5 at 200K | $2.5$5 at 200K | |
| Grok 4.5 | xAI | 500K | $2$4 at 200K | $6$12 at 200K | |
| Grok Build 0.1 | xAI | 256K | $1$2 at 200K | $2$4 at 200K | |
| GLM-5.2 | Z.aiopen | 1,048K | $0.75 | $2.4 | — |
Then see what the spend shipped
Every request is metered per engineer, then tied to shipped work.
See live demo