LLM API pricing
Compare per-token prices across LLM API providers.
LLM market heatmap
3,582 models grouped by vendor — click a vendor, then a family to filter the catalog
Models
| Model | Providers | Input from / 1M | Output from / 1M | Context | Capabilities |
|---|---|---|---|---|---|
| inclusionAI: Ling 3.0 Flash Fin | 1 | Free | Free | — | |
| inclusionAI: Ling 3.0 Flash Sante (free) | 1 | Free | Free | — | |
| Meituan: LongCat 2.0 | 1 | Free | Free | — | |
| Poolside: Laguna S 2.1 | 1 | Free | Free | — | |
| Poolside: Laguna XS 2.1 | 1 | Free | Free | — | |
| StepFun: Step 3.7 Flash | 1 | Free | Free | — | |
| Upstage: Solar Pro 4 | 1 | Free | Free | — | |
| inclusionAI: Ling 3.0 Flash | 1 | $0.02/1M tokens | $0.06/1M tokens | — | |
| Meta: Llama 3.1 8B Instruct | 1 | $0.02/1M tokens | $0.04/1M tokens | — | |
| Mistral: Mistral Nemo | 1 | $0.02/1M tokens | $0.03/1M tokens | — | |
| OpenAI: gpt-oss-20b | 1 | $0.02/1M tokens | $0.10/1M tokens | — | |
| DeepSeek: DeepSeek V4 Flash 0731 | 1 | $0.03/1M tokens | $0.07/1M tokens | — | |
| OpenAI: gpt-oss-120b | 1 | $0.03/1M tokens | $0.17/1M tokens | — | |
| Qwen: Qwen3.7 Flash | 1 | $0.03/1M tokens | $0.13/1M tokens | — | |
| DeepSeek: DeepSeek V4 Flash Latest | 1 | $0.03/1M tokens | $0.07/1M tokens | — | |
| Amazon: Nova Micro 1.0 | 1 | $0.04/1M tokens | $0.14/1M tokens | — | |
| Google: Gemma 4 26B A4B | 1 | $0.04/1M tokens | $0.22/1M tokens | — | |
| Inception: Mercury 2.5 | 1 | $0.04/1M tokens | $0.15/1M tokens | — | |
| DeepSeek: DeepSeek V4 Flash 0423 | 1 | $0.05/1M tokens | $0.12/1M tokens | — | |
| Google: Gemma 3 12B | 1 | $0.05/1M tokens | $0.15/1M tokens | — | |
| NVIDIA: Nemotron 3 Nano 30B A3B | 1 | $0.05/1M tokens | $0.20/1M tokens | — | |
| OpenAI: GPT-5 Nano | 1 | $0.05/1M tokens | $0.40/1M tokens | — | |
| Qwen: Qwen3 30B A3B Instruct 2507 | 1 | $0.05/1M tokens | $0.19/1M tokens | — | |
| Qwen: Qwen3.6 35B A3B | 1 | $0.05/1M tokens | $0.70/1M tokens | — | |
| Amazon: Nova Lite 1.0 | 1 | $0.06/1M tokens | $0.24/1M tokens | — | |
| IBM: Granite 4.2 8B | 1 | $0.06/1M tokens | $0.25/1M tokens | — | |
| inclusionAI: Ling 3.0 Flash Fin | 1 | $0.06/1M tokens | $0.18/1M tokens | — | |
| inclusionAI: Ling 3.0 Flash VL | 1 | $0.06/1M tokens | $0.18/1M tokens | — | |
| Poolside: Laguna XS 2.1 | 1 | $0.06/1M tokens | $0.12/1M tokens | — | |
| Z.ai: GLM 4.7 Flash | 1 | $0.06/1M tokens | $0.40/1M tokens | — | |
| NVIDIA: Nemotron 3.5 Lightning | 1 | $0.07/1M tokens | $0.18/1M tokens | — | |
| Qwen: Qwen3 Coder 30B A3B Instruct | 1 | $0.07/1M tokens | $0.27/1M tokens | — | |
| Qwen: Qwen3.5-Flash | 1 | $0.07/1M tokens | $0.26/1M tokens | — | |
| Tencent: Hy3 | 1 | $0.07/1M tokens | $0.29/1M tokens | — | |
| ByteDance Seed: Seed 1.6 Flash | 1 | $0.08/1M tokens | $0.30/1M tokens | — | |
| Google: Gemma 3 27B | 1 | $0.08/1M tokens | $0.16/1M tokens | — | |
| Mistral: Mistral Small 3.2 24B | 1 | $0.08/1M tokens | $0.20/1M tokens | — | |
| NVIDIA: Nemotron 3 Super | 1 | $0.08/1M tokens | $0.45/1M tokens | — | |
| OpenAI: gpt-oss-safeguard-20b | 1 | $0.08/1M tokens | $0.30/1M tokens | — | |
| Qwen: Qwen3 32B | 1 | $0.08/1M tokens | $0.28/1M tokens | — | |
| Qwen: Qwen3.5-35B-A3B | 1 | $0.08/1M tokens | $0.75/1M tokens | — | |
| Qwen: Qwen3.5-9B | 1 | $0.08/1M tokens | $0.13/1M tokens | — | |
| Z.ai: GLM 5.3 Flash | 1 | $0.08/1M tokens | $0.25/1M tokens | — | |
| Z.ai: GLM Flash Latest | 1 | $0.08/1M tokens | $0.25/1M tokens | — | |
| Google: Gemma 4 31B | 1 | $0.09/1M tokens | $0.34/1M tokens | — | |
| Poolside: Laguna S 2.1 | 1 | $0.09/1M tokens | $0.18/1M tokens | — | |
| Qwen: Qwen3 235B A22B Instruct 2507 | 1 | $0.09/1M tokens | $0.35/1M tokens | — | |
| Qwen: Qwen3 Next 80B A3B Instruct | 1 | $0.09/1M tokens | $1.10/1M tokens | — | |
| Upstage: Solar Pro 4 | 1 | $0.09/1M tokens | $0.36/1M tokens | — | |
| ByteDance Seed: Seed-2.0-Mini | 1 | $0.10/1M tokens | $0.40/1M tokens | — | |
| Google: Gemini 2.5 Flash Lite | 1 | $0.10/1M tokens | $0.40/1M tokens | — | |
| Meta: Llama 3.3 70B Instruct | 1 | $0.10/1M tokens | $0.32/1M tokens | — | |
| Meta: Llama 4 Scout | 1 | $0.10/1M tokens | $0.30/1M tokens | — | |
| Mistral: Ministral 3 3B 2512 | 1 | $0.10/1M tokens | $0.10/1M tokens | — | |
| Mistral: Voxtral Small 24B 2507 | 1 | $0.10/1M tokens | $0.30/1M tokens | — | |
| OpenAI: GPT-4.1 Nano | 1 | $0.10/1M tokens | $0.40/1M tokens | — | |
| Qwen: Qwen2.5 7B Instruct | 1 | $0.10/1M tokens | $0.20/1M tokens | — | |
| Qwen: Qwen3 14B | 1 | $0.10/1M tokens | $0.22/1M tokens | — | |
| Qwen: Qwen3 VL 32B Instruct | 1 | $0.10/1M tokens | $0.42/1M tokens | — | |
| Reka Edge | 1 | $0.10/1M tokens | $0.10/1M tokens | — | |
| StepFun: Step 3.5 Flash | 1 | $0.10/1M tokens | $0.30/1M tokens | — | |
| Qwen: Qwen3 30B A3B | 1 | $0.12/1M tokens | $0.50/1M tokens | — | |
| Qwen: Qwen3 8B | 1 | $0.12/1M tokens | $0.45/1M tokens | — | |
| Qwen: Qwen3 Coder Next | 1 | $0.12/1M tokens | $0.80/1M tokens | — | |
| Qwen: Qwen3 VL 8B Instruct | 1 | $0.12/1M tokens | $0.45/1M tokens | — | |
| Xiaomi: MiMo-V2.5 | 1 | $0.12/1M tokens | $0.24/1M tokens | — | |
| Qwen: Qwen3 VL 30B A3B Instruct | 1 | $0.13/1M tokens | $0.52/1M tokens | — | |
| Z.ai: GLM 4.5 Air | 1 | $0.13/1M tokens | $0.85/1M tokens | — | |
| Cohere: Command R (08-2024) | 1 | $0.15/1M tokens | $0.60/1M tokens | — | |
| Mistral: Ministral 3 8B 2512 | 1 | $0.15/1M tokens | $0.15/1M tokens | — | |
| Mistral: Mistral Small 4 | 1 | $0.15/1M tokens | $0.60/1M tokens | — | |
| OpenAI: GPT-4o-mini | 1 | $0.15/1M tokens | $0.60/1M tokens | — | |
| OpenAI: GPT-4o-mini (2024-07-18) | 1 | $0.15/1M tokens | $0.60/1M tokens | — | |
| Qwen: Qwen3 Next 80B A3B Thinking | 1 | $0.15/1M tokens | $1.20/1M tokens | — | |
| Qwen: Qwen3.8 27B | 1 | $0.15/1M tokens | $2.00/1M tokens | — | |
| Qwen: Qwen3.8 Flash | 1 | $0.15/1M tokens | $0.47/1M tokens | — | |
| Upstage: Solar Pro 3 | 1 | $0.15/1M tokens | $0.60/1M tokens | — | |
| StepFun: Step 3.7 Flash | 1 | $0.16/1M tokens | $0.92/1M tokens | — | |
| Qwen: Qwen3 VL 8B Thinking | 1 | $0.18/1M tokens | $2.10/1M tokens | — | |
| Tencent: Hy3 preview | 1 | $0.18/1M tokens | $0.60/1M tokens | — | |
| Qwen: Qwen3.6 Flash | 1 | $0.19/1M tokens | $1.13/1M tokens | — | |
| DeepSeek: DeepSeek V4.1 Flash | 1 | $0.20/1M tokens | $0.60/1M tokens | — | |
| Meta: Llama 4 Maverick | 1 | $0.20/1M tokens | $0.70/1M tokens | — | |
| Mistral: Ministral 3 14B 2512 | 1 | $0.20/1M tokens | $0.20/1M tokens | — | |
| Mistral: Saba | 1 | $0.20/1M tokens | $0.60/1M tokens | — | |
| OpenAI: GPT-5.4 Nano | 1 | $0.20/1M tokens | $1.25/1M tokens | — | |
| OpenAI: GPT-5.6 Luna | 1 | $0.20/1M tokens | $1.20/1M tokens | — | |
| OpenAI: GPT-5.6 Luna Pro | 1 | $0.20/1M tokens | $1.20/1M tokens | — | |
| Qwen: Qwen3 30B A3B Thinking 2507 | 1 | $0.20/1M tokens | $2.40/1M tokens | — | |
| Qwen: Qwen3 Coder Flash | 1 | $0.20/1M tokens | $0.98/1M tokens | — | |
| Qwen: Qwen3 VL 235B A22B Instruct | 1 | $0.20/1M tokens | $0.88/1M tokens | — | |
| Qwen: Qwen3 VL 30B A3B Thinking | 1 | $0.20/1M tokens | $2.40/1M tokens | — | |
| Qwen: Qwen3.5-27B | 1 | $0.20/1M tokens | $1.56/1M tokens | — | |
| OpenAI: GPT Luna Latest | 1 | $0.20/1M tokens | $1.20/1M tokens | — | |
| DeepSeek: DeepSeek V3.2 | 1 | $0.21/1M tokens | $0.31/1M tokens | — | |
| MiniMax: MiniMax M2.7 | 1 | $0.21/1M tokens | $0.84/1M tokens | — | |
| DeepSeek: DeepSeek V4 Flash Vision Exp | 1 | $0.22/1M tokens | $0.65/1M tokens | — | |
| Qwen: Qwen3 Coder 480B A35B | 1 | $0.22/1M tokens | $1.80/1M tokens | — | |
| MiniMax: MiniMax M3 | 1 | $0.23/1M tokens | $0.96/1M tokens | — | |
| Qwen: Qwen3 235B A22B Thinking 2507 | 1 | $0.23/1M tokens | $2.30/1M tokens | — |