LLM API pricing

Compare per-token prices across LLM API providers.

3,516
Chat models
18
Providers
Free
Lowest input / 1M tokens
10.5M
Largest context

LLM market heatmap

3,582 models grouped by vendor — click a vendor, then a family to filter the catalog

DEAL% · listings-weighted · signed (− red / + green) · n=24/29

Models

2,461 models
ModelProvidersInput from / 1MOutput from / 1MContextCapabilities
Meta Llama Llama 3 2 3b Instruct1$0.15/1M tokens$0.15/1M tokens128,000 FC
Google Gemma 3 27b It1$0.08/1M tokens$0.16/1M tokens131,072 FC
Nvidia NVIDIA Nemotron Nano 9B V21$0.04/1M tokens$0.16/1M tokens131,072 FC
Meta Llama 3 2 11b1$0.16/1M tokens$0.16/1M tokens128,000Vision FC
Us Gov West 1 Amazon Nova Micro V1 01$0.04/1M tokens$0.17/1M tokens128,000 FC
Gemma 4 26b1$0.03/1M tokens$0.17/1M tokens131,072 FC
Openai Gpt Oss 120b1$0.04/1M tokens$0.17/1M tokens131,072 FC
Openai Gpt Oss 120b1$0.04/1M tokens$0.17/1M tokens131,072 FC Reasoning
Deepseek Ai DeepSeek V4 Flash1$0.09/1M tokens$0.18/1M tokens1,048,576 FC Reasoning
Deepseek Ai DeepSeek V4 Flash 07311$0.08/1M tokens$0.18/1M tokens1,048,576 FC Reasoning
InclusionAI Ling 3 0 Flash1$0.06/1M tokens$0.18/1M tokens131,072 FC Reasoning
DeepSeek V4 Flash Latest1$0.09/1M tokens$0.18/1M tokens1,000,000 FC
Eu Amazon Nova Micro V1 01$0.05/1M tokens$0.18/1M tokens128,000 FC
inclusionAI: Ling 3.0 Flash Fin1$0.06/1M tokens$0.18/1M tokens262,144 FC Reasoning
inclusionAI: Ling 3.0 Flash VL1$0.06/1M tokens$0.18/1M tokens131,072Vision FC Reasoning
Mistral Small 3 2 25061$0.06/1M tokens$0.18/1M tokens131,072Vision FC
Inclusionai Ling 3 0 Flash1$0.06/1M tokens$0.18/1M tokens262,144 FC Reasoning
Inclusionai Ling 3 0 Flash Fast1$0.06/1M tokens$0.18/1M tokens262,144 FC Reasoning
Deepseek Deepseek V4 Flash1$0.09/1M tokens$0.18/1M tokens1,048,576 FC Reasoning
Deepseek Deepseek V4 Flash 07311$0.07/1M tokens$0.18/1M tokens1,310,720 FC Reasoning
Poolside Laguna S 2 11$0.09/1M tokens$0.18/1M tokens1,048,576 FC Reasoning
Poolside: Laguna S 2.11$0.09/1M tokens$0.18/1M tokens1,048,576 FC Reasoning
Meta Llama Meta Llama 3 1 8B Instruct Turbo1$0.18/1M tokens$0.18/1M tokens FC
Eu Meta Llama3 2 3b Instruct V1 01$0.19/1M tokens$0.19/1M tokens128,000 FC
Qwen Qwen3 30b A3b Instruct 25071$0.05/1M tokens$0.19/1M tokens262,144 FC
Openai Gpt Oss Safeguard 20b1$0.07/1M tokens$0.20/1M tokens131,072 FC Reasoning
Meta Llama Llama 3 3 70B Instruct1$0.20/1M tokens$0.20/1M tokens131,072 FC
Qwen Turbo1$0.05/1M tokens$0.20/1M tokens129,024 FC Reasoning
Qwen Turbo 2024 11 011$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo 2025 04 281$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo Latest1$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Mistralai Mistral Small 3 2 24B Instruct 25061$0.08/1M tokens$0.20/1M tokens128,000 FC
Nvidia NVIDIA Nemotron 3 5 Lightning1$0.08/1M tokens$0.20/1M tokens262,144 FC Reasoning
Nvidia Nemotron 3 Nano 30B A3B1$0.05/1M tokens$0.20/1M tokens262,144 FC Reasoning
Accounts Fireworks Models Nemotron Lightning 3p5 30b A3b1$0.05/1M tokens$0.20/1M tokens262,144 FC Reasoning
Nemotron Lightning 3p5 30b A3b1$0.05/1M tokens$0.20/1M tokens262,144 FC Reasoning
Google: Gemini 2.5 Flash Lite (batch)1$0.05/1M tokens$0.20/1M tokens1,048,576Vision FC Reasoning
Qwen QwQ 32B1$0.20/1M tokens$0.20/1M tokens131,072 FC
Deepseek Ai DeepSeek V31$0.20/1M tokens$0.20/1M tokens32,768 FC
Lfm 40b1$0.10/1M tokens$0.20/1M tokens131,072 FC
Deepseek R1 8b1$0.10/1M tokens$0.20/1M tokens65,536 FC Reasoning
Meta: Muse Spark 1.2 Contributor2$0.10/1M tokens$0.20/1M tokens1,048,576Vision FC Reasoning
Meta: Muse Spark 1.3 Contributor2$0.10/1M tokens$0.20/1M tokens1,048,576Vision FC Reasoning
Mistral Ministral 3 14b Instruct1$0.20/1M tokens$0.20/1M tokens128,000 FC
Ministral 14b 25121$0.20/1M tokens$0.20/1M tokens262,144Vision FC
Ministral 14b Latest1$0.20/1M tokens$0.20/1M tokens262,144Vision FC
Ministral 3 14b 25121$0.20/1M tokens$0.20/1M tokens262,144Vision FC
Mistral: Ministral 3 14B 25121$0.20/1M tokens$0.20/1M tokens262,144Vision FC
Mistral: Mistral Small 3.2 24B1$0.08/1M tokens$0.20/1M tokens256,000Vision FC
Qwen Qwen2 5 32B Instruct1$0.06/1M tokens$0.20/1M tokens128,000 FC
Nvidia Nemotron 3 Nano 30b A3b1$0.05/1M tokens$0.20/1M tokens262,144 FC Reasoning
NVIDIA: Nemotron 3.5 Lightning1$0.08/1M tokens$0.20/1M tokens262,144 FC Reasoning
OpenAI: GPT-4.1 Nano (batch)1$0.05/1M tokens$0.20/1M tokens1,047,576Vision FC
OpenAI: GPT-5 Nano (batch)1$0.03/1M tokens$0.20/1M tokens400,000Vision FC Reasoning
Mistralai Ministral 14b 25121$0.20/1M tokens$0.20/1M tokens262,144Vision FC
Nvidia Nemotron 3 Nano 30b A3b1$0.05/1M tokens$0.20/1M tokens262,144 FC Reasoning
Nvidia Nemotron 3 5 Lightning1$0.08/1M tokens$0.20/1M tokens262,144 FC Reasoning
Qwen Qwen 2 5 7b Instruct1$0.10/1M tokens$0.20/1M tokens32,768 FC
Ps Deepseek V4 Flash1$0.10/1M tokens$0.20/1M tokens163,840 FC Reasoning
Ps Qwen3 30b A3b1$0.09/1M tokens$0.20/1M tokens131,072 FC Reasoning
Qwen: Qwen2.5 7B Instruct1$0.10/1M tokens$0.20/1M tokens32,768 FC
Qwen Turbo1$0.05/1M tokens$0.20/1M tokens129,024 FC Reasoning
Qwen Turbo 2024 11 011$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo 2025 04 281$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo Latest1$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo1$0.05/1M tokens$0.20/1M tokens129,024 FC Reasoning
Qwen Turbo 2024 11 011$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo 2025 04 281$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Qwen Turbo Latest1$0.05/1M tokens$0.20/1M tokens1,000,000 FC Reasoning
Meta Llama 3 1 8B Instruct1$0.10/1M tokens$0.20/1M tokens16,384 FC
Mistralai Pixtral 12b 24091$0.20/1M tokens$0.20/1M tokens128,000Vision FC
Openai Gpt Oss 20b1$0.05/1M tokens$0.20/1M tokens131,072 FC
Google Gemma 2 9b1$0.20/1M tokens$0.20/1M tokens8,192Vision FC
Ibm Granite 3 3 8b Instruct1$0.20/1M tokens$0.20/1M tokens8,192 FC
Ibm Granite 3 8b Instruct1$0.20/1M tokens$0.20/1M tokens8,192 FC
Hy3 preview1$0.06/1M tokens$0.21/1M tokens262,000 FC
FW Nemotron Lightning 3 5 30B A3B1$0.06/1M tokens$0.22/1M tokens262,144 FC Reasoning
Google: Gemma 4 26B A4B 1$0.04/1M tokens$0.22/1M tokens262,144Vision FC Reasoning
Meta Llama3 1 8b Instruct V1 01$0.22/1M tokens$0.22/1M tokens128,000 FC
Us Meta Llama3 1 8b Instruct V1 01$0.22/1M tokens$0.22/1M tokens128,000 FC
Qwen3 32B1$0.08/1M tokens$0.23/1M tokens32,000 FC Reasoning
Nova Lite V11$0.06/1M tokens$0.24/1M tokens300,000Vision FC
Amazon Nova Lite V1 01$0.06/1M tokens$0.24/1M tokens300,000Vision FC
Amazon: Nova Lite 1.01$0.06/1M tokens$0.24/1M tokens300,000Vision FC
Qwen Qwen3 14B1$0.12/1M tokens$0.24/1M tokens40,960 FC
Qwen Qwen3 14B1$0.08/1M tokens$0.24/1M tokens32,768 FC
Qwen Qwen3 4B1$0.08/1M tokens$0.24/1M tokens32,768 FC
Nvidia NVIDIA Nemotron 3 Nano 30B A3B1$0.06/1M tokens$0.24/1M tokens262,144 FC Reasoning
Nvidia Nemotron 3 Nano Omni1$0.06/1M tokens$0.24/1M tokens262,144Vision FC Reasoning
Nvidia Nemotron 3 5 Lightning1$0.06/1M tokens$0.24/1M tokens1,048,576 FC Reasoning
Nvidia Nemotron Nano 3 30b1$0.06/1M tokens$0.24/1M tokens262,144 FC
Qwen Qwen3 14b1$0.12/1M tokens$0.24/1M tokens131,072 FC Reasoning
Us Amazon Nova Lite V1 01$0.06/1M tokens$0.24/1M tokens300,000Vision FC
Amazon Nova Lite1$0.06/1M tokens$0.24/1M tokens300,000Vision FC
Apac Amazon Nova Lite V1 01$0.06/1M tokens$0.25/1M tokens300,000Vision FC
Deepseek Ai DeepSeek R1 05281$0.25/1M tokens$0.25/1M tokens131,072 FC
IBM: Granite 4.2 8B1$0.06/1M tokens$0.25/1M tokens131,072 FC Reasoning
Openai Gpt Oss 120b1$0.05/1M tokens$0.25/1M tokens131,072 FC Reasoning
Z Ai Glm 5 3 Flash1$0.08/1M tokens$0.25/1M tokens1,310,720Vision FC Reasoning
Qwen: Qwen3.5-9B (batch)1$0.17/1M tokens$0.25/1M tokens262,144Vision FC Reasoning