Live catalog/29 labs/12 free to call/2M context
Compare 684+ AI models.
Flagship and open-weight models from OpenAI, Anthropic, Google, AWS Bedrock, Azure, DeepSeek, Meta, xAI, Mistral, Moonshot and more, through one OpenAI-compatible API. Prices shown are provider rates; pay as you go adds 5%, or 0% on your own keys.
207
unique models
684
unique endpoints
30
unique providers
18,180
data points in the catalog
Price spread 1,500x207 models from 29 labs, 684 endpoints across 30 providers
207/
glm-5.3-flash50% off until 9 Sep 2026Z.AI · 4 providers · 1.0M ctx$0.15$0.07$0.50$0.25
qwen3.8-flashAlibaba (Qwen) · 2 providers · 1.0M ctx$0.16$0.47
qwen3.8-2.4t-a95bAlibaba (Qwen) · 1 provider · 1M ctx$2.50$6.00
glm-5.3Z.AI · 1 provider · 1M ctx$1.40$4.40
nemotron-lightning-3.5-30b-a3bNVIDIA · 1 provider · 262K ctx$0.05$0.20
gemini-3.7-flash50% offGoogle · 1 provider · 1.0M ctx$1.50$0.75$7.50$3.75
deepseek-v4-pro-0813DeepSeek · 2 providers · 1.0M ctx$1.30$2.60
qwen3.8-2.4T-A95BDeepInfra · 1 provider · 262K ctx$2.00$6.00
grok-4.6xAI · 1 provider · 500K ctx$2.00$6.00
nemotron-3.5-lightning-30b-a3bNVIDIA · 1 provider · 1.0M ctxFreeFree
muse-glimmer-30bMeta · 2 providers · 131K ctxFreeFree- iling-3.0-tinyInclusionAI · 1 provider · 262K ctxFreeFree
qwen3.8-maxAlibaba (Qwen) · 3 providers · 1.0M ctx$2.00$6.00
deepseek-v4-flash-0731DeepSeek · 5 providers · 1.0M ctx$0.07$0.14
claude-opus-5Anthropic · 3 providers · 1M ctx$5.00$25.00
gemini-3.6-flashGoogle · 2 providers · 1.0M ctx$0.38$1.88
gemini-3.5-flash-liteGoogle · 2 providers · 1.0M ctx$0.15$1.25
kimi-k3Moonshot AI · 5 providers · 1.0M ctx$2.25$11.25
inkling-256k50% offThinking Machines · 1 provider · 262K ctx$3.74$1.87$9.36$4.68
inklingThinking Machines · 1 provider · 66K ctx$1.87$4.68
glm-5.2-fastZ.AI · 1 provider · 1M ctx$2.10$6.60
thinkingcap-qwen3.6-27bSference · 1 provider · 262K ctx$0.40$3.00
gpt-5.6-lunaOpenAI · 4 providers · 1.1M ctx$0.10$0.60
gpt-5.6-terraOpenAI · 4 providers · 1.1M ctx$1.00$6.00
gpt-5.6-solOpenAI · 4 providers · 1.1M ctx$2.50$15.00
grok-4.5xAI · 1 provider · 500K ctx$2.00$6.00- thy3Tencent · 1 provider · 262K ctx$0.14$0.58
claude-sonnet-5Anthropic · 3 providers · 1M ctx$2.00$10.00
nvidia-nemotron-3-ultraNVIDIA · 1 provider · 262K ctx$0.37$1.87
fugu-ultraSakana AI · 1 provider · 1.0M ctx$5.00$30.00
gemini-3.1-flash-imageGoogle · 2 providers · 131K ctx$0.25$1.50
gemini-3-pro-imageGoogle · 2 providers · 1.0M ctx$1.00$6.00
glm-5.2Z.AI · 8 providers · 1.0M ctx$1.05$3.30
glm-5.2DeepInfra · 1 provider · 1M ctx$0.60$1.92
nemotron-3.5-content-safetyNVIDIA · 1 provider · 131K ctxFreeFree
nemotron-3-ultra-nvfp4NVIDIA · 1 provider · 262K ctx$0.60$2.40
kimi-k2.7-codeMoonshot AI · 5 providers · 262K ctx$0.75$3.50
claude-fable-5Anthropic · 3 providers · 1M ctx$10.00$50.00
laguna-m.1Poolside · 1 provider · 33K ctxFreeFree
laguna-xs.2Poolside · 1 provider · 33K ctxFreeFree
nemotron-3-nano-omni-30b-a3b-reasoningNVIDIA · 1 provider · 131K ctxFreeFree
nemotron-3-ultra-550b-a55bNVIDIA · 2 providers · 1.0M ctxFreeFree
qwen3.7-plus20% offAlibaba (Qwen) · 2 providers · 1.0M ctx$0.40$0.32$1.60$1.28
minimax-m3MiniMax · 3 providers · 1.0M ctx$0.30$1.20- sstep-3.7-flashStepFun · 1 provider · 262K ctx$0.20$1.15
claude-opus-4-8Anthropic · 3 providers · 1M ctx$5.00$25.00- bseed-1.8ByteDance · 1 provider · 256K ctx$0.25$2.00
devstral-latestMistral AI · 1 provider · 256K ctx$0.44$2.20
leanstral-1-5Mistral AI · 1 provider · 262K ctxFreeFree
qwen3.7-maxAlibaba (Qwen) · 1 provider · 1.0M ctx$2.50$7.50
grok-build-0.1xAI · 1 provider · 256K ctx$1.00$2.00
nemotron-3-nano-omniNVIDIA · 1 provider · 300K ctx$0.06$0.24
gemini-3.5-flashGoogle · 2 providers · 1.0M ctx$0.75$4.50- iring-2.6-1tInclusionAI · 1 provider · 262K ctx$0.30$2.50
gemini-3.1-flash-liteGoogle · 2 providers · 1.0M ctx$0.13$0.75
grok-4.3xAI · 1 provider · 1M ctx$1.25$2.50
mistral-medium-3-5Mistral AI · 1 provider · 262K ctx$1.65$8.25
mistral-medium-latestMistral AI · 1 provider · 131K ctx$0.44$2.20
gpt-5.5-proOpenAI · 1 provider · 1.1M ctx$30.00$180.00
gpt-5.5OpenAI · 4 providers · 1.1M ctx$2.50$15.00
deepseek-v4-proDeepSeek · 6 providers · 1.0M ctx$1.04$2.08
deepseek-v4-flashDeepSeek · 5 providers · 1.0M ctx$0.07$0.14- iling-2.6-1tInclusionAI · 1 provider · 262K ctx$0.30$2.50
mimo-v2.5-proXiaomi · 2 providers · 1.0M ctx$0.43$0.87
mimo-v2.5Xiaomi · 2 providers · 1.0M ctx$0.14$0.28- iling-2.6-flashInclusionAI · 1 provider · 262K ctx$0.10$0.30
kimi-k2.6Moonshot AI · 5 providers · 262K ctx$0.60$2.80
claude-opus-4-7Anthropic · 3 providers · 1M ctx$5.00$25.00
glm-5.1Z.AI · 5 providers · 205K ctx$0.84$2.80
gemma-4-26b-a4b-itGoogle · 3 providers · 262K ctx$0.06$0.27
gemma-4-31b-itGoogle · 2 providers · 262K ctxFreeFree
qwen3.6-plusAlibaba (Qwen) · 1 provider · 1M ctx$0.50$3.00
kimi-k2.5Moonshot AI · 3 providers · 262K ctx$0.45$2.25- kkat-coder-proKwaiPilot · 1 provider · 256K ctx$0.30$1.20
grok-4.2-betaxAI · 1 provider · 2M ctx$2.00$6.00
minimax-m2.7-highspeedMiniMax · 2 providers · 205K ctx$0.60$2.40
minimax-m2.7MiniMax · 3 providers · 200K ctx$0.30$1.20
gpt-5.3-chatOpenAI · 2 providers · 128K ctx$1.75$14.00
gpt-5.4-nanoOpenAI · 2 providers · 400K ctx$0.10$0.63
gpt-5.4-miniOpenAI · 3 providers · 400K ctx$0.38$2.25
mistral-small-2603Mistral AI · 1 provider · 256K ctx$0.17$0.66
nemotron-3-super-120b-a12bNVIDIA · 2 providers · 1.0M ctxFreeFree
nvidia-nemotron-3-super-120b-a12bNVIDIA · 1 provider · 262K ctx$0.07$0.32- bseed-2.0-proByteDance · 1 provider · 256K ctx$0.50$3.00
- bseed-2.0-codeByteDance · 1 provider · 256K ctx$0.50$3.00
qwen3.5-2bAlibaba (Qwen) · 1 provider · 262K ctx$0.02$0.10
gpt-5.4-proOpenAI · 2 providers · 1.1M ctx$30.00$180.00
gpt-5.4OpenAI · 4 providers · 1.1M ctx$1.25$7.50- bseed-2.0-miniByteDance · 1 provider · 256K ctx$0.10$0.40
qwen3.5-35b-a3bAlibaba (Qwen) · 1 provider · 262K ctx$0.11$0.80
qwen3.5-27bAlibaba (Qwen) · 1 provider · 262K ctx$0.21$2.08
gpt-5.3-codexOpenAI · 2 providers · 400K ctx$1.75$14.00
gemini-3.1-pro-previewGoogle · 2 providers · 1.0M ctx$1.00$6.00
claude-sonnet-4-6Anthropic · 3 providers · 1M ctx$3.00$15.00
qwen3.5-397b-a17bAlibaba (Qwen) · 3 providers · 262K ctx$0.36$2.40
minimax-m2.5MiniMax · 4 providers · 200K ctx$0.28$1.10
minimax-m2.5-highspeedMiniMax · 1 provider · 200K ctx$0.60$2.40
glm-5Z.AI · 2 providers · 203K ctx$1.00$3.20
claude-opus-4-6Anthropic · 3 providers · 1M ctx$5.00$25.00
gpt-5.2-codexOpenAI · 2 providers · 400K ctx$1.75$14.00
glm-4.7Z.AI · 1 provider · 200K ctx$0.60$2.20
gemini-3-flash-previewGoogle · 2 providers · 1.0M ctx$0.25$1.50
nemotron-3-nano-30b-a3bNVIDIA · 2 providers · 262K ctxFreeFree
gpt-5.2-chatOpenAI · 1 provider · 128K ctx$1.75$14.00
gpt-5.2OpenAI · 3 providers · 400K ctx$0.88$7.00
mistral-large-latestMistral AI · 1 provider · 131K ctx$0.55$1.65
gpt-5.1-chatOpenAI · 1 provider · 128K ctx$1.25$10.00
deepseek-v3.2DeepSeek · 2 providers · 164K ctx$0.27$0.40
claude-opus-4-5Anthropic · 3 providers · 200K ctx$5.00$25.00
grok-4-1-fast-non-reasoningxAI · 1 provider · 2M ctx$0.20$0.50
grok-4-1-fast-reasoningxAI · 1 provider · 2M ctx$0.20$0.50
gpt-5.1OpenAI · 3 providers · 400K ctx$0.63$5.00
gpt-5.1-codexOpenAI · 1 provider · 400K ctx$1.25$10.00
minimax-m2MiniMax · 1 provider · 200K ctx$0.30$1.20
claude-haiku-4-5Anthropic · 3 providers · 200K ctx$1.00$5.00
gemini-2.5-flash-imageGoogle · 2 providers · 1.0M ctx$0.30$2.50
gpt-5-proOpenAI · 1 provider · 400K ctx$15.00$120.00
glm-4.6Z.AI · 2 providers · 205K ctx$0.60$2.20
claude-sonnet-4-5Anthropic · 3 providers · 1M ctx$3.00$15.00
qwen3-maxAlibaba (Qwen) · 2 providers · 262K ctx$0.86$3.44
qwen3-coder-plusAlibaba (Qwen) · 1 provider · 1.0M ctx$1.00$5.00
gpt-5-codexOpenAI · 1 provider · 400K ctx$1.25$10.00
grok-4-fastxAI · 1 provider · 2M ctx$0.20$0.50
grok-4-fast-non-reasoningxAI · 1 provider · 2M ctx$0.20$0.50
qwen3-coder-flashAlibaba (Qwen) · 1 provider · 1.0M ctx$0.30$1.50
qwen3-next-80b-a3b-thinkingAlibaba (Qwen) · 1 provider · 128K ctx$0.15$1.20
grok-code-fast-1xAI · 1 provider · 256K ctx$0.20$1.50- nhermes-4-70bNous Research · 1 provider · 128K ctx$0.13$0.40
- nhermes-4-405bNous Research · 1 provider · 128K ctx$1.00$3.00
deepseek-v3.1DeepSeek · 1 provider · 164K ctx$0.20$0.76- bbaichuan-m2-32bBaichuan · 1 provider · 131K ctx$0.07$0.07
gpt-5OpenAI · 3 providers · 400K ctx$0.63$5.00
gpt-5-miniOpenAI · 3 providers · 400K ctx$0.13$1.00
gpt-5-nanoOpenAI · 3 providers · 400K ctx$0.02$0.20
gpt-oss-120bOpenAI · 3 providers · 131K ctx$0.15$0.60
gpt-oss-20bOpenAI · 2 providers · 131K ctx$0.07$0.30
claude-opus-4-1Anthropic · 2 providers · 200K ctx$15.00$75.00
codestral-latestMistral AI · 1 provider · 131K ctx$0.33$0.99
qwen3-30b-a3b-instruct-2507Alibaba (Qwen) · 2 providers · 131K ctx$0.10$0.30
glm-4.5Z.AI · 2 providers · 131K ctx$0.60$2.20
glm-4.5-airZ.AI · 1 provider · 131K ctx$0.20$1.10
qwen3-235b-a22b-thinking-2507Alibaba (Qwen) · 1 provider · 262K ctx$0.18$1.84
qwen3-coder-480b-a35b-instruct-turboAlibaba (Qwen) · 1 provider · 262K ctx$0.24$0.80
qwen3-coder-480b-a35b-instructAlibaba (Qwen) · 1 provider · 262K ctx$0.40$1.60
gemini-2.5-flash-liteGoogle · 2 providers · 1.0M ctx$0.05$0.20
qwen3-235b-a22b-instruct-2507Alibaba (Qwen) · 3 providers · 262K ctx$0.07$0.10
kimi-k2Moonshot AI · 1 provider · 262K ctx$0.60$2.50
kimi-k2-instructMoonshot AI · 1 provider · 131K ctx$0.57$2.30
devstral-small-latestMistral AI · 1 provider · 131K ctx$0.11$0.33
grok-4xAI · 1 provider · 256K ctx$3.00$15.00
gemini-2.5-flashGoogle · 2 providers · 1.0M ctx$0.15$1.25
gemini-2.5-proGoogle · 2 providers · 1.0M ctx$0.63$5.00
o3-proOpenAI · 1 provider · 200K ctx$20.00$80.00
claude-sonnet-4Anthropic · 2 providers · 1M ctx$3.00$15.00
claude-opus-4Anthropic · 1 provider · 200K ctx$15.00$75.00
qwen3-32bAlibaba (Qwen) · 2 providers · 128K ctx$0.06$0.22
qwen3-235b-a22bAlibaba (Qwen) · 2 providers · 128K ctx$0.20$0.60
o3OpenAI · 1 provider · 200K ctx$1.00$4.00
o4-miniOpenAI · 3 providers · 200K ctx$0.55$2.20
gpt-4.1OpenAI · 3 providers · 1.0M ctx$2.00$8.00
gpt-4.1-miniOpenAI · 3 providers · 1.0M ctx$0.40$1.60
gpt-4.1-nanoOpenAI · 3 providers · 1.0M ctx$0.10$0.40
llama-4-maverick-17b-128e-instructMeta · 1 provider · 1.0M ctx$0.20$0.85
deepseek-v3-0324DeepSeek · 1 provider · 128K ctx$0.40$1.30
mistral-small-2503Mistral AI · 1 provider · 33K ctx$0.11$0.33
gemma-3-27b-itGoogle · 1 provider · 128K ctx$0.10$0.30
parasail-gemma3-27b-itGoogle · 1 provider · 128K ctx$0.30$0.50
sonar-reasoning-proPerplexity · 1 provider · 131K ctx$2.00$8.00
sonar-proPerplexity · 1 provider · 205K ctx$3.00$15.00
grok-3-minixAI · 1 provider · 131K ctx$0.30$0.50
grok-3xAI · 1 provider · 131K ctx$5.00$25.00
parasail-qwen25-vl-72b-instructAlibaba (Qwen) · 1 provider · 33K ctx$0.70$0.70
qwen-plusAlibaba (Qwen) · 1 provider · 131K ctx$0.40$1.20
o3-miniOpenAI · 2 providers · 200K ctx$1.10$4.40
sonarPerplexity · 1 provider · 131K ctx$1.00$1.00
qwen-maxAlibaba (Qwen) · 1 provider · 33K ctx$1.60$6.40
deepseek-r1-distill-llama-70bDeepSeek · 2 providers · 64K ctx$0.23$0.69
deepseek-reasonerDeepSeek · 1 provider · 1M ctx$0.14$0.28
deepseek-r1-turboDeepSeek · 1 provider · 64K ctx$0.70$2.50
deepseek-r1DeepSeek · 2 providers · 64K ctx$0.85$2.50
phi-4Microsoft · 1 provider · 16K ctx$0.06$0.11
deepseek-chatDeepSeek · 1 provider · 1M ctx$0.14$0.28
deepseek-v3DeepSeek · 2 providers · 128K ctx$0.26$0.71
deepseek-v3-turboDeepSeek · 1 provider · 128K ctx$0.40$1.30- sl3-8b-stheno-v3.2Sao10K · 1 provider · 8K ctx$0.05$0.05
o1OpenAI · 1 provider · 200K ctx$15.00$60.00
llama-3.3-70b-instructMeta · 3 providers · 131K ctx$0.13$0.39
llama-3.3-70b-instruct-turboMeta · 1 provider · 131K ctx$0.08$0.26
gpt-4o-2024-11-20OpenAI · 1 provider · 128K ctx$2.50$10.00
qwen2.5-coder-32b-instructAlibaba (Qwen) · 1 provider · 16K ctx$0.07$0.16
qwen-turboAlibaba (Qwen) · 1 provider · 1M ctx$0.05$0.20
llama-3.2-90b-vision-instructMeta · 1 provider · 131K ctx$0.35$0.40
qwen-2.5-72b-instructAlibaba (Qwen) · 1 provider · 32K ctx$0.38$0.40
qwen2.5-72b-instructAlibaba (Qwen) · 1 provider · 131K ctx$0.23$0.40- sl31-70b-euryale-v2.2Sao10K · 1 provider · 16K ctx$1.48$1.48
- sl3-8b-lunarisSao10K · 1 provider · 8K ctx$0.05$0.05
gpt-4o-2024-08-06OpenAI · 1 provider · 128K ctx$2.50$10.00
llama-3.1-8b-instructMeta · 1 provider · 16K ctx$0.05$0.05
meta-llama-3.1-70b-instructMeta · 1 provider · 131K ctx$0.23$0.40
meta-llama-3.1-405b-instructMeta · 1 provider · 131K ctx$0.80$0.80
meta-llama-3.1-8b-instruct-turboMeta · 1 provider · 131K ctx$0.02$0.05
mistral-nemoMistral AI · 1 provider · 131K ctx$0.17$0.17
gpt-4o-miniOpenAI · 2 providers · 128K ctx$0.15$0.60
gpt-4o-2024-05-13OpenAI · 1 provider · 128K ctx$2.50$10.00
wizardlm-2-8x22bMicrosoft · 1 provider · 66K ctx$0.62$0.62
open-mistral-7bMistral AI · 1 provider · 33K ctx$0.28$0.28- gmythomax-l2-13bGryphe · 1 provider · 4K ctx$0.09$0.09
Frequently asked questions
Everything you need to know about accessing hundreds of AI models through a single API.
How many AI models can I access through Requesty?
Requesty routes to 684+ models across 30 providers, including OpenAI, Anthropic, Google Gemini, AWS Bedrock, Azure OpenAI, Google Vertex AI, DeepSeek, Meta Llama, xAI Grok, Mistral, Moonshot Kimi, Alibaba Qwen, Zhipu GLM and MiniMax. Use any of them through a single OpenAI-compatible API.
What is the difference between a model and an endpoint?
A model is one trained model, like Claude Sonnet 4.5. An endpoint is one provider's deployment of it in one region, and popular models have a dozen of those at different prices, context limits and data policies. The catalog holds 207 models served by 684 endpoints. The explorer above switches between the two views: Models groups every deployment onto one row, Endpoints lists them all so you can compare price and region directly.
Does Requesty charge markup on top of provider pricing?
On pay as you go, Requesty adds 5% to the upstream provider rate: a model that costs $10 per 1M tokens costs $10.50 through Requesty. Bring your own provider keys and the markup is 0%. Either way, smart routing, automatic failover, prompt caching, analytics and a single unified API are included, with no per-seat or per-request fees.
Which model is best for coding?
On SWE-Bench Verified (the most realistic coding benchmark, based on real GitHub issues) GPT-5.2 Codex, Claude Opus 4.7 and Claude Sonnet 4.6 currently lead. MiniMax M2.5 is the strongest open-weights option. The coding leaderboard ranks thirty models on live scores, and each model page carries its full benchmark chart.See the coding leaderboard→
Which model is best for reasoning and math?
For graduate-level reasoning (GPQA Diamond), GPT-5.4, Grok 4 and Claude Opus 4.7 lead the pack. For math (AIME, MATH benchmarks), GPT-5.4 and Grok 4 currently top the charts, with DeepSeek R1 offering strong performance at a fraction of the price.
What is the longest context window available?
Several models now support 1M+ token context windows, great for whole-codebase analysis or long document reasoning. Gemini 2.5 Pro and some Claude variants lead on context length. Note that effective quality often degrades past 128K tokens; prompt caching (supported on many models) is usually a better approach for repeated long context.
Are there free AI models I can use?
Yes, 12 models on Requesty have a zero-cost tier, including several Llama variants and DeepSeek models via third-party hosts. They're ideal for prototyping and development. You can filter by "Free" in the model explorer above.Browse all free models→
How do I switch between models in my code?
Requesty is OpenAI-SDK compatible. Point base_url to "https://router.requesty.ai/v1", set your API key, and change the "model" parameter to any supported model ID (e.g. "anthropic/claude-opus-5", "openai/gpt-5.6-sol", "vertex/gemini-3.7-flash"). No library changes needed. The same code works across providers.
Is my data private? Is it used for training?
Most major providers (Anthropic, Vertex AI, Azure OpenAI, AWS Bedrock) do not use API data for training by default. OpenAI offers zero-retention deployments via enterprise tiers. Each model detail page shows the specific data retention and training policy for that provider. Requesty itself never uses your data for training.
Can I get regional deployments (EU, US, APAC)?
Yes. Models available through AWS Bedrock, Azure OpenAI, and Google Vertex AI can be pinned to specific regions (eu-west-1, us-east5, etc.) using the @region suffix. Useful for GDPR, HIPAA, and data residency requirements. Filter by Region in the explorer to see all options.
How are benchmark scores calculated?
Benchmark scores shown on Requesty are sourced from official model cards, Artificial Analysis, and public leaderboards (LiveBench, SWE-Bench, Vellum). Scores measure specific skills and do not capture every aspect of model quality. Always test on your own workload. Each model detail page links the canonical benchmark sources.
