# LiteLLM Model Catalog > Pricing, context windows and providers for 1,409 AI models, from LiteLLM's open-source model price file. Every model page has a markdown copy at the same URL plus `.md`, and model pages also return markdown for `Accept: text/markdown`. ## Overview - [All models](https://models.litellm.ai/models): every model with its headline price, newest first - [Price file on GitHub](https://github.com/BerriAI/litellm/blob/main/model_prices_and_context_window.json): the raw data, updated several times a day - [LiteLLM docs](https://docs.litellm.ai): the SDK and AI gateway that use these prices for cost tracking ## Providers - [Fireworks AI](https://models.litellm.ai/providers/fireworks_ai): 286 models - [Amazon Bedrock](https://models.litellm.ai/providers/bedrock): 165 models - [Google Vertex AI](https://models.litellm.ai/providers/vertex_ai): 139 models - [Azure AI Foundry](https://models.litellm.ai/providers/azure_ai): 133 models - [Novita AI](https://models.litellm.ai/providers/novita): 130 models - [DeepInfra](https://models.litellm.ai/providers/deepinfra): 128 models - [Azure OpenAI](https://models.litellm.ai/providers/azure): 101 models - [OpenAI](https://models.litellm.ai/providers/openai): 100 models - [Vercel AI Gateway](https://models.litellm.ai/providers/vercel_ai_gateway): 96 models - [Perplexity](https://models.litellm.ai/providers/perplexity): 83 models - [Together AI](https://models.litellm.ai/providers/together_ai): 79 models - [AIHubMix](https://models.litellm.ai/providers/aihubmix): 72 models - [Google AI Studio](https://models.litellm.ai/providers/gemini): 70 models - [Databricks](https://models.litellm.ai/providers/databricks): 62 models - [Nebius AI Studio](https://models.litellm.ai/providers/nebius): 55 models - [Mistral AI](https://models.litellm.ai/providers/mistral): 50 models - [Deepgram](https://models.litellm.ai/providers/deepgram): 41 models - [Oracle Cloud (OCI)](https://models.litellm.ai/providers/oci): 41 models - [Replicate](https://models.litellm.ai/providers/replicate): 39 models - [xAI](https://models.litellm.ai/providers/xai): 36 models - [GitHub Copilot](https://models.litellm.ai/providers/github_copilot): 35 models - [Snowflake Cortex](https://models.litellm.ai/providers/snowflake): 35 models - [Voyage AI](https://models.litellm.ai/providers/voyage): 31 models - [IBM watsonx.ai](https://models.litellm.ai/providers/watsonx): 30 models - [Alibaba Cloud Model Studio](https://models.litellm.ai/providers/dashscope): 29 models - [Cloudflare Workers AI](https://models.litellm.ai/providers/cloudflare): 29 models - [Qianwen AI Platform](https://models.litellm.ai/providers/qwen_ai_platform): 29 models - [Weights & Biases](https://models.litellm.ai/providers/wandb): 28 models - [QwenCloud](https://models.litellm.ai/providers/qwencloud): 27 models - [Baseten](https://models.litellm.ai/providers/baseten): 26 models - [fal](https://models.litellm.ai/providers/fal_ai): 26 models - [Ollama](https://models.litellm.ai/providers/ollama): 23 models - [Stability AI](https://models.litellm.ai/providers/stability): 23 models - [Cohere](https://models.litellm.ai/providers/cohere): 20 models - [Lambda](https://models.litellm.ai/providers/lambda_ai): 20 models - [ChatGPT Subscription](https://models.litellm.ai/providers/chatgpt): 19 models - [Anthropic](https://models.litellm.ai/providers/anthropic): 17 models - [GMI Cloud](https://models.litellm.ai/providers/gmi): 16 models - [LlamaGate](https://models.litellm.ai/providers/llamagate): 16 models - [Z.ai](https://models.litellm.ai/providers/zai): 16 models - [Nscale](https://models.litellm.ai/providers/nscale): 15 models - [OVHcloud](https://models.litellm.ai/providers/ovhcloud): 15 models - [Scaleway](https://models.litellm.ai/providers/scaleway): 15 models - [Volcano Engine](https://models.litellm.ai/providers/volcengine): 14 models - [GradientAI](https://models.litellm.ai/providers/gradient_ai): 13 models - [Runway](https://models.litellm.ai/providers/runwayml): 13 models - [AI/ML API](https://models.litellm.ai/providers/aiml): 12 models - [Anyscale](https://models.litellm.ai/providers/anyscale): 12 models - [LibertAI](https://models.litellm.ai/providers/libertai): 12 models - [Groq](https://models.litellm.ai/providers/groq): 11 models - [Hyperbolic](https://models.litellm.ai/providers/hyperbolic): 11 models - [Moonshot AI](https://models.litellm.ai/providers/moonshot): 11 models - [Sail](https://models.litellm.ai/providers/sail): 11 models - [AI21 Labs](https://models.litellm.ai/providers/ai21): 10 models - [DeepSeek](https://models.litellm.ai/providers/deepseek): 10 models - [MiniMax](https://models.litellm.ai/providers/minimax): 10 models - [Tensormesh](https://models.litellm.ai/providers/tensormesh): 10 models - [PublicAI](https://models.litellm.ai/providers/publicai): 9 models - [Black Forest Labs](https://models.litellm.ai/providers/black_forest_labs): 8 models - [SambaNova](https://models.litellm.ai/providers/sambanova): 8 models - [Cerebras](https://models.litellm.ai/providers/cerebras): 7 models - [FriendliAI](https://models.litellm.ai/providers/friendliai): 7 models - [GigaChat](https://models.litellm.ai/providers/gigachat): 7 models - [Amazon SageMaker](https://models.litellm.ai/providers/sagemaker): 6 models - [Crusoe](https://models.litellm.ai/providers/crusoe): 6 models - [Meta Model API](https://models.litellm.ai/providers/meta): 6 models - [Pinstripes](https://models.litellm.ai/providers/pinstripes): 6 models - [ElevenLabs](https://models.litellm.ai/providers/elevenlabs): 5 models - [Lemonade](https://models.litellm.ai/providers/lemonade): 5 models - [Amazon Nova](https://models.litellm.ai/providers/amazon_nova): 4 models - [AWS - Polly](https://models.litellm.ai/providers/aws_polly): 4 models - [Heroku](https://models.litellm.ai/providers/heroku): 4 models - [Meta Llama API](https://models.litellm.ai/providers/meta_llama): 4 models - [Cognition](https://models.litellm.ai/providers/cognition): 3 models - [Inception Labs](https://models.litellm.ai/providers/inception): 3 models - [Tencent TokenHub](https://models.litellm.ai/providers/tencent): 3 models - [V0](https://models.litellm.ai/providers/v0): 3 models - [AssemblyAI](https://models.litellm.ai/providers/assemblyai): 2 models - [Azure Text](https://models.litellm.ai/providers/azure_text): 2 models - [Darkbloom](https://models.litellm.ai/providers/darkbloom): 2 models - [Featherless AI](https://models.litellm.ai/providers/featherless_ai): 2 models - [Morph](https://models.litellm.ai/providers/morph): 2 models - [NLP Cloud](https://models.litellm.ai/providers/nlp_cloud): 2 models - [NVIDIA NIM](https://models.litellm.ai/providers/nvidia_nim): 2 models - [Prism](https://models.litellm.ai/providers/prism): 2 models - [Recraft](https://models.litellm.ai/providers/recraft): 2 models - [SCX.ai](https://models.litellm.ai/providers/scx-ai): 2 models - [Soniox](https://models.litellm.ai/providers/soniox): 2 models - [Xiaomi MiMo](https://models.litellm.ai/providers/xiaomi_mimo): 2 models - [Codestral](https://models.litellm.ai/providers/codestral): 1 models - [Jina AI](https://models.litellm.ai/providers/jina_ai): 1 models - [Microsoft 365 Copilot](https://models.litellm.ai/providers/microsoft_365_copilot): 1 models - [Sarvam](https://models.litellm.ai/providers/sarvam): 1 models - [Text Completion Codestral](https://models.litellm.ai/providers/text-completion-codestral): 1 models - [Transcribe](https://models.litellm.ai/providers/transcribe): 1 models ## Models - [Cohere Embed V5 Fast](https://models.litellm.ai/models/cohere-embed-v5-fast.md): $0.08 per 1M tokens, 128K context, 1 provider - [Cohere Embed V5 Pro](https://models.litellm.ai/models/cohere-embed-v5-pro.md): $0.12 per 1M tokens, 128K context, 1 provider - [Mistral Large 4](https://models.litellm.ai/models/mistral-large-4.md): $0.68 / $2.09 per 1M tokens, 1M context, 1 provider - [Gemini Nano Banana 2.1](https://models.litellm.ai/models/gemini-nano-banana-2.1.md): $0.0336 per image, 128K context, 2 providers - [Nova 2.5 Sonic](https://models.litellm.ai/models/nova-2-5-sonic.md): $0.33 / $2.75 per 1M tokens, 1 provider - [Embed V5.0 Fast](https://models.litellm.ai/models/embed-v5.0-fast.md): $0.08 per 1M tokens, 128K context, 1 provider - [Embed V5.0 Pro](https://models.litellm.ai/models/embed-v5.0-pro.md): $0.12 per 1M tokens, 128K context, 1 provider - [Grok Imagine Video 1.5 Lite](https://models.litellm.ai/models/grok-imagine-video-1.5-lite.md): $0.02 per second, 1 provider - [Rerank 1](https://models.litellm.ai/models/rerank-1.md): $0.05 per 1M input tokens, 8K context, 1 provider - [Rerank Lite 1](https://models.litellm.ai/models/rerank-lite-1.md): $0.02 per 1M input tokens, 4K context, 1 provider - [Voyage Large 2 Instruct](https://models.litellm.ai/models/voyage-large-2-instruct.md): $0.12 per 1M tokens, 16K context, 1 provider - [DeepSeek V4.1 Flash Fast](https://models.litellm.ai/models/deepseek-v4.1-flash-fast.md): $0.60 / $2.40 per 1M tokens, 1M context, 1 provider - [GPT-6.1 Sol](https://models.litellm.ai/models/gpt-6.1-sol.md): $2 / $10 per 1M tokens, 922K context, 8 providers - [Claude Sonnet 5.5](https://models.litellm.ai/models/claude-sonnet-5-5.md): $2 / $10 per 1M tokens, 1M context, 7 providers - [Mai Cyber 1 Flash](https://models.litellm.ai/models/mai-cyber-1-flash.md): $0.60 / $3.50 per 1M tokens, 256K context, 1 provider - [C4ai Aya Expanse 32B](https://models.litellm.ai/models/c4ai-aya-expanse-32b.md): $0.50 / $1.50 per 1M tokens, 128K context, 1 provider - [Gemma 4 12B IT](https://models.litellm.ai/models/gemma-4-12b-it.md): $0.30 / $2 per 1M tokens, 16K context, 1 provider - [Llama Rank V1](https://models.litellm.ai/models/llama-rank-v1.md): $0.10 per 1M input tokens, 8K context, 1 provider - [DeepSeek V4p1 Flash Us](https://models.litellm.ai/models/deepseek-v4p1-flash-us.md): $0.45 / $1.80 per 1M tokens, 1M context, 1 provider - [GLM 5p3 Flash Us](https://models.litellm.ai/models/glm-5p3-flash-us.md): $0.225 / $0.75 per 1M tokens, 1M context, 1 provider - [GLM 5p3 Us](https://models.litellm.ai/models/glm-5p3-us.md): $2.10 / $6.60 per 1M tokens, 1M context, 1 provider - [Chirp 2](https://models.litellm.ai/models/chirp_2.md): $0.016 per minute, 1 provider - [Cohere Command A Plus](https://models.litellm.ai/models/cohere-command-a-plus.md): $0.80 / $3.20 per 1M tokens, 128K context, 1 provider - [Deep Research Max Preview](https://models.litellm.ai/models/deep-research-max-preview.md): $2 / $12 per 1M tokens, 1M context, 1 provider - [Deep Research Preview](https://models.litellm.ai/models/deep-research-preview.md): $2 / $12 per 1M tokens, 1M context, 1 provider - [Fw DeepSeek V4 Flash](https://models.litellm.ai/models/fw-deepseek-v4-flash.md): $0.15 / $0.31 per 1M tokens, 1M context, 1 provider - [Fw DeepSeek V4.1 Flash](https://models.litellm.ai/models/fw-deepseek-v4.1-flash.md): $0.375 / $1.50 per 1M tokens, 1M context, 1 provider - [Fw GLM 5.3](https://models.litellm.ai/models/fw-glm-5.3.md): $1.75 / $5.50 per 1M tokens, 1M context, 1 provider - [Fw GLM 5.3 Flash](https://models.litellm.ai/models/fw-glm-5.3-flash.md): $0.188 / $0.625 per 1M tokens, 1M context, 1 provider - [Fw GPT OSS 120B](https://models.litellm.ai/models/fw-gpt-oss-120b.md): $0.165 / $0.66 per 1M tokens, 128K context, 1 provider - [Gemini 2.5 Flash TTS](https://models.litellm.ai/models/gemini-2.5-flash-tts.md): $0.50 per 1M input tokens, 1 provider - [Gemini 2.5 Pro TTS](https://models.litellm.ai/models/gemini-2.5-pro-tts.md): $1 per 1M input tokens, 1 provider - [Gemini 3.8 Flash Cyber](https://models.litellm.ai/models/gemini-3.8-flash-cyber.md): $1.50 / $7.50 per 1M tokens, 1M context, 1 provider - [Lyria Realtime Exp](https://models.litellm.ai/models/lyria-realtime-exp.md): Free, 1M context, 1 provider - [Mai Image 2.6](https://models.litellm.ai/models/mai-image-2.6.md): $5 per 1M input tokens, 32K context, 1 provider - [Mai Image 2.6 Flash](https://models.litellm.ai/models/mai-image-2.6-flash.md): $1.75 per 1M input tokens, 32K context, 1 provider - [Virtual Try On 001](https://models.litellm.ai/models/virtual-try-on-001.md): $0.06 per image, 1 provider - [Ember 1](https://models.litellm.ai/models/ember-1.md): $3 / $15 per 1M tokens, 1M context, 1 provider - [Gemini 3.8 Flash Lite TTS](https://models.litellm.ai/models/gemini-3.8-flash-lite-tts.md): $0.50 per 1M input tokens, 8K context, 2 providers - [Gemini 3.8 Flash TTS](https://models.litellm.ai/models/gemini-3.8-flash-tts.md): $0.50 per 1M input tokens, 8K context, 2 providers - [Gemini Omni 1.1 Flash Preview](https://models.litellm.ai/models/gemini-omni-1.1-flash-preview.md): $1.50 / $9 per 1M tokens, 58K context, 1 provider - [Tev1 4B Experimental](https://models.litellm.ai/models/tev1-4b-experimental.md): $0.042 / $0 per 1M tokens, 32K context, 1 provider - [Claude Opus 5.5](https://models.litellm.ai/models/claude-opus-5-5.md): $4 / $20 per 1M tokens, 1M context, 8 providers - [FLUX Lora Depth](https://models.litellm.ai/models/flux-lora-depth.md): $0.035 per image, 1 provider - [GPT-6 Luna](https://models.litellm.ai/models/gpt-6-luna.md): $0.10 / $0.50 per 1M tokens, 922K context, 8 providers - [GPT-6 Sol](https://models.litellm.ai/models/gpt-6-sol.md): $2 / $10 per 1M tokens, 922K context, 8 providers - [Grok 4.20 Beta](https://models.litellm.ai/models/grok-4.20-beta.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Beta Latest Non Reasoning](https://models.litellm.ai/models/grok-4.20-beta-latest-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Beta Latest Reasoning](https://models.litellm.ai/models/grok-4.20-beta-latest-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Beta Non Reasoning](https://models.litellm.ai/models/grok-4.20-beta-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Beta Reasoning](https://models.litellm.ai/models/grok-4.20-beta-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Experimental Beta](https://models.litellm.ai/models/grok-4.20-experimental-beta.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Experimental Beta 0304 Non Reasoning](https://models.litellm.ai/models/grok-4.20-experimental-beta-0304-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Experimental Beta 0304 Reasoning](https://models.litellm.ai/models/grok-4.20-experimental-beta-0304-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Experimental Beta Non Reasoning](https://models.litellm.ai/models/grok-4.20-experimental-beta-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Experimental Beta Reasoning](https://models.litellm.ai/models/grok-4.20-experimental-beta-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Multi Agent Experimental Beta](https://models.litellm.ai/models/grok-4.20-multi-agent-experimental-beta.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Non Reasoning Gv2](https://models.litellm.ai/models/grok-4.20-non-reasoning-gv2.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Reasoning Gv2](https://models.litellm.ai/models/grok-4.20-reasoning-gv2.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Moondream3 Preview Query](https://models.litellm.ai/models/moondream3-preview-query.md): $0.40 / $3.50 per 1M tokens, 1 provider - [Trellis](https://models.litellm.ai/models/trellis.md): $0.02 per image, 1 provider - [Trellis 2](https://models.litellm.ai/models/trellis-2.md): $0.30 per image, 1 provider - [Grok 4.7](https://models.litellm.ai/models/grok-4.7.md): $2 / $6 per 1M tokens, 500K context, 5 providers - [H3](https://models.litellm.ai/models/h3.md): $0.13 per second, 1 provider - [Mai Image 2.5 Pro](https://models.litellm.ai/models/mai-image-2.5-pro.md): $0.1085 per image, 32K context, 1 provider - [Mimo V2.6 Flash](https://models.litellm.ai/models/mimo-v2.6-flash.md): $0.14 / $0.28 per 1M tokens, 1M context, 1 provider - [Mimo V2.6 Pro](https://models.litellm.ai/models/mimo-v2.6-pro.md): $0.435 / $0.87 per 1M tokens, 1M context, 1 provider - [Seedance 2.0](https://models.litellm.ai/models/seedance-2.0.md): $0.3034 per second, 1 provider - [Grok Voice Transcribe 1.0](https://models.litellm.ai/models/grok-voice-transcribe-1.0.md): $0 per second, 1 provider - [Grok Voice Transcribe 2.0](https://models.litellm.ai/models/grok-voice-transcribe-2.0.md): $0 per second, 1 provider - [Detect Entities](https://models.litellm.ai/models/detect_entities.md): $0 per second, 1 provider - [Diarize](https://models.litellm.ai/models/diarize.md): $0 per second, 1 provider - [Flux.2 Flex](https://models.litellm.ai/models/flux.2-flex.md): 32K context, 1 provider - [Keyterm](https://models.litellm.ai/models/keyterm.md): $0 per second, 1 provider - [Nova 3 Multilingual](https://models.litellm.ai/models/nova-3-multilingual.md): $0 per second, 1 provider - [Qwen3.8 Omni Flash](https://models.litellm.ai/models/qwen3.8-omni-flash.md): $0.15 / $0.47 per 1M tokens, 992K context, 2 providers - [Redact](https://models.litellm.ai/models/redact.md): $0 per second, 1 provider - [Starttranscriptionjob](https://models.litellm.ai/models/starttranscriptionjob.md): $0 per second, 1 provider - [Agnes 2.5 Flash](https://models.litellm.ai/models/agnes-2.5-flash.md): $0.03 / $0.15 per 1M tokens, 512K context, 1 provider - [Agnes 2.5 Pro](https://models.litellm.ai/models/agnes-2.5-pro.md): $0.45 / $0.90 per 1M tokens, 1M context, 1 provider - [Cc GLM 5.1](https://models.litellm.ai/models/cc-glm-5.1.md): $0.06 / $0.22 per 1M tokens, 200K context, 1 provider - [Claude Opus 4.8 Think](https://models.litellm.ai/models/claude-opus-4-8-think.md): $5 / $25 per 1M tokens, 1M context, 1 provider - [Coding GLM 5.3](https://models.litellm.ai/models/coding-glm-5.3.md): $0.06 / $0.22 per 1M tokens, 1M context, 1 provider - [Coding Kimi K3](https://models.litellm.ai/models/coding-kimi-k3.md): $0.44 / $1.613 per 1M tokens, 1M context, 1 provider - [Coding Xiaomi Mimo V2 Omni](https://models.litellm.ai/models/coding-xiaomi-mimo-v2-omni.md): $0.08 / $0.40 per 1M tokens, 1 provider - [Coding Xiaomi Mimo V2.5](https://models.litellm.ai/models/coding-xiaomi-mimo-v2.5.md): $0.08 / $0.16 per 1M tokens, 1M context, 1 provider - [Coding Xiaomi Mimo V2.5 Pro](https://models.litellm.ai/models/coding-xiaomi-mimo-v2.5-pro.md): $0.20 / $0.40 per 1M tokens, 1M context, 1 provider - [Command A Plus](https://models.litellm.ai/models/command-a-plus.md): Free, 128K context, 2 providers - [Doubao Seed 2.0 Code Preview](https://models.litellm.ai/models/doubao-seed-2-0-code-preview.md): $0.4822 / $2.411 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.0 Lite 260428](https://models.litellm.ai/models/doubao-seed-2-0-lite-260428.md): $0.09041 / $0.5425 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.0 Mini](https://models.litellm.ai/models/doubao-seed-2-0-mini.md): $0.03014 / $0.3014 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.0 Pro](https://models.litellm.ai/models/doubao-seed-2-0-pro.md): $0.4822 / $2.411 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.1 Pro 260628](https://models.litellm.ai/models/doubao-seed-2-1-pro-260628.md): $0.8625 / $4.313 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.1 Turbo](https://models.litellm.ai/models/doubao-seed-2-1-turbo.md): $0.4647 / $2.324 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.1 Turbo 260628](https://models.litellm.ai/models/doubao-seed-2-1-turbo-260628.md): $0.4313 / $2.156 per 1M tokens, 256K context, 1 provider - [Ernie 5.1](https://models.litellm.ai/models/ernie-5.1.md): $0.5634 / $2.535 per 1M tokens, 119K context, 1 provider - [Gemini 3 Flash Preview Search](https://models.litellm.ai/models/gemini-3-flash-preview-search.md): $0.50 / $3 per 1M tokens, 1M context, 1 provider - [Gemini 3.8 Live](https://models.litellm.ai/models/gemini-3.8-live.md): $0.75 / $4.50 per 1M tokens, 128K context, 2 providers - [Gemini 3.8 Live Extended Thinking](https://models.litellm.ai/models/gemini-3.8-live-extended-thinking.md): $0.75 / $4.50 per 1M tokens, 128K context, 1 provider - [GLM 5.2 Fast Preview](https://models.litellm.ai/models/glm-5.2-fast-preview.md): $2.254 / $7.889 per 1M tokens, 1M context, 1 provider - [GPT-5.4 High](https://models.litellm.ai/models/gpt-5.4-high.md): $2.50 / $15 per 1M tokens, 1M context, 1 provider - [GPT-5.4 Low](https://models.litellm.ai/models/gpt-5.4-low.md): $2.50 / $15 per 1M tokens, 1M context, 1 provider - [GPT-5.6 Sol Disc](https://models.litellm.ai/models/gpt-5.6-sol-disc.md): $4 / $20 per 1M tokens, 1M context, 1 provider - [Hy4 Preview](https://models.litellm.ai/models/hy4-preview.md): $0.845 / $2.535 per 1M tokens, 1M context, 1 provider - [Kimi K2.7 Code Highspeed](https://models.litellm.ai/models/kimi-k2.7-code-highspeed.md): $1.90 / $7.999 per 1M tokens, 256K context, 1 provider - [Longcat 2.0](https://models.litellm.ai/models/longcat-2.0.md): $0.7746 / $3.098 per 1M tokens, 1M context, 1 provider - [Mimo V2 Omni](https://models.litellm.ai/models/mimo-v2-omni.md): $0.44 / $2.20 per 1M tokens, 256K context, 1 provider - [Mimo V2 Pro](https://models.litellm.ai/models/mimo-v2-pro.md): $1.10 / $3.30 per 1M tokens, 1M context, 1 provider - [Palmyra Vision 7B](https://models.litellm.ai/models/palmyra-vision-7b.md): $0.15 / $0.60 per 1M tokens, 4K context, 1 provider - [Zai GLM](https://models.litellm.ai/models/zai-glm.md): $1.40 / $4.40 per 1M tokens, 1M context, 1 provider - [Zai GLM 5](https://models.litellm.ai/models/zai-glm-5.md): $1.40 / $4.40 per 1M tokens, 1M context, 1 provider - [Zai GLM 5.3](https://models.litellm.ai/models/zai-glm-5-3.md): $1.40 / $4.40 per 1M tokens, 1M context, 1 provider - [GLM 5p3 Fast](https://models.litellm.ai/models/glm-5p3-fast.md): $2.10 / $6.60 per 1M tokens, 1M context, 2 providers - [GPT Rosalind Research](https://models.litellm.ai/models/gpt-rosalind-research.md): $5 / $25 per 1M tokens, 1 provider - [GPT-5.5 Cyber](https://models.litellm.ai/models/gpt-5.5-cyber.md): $12.50 / $75 per 1M tokens, 1 provider - [Llama 3 70B Instruct Turbo](https://models.litellm.ai/models/llama-3-70b-instruct-turbo.md): $0.88 / $0.88 per 1M tokens, 8K context, 1 provider - [Llama 3 8B Chat HF](https://models.litellm.ai/models/llama-3-8b-chat-hf.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Llama 3.1 Nemotron 70B Instruct HF](https://models.litellm.ai/models/llama-3.1-nemotron-70b-instruct-hf.md): $0.88 / $0.88 per 1M tokens, 32K context, 1 provider - [Qwen2.5 14B Instruct](https://models.litellm.ai/models/qwen2.5-14b-instruct.md): $0.80 / $0.80 per 1M tokens, 32K context, 1 provider - [Trinity Mini](https://models.litellm.ai/models/trinity-mini.md): $0.045 / $0.15 per 1M tokens, 128K context, 1 provider - [Muse Voice Transcribe 1.0](https://models.litellm.ai/models/muse-voice-transcribe-1.0.md): $0.003 per minute, 1 provider - [DeepSeek Flash](https://models.litellm.ai/models/deepseek-flash.md): $0.30 / $1.20 per 1M tokens, 1M context, 1 provider - [DeepSeek V4.1 Flash](https://models.litellm.ai/models/deepseek-v4.1-flash.md): $0.15 / $0.60 per 1M tokens, 1M context, 8 providers - [Kimi K2.5 Fp4](https://models.litellm.ai/models/kimi-k2.5-fp4.md): $0.50 / $2.80 per 1M tokens, 256K context, 1 provider - [Mercury 2.5](https://models.litellm.ai/models/mercury-2.5.md): $0.20 / $0.75 per 1M tokens, 260K context, 1 provider - [Granite 4.2 8B](https://models.litellm.ai/models/granite-4.2-8b.md): $0.10 / $0.15 per 1M tokens, 131K context, 1 provider - [Cohere Command A](https://models.litellm.ai/models/cohere-command-a.md): $2.50 / $10 per 1M tokens, 128K context, 1 provider - [GPT Chat](https://models.litellm.ai/models/gpt-chat.md): $5 / $30 per 1M tokens, 272K context, 3 providers - [GPT Image 2.5 Flare](https://models.litellm.ai/models/gpt-image-2.5-flare.md): $5 per 1M input tokens, 3 providers - [GPT Image 2.5 Sunburst](https://models.litellm.ai/models/gpt-image-2.5-sunburst.md): $5 per 1M input tokens, 3 providers - [Marengo Embed 3.0](https://models.litellm.ai/models/marengo-embed-3-0.md): 500 context, 1 provider - [GPT Daybreak Blue 5.6 Sol](https://models.litellm.ai/models/gpt-daybreak-blue-5.6-sol.md): $4.40 / $22 per 1M tokens, 1M context, 1 provider - [Grok Imagine Video](https://models.litellm.ai/models/grok-imagine-video.md): $0.05 per second, 1 provider - [Grok Imagine Video 1.5](https://models.litellm.ai/models/grok-imagine-video-1.5.md): $0.08 per second, 1 provider - [Grok Imagine Video 1.5 Preview](https://models.litellm.ai/models/grok-imagine-video-1.5-preview.md): $0.08 per second, 1 provider - [Lyria 3.5](https://models.litellm.ai/models/lyria-3.5.md): Free, 128K context, 1 provider - [Rerank V4.0 Fast](https://models.litellm.ai/models/rerank-v4.0-fast.md): $0 per 1M input tokens, 32K context, 1 provider - [Rerank V4.0 Pro](https://models.litellm.ai/models/rerank-v4.0-pro.md): $0 per 1M input tokens, 32K context, 1 provider - [Voyage Multilingual 2](https://models.litellm.ai/models/voyage-multilingual-2.md): $0.12 per 1M tokens, 32K context, 1 provider - [Cohere Parse V5](https://models.litellm.ai/models/cohere-parse-v5.md): 1 provider - [Parse V5.0](https://models.litellm.ai/models/parse-v5.0.md): 1 provider - [Databricks Grok 4.6](https://models.litellm.ai/models/databricks-grok-4-6.md): $2.50 / $7.50 per 1M tokens, 500K context, 1 provider - [Databricks Inkling](https://models.litellm.ai/models/databricks-inkling.md): $1 / $4.05 per 1M tokens, 1M context, 1 provider - [Qwen3.6 Max Preview](https://models.litellm.ai/models/qwen3.6-max-preview.md): $1.268 / $7.608 per 1M tokens, 256K context, 1 provider - [Qwen35 122B A10B](https://models.litellm.ai/models/qwen35-122b-a10b.md): $0.22 / $2.20 per 1M tokens, 256K context, 1 provider - [Claude Mythos 5.1](https://models.litellm.ai/models/claude-mythos-5-1.md): $10 / $50 per 1M tokens, 1M context, 2 providers - [Cosmos3 Super Reasoner](https://models.litellm.ai/models/cosmos3-super-reasoner.md): $0.10 / $0.30 per 1M tokens, 256K context, 1 provider - [Fw Nemotron Lightning 3.5 30B A3B](https://models.litellm.ai/models/fw-nemotron-lightning-3.5-30b-a3b.md): $0.06 / $0.22 per 1M tokens, 256K context, 1 provider - [GPT Daybreak Blue](https://models.litellm.ai/models/gpt-daybreak-blue.md): $4 / $20 per 1M tokens, 922K context, 1 provider - [GPT Daybreak Red](https://models.litellm.ai/models/gpt-daybreak-red.md): $12.50 / $75 per 1M tokens, 400K context, 1 provider - [GPT-6 Astra](https://models.litellm.ai/models/gpt-6-astra.md): $10 / $50 per 1M tokens, 922K context, 8 providers - [Hermes 4 405B](https://models.litellm.ai/models/hermes-4-405b.md): $1 / $3 per 1M tokens, 128K context, 1 provider - [Hermes 4 70B](https://models.litellm.ai/models/hermes-4-70b.md): $0.13 / $0.40 per 1M tokens, 128K context, 1 provider - [Lyria 3.5 Clip Preview](https://models.litellm.ai/models/lyria-3.5-clip-preview.md): Free, 128K context, 1 provider - [Lyria 3.5 Pro Preview](https://models.litellm.ai/models/lyria-3.5-pro-preview.md): Free, 128K context, 1 provider - [Mai Thinking 1](https://models.litellm.ai/models/mai-thinking-1.md): $2 / $8 per 1M tokens, 256K context, 2 providers - [Minicpm V 4.5](https://models.litellm.ai/models/minicpm-v-4_5.md): $0.658 / $1.11 per 1M tokens, 32K context, 1 provider - [Mt0 Xxl](https://models.litellm.ai/models/mt0-xxl.md): $1.908 / $1.908 per 1M tokens, 4K context, 1 provider - [Nemotron 3 Nano Omni](https://models.litellm.ai/models/nemotron-3-nano-omni.md): $0.06 / $0.24 per 1M tokens, 256K context, 1 provider - [Nemotron 3 Super 120B A12B](https://models.litellm.ai/models/nemotron-3-super-120b-a12b.md): $0.30 / $0.90 per 1M tokens, 256K context, 1 provider - [Nemotron 3.5 Lightning 30B A3B](https://models.litellm.ai/models/nemotron-3.5-lightning-30b-a3b.md): $0.0115 / $0.17 per 1M tokens, 1 provider - [Nvidia Nemotron 3 Nano 30B A3B](https://models.litellm.ai/models/nvidia-nemotron-3-nano-30b-a3b.md): $0.06 / $0.24 per 1M tokens, 256K context, 1 provider - [Gemini 3.8 Flash](https://models.litellm.ai/models/gemini-3.8-flash.md): $0.75 / $3.75 per 1M tokens, 1M context, 5 providers - [Grok Build](https://models.litellm.ai/models/grok-build.md): $2 / $6 per 1M tokens, 500K context, 1 provider - [Muse Spark 1.3](https://models.litellm.ai/models/muse-spark-1.3.md): $1.25 / $4.25 per 1M tokens, 1M context, 1 provider - [Muse Spark 1.3 Contributor](https://models.litellm.ai/models/muse-spark-1.3-contributor.md): $0.10 / $0.20 per 1M tokens, 1M context, 1 provider - [Rerank 3](https://models.litellm.ai/models/rerank-3.md): $0.05 per 1M input tokens, 32K context, 1 provider - [Rerank 3 Lite](https://models.litellm.ai/models/rerank-3-lite.md): $0.02 per 1M input tokens, 32K context, 1 provider - [Claude Fable 5.1](https://models.litellm.ai/models/claude-fable-5-1.md): $10 / $50 per 1M tokens, 1M context, 7 providers - [Qwen3.8 Flash](https://models.litellm.ai/models/qwen3.8-flash.md): $0.15 / $0.47 per 1M tokens, 992K context, 4 providers - [Scribe V2](https://models.litellm.ai/models/scribe_v2.md): $0 per second, 1 provider - [Nova 2 Sonic](https://models.litellm.ai/models/nova-2-sonic.md): $0.33 / $2.75 per 1M tokens, 1 provider - [Gemini 3.5 Transcribe Live Preview](https://models.litellm.ai/models/gemini-3.5-transcribe-live-preview.md): $3.50 per 1M input tokens, 1 provider - [Gemini 3.5 Transcribe Preview](https://models.litellm.ai/models/gemini-3.5-transcribe-preview.md): $2 per 1M input tokens, 1 provider - [Labs Leanstral 1.5.1](https://models.litellm.ai/models/labs-leanstral-1-5-1.md): Free, 256K context, 1 provider - [Mistral Code](https://models.litellm.ai/models/mistral-code.md): $0.30 / $0.90 per 1M tokens, 128K context, 1 provider - [Mistral Code Agent](https://models.litellm.ai/models/mistral-code-agent.md): $0.40 / $2 per 1M tokens, 256K context, 1 provider - [Mistral Code Fim](https://models.litellm.ai/models/mistral-code-fim.md): $0.30 / $0.90 per 1M tokens, 128K context, 1 provider - [Mistral Ocr 3](https://models.litellm.ai/models/mistral-ocr-3.md): 1 provider - [Mistral Ocr 3.0](https://models.litellm.ai/models/mistral-ocr-3-0.md): 1 provider - [Mistral Ocr 4](https://models.litellm.ai/models/mistral-ocr-4.md): 1 provider - [Mistral Vibe Cli](https://models.litellm.ai/models/mistral-vibe-cli.md): $1.50 / $7.50 per 1M tokens, 256K context, 1 provider - [Mistral Vibe Cli Fast](https://models.litellm.ai/models/mistral-vibe-cli-fast.md): $0.15 / $0.60 per 1M tokens, 256K context, 1 provider - [Mistral Vibe Cli With Tools](https://models.litellm.ai/models/mistral-vibe-cli-with-tools.md): $1.50 / $7.50 per 1M tokens, 256K context, 1 provider - [Nano Banana Pro Preview](https://models.litellm.ai/models/nano-banana-pro-preview.md): $0.134 per image, 128K context, 1 provider - [Veo 3.1 Lite Generate 001](https://models.litellm.ai/models/veo-3.1-lite-generate-001.md): $0.05 per second, 1K context, 1 provider - [Voxtral Mini Realtime](https://models.litellm.ai/models/voxtral-mini-realtime.md): $0.006 per minute, 1 provider - [Gemini Omni 1.1 Flash](https://models.litellm.ai/models/gemini-omni-1.1-flash.md): $1.50 / $9 per 1M tokens, 1M context, 2 providers - [Cobuddy](https://models.litellm.ai/models/cobuddy.md): $0.28 / $1.13 per 1M tokens, 128K context, 1 provider - [Community](https://models.litellm.ai/models/community.md): $0.89 / $0.89 per 1M tokens, 64K context, 1 provider - [DeepSeek Ocr 2](https://models.litellm.ai/models/deepseek-ocr-2.md): $0.03 / $0.03 per 1M tokens, 8K context, 1 provider - [Gemini 3.5 Transcribe](https://models.litellm.ai/models/gemini-3.5-transcribe.md): $2 per 1M input tokens, 96K context, 2 providers - [Gemini 3.5 Transcribe Live](https://models.litellm.ai/models/gemini-3.5-transcribe-live.md): $3.50 per 1M input tokens, 128K context, 2 providers - [Gemini Live 2.5 Flash Native Audio](https://models.litellm.ai/models/gemini-live-2.5-flash-native-audio.md): $0.50 / $2 per 1M tokens, 128K context, 1 provider - [Gemma 4 31B IT Turbo](https://models.litellm.ai/models/gemma-4-31b-it-turbo.md): $0.09 / $0.34 per 1M tokens, 256K context, 1 provider - [Gemma 4 31B IT Ultra](https://models.litellm.ai/models/gemma-4-31b-it-ultra.md): $0.27 / $0.76 per 1M tokens, 128K context, 1 provider - [Gemma 4 E4B IT](https://models.litellm.ai/models/gemma-4-e4b-it.md): $0.02 / $0.10 per 1M tokens, 128K context, 1 provider - [GLM 4.7 H](https://models.litellm.ai/models/glm-4.7-h.md): $0.60 / $2.20 per 1M tokens, 200K context, 1 provider - [GLM 5 Turbo](https://models.litellm.ai/models/glm-5-turbo.md): $1.20 / $4 per 1M tokens, 203K context, 1 provider - [GLM 5.3](https://models.litellm.ai/models/glm-5.3.md): $1.40 / $4.40 per 1M tokens, 1M context, 12 providers - [GLM 5.3 Flash](https://models.litellm.ai/models/glm-5.3-flash.md): $0.15 / $0.50 per 1M tokens, 1M context, 11 providers - [GLM 5v Turbo](https://models.litellm.ai/models/glm-5v-turbo.md): $0.7042 / $3.098 per 1M tokens, 200K context, 2 providers - [GPT OSS 120B Turbo](https://models.litellm.ai/models/gpt-oss-120b-turbo.md): $0.15 / $0.60 per 1M tokens, 128K context, 1 provider - [GPT OSS 120B Ultra](https://models.litellm.ai/models/gpt-oss-120b-ultra.md): $0.20 / $0.95 per 1M tokens, 128K context, 1 provider - [Granite 4.1 8B](https://models.litellm.ai/models/granite-4.1-8b.md): $0.05 / $0.10 per 1M tokens, 131K context, 1 provider - [Hy3](https://models.litellm.ai/models/hy3.md): $0.14 / $0.58 per 1M tokens, 256K context, 3 providers - [Ling 3.0 Flash](https://models.litellm.ai/models/ling-3.0-flash.md): $0.06 / $0.18 per 1M tokens, 256K context, 2 providers - [Ling 3.0 Flash Fast](https://models.litellm.ai/models/ling-3.0-flash-fast.md): $0.06 / $0.18 per 1M tokens, 256K context, 1 provider - [Macaron V1 Tall](https://models.litellm.ai/models/macaron-v1-tall.md): $0.45 / $2.60 per 1M tokens, 256K context, 1 provider - [Macaron V1 Venti](https://models.litellm.ai/models/macaron-v1-venti.md): $1.50 / $4.50 per 1M tokens, 1M context, 1 provider - [Mellum2 12B A2.5b Instruct](https://models.litellm.ai/models/mellum2-12b-a2.5b-instruct.md): $0.05 / $0.10 per 1M tokens, 131K context, 1 provider - [MiniMax M2.5 Highspeed](https://models.litellm.ai/models/minimax-m2.5-highspeed.md): $0.60 / $2.40 per 1M tokens, 200K context, 1 provider - [MiniMax M2.7 Highspeed](https://models.litellm.ai/models/minimax-m2.7-highspeed.md): $0.60 / $2.40 per 1M tokens, 200K context, 1 provider - [MiniMax M2.7 Turbo](https://models.litellm.ai/models/minimax-m2.7-turbo.md): $0.38 / $1.70 per 1M tokens, 192K context, 1 provider - [Nemotron 3 Nano 30B A3B](https://models.litellm.ai/models/nemotron-3-nano-30b-a3b.md): $0.05 / $0.20 per 1M tokens, 256K context, 2 providers - [Nemotron Content Safety 3.5](https://models.litellm.ai/models/nemotron-content-safety-3.5.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Nvidia Nemotron 3 Super 120B A12B](https://models.litellm.ai/models/nvidia-nemotron-3-super-120b-a12b.md): $0.085 / $0.40 per 1M tokens, 256K context, 1 provider - [Nvidia Nemotron 3 Ultra 550B A55B](https://models.litellm.ai/models/nvidia-nemotron-3-ultra-550b-a55b.md): $0.50 / $2.15 per 1M tokens, 262K context, 3 providers - [Nvidia Nemotron 3.5 Lightning 30B A3B](https://models.litellm.ai/models/nvidia-nemotron-3.5-lightning-30b-a3b.md): $0.07 / $0.20 per 1M tokens, 262K context, 1 provider - [Qwen3 14B Instruct](https://models.litellm.ai/models/qwen3-14b-instruct.md): $0.05 / $0.22 per 1M tokens, 33K context, 1 provider - [Qwen3 Max Thinking](https://models.litellm.ai/models/qwen3-max-thinking.md): $1.20 / $6 per 1M tokens, 256K context, 1 provider - [Qwen3.8 27B](https://models.litellm.ai/models/qwen3.8-27b.md): $0.40 / $3 per 1M tokens, 262K context, 5 providers - [Seed 1.8](https://models.litellm.ai/models/seed-1.8.md): $0.25 / $2 per 1M tokens, 256K context, 1 provider - [Seed 2.0 Code](https://models.litellm.ai/models/seed-2.0-code.md): $0.50 / $3 per 1M tokens, 256K context, 1 provider - [Seed 2.0 Mini](https://models.litellm.ai/models/seed-2.0-mini.md): $0.10 / $0.40 per 1M tokens, 256K context, 1 provider - [Seed 2.0 Pro](https://models.litellm.ai/models/seed-2.0-pro.md): $0.50 / $3 per 1M tokens, 256K context, 1 provider - [Step 3.7 Flash](https://models.litellm.ai/models/step-3.7-flash.md): $0.20 / $1.15 per 1M tokens, 256K context, 3 providers - [Voxtral Small](https://models.litellm.ai/models/voxtral-small.md): $0.10 / $0.40 per 1M tokens, 32K context, 1 provider - [DeepSeek V4 Flash Vision Exp](https://models.litellm.ai/models/deepseek-v4-flash-vision-exp.md): $0.30 / $1.20 per 1M tokens, 1M context, 3 providers - [Inkling](https://models.litellm.ai/models/inkling.md): $0.95 / $4.05 per 1M tokens, 512K context, 4 providers - [Inkling Small](https://models.litellm.ai/models/inkling-small.md): $0.45 / $1.20 per 1M tokens, 512K context, 2 providers - [Nemotron 3 Ultra 550B A55B](https://models.litellm.ai/models/nemotron-3-ultra-550b-a55b.md): $0.25 / $2.50 per 1M tokens, 1M context, 3 providers - [Qwen2 1.5B Instruct](https://models.litellm.ai/models/qwen-2-1.5b-instruct.md): $0.02 / $0.02 per 1M tokens, 32K context, 1 provider - [Qwen3.5 9B](https://models.litellm.ai/models/qwen3.5-9b.md): $0.10 / $0.15 per 1M tokens, 256K context, 2 providers - [Qwen3.8 2.4t A95B](https://models.litellm.ai/models/qwen3.8-2.4t-a95b.md): $2 / $6 per 1M tokens, 1M context, 3 providers - [Ternary Bonsai 27B](https://models.litellm.ai/models/ternary-bonsai-27b.md): Free, 256K context, 1 provider - [Aleph2](https://models.litellm.ai/models/aleph2.md): $0.28 per second, 1 provider - [Gemini Omni Flash](https://models.litellm.ai/models/gemini_omni_flash.md): $0.10 per second, 1 provider - [Gen4.5](https://models.litellm.ai/models/gen4.5.md): $0.12 per second, 1 provider - [Hailuo3](https://models.litellm.ai/models/hailuo3.md): $0.10 per second, 1 provider - [Seedance2](https://models.litellm.ai/models/seedance2.md): $0.36 per second, 1 provider - [Seedance2 5](https://models.litellm.ai/models/seedance-2.5.md): $0.30 per second, 2 providers - [Seedance2 Fast](https://models.litellm.ai/models/seedance2_fast.md): $0.29 per second, 1 provider - [Seedance2 Mini](https://models.litellm.ai/models/seedance2_mini.md): $0.16 per second, 1 provider - [Veo3.1](https://models.litellm.ai/models/veo3.1.md): $0.40 per second, 1 provider - [Veo3.1 Fast](https://models.litellm.ai/models/veo3.1_fast.md): $0.15 per second, 1 provider - [Swe 1.6](https://models.litellm.ai/models/swe-1.6.md): $0.50 / $2.50 per 1M tokens, 1 provider - [Swe 1.7](https://models.litellm.ai/models/swe-1.7.md): $0.50 / $2.50 per 1M tokens, 1 provider - [Swe 1.7 Lightning](https://models.litellm.ai/models/swe-1.7-lightning.md): $2.50 / $12.50 per 1M tokens, 1 provider - [Chat](https://models.litellm.ai/models/chat.md): $5 / $30 per 1M tokens, 400K context, 3 providers - [Daybreak Blue](https://models.litellm.ai/models/daybreak-blue.md): $4 / $20 per 1M tokens, 922K context, 1 provider - [Daybreak Red](https://models.litellm.ai/models/daybreak-red.md): $12.50 / $75 per 1M tokens, 400K context, 1 provider - [Gemini 3.1 Flash Lite Image](https://models.litellm.ai/models/gemini-3.1-flash-lite-image.md): $0.0336 per image, 64K context, 2 providers - [Gemini 3.5 Live Translate Preview](https://models.litellm.ai/models/gemini-3.5-live-translate-preview.md): $3.50 / $21 per 1M tokens, 128K context, 2 providers - [GLM 5p2 Fast](https://models.litellm.ai/models/glm-5p2-fast.md): $2.10 / $6.60 per 1M tokens, 1M context, 2 providers - [GLM 5p2 Fast Us](https://models.litellm.ai/models/glm-5p2-fast-us.md): $2.10 / $6.60 per 1M tokens, 1M context, 1 provider - [GPT-5.6 Cyber](https://models.litellm.ai/models/gpt-5.6-cyber.md): $12.50 / $75 per 1M tokens, 400K context, 2 providers - [Kimi K3 Fast](https://models.litellm.ai/models/kimi-k3-fast.md): $4.50 / $22.50 per 1M tokens, 1M context, 1 provider - [Kimi K3 Us](https://models.litellm.ai/models/kimi-k3-us.md): $4.50 / $22.50 per 1M tokens, 1M context, 1 provider - [Mistral Ocr 4.1](https://models.litellm.ai/models/mistral-ocr-4-1.md): 1 provider - [Muse Glimmer 30B](https://models.litellm.ai/models/muse-glimmer-30b.md): $0.30 / $1.20 per 1M tokens, 128K context, 3 providers - [Nemotron 3 Ultra](https://models.litellm.ai/models/nemotron-3-ultra.md): $0.60 / $2.40 per 1M tokens, 256K context, 1 provider - [Nemotron Lightning 3p5 30B A3B](https://models.litellm.ai/models/nemotron-lightning-3p5-30b-a3b.md): $0.05 / $0.20 per 1M tokens, 256K context, 1 provider - [PPLX Embed Context V1 0.6B](https://models.litellm.ai/models/pplx-embed-context-v1-0.6b.md): $0.008 per 1M tokens, 32K context, 1 provider - [PPLX Embed Context V1 4B](https://models.litellm.ai/models/pplx-embed-context-v1-4b.md): $0.05 per 1M tokens, 32K context, 1 provider - [Voyage 4](https://models.litellm.ai/models/voyage-4.md): $0.06 per 1M tokens, 32K context, 1 provider - [Voyage 4 Large](https://models.litellm.ai/models/voyage-4-large.md): $0.12 per 1M tokens, 32K context, 1 provider - [Voyage 4 Lite](https://models.litellm.ai/models/voyage-4-lite.md): $0.02 per 1M tokens, 32K context, 1 provider - [Voyage Code 4](https://models.litellm.ai/models/voyage-code-4.md): $0.12 per 1M tokens, 32K context, 1 provider - [Voyage Context 4](https://models.litellm.ai/models/voyage-context-4.md): $0.12 per 1M tokens, 120K context, 1 provider - [Voyage Multimodal 3.5](https://models.litellm.ai/models/voyage-multimodal-3.5.md): $0.12 per 1M tokens, 32K context, 1 provider - [Zai GLM 5.2](https://models.litellm.ai/models/zai-glm-5-2.md): $1.40 / $4.40 per 1M tokens, 1M context, 1 provider - [Gemini 3 Flash](https://models.litellm.ai/models/gemini-3-flash.md): $0.625 / $3.75 per 1M tokens, 1M context, 1 provider - [Gemini 3.1 Pro](https://models.litellm.ai/models/gemini-3-1-pro.md): $2 / $12 per 1M tokens, 1M context, 2 providers - [Kimi K3](https://models.litellm.ai/models/kimi-k3.md): $3 / $15 per 1M tokens, 1M context, 13 providers - [Gemini 3.1 Flash TTS Preview](https://models.litellm.ai/models/gemini-3.1-flash-tts-preview.md): $1 per 1M input tokens, 8K context, 2 providers - [Fw DeepSeek V3.2](https://models.litellm.ai/models/fw-deepseek-v3.2.md): $0.62 / $1.85 per 1M tokens, 160K context, 1 provider - [Fw DeepSeek V4 Pro](https://models.litellm.ai/models/fw-deepseek-v4-pro.md): $1.925 / $3.828 per 1M tokens, 1M context, 1 provider - [Fw GLM 5](https://models.litellm.ai/models/fw-glm-5.md): $1.10 / $3.52 per 1M tokens, 200K context, 1 provider - [Fw GLM 5.1](https://models.litellm.ai/models/fw-glm-5.1.md): $1.54 / $4.84 per 1M tokens, 203K context, 1 provider - [Fw GLM 5.2](https://models.litellm.ai/models/fw-glm-5.2.md): $1.54 / $4.84 per 1M tokens, 1M context, 1 provider - [Fw GLM 5.2 Fast](https://models.litellm.ai/models/fw-glm-5.2-fast.md): $2.31 / $7.26 per 1M tokens, 1M context, 1 provider - [Fw Inkling](https://models.litellm.ai/models/fw-inkling.md): $1.10 / $4.46 per 1M tokens, 1M context, 1 provider - [Fw Kimi K2.5](https://models.litellm.ai/models/fw-kimi-k2.5.md): $0.66 / $3.30 per 1M tokens, 256K context, 1 provider - [Fw Kimi K2.6](https://models.litellm.ai/models/fw-kimi-k2.6.md): $1.045 / $4.40 per 1M tokens, 256K context, 1 provider - [Fw Kimi K2.7 Code](https://models.litellm.ai/models/fw-kimi-k2.7-code.md): $1.05 / $4.40 per 1M tokens, 256K context, 1 provider - [Fw Kimi K3](https://models.litellm.ai/models/fw-kimi-k3.md): $3 / $15 per 1M tokens, 1M context, 1 provider - [Fw MiniMax M2.5](https://models.litellm.ai/models/fw-minimax-m2.5.md): $0.33 / $1.32 per 1M tokens, 1M context, 1 provider - [Fw MiniMax M3](https://models.litellm.ai/models/fw-minimax-m3.md): $0.33 / $1.32 per 1M tokens, 512K context, 1 provider - [Fw Nemotron 3 Ultra](https://models.litellm.ai/models/fw-nemotron-3-ultra.md): $0.66 / $2.64 per 1M tokens, 256K context, 1 provider - [Gemini 3.7 Flash](https://models.litellm.ai/models/gemini-3.7-flash.md): $0.75 / $3.75 per 1M tokens, 1M context, 7 providers - [Grok 4.6](https://models.litellm.ai/models/grok-4.6.md): $2 / $6 per 1M tokens, 500K context, 7 providers - [Llama Prompt Guard 2 22M](https://models.litellm.ai/models/llama-prompt-guard-2-22m.md): $0.03 / $0.03 per 1M tokens, 512 context, 1 provider - [Llama Prompt Guard 2 86M](https://models.litellm.ai/models/llama-prompt-guard-2-86m.md): $0.04 / $0.04 per 1M tokens, 512 context, 1 provider - [Muse Spark 1.2](https://models.litellm.ai/models/muse-spark-1.2.md): $1.25 / $4.25 per 1M tokens, 1M context, 2 providers - [Muse Spark 1.2 Contributor](https://models.litellm.ai/models/muse-spark-1.2-contributor.md): $0.10 / $0.20 per 1M tokens, 1M context, 1 provider - [Orpheus Arabic Saudi](https://models.litellm.ai/models/orpheus-arabic-saudi.md): $40 per 1M characters, 4K context, 1 provider - [Orpheus V1 English](https://models.litellm.ai/models/orpheus-v1-english.md): $22 per 1M characters, 4K context, 1 provider - [Nemotron 3.5 Lightning](https://models.litellm.ai/models/nemotron-3_5-lightning.md): $0.06 / $0.24 per 1M tokens, 1M context, 1 provider - [Nvidia Nemotron 3.5 Lightning](https://models.litellm.ai/models/nvidia-nemotron-3.5-lightning.md): $0.08 / $0.20 per 1M tokens, 256K context, 1 provider - [Claude Mythos 5](https://models.litellm.ai/models/claude-mythos-5.md): $10 / $50 per 1M tokens, 1M context, 2 providers - [Gemini Robotics Er 2 Streaming Preview](https://models.litellm.ai/models/gemini-robotics-er-2-streaming-preview.md): $1 / $5 per 1M tokens, 128K context, 1 provider - [GPT Live Transcribe](https://models.litellm.ai/models/gpt-live-transcribe.md): $0.017 per minute, 32K context, 2 providers - [GPT Realtime Translate](https://models.litellm.ai/models/gpt-realtime-translate.md): 16K context, 2 providers - [GPT Transcribe](https://models.litellm.ai/models/gpt-transcribe.md): $0.0045 per minute, 2 providers - [Grok 4.20 0309 Non Reasoning](https://models.litellm.ai/models/grok-4.20-0309-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok Build 0.1](https://models.litellm.ai/models/grok-build-0.1.md): $1 / $2 per 1M tokens, 256K context, 2 providers - [Labs Leanstral 1.5](https://models.litellm.ai/models/labs-leanstral-1-5.md): Free, 256K context, 1 provider - [Mistral Moderation](https://models.litellm.ai/models/mistral-moderation.md): Free, 128K context, 1 provider - [Voxtral Mini](https://models.litellm.ai/models/voxtral-mini.md): $0.003 per minute, 1 provider - [Voxtral Mini Transcribe Realtime](https://models.litellm.ai/models/voxtral-mini-transcribe-realtime.md): $0.006 per minute, 1 provider - [Voxtral Mini TTS](https://models.litellm.ai/models/voxtral-mini-tts.md): $16 per 1M characters, 1 provider - [Qwen3.8 Max](https://models.litellm.ai/models/qwen3.8-max.md): $2 / $6 per 1M tokens, 992K context, 8 providers - [Gemini Robotics Er 2 Preview](https://models.litellm.ai/models/gemini-robotics-er-2-preview.md): $1 / $5 per 1M tokens, 128K context, 1 provider - [Qwen3.7 Max](https://models.litellm.ai/models/qwen3.7-max.md): $2.50 / $7.50 per 1M tokens, 992K context, 6 providers - [Claude Opus 5](https://models.litellm.ai/models/claude-opus-5.md): $5 / $25 per 1M tokens, 1M context, 9 providers - [Gemini 3.5 Flash Lite](https://models.litellm.ai/models/gemini-3.5-flash-lite.md): $0.30 / $2.50 per 1M tokens, 1M context, 5 providers - [Gemini 3.6 Flash](https://models.litellm.ai/models/gemini-3.6-flash.md): $0.75 / $3.75 per 1M tokens, 1M context, 4 providers - [Gemini Omni Flash Preview](https://models.litellm.ai/models/gemini-omni-flash-preview.md): $1.50 / $9 per 1M tokens, 128K context, 2 providers - [Muse Spark 1.1](https://models.litellm.ai/models/muse-spark-1.1.md): $1.25 / $4.25 per 1M tokens, 1M context, 1 provider - [GPT-5.6](https://models.litellm.ai/models/gpt-5.6.md): $4 / $20 per 1M tokens, 922K context, 2 providers - [GPT-5.6 Luna](https://models.litellm.ai/models/gpt-5.6-luna.md): $0.20 / $1.20 per 1M tokens, 922K context, 9 providers - [GPT-5.6 Sol](https://models.litellm.ai/models/gpt-5.6-sol.md): $4 / $20 per 1M tokens, 922K context, 8 providers - [GPT-5.6 Terra](https://models.litellm.ai/models/gpt-5.6-terra.md): $2 / $12 per 1M tokens, 922K context, 9 providers - [Grok 4.5](https://models.litellm.ai/models/grok-4.5.md): $2 / $6 per 1M tokens, 500K context, 2 providers - [GPT Realtime 2.1](https://models.litellm.ai/models/gpt-realtime-2.1.md): $4 / $24 per 1M tokens, 128K context, 2 providers - [GPT Realtime 2.1 Mini](https://models.litellm.ai/models/gpt-realtime-2.1-mini.md): $0.60 / $2.40 per 1M tokens, 128K context, 2 providers - [Chirp 3](https://models.litellm.ai/models/chirp_3.md): $0.016 per minute, 1 provider - [Claude Sonnet 5](https://models.litellm.ai/models/claude-sonnet-5.md): $2 / $10 per 1M tokens, 1M context, 9 providers - [Gemini 3 Pro Image](https://models.litellm.ai/models/gemini-3-pro-image.md): $0.134 per image, 64K context, 3 providers - [Gemini 3.1 Flash Image](https://models.litellm.ai/models/gemini-3.1-flash-image.md): $0.045 per image, 128K context, 4 providers - [Mistral Ocr 4.0](https://models.litellm.ai/models/mistral-ocr-4-0.md): 2 providers - [Titan Embed G1 Text 02](https://models.litellm.ai/models/titan-embed-g1-text-02.md): $0.10 per 1M tokens, 8K context, 1 provider - [Arctic Embed L V2.0](https://models.litellm.ai/models/arctic-embed-l-v2.0.md): $0.07 per 1M tokens, 8K context, 1 provider - [Arctic Embed M V2.0](https://models.litellm.ai/models/arctic-embed-m-v2.0.md): $0.07 per 1M tokens, 8K context, 1 provider - [Claude Fable 5](https://models.litellm.ai/models/claude-fable-5.md): $10 / $50 per 1M tokens, 1M context, 9 providers - [Claude Opus 4.8](https://models.litellm.ai/models/claude-opus-4-8.md): $5 / $25 per 1M tokens, 1M context, 8 providers - [DeepSeek V4 Flash](https://models.litellm.ai/models/deepseek-v4-flash.md): $0.30 / $1.20 per 1M tokens, 1M context, 22 providers - [DeepSeek V4 Flash Thinking](https://models.litellm.ai/models/deepseek-v4-flash-thinking.md): $0.25 / $1.75 per 1M tokens, 200K context, 1 provider - [DeepSeek V4 Pro](https://models.litellm.ai/models/deepseek-v4-pro.md): $1.32 / $3.96 per 1M tokens, 1M context, 17 providers - [Gemini 25 Flash Image](https://models.litellm.ai/models/gemini-25-flash-image.md): $0.039 per image, 1 provider - [Gemma 2B IT Lora](https://models.litellm.ai/models/gemma-2b-it-lora.md): Free, 8K context, 1 provider - [Gemma 4 26B](https://models.litellm.ai/models/gemma-4-26b.md): $0.03 / $0.165 per 1M tokens, 128K context, 1 provider - [Gemma 4 26B A4B](https://models.litellm.ai/models/gemma-4-26b-a4b.md): $0.13 / $0.40 per 1M tokens, 256K context, 1 provider - [Gemma 4 26B A4B IT](https://models.litellm.ai/models/gemma-4-26b-a4b-it.md): Free, 256K context, 8 providers - [Gemma 4 31B](https://models.litellm.ai/models/gemma-4-31b.md): $0.14 / $0.40 per 1M tokens, 256K context, 2 providers - [Gemma 4 31B IT](https://models.litellm.ai/models/gemma-4-31b-it.md): Free, 256K context, 11 providers - [Gemma 4 31B IT Thinking](https://models.litellm.ai/models/gemma-4-31b-it-thinking.md): $0.15 / $0.40 per 1M tokens, 256K context, 1 provider - [Gemma 4 E2B](https://models.litellm.ai/models/gemma-4-e2b.md): $0.04 / $0.08 per 1M tokens, 128K context, 1 provider - [Gemma 7B IT Lora](https://models.litellm.ai/models/gemma-7b-it-lora.md): Free, 4K context, 1 provider - [Gigachat 2](https://models.litellm.ai/models/gigachat-2.md): Free, 128K context, 1 provider - [Gigaembeddings 3B 2025 09](https://models.litellm.ai/models/gigaembeddings-3b-2025-09.md): Free, 4K context, 1 provider - [GLM 5.1 Nvfp4 Mtp](https://models.litellm.ai/models/glm-5.1-nvfp4-mtp.md): $1.40 / $4.40 per 1M tokens, 198K context, 1 provider - [GLM 5.2](https://models.litellm.ai/models/glm-5.2.md): $1.40 / $4.40 per 1M tokens, 1M context, 19 providers - [GLM 5p1 Fast](https://models.litellm.ai/models/glm-5p1-fast.md): $2.80 / $8.80 per 1M tokens, 203K context, 1 provider - [GPT Realtime Whisper](https://models.litellm.ai/models/gpt-realtime-whisper.md): $0.017 per minute, 32K context, 2 providers - [Granite 4.0 H Micro](https://models.litellm.ai/models/granite-4.0-h-micro.md): $0.017 / $0.112 per 1M tokens, 131K context, 1 provider - [Hermes 3 8B Tee](https://models.litellm.ai/models/hermes-3-8b-tee.md): $0.15 / $0.60 per 1M tokens, 16K context, 1 provider - [Kimi K2.7 Code](https://models.litellm.ai/models/kimi-k2.7-code.md): $0.95 / $4 per 1M tokens, 256K context, 14 providers - [Kimi K2p6 Fast](https://models.litellm.ai/models/kimi-k2p6-fast.md): $2 / $8 per 1M tokens, 256K context, 1 provider - [Kimi K2p7 Code Fast](https://models.litellm.ai/models/kimi-k2p7-code-fast.md): $1.90 / $8 per 1M tokens, 256K context, 1 provider - [Llama 2 7B Chat HF Lora](https://models.litellm.ai/models/llama-2-7b-chat-hf-lora.md): Free, 8K context, 1 provider - [Llama 3.3 70B Instruct FP8 Fast](https://models.litellm.ai/models/llama-3.3-70b-instruct-fp8-fast.md): $0.293 / $2.253 per 1M tokens, 24K context, 1 provider - [Mai Image 2.5](https://models.litellm.ai/models/mai-image-2.5.md): $0.048 per image, 32K context, 1 provider - [Mai Image 2.5 Flash](https://models.litellm.ai/models/mai-image-2.5-flash.md): $0.02 per image, 32K context, 1 provider - [Mercury 2](https://models.litellm.ai/models/mercury-2.md): $0.25 / $0.75 per 1M tokens, 128K context, 1 provider - [Mercury Edit 2](https://models.litellm.ai/models/mercury-edit-2.md): $0.25 / $0.75 per 1M tokens, 32K context, 1 provider - [MiniMax M3](https://models.litellm.ai/models/minimax-m3.md): $0.30 / $1.20 per 1M tokens, 1M context, 9 providers - [Mistral 7B Instruct V0.2 Lora](https://models.litellm.ai/models/mistral-7b-instruct-v0.2-lora.md): Free, 15K context, 1 provider - [Mistral Medium 3.5](https://models.litellm.ai/models/mistral-medium-3-5.md): $1.50 / $7.50 per 1M tokens, 256K context, 2 providers - [Mistral Medium 3.5 128B](https://models.litellm.ai/models/mistral-medium-3.5-128b.md): $1.50 / $7.50 per 1M tokens, 256K context, 1 provider - [Nano Banana](https://models.litellm.ai/models/nano-banana.md): $0.039 per image, 1 provider - [Nemotron 3 120B A12B](https://models.litellm.ai/models/nemotron-3-120b-a12b.md): $0.50 / $1.50 per 1M tokens, 256K context, 1 provider - [Qwen3.5 122B A10B Thinking](https://models.litellm.ai/models/qwen3.5-122b-a10b-thinking.md): $0.25 / $1.75 per 1M tokens, 256K context, 1 provider - [Qwen3.6 27B](https://models.litellm.ai/models/qwen3.6-27b.md): $0.15 / $0.50 per 1M tokens, 256K context, 6 providers - [Qwen3.6 27B Thinking](https://models.litellm.ai/models/qwen3.6-27b-thinking.md): $0.15 / $0.50 per 1M tokens, 256K context, 1 provider - [Qwen3.6 35B A3B](https://models.litellm.ai/models/qwen3.6-35b-a3b.md): $0.05 / $0.40 per 1M tokens, 256K context, 8 providers - [Qwen3.6 35B A3B Thinking](https://models.litellm.ai/models/qwen3.6-35b-a3b-thinking.md): $0.15 / $0.50 per 1M tokens, 256K context, 1 provider - [Qwen3.7 Plus](https://models.litellm.ai/models/qwen3.7-plus.md): $0.282 / $1.128 per 1M tokens, 1M context, 6 providers - [STT Async V4](https://models.litellm.ai/models/stt-async-v4.md): $0.00002778 per second, 8K context, 1 provider - [STT Async V5](https://models.litellm.ai/models/stt-async-v5.md): $0.00002778 per second, 8K context, 1 provider - [Azure STT](https://models.litellm.ai/models/azure-stt.md): $0 per second, 1 provider - [Embed Multilingual Image V3.0](https://models.litellm.ai/models/embed-multilingual-image-v3.0.md): $0.10 per 1M tokens, 512 context, 1 provider - [Gemini 3.1 Flash Lite](https://models.litellm.ai/models/gemini-3.1-flash-lite.md): $0.25 / $1.50 per 1M tokens, 1M context, 5 providers - [Gemini 3.5 Flash](https://models.litellm.ai/models/gemini-3.5-flash.md): $1.50 / $9 per 1M tokens, 1M context, 5 providers - [GLM 5.1](https://models.litellm.ai/models/glm-5.1.md): $1.40 / $4.40 per 1M tokens, 200K context, 10 providers - [GPT Realtime 2](https://models.litellm.ai/models/gpt-realtime-2.md): $4 / $24 per 1M tokens, 128K context, 2 providers - [Grok 4.20 Non Reasoning](https://models.litellm.ai/models/grok-4.20-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 5 providers - [Grok 4.20 Reasoning](https://models.litellm.ai/models/grok-4.20-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 5 providers - [Grok 4.3](https://models.litellm.ai/models/grok-4.3.md): $1.25 / $2.50 per 1M tokens, 1M context, 5 providers - [Mimo V2.5](https://models.litellm.ai/models/mimo-v2.5.md): $0.168 / $0.336 per 1M tokens, 1M context, 2 providers - [Mimo V2.5 Pro](https://models.litellm.ai/models/mimo-v2.5-pro.md): $0.522 / $1.044 per 1M tokens, 1M context, 2 providers - [MiniMax M2.7](https://models.litellm.ai/models/minimax-m2.7.md): $0.25 / $1 per 1M tokens, 192K context, 7 providers - [Qwen3.6 Plus](https://models.litellm.ai/models/qwen3.6-plus.md): $0.50 / $3 per 1M tokens, 1M context, 1 provider - [Claude Mythos Preview](https://models.litellm.ai/models/claude-mythos-preview.md): $10 / $50 per 1M tokens, 1M context, 2 providers - [Claude Opus 4.7](https://models.litellm.ai/models/claude-opus-4-7.md): $5 / $25 per 1M tokens, 1M context, 7 providers - [Command A Reasoning](https://models.litellm.ai/models/command-a-reasoning.md): $1.56 / $1.56 per 1M tokens, 256K context, 1 provider - [Command A Translate](https://models.litellm.ai/models/command-a-translate.md): $0.09 / $0.09 per 1M tokens, 256K context, 1 provider - [Command A Vision](https://models.litellm.ai/models/command-a-vision.md): $1.56 / $1.56 per 1M tokens, 256K context, 1 provider - [Embed English Image V3.0](https://models.litellm.ai/models/embed-english-image-v3.0.md): $0.10 per 1M tokens, 512 context, 1 provider - [Embed English Light Image V3.0](https://models.litellm.ai/models/embed-english-light-image-v3.0.md): $0.10 per 1M tokens, 512 context, 1 provider - [Embed Multilingual Light Image V3.0](https://models.litellm.ai/models/embed-multilingual-light-image-v3.0.md): $0.10 per 1M tokens, 512 context, 1 provider - [Gemini 3.1 Flash Live Preview](https://models.litellm.ai/models/gemini-3.1-flash-live-preview.md): $0.75 / $4.50 per 1M tokens, 128K context, 1 provider - [Gemini Embedding 2](https://models.litellm.ai/models/gemini-embedding-2.md): $0.20 per 1M tokens, 8K context, 2 providers - [GPT Image 2](https://models.litellm.ai/models/gpt-image-2.md): $5 per 1M input tokens, 5 providers - [GPT-5.5](https://models.litellm.ai/models/gpt-5.5.md): $5 / $30 per 1M tokens, 1M context, 10 providers - [GPT-5.5 Pro](https://models.litellm.ai/models/gpt-5.5-pro.md): $30 / $180 per 1M tokens, 1M context, 4 providers - [Grok 4.20](https://models.litellm.ai/models/grok-4.20.md): $1.25 / $2.50 per 1M tokens, 1M context, 2 providers - [Grok 4.20 0309 Reasoning](https://models.litellm.ai/models/grok-4.20-0309-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Multi Agent](https://models.litellm.ai/models/grok-4.20-multi-agent.md): $1.25 / $2.50 per 1M tokens, 1M context, 3 providers - [Kimi K2.6](https://models.litellm.ai/models/kimi-k2.6.md): $0.95 / $4 per 1M tokens, 256K context, 13 providers - [Llama 3.3 70B Instruct FP8 Dynamic](https://models.litellm.ai/models/llama-3.3-70b-instruct-fp8-dynamic.md): $0.72 / $0.72 per 1M tokens, 128K context, 1 provider - [Lyria 3 Clip Preview](https://models.litellm.ai/models/lyria-3-clip-preview.md): Free, 128K context, 2 providers - [Lyria 3 Pro Preview](https://models.litellm.ai/models/lyria-3-pro-preview.md): Free, 128K context, 2 providers - [Nemotron 120B A12B](https://models.litellm.ai/models/nemotron-120b-a12b.md): $0.30 / $0.75 per 1M tokens, 1 provider - [Nemotron Super 3 120B](https://models.litellm.ai/models/nemotron-super-3-120b.md): $0.15 / $0.65 per 1M tokens, 256K context, 1 provider - [Veo 3.1 Lite Generate Preview](https://models.litellm.ai/models/veo-3.1-lite-generate-preview.md): $0.05 per second, 1K context, 1 provider - [BGE En Icl](https://models.litellm.ai/models/bge-en-icl.md): $0.01 per 1M tokens, 32K context, 1 provider - [BGE Multilingual Gemma2](https://models.litellm.ai/models/bge-multilingual-gemma2.md): $0.01 per 1M tokens, 8K context, 2 providers - [Devstral 2 123B](https://models.litellm.ai/models/devstral-2-123b.md): $0.40 / $2 per 1M tokens, 256K context, 1 provider - [Doubao Seed 2.0 Code Preview 260215](https://models.litellm.ai/models/doubao-seed-2-0-code-preview-260215.md): 256K context, 1 provider - [Doubao Seed 2.0 Lite 260215](https://models.litellm.ai/models/doubao-seed-2-0-lite-260215.md): 256K context, 1 provider - [Doubao Seed 2.0 Mini 260215](https://models.litellm.ai/models/doubao-seed-2-0-mini-260215.md): 256K context, 1 provider - [Doubao Seed 2.0 Pro 260215](https://models.litellm.ai/models/doubao-seed-2-0-pro-260215.md): 256K context, 1 provider - [E5 Mistral 7B Instruct](https://models.litellm.ai/models/e5-mistral-7b-instruct.md): $0.01 per 1M tokens, 32K context, 1 provider - [FLUX Dev](https://models.litellm.ai/models/flux-dev.md): $0.025 per image, 2 providers - [FLUX Pro 1.0 Expand](https://models.litellm.ai/models/flux-pro-1.0-expand.md): $0.05 per image, 1 provider - [FLUX Pro 1.0 Fill](https://models.litellm.ai/models/flux-pro-1.0-fill.md): $0.05 per image, 1 provider - [FLUX Pro 1.1](https://models.litellm.ai/models/flux-pro-1.1.md): $0.04 per image, 1 provider - [FLUX Pro 1.1 Ultra](https://models.litellm.ai/models/flux-pro-1.1-ultra.md): $0.06 per image, 1 provider - [Gemini 3.1 Flash Image Preview](https://models.litellm.ai/models/gemini-3.1-flash-image-preview.md): $0.045 per image, 64K context, 2 providers - [Gemini 3.1 Flash Lite Preview](https://models.litellm.ai/models/gemini-3.1-flash-lite-preview.md): $0.25 / $1.50 per 1M tokens, 1M context, 2 providers - [Gemini Embedding 2 Preview](https://models.litellm.ai/models/gemini-embedding-2-preview.md): $0.20 per 1M tokens, 8K context, 2 providers - [GLM 5 Code](https://models.litellm.ai/models/glm-5-code.md): $1.20 / $5 per 1M tokens, 200K context, 1 provider - [GPT-5.3 Chat](https://models.litellm.ai/models/gpt-5.3-chat.md): $1.75 / $14 per 1M tokens, 128K context, 3 providers - [GPT-5.3 Codex Spark](https://models.litellm.ai/models/gpt-5.3-codex-spark.md): 128K context, 1 provider - [GPT-5.3 Instant](https://models.litellm.ai/models/gpt-5.3-instant.md): 128K context, 1 provider - [GPT-5.4](https://models.litellm.ai/models/gpt-5.4.md): $2.50 / $15 per 1M tokens, 1M context, 9 providers - [GPT-5.4 Mini](https://models.litellm.ai/models/gpt-5.4-mini.md): $0.75 / $4.50 per 1M tokens, 272K context, 7 providers - [GPT-5.4 Nano](https://models.litellm.ai/models/gpt-5.4-nano.md): $0.20 / $1.25 per 1M tokens, 272K context, 6 providers - [GPT-5.4 Pro](https://models.litellm.ai/models/gpt-5.4-pro.md): $30 / $180 per 1M tokens, 1M context, 4 providers - [Grok 4.20 Beta 0309 Non Reasoning](https://models.litellm.ai/models/grok-4.20-beta-0309-non-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Beta 0309 Reasoning](https://models.litellm.ai/models/grok-4.20-beta-0309-reasoning.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Grok 4.20 Multi Agent Beta](https://models.litellm.ai/models/grok-4.20-multi-agent-beta.md): $1.25 / $2.50 per 1M tokens, 1M context, 1 provider - [Ministral 3 14B](https://models.litellm.ai/models/ministral-3-14b.md): $0.20 / $0.20 per 1M tokens, 256K context, 1 provider - [Ministral 3 3B](https://models.litellm.ai/models/ministral-3-3b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Ministral 3 8B](https://models.litellm.ai/models/ministral-3-8b.md): $0.15 / $0.15 per 1M tokens, 256K context, 1 provider - [PPLX Embed V1 0.6B](https://models.litellm.ai/models/pplx-embed-v1-0.6b.md): $0.004 per 1M tokens, 32K context, 1 provider - [PPLX Embed V1 4B](https://models.litellm.ai/models/pplx-embed-v1-4b.md): $0.03 per 1M tokens, 32K context, 1 provider - [Qwen3 VL 32B Thinking](https://models.litellm.ai/models/qwen3-vl-32b-thinking.md): $0.16 / $2.87 per 1M tokens, 128K context, 3 providers - [Qwen3 VL Plus](https://models.litellm.ai/models/qwen3-vl-plus.md): 254K context, 3 providers - [Qwen3.5 122B A10B](https://models.litellm.ai/models/qwen3.5-122b-a10b.md): $0.1126 / $0.9008 per 1M tokens, 256K context, 4 providers - [Qwen3.5 27B](https://models.litellm.ai/models/qwen3.5-27b.md): $0.26 / $2.60 per 1M tokens, 256K context, 2 providers - [Qwen3.5 35B A3B](https://models.litellm.ai/models/qwen3.5-35b-a3b.md): $0.14 / $1 per 1M tokens, 256K context, 3 providers - [Qwen3.5 397B A17B](https://models.litellm.ai/models/qwen3.5-397b-a17b.md): $0.1644 / $0.9864 per 1M tokens, 256K context, 7 providers - [Qwen3.5 Plus](https://models.litellm.ai/models/qwen3.5-plus.md): 992K context, 3 providers - [ChatGPT Image](https://models.litellm.ai/models/chatgpt-image.md): $5 per 1M input tokens, 1 provider - [Claude Opus 4.6](https://models.litellm.ai/models/claude-opus-4-6.md): $5 / $25 per 1M tokens, 1M context, 7 providers - [Claude Sonnet 4.6](https://models.litellm.ai/models/claude-sonnet-4-6.md): $3 / $15 per 1M tokens, 1M context, 8 providers - [Deep Research Pro Preview](https://models.litellm.ai/models/deep-research-pro-preview.md): $2 / $12 per 1M tokens, 1M context, 2 providers - [Eleven V3](https://models.litellm.ai/models/eleven_v3.md): $180 per 1M characters, 1 provider - [Gemini 2.0 Flash Exp Image Generation](https://models.litellm.ai/models/gemini-2.0-flash-exp-image-generation.md): $0.039 per image, 32K context, 1 provider - [Gemini 2.5 Flash Native Audio](https://models.litellm.ai/models/gemini-2.5-flash-native-audio.md): $0.50 / $2 per 1M tokens, 128K context, 2 providers - [Gemini 2.5 Flash Native Audio Preview](https://models.litellm.ai/models/gemini-2.5-flash-native-audio-preview.md): $0.50 / $2 per 1M tokens, 1M context, 1 provider - [Gemini 3.1 Pro Preview](https://models.litellm.ai/models/gemini-3.1-pro-preview.md): $2 / $12 per 1M tokens, 1M context, 4 providers - [Gemini 3.1 Pro Preview Customtools](https://models.litellm.ai/models/gemini-3.1-pro-preview-customtools.md): $2 / $12 per 1M tokens, 1M context, 3 providers - [GLM 4.7 Flash](https://models.litellm.ai/models/glm-4.7-flash.md): Free, 200K context, 5 providers - [GLM 5](https://models.litellm.ai/models/glm-5.md): $1 / $3.20 per 1M tokens, 200K context, 7 providers - [GPT Audio 1.5](https://models.litellm.ai/models/gpt-audio-1.5.md): $2.50 / $10 per 1M tokens, 128K context, 2 providers - [GPT Realtime 1.5](https://models.litellm.ai/models/gpt-realtime-1.5.md): $4 / $16 per 1M tokens, 32K context, 2 providers - [GPT-5 Search API](https://models.litellm.ai/models/gpt-5-search-api.md): $1.25 / $10 per 1M tokens, 272K context, 1 provider - [GPT-5.3 Codex](https://models.litellm.ai/models/gpt-5.3-codex.md): $1.75 / $14 per 1M tokens, 272K context, 7 providers - [Kimi K2.5](https://models.litellm.ai/models/kimi-k2.5.md): $0.60 / $3 per 1M tokens, 256K context, 8 providers - [MiniMax M2.5](https://models.litellm.ai/models/minimax-m2.5.md): $0.30 / $1.20 per 1M tokens, 1M context, 7 providers - [MiniMax M2.5 Lightning](https://models.litellm.ai/models/minimax-m2.5-lightning.md): $0.30 / $2.40 per 1M tokens, 1M context, 1 provider - [Model Router](https://models.litellm.ai/models/model-router.md): $0.14 / $0 per 1M tokens, 200K context, 2 providers - [Nemotron Nano 3 30B](https://models.litellm.ai/models/nemotron-nano-3-30b.md): $0.06 / $0.24 per 1M tokens, 256K context, 1 provider - [Nova 2 Pro Preview](https://models.litellm.ai/models/nova-2-pro-preview.md): $1.25 / $10 per 1M tokens, 1M context, 1 provider - [Qwen3 Coder Next](https://models.litellm.ai/models/qwen3-coder-next.md): $0.137 / $0.548 per 1M tokens, 256K context, 4 providers - [Autoglm Phone 9B Multilingual](https://models.litellm.ai/models/autoglm-phone-9b-multilingual.md): $0.035 / $0.138 per 1M tokens, 64K context, 1 provider - [Baichuan M2 32B](https://models.litellm.ai/models/baichuan-m2-32b.md): $0.07 / $0.07 per 1M tokens, 128K context, 1 provider - [BGE M3](https://models.litellm.ai/models/bge-m3.md): $0.01 per 1M tokens, 8K context, 2 providers - [BGE Reranker V2 M3](https://models.litellm.ai/models/bge-reranker-v2-m3.md): $0.01 per 1M input tokens, 8K context, 1 provider - [Claude 4.5 Haiku](https://models.litellm.ai/models/claude-4.5-haiku.md): $1 / $5 per 1M tokens, 1 provider - [Claude 4.5 Sonnet](https://models.litellm.ai/models/claude-4.5-sonnet.md): $3 / $15 per 1M tokens, 1 provider - [CodeLlama 7B](https://models.litellm.ai/models/codellama-7b.md): $0.06 / $0.12 per 1M tokens, 16K context, 1 provider - [DeepSeek Coder 6.7B](https://models.litellm.ai/models/deepseek-coder-6.7b.md): $0.06 / $0.12 per 1M tokens, 16K context, 1 provider - [DeepSeek R1 7B Qwen](https://models.litellm.ai/models/deepseek-r1-7b-qwen.md): $0.08 / $0.15 per 1M tokens, 128K context, 1 provider - [DeepSeek R1 8B](https://models.litellm.ai/models/deepseek-r1-8b.md): $0.10 / $0.20 per 1M tokens, 64K context, 1 provider - [DeepSeek V3 2 251201](https://models.litellm.ai/models/deepseek-v3-2-251201.md): Free, 96K context, 1 provider - [DeepSeek V3 Turbo](https://models.litellm.ai/models/deepseek-v3-turbo.md): $0.40 / $1.30 per 1M tokens, 64K context, 1 provider - [Dolphin3 8B](https://models.litellm.ai/models/dolphin3-8b.md): $0.08 / $0.15 per 1M tokens, 128K context, 1 provider - [Embeddings](https://models.litellm.ai/models/embeddings.md): Free, 512 context, 1 provider - [Embeddings 2](https://models.litellm.ai/models/embeddings-2.md): Free, 512 context, 1 provider - [Embeddingsgigar](https://models.litellm.ai/models/embeddingsgigar.md): Free, 4K context, 1 provider - [Ernie 4.5 21B A3B](https://models.litellm.ai/models/ernie-4.5-21b-a3b.md): $0.07 / $0.28 per 1M tokens, 120K context, 1 provider - [Ernie 4.5 21B A3B Thinking](https://models.litellm.ai/models/ernie-4.5-21b-a3b-thinking.md): $0.07 / $0.28 per 1M tokens, 128K context, 1 provider - [Ernie 4.5 300B A47B Paddle](https://models.litellm.ai/models/ernie-4.5-300b-a47b-paddle.md): $0.28 / $1.10 per 1M tokens, 123K context, 1 provider - [Ernie 4.5 VL 28B A3B](https://models.litellm.ai/models/ernie-4.5-vl-28b-a3b.md): $0.14 / $0.56 per 1M tokens, 30K context, 1 provider - [Ernie 4.5 VL 28B A3B Thinking](https://models.litellm.ai/models/ernie-4.5-vl-28b-a3b-thinking.md): $0.39 / $0.39 per 1M tokens, 128K context, 1 provider - [Ernie 4.5 VL 424B A47B](https://models.litellm.ai/models/ernie-4.5-vl-424b-a47b.md): $0.42 / $1.25 per 1M tokens, 123K context, 1 provider - [Flux.2 Pro](https://models.litellm.ai/models/flux.2-pro.md): $0.04 per image, 32K context, 1 provider - [Gemini 3 Pro](https://models.litellm.ai/models/gemini-3-pro.md): $2 / $12 per 1M tokens, 1M context, 2 providers - [Gemini Robotics Er 1.5 Preview](https://models.litellm.ai/models/gemini-robotics-er-1.5-preview.md): $0.30 / $2.50 per 1M tokens, 1M context, 1 provider - [Gemma3 4B](https://models.litellm.ai/models/gemma3-4b.md): $0.03 / $0.08 per 1M tokens, 128K context, 1 provider - [Gigachat 2 Max](https://models.litellm.ai/models/gigachat-2-max.md): Free, 128K context, 1 provider - [Gigachat 2 Pro](https://models.litellm.ai/models/gigachat-2-pro.md): Free, 128K context, 1 provider - [GLM 4.6v](https://models.litellm.ai/models/glm-4.6v.md): $0.30 / $0.90 per 1M tokens, 128K context, 1 provider - [GLM 4.7](https://models.litellm.ai/models/glm-4.7.md): $0.60 / $2.20 per 1M tokens, 200K context, 9 providers - [GLM 4.7 251222](https://models.litellm.ai/models/glm-4-7-251222.md): Free, 200K context, 1 provider - [GPT-5.2 Codex](https://models.litellm.ai/models/gpt-5.2-codex.md): $1.75 / $14 per 1M tokens, 272K context, 3 providers - [Kat Coder Pro](https://models.litellm.ai/models/kat-coder-pro.md): $0.30 / $1.20 per 1M tokens, 256K context, 1 provider - [Kimi K2 Thinking 251104](https://models.litellm.ai/models/kimi-k2-thinking-251104.md): Free, 224K context, 1 provider - [L3 8B Lunaris](https://models.litellm.ai/models/l3-8b-lunaris.md): $0.05 / $0.05 per 1M tokens, 8K context, 1 provider - [L3 8B Stheno V3.2](https://models.litellm.ai/models/l3-8b-stheno-v3.2.md): $0.05 / $0.05 per 1M tokens, 8K context, 1 provider - [L31 70B Euryale V2.2](https://models.litellm.ai/models/l31-70b-euryale-v2.2.md): $1.48 / $1.48 per 1M tokens, 8K context, 1 provider - [Llava 7B](https://models.litellm.ai/models/llava-7b.md): $0.10 / $0.20 per 1M tokens, 4K context, 1 provider - [Mimo V2 Flash](https://models.litellm.ai/models/mimo-v2-flash.md): $0.11 / $0.33 per 1M tokens, 256K context, 1 provider - [Mistral 7B V0.3](https://models.litellm.ai/models/mistral-7b-v0.3.md): $0.10 / $0.15 per 1M tokens, 32K context, 1 provider - [Nomic Embed Text](https://models.litellm.ai/models/nomic-embed-text.md): $0.02 per 1M tokens, 8K context, 1 provider - [Nova 2 Multimodal Embeddings](https://models.litellm.ai/models/nova-2-multimodal-embeddings.md): $0.135 per 1M tokens, 8K context, 1 provider - [Openthinker 7B](https://models.litellm.ai/models/openthinker-7b.md): $0.08 / $0.15 per 1M tokens, 32K context, 1 provider - [Paddleocr VL](https://models.litellm.ai/models/paddleocr-vl.md): $0.02 / $0.02 per 1M tokens, 16K context, 1 provider - [Qwen Mt Plus](https://models.litellm.ai/models/qwen-mt-plus.md): $0.25 / $0.75 per 1M tokens, 16K context, 1 provider - [Qwen3 Max](https://models.litellm.ai/models/qwen3-max.md): $1.20 / $6 per 1M tokens, 256K context, 5 providers - [Qwen3 Omni 30B A3B Instruct](https://models.litellm.ai/models/qwen3-omni-30b-a3b-instruct.md): $0.25 / $0.97 per 1M tokens, 64K context, 1 provider - [Qwen3 Omni 30B A3B Thinking](https://models.litellm.ai/models/qwen3-omni-30b-a3b-thinking.md): $0.25 / $0.97 per 1M tokens, 64K context, 1 provider - [Qwen3 VL 8B](https://models.litellm.ai/models/qwen3-vl-8b.md): $0.15 / $0.55 per 1M tokens, 32K context, 1 provider - [R1v4 Lite](https://models.litellm.ai/models/r1v4-lite.md): $0.20 / $0.60 per 1M tokens, 256K context, 1 provider - [Alia 40B Instruct Q8 0](https://models.litellm.ai/models/alia-40b-instruct_q8_0.md): Free, 8K context, 1 provider - [Apertus 70B Instruct](https://models.litellm.ai/models/apertus-70b-instruct.md): Free, 8K context, 1 provider - [Apertus 8B Instruct](https://models.litellm.ai/models/apertus-8b-instruct.md): Free, 8K context, 1 provider - [Chirp](https://models.litellm.ai/models/chirp.md): $30 per 1M characters, 1 provider - [Claude Sonnet 4.1](https://models.litellm.ai/models/claude-sonnet-4-1.md): $3 / $15 per 1M tokens, 200K context, 1 provider - [Code Llama 13B](https://models.litellm.ai/models/code-llama-13b.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Llama 13B Instruct](https://models.litellm.ai/models/code-llama-13b-instruct.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Llama 13B Python](https://models.litellm.ai/models/code-llama-13b-python.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Llama 34B](https://models.litellm.ai/models/code-llama-34b.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Code Llama 34B Instruct](https://models.litellm.ai/models/code-llama-34b-instruct.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Code Llama 34B Python](https://models.litellm.ai/models/code-llama-34b-python.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Code Llama 70B](https://models.litellm.ai/models/code-llama-70b.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Code Llama 70B Instruct](https://models.litellm.ai/models/code-llama-70b-instruct.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Code Llama 70B Python](https://models.litellm.ai/models/code-llama-70b-python.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Code Llama 7B](https://models.litellm.ai/models/code-llama-7b.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Llama 7B Instruct](https://models.litellm.ai/models/code-llama-7b-instruct.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Llama 7B Python](https://models.litellm.ai/models/code-llama-7b-python.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Code Qwen 1p5 7B](https://models.litellm.ai/models/code-qwen-1p5-7b.md): $0.20 / $0.20 per 1M tokens, 64K context, 1 provider - [Codegemma 2B](https://models.litellm.ai/models/codegemma-2b.md): $0.10 / $0.10 per 1M tokens, 8K context, 1 provider - [Codegemma 7B](https://models.litellm.ai/models/codegemma-7b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Cogito 671B V2 P1](https://models.litellm.ai/models/cogito-671b-v2-p1.md): $1.20 / $1.20 per 1M tokens, 160K context, 1 provider - [Cogito V1 Preview Llama 3B](https://models.litellm.ai/models/cogito-v1-preview-llama-3b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Cogito V1 Preview Llama 70B](https://models.litellm.ai/models/cogito-v1-preview-llama-70b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Cogito V1 Preview Llama 8B](https://models.litellm.ai/models/cogito-v1-preview-llama-8b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Cogito V1 Preview Qwen 14B](https://models.litellm.ai/models/cogito-v1-preview-qwen-14b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Cogito V1 Preview Qwen 32B](https://models.litellm.ai/models/cogito-v1-preview-qwen-32b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Cohere Rerank V4.0 Fast](https://models.litellm.ai/models/cohere-rerank-v4.0-fast.md): $0 per 1M input tokens, 32K context, 1 provider - [Cohere Rerank V4.0 Pro](https://models.litellm.ai/models/cohere-rerank-v4.0-pro.md): $0 per 1M input tokens, 32K context, 1 provider - [Conservative](https://models.litellm.ai/models/conservative.md): $0.04 per image, 1 provider - [Creative](https://models.litellm.ai/models/creative.md): $0.06 per image, 1 provider - [Databricks Meta Llama 3.1 8B Instruct](https://models.litellm.ai/models/databricks-meta-llama-3-1-8b-instruct.md): $0.15 / $0.45 per 1M tokens, 200K context, 1 provider - [DeepSeek Coder 1B Base](https://models.litellm.ai/models/deepseek-coder-1b-base.md): $0.10 / $0.10 per 1M tokens, 16K context, 1 provider - [DeepSeek Coder 33B Instruct](https://models.litellm.ai/models/deepseek-coder-33b-instruct.md): $0.80 / $0.80 per 1M tokens, 16K context, 2 providers - [DeepSeek Coder 7B Base](https://models.litellm.ai/models/deepseek-coder-7b-base.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [DeepSeek Coder 7B Base V1p5](https://models.litellm.ai/models/deepseek-coder-7b-base-v1p5.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [DeepSeek Coder 7B Instruct V1p5](https://models.litellm.ai/models/deepseek-coder-7b-instruct-v1p5.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [DeepSeek Ocr](https://models.litellm.ai/models/deepseek-ocr.md): $0.03 / $0.03 per 1M tokens, 8K context, 2 providers - [DeepSeek R1 0528 Distill Qwen3 8B](https://models.litellm.ai/models/deepseek-r1-0528-distill-qwen3-8b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [DeepSeek V2 Lite Chat](https://models.litellm.ai/models/deepseek-v2-lite-chat.md): $0.50 / $0.50 per 1M tokens, 160K context, 1 provider - [DeepSeek V2p5](https://models.litellm.ai/models/deepseek-v2p5.md): $1.20 / $1.20 per 1M tokens, 32K context, 1 provider - [DeepSeek V3.2](https://models.litellm.ai/models/deepseek-v3.2.md): $0.28 / $0.40 per 1M tokens, 160K context, 10 providers - [DeepSeek V3.2 Speciale](https://models.litellm.ai/models/deepseek-v3.2-speciale.md): $0.58 / $1.68 per 1M tokens, 128K context, 1 provider - [Devstral](https://models.litellm.ai/models/devstral.md): $0.40 / $2 per 1M tokens, 256K context, 1 provider - [Dobby Mini Unhinged Plus Llama 3.1 8B](https://models.litellm.ai/models/dobby-mini-unhinged-plus-llama-3-1-8b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Dobby Unhinged Llama 3.3 70B New](https://models.litellm.ai/models/dobby-unhinged-llama-3-3-70b-new.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Dolphin 2.9.2 Qwen2 72B](https://models.litellm.ai/models/dolphin-2-9-2-qwen2-72b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Erase](https://models.litellm.ai/models/erase.md): $0.005 per image, 1 provider - [Ernie 4p5 21B A3B Pt](https://models.litellm.ai/models/ernie-4p5-21b-a3b-pt.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Ernie 4p5 300B A47B Pt](https://models.litellm.ai/models/ernie-4p5-300b-a47b-pt.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Fare 20B](https://models.litellm.ai/models/fare-20b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Fast](https://models.litellm.ai/models/fast.md): $0.002 per image, 1 provider - [Firefunction V1](https://models.litellm.ai/models/firefunction-v1.md): $0.50 / $0.50 per 1M tokens, 32K context, 1 provider - [Firesearch Ocr V6](https://models.litellm.ai/models/firesearch-ocr-v6.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Fireworks Asr Large](https://models.litellm.ai/models/fireworks-asr-large.md): $0 per 1M input tokens, 4K context, 1 provider - [Fireworks Asr V2](https://models.litellm.ai/models/fireworks-asr-v2.md): $0 per 1M input tokens, 4K context, 1 provider - [FLUX 1 Dev](https://models.litellm.ai/models/flux-1-dev.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [FLUX 1 Dev Controlnet Union](https://models.litellm.ai/models/flux-1-dev-controlnet-union.md): $0.001 / $0.001 per 1M tokens, 4K context, 1 provider - [FLUX 1 Schnell](https://models.litellm.ai/models/flux-1-schnell.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [FLUX Kontext Max](https://models.litellm.ai/models/flux-kontext-max.md): $0.08 per image, 4K context, 2 providers - [FLUX Kontext Pro](https://models.litellm.ai/models/flux-kontext-pro.md): $0.04 per image, 4K context, 2 providers - [Gemini 2.5 Computer Use Preview](https://models.litellm.ai/models/gemini-2.5-computer-use-preview.md): $1.25 / $10 per 1M tokens, 128K context, 2 providers - [Gemini 3 Flash Preview](https://models.litellm.ai/models/gemini-3-flash-preview.md): $0.50 / $3 per 1M tokens, 1M context, 5 providers - [Gemma 2B IT](https://models.litellm.ai/models/gemma-2b-it.md): $0.10 / $0.10 per 1M tokens, 8K context, 1 provider - [Gemma 3 12B](https://models.litellm.ai/models/gemma-3-12b.md): $0.15 / $0.50 per 1M tokens, 128K context, 1 provider - [Gemma Sea Lion V4 27B IT](https://models.litellm.ai/models/gemma-sea-lion-v4-27b-it.md): Free, 8K context, 2 providers - [Generative](https://models.litellm.ai/models/generative.md): $30 per 1M characters, 1 provider - [GLM 4 32B 0414 128K](https://models.litellm.ai/models/glm-4-32b-0414-128k.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [GLM 4.5 Airx](https://models.litellm.ai/models/glm-4.5-airx.md): $1.10 / $4.50 per 1M tokens, 128K context, 1 provider - [GLM 4.5 Flash](https://models.litellm.ai/models/glm-4.5-flash.md): Free, 128K context, 1 provider - [GLM 4.5 X](https://models.litellm.ai/models/glm-4.5-x.md): $2.20 / $8.90 per 1M tokens, 128K context, 1 provider - [GLM 4.5v](https://models.litellm.ai/models/glm-4.5v.md): $0.60 / $1.80 per 1M tokens, 128K context, 3 providers - [GPT Image 1.5](https://models.litellm.ai/models/gpt-image-1.5.md): $5 per 1M input tokens, 2 providers - [GPT OSS Safeguard 120B](https://models.litellm.ai/models/gpt-oss-safeguard-120b.md): $0.15 / $0.60 per 1M tokens, 128K context, 3 providers - [GPT OSS Safeguard 20B](https://models.litellm.ai/models/gpt-oss-safeguard-20b.md): $0.07 / $0.20 per 1M tokens, 128K context, 4 providers - [GPT-4 O Preview](https://models.litellm.ai/models/gpt-4-o-preview.md): 64K context, 1 provider - [GPT-5.1 Codex Max](https://models.litellm.ai/models/gpt-5.1-codex-max.md): $1.25 / $10 per 1M tokens, 400K context, 3 providers - [GPT-5.2](https://models.litellm.ai/models/gpt-5.2.md): $1.75 / $14 per 1M tokens, 272K context, 6 providers - [GPT-5.2 Chat](https://models.litellm.ai/models/gpt-5.2-chat.md): $1.75 / $14 per 1M tokens, 128K context, 2 providers - [GPT-5.2 Pro](https://models.litellm.ai/models/gpt-5.2-pro.md): $21 / $168 per 1M tokens, 272K context, 2 providers - [Hermes 2 Pro Mistral 7B](https://models.litellm.ai/models/hermes-2-pro-mistral-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Inpaint](https://models.litellm.ai/models/inpaint.md): $0.005 per image, 1 provider - [Internvl3 38B](https://models.litellm.ai/models/internvl3-38b.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Internvl3 78B](https://models.litellm.ai/models/internvl3-78b.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Internvl3 8B](https://models.litellm.ai/models/internvl3-8b.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Japanese Stable Diffusion XL](https://models.litellm.ai/models/japanese-stable-diffusion-xl.md): $0.00013 per 1M input tokens, 4K context, 1 provider - [Kat Coder](https://models.litellm.ai/models/kat-coder.md): $0.90 / $0.90 per 1M tokens, 256K context, 1 provider - [Kat Dev 32B](https://models.litellm.ai/models/kat-dev-32b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Kat Dev 72B Exp](https://models.litellm.ai/models/kat-dev-72b-exp.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Llama Guard 3 1B](https://models.litellm.ai/models/llama-guard-3-1b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Llama V2 13B](https://models.litellm.ai/models/llama-v2-13b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Llama V2 13B Chat](https://models.litellm.ai/models/llama-v2-13b-chat.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Llama V2 70B](https://models.litellm.ai/models/llama-v2-70b.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Llama V2 70B Chat](https://models.litellm.ai/models/llama-v2-70b-chat.md): $0.90 / $0.90 per 1M tokens, 2K context, 1 provider - [Llama V2 7B](https://models.litellm.ai/models/llama-v2-7b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Llama V2 7B Chat](https://models.litellm.ai/models/llama-v2-7b-chat.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Llama V3 70B Instruct](https://models.litellm.ai/models/llama-v3-70b-instruct.md): $0.90 / $0.90 per 1M tokens, 8K context, 1 provider - [Llama V3 70B Instruct HF](https://models.litellm.ai/models/llama-v3-70b-instruct-hf.md): $0.90 / $0.90 per 1M tokens, 8K context, 1 provider - [Llama V3 8B](https://models.litellm.ai/models/llama-v3-8b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Llama V3 8B Instruct HF](https://models.litellm.ai/models/llama-v3-8b-instruct-hf.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Llama V3p1 405B Instruct Long](https://models.litellm.ai/models/llama-v3p1-405b-instruct-long.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Llama V3p1 70B Instruct](https://models.litellm.ai/models/llama-v3p1-70b-instruct.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Llama V3p1 70B Instruct 1B](https://models.litellm.ai/models/llama-v3p1-70b-instruct-1b.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Llama V3p1 Nemotron 70B Instruct](https://models.litellm.ai/models/llama-v3p1-nemotron-70b-instruct.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Llama V3p2 1B](https://models.litellm.ai/models/llama-v3p2-1b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Llama V3p2 3B](https://models.litellm.ai/models/llama-v3p2-3b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Llama V3p3 70B Instruct](https://models.litellm.ai/models/llama-v3p3-70b-instruct.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Llamaguard 7B](https://models.litellm.ai/models/llamaguard-7b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Llava Yi 34B](https://models.litellm.ai/models/llava-yi-34b.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Long Form](https://models.litellm.ai/models/long-form.md): $100 per 1M characters, 1 provider - [MiniMax M1 80K](https://models.litellm.ai/models/minimax-m1-80k.md): $0.10 / $0.10 per 1M tokens, 4K context, 2 providers - [MiniMax M2.1](https://models.litellm.ai/models/minimax-m2.1.md): $0.30 / $1.20 per 1M tokens, 1M context, 5 providers - [MiniMax M2.1 Lightning](https://models.litellm.ai/models/minimax-m2.1-lightning.md): $0.30 / $2.40 per 1M tokens, 1M context, 1 provider - [Ministral 14B](https://models.litellm.ai/models/ministral-14b.md): $0.20 / $0.20 per 1M tokens, 256K context, 1 provider - [Ministral 3 14B Instruct](https://models.litellm.ai/models/ministral-3-14b-instruct.md): $0.20 / $0.20 per 1M tokens, 128K context, 3 providers - [Ministral 3 3B Instruct](https://models.litellm.ai/models/ministral-3-3b-instruct.md): $0.10 / $0.10 per 1M tokens, 128K context, 2 providers - [Ministral 3 8B Instruct](https://models.litellm.ai/models/ministral-3-8b-instruct.md): $0.15 / $0.15 per 1M tokens, 128K context, 2 providers - [Mistral 7B Instruct 4K](https://models.litellm.ai/models/mistral-7b-instruct-4k.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Mistral 7B Instruct V3](https://models.litellm.ai/models/mistral-7b-instruct-v3.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Mistral 7B V0p2](https://models.litellm.ai/models/mistral-7b-v0p2.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Mistral Large 3](https://models.litellm.ai/models/mistral-large-3.md): $0.50 / $1.50 per 1M tokens, 256K context, 3 providers - [Mistral Large 3 675B Instruct](https://models.litellm.ai/models/mistral-large-3-675b-instruct.md): $0.50 / $1.50 per 1M tokens, 256K context, 1 provider - [Mistral Nemo Base](https://models.litellm.ai/models/mistral-nemo-base.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Mixtral 8x22B](https://models.litellm.ai/models/mixtral-8x22b.md): $1.20 / $1.20 per 1M tokens, 64K context, 1 provider - [Mixtral 8x7B Instruct HF](https://models.litellm.ai/models/mixtral-8x7b-instruct-hf.md): $0.50 / $0.50 per 1M tokens, 32K context, 1 provider - [Nano Banana Pro](https://models.litellm.ai/models/nano-banana-pro.md): $0.15 per image, 2 providers - [Nemotron Nano 12B V2](https://models.litellm.ai/models/nemotron-nano-12b-v2.md): $0.20 / $0.60 per 1M tokens, 128K context, 1 provider - [Nemotron Nano 9B V2](https://models.litellm.ai/models/nemotron-nano-9b-v2.md): $0.06 / $0.23 per 1M tokens, 128K context, 1 provider - [Nemotron Nano V2 12B VL](https://models.litellm.ai/models/nemotron-nano-v2-12b-vl.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Neural](https://models.litellm.ai/models/neural.md): $16 per 1M characters, 1 provider - [Nous Capybara 7B V1p9](https://models.litellm.ai/models/nous-capybara-7b-v1p9.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Nous Hermes 2 Yi 34B](https://models.litellm.ai/models/nous-hermes-2-yi-34b.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Nous Hermes Llama2 70B](https://models.litellm.ai/models/nous-hermes-llama2-70b.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Nous Hermes Llama2 7B](https://models.litellm.ai/models/nous-hermes-llama2-7b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Nova 2 Lite](https://models.litellm.ai/models/nova-2-lite.md): $0.30 / $2.50 per 1M tokens, 1M context, 1 provider - [Nova Premier V1](https://models.litellm.ai/models/nova-premier-v1.md): $2.50 / $12.50 per 1M tokens, 1M context, 1 provider - [Nvidia Nemotron Nano 12B V2](https://models.litellm.ai/models/nvidia-nemotron-nano-12b-v2.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Olmo 3 32B Think](https://models.litellm.ai/models/olmo-3-32b-think.md): Free, 32K context, 1 provider - [Olmo 3 7B Instruct](https://models.litellm.ai/models/olmo-3-7b-instruct.md): Free, 32K context, 1 provider - [Olmo 3 7B Think](https://models.litellm.ai/models/olmo-3-7b-think.md): Free, 32K context, 1 provider - [Openchat 3p5 0106 7B](https://models.litellm.ai/models/openchat-3p5-0106-7b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Openhermes 2 Mistral 7B](https://models.litellm.ai/models/openhermes-2-mistral-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Openhermes 2p5 Mistral 7B](https://models.litellm.ai/models/openhermes-2p5-mistral-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Openorca 7B](https://models.litellm.ai/models/openorca-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Outpaint](https://models.litellm.ai/models/outpaint.md): $0.004 per image, 1 provider - [Palmyra X4](https://models.litellm.ai/models/palmyra-x4.md): $2.50 / $10 per 1M tokens, 128K context, 1 provider - [Palmyra X5](https://models.litellm.ai/models/palmyra-x5.md): $0.60 / $6 per 1M tokens, 1M context, 1 provider - [Phi 2 3B](https://models.litellm.ai/models/phi-2-3b.md): $0.10 / $0.10 per 1M tokens, 2K context, 1 provider - [Phi 3 Vision 128K Instruct](https://models.litellm.ai/models/phi-3-vision-128k-instruct.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Phind Code Llama 34B Python V1](https://models.litellm.ai/models/phind-code-llama-34b-python-v1.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Phind Code Llama 34B V1](https://models.litellm.ai/models/phind-code-llama-34b-v1.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Phind Code Llama 34B V2](https://models.litellm.ai/models/phind-code-llama-34b-v2.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Playground V2 1024px Aesthetic](https://models.litellm.ai/models/playground-v2-1024px-aesthetic.md): $0.00013 per 1M input tokens, 4K context, 1 provider - [Playground V2 5 1024px Aesthetic](https://models.litellm.ai/models/playground-v2-5-1024px-aesthetic.md): $0.00013 per 1M input tokens, 4K context, 1 provider - [Pythia 12B](https://models.litellm.ai/models/pythia-12b.md): $0.20 / $0.20 per 1M tokens, 2K context, 1 provider - [Qwen QwQ 32B Preview](https://models.litellm.ai/models/qwen-qwq-32b-preview.md): $0.90 / $0.90 per 1M tokens, 32K context, 1 provider - [Qwen Sea Lion V4 32B IT](https://models.litellm.ai/models/qwen-sea-lion-v4-32b-it.md): Free, 32K context, 1 provider - [Qwen V2p5 14B Instruct](https://models.litellm.ai/models/qwen-v2p5-14b-instruct.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Qwen V2p5 7B](https://models.litellm.ai/models/qwen-v2p5-7b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Qwen1p5 72B Chat](https://models.litellm.ai/models/qwen1p5-72b-chat.md): $0.90 / $0.90 per 1M tokens, 32K context, 1 provider - [Qwen2 VL 2B Instruct](https://models.litellm.ai/models/qwen2-vl-2b-instruct.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2 VL 72B Instruct](https://models.litellm.ai/models/qwen2-vl-72b-instruct.md): $0.13 / $0.40 per 1M tokens, 128K context, 3 providers - [Qwen2 VL 7B Instruct](https://models.litellm.ai/models/qwen2-vl-7b-instruct.md): $0.02 / $0.06 per 1M tokens, 128K context, 2 providers - [Qwen2.5 32B Instruct](https://models.litellm.ai/models/qwen2.5-32b-instruct.md): $0.06 / $0.20 per 1M tokens, 128K context, 2 providers - [Qwen2p5 0p5b Instruct](https://models.litellm.ai/models/qwen2p5-0p5b-instruct.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 14B](https://models.litellm.ai/models/qwen2p5-14b.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Qwen2p5 1p5b Instruct](https://models.litellm.ai/models/qwen2p5-1p5b-instruct.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 32B](https://models.litellm.ai/models/qwen2p5-32b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Qwen2p5 72B](https://models.litellm.ai/models/qwen2p5-72b.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Qwen2p5 Coder 0p5b](https://models.litellm.ai/models/qwen2p5-coder-0p5b.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 0p5b Instruct](https://models.litellm.ai/models/qwen2p5-coder-0p5b-instruct.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 14B](https://models.litellm.ai/models/qwen2p5-coder-14b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 14B Instruct](https://models.litellm.ai/models/qwen2p5-coder-14b-instruct.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 1p5b](https://models.litellm.ai/models/qwen2p5-coder-1p5b.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 1p5b Instruct](https://models.litellm.ai/models/qwen2p5-coder-1p5b-instruct.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 32B](https://models.litellm.ai/models/qwen2p5-coder-32b.md): $0.90 / $0.90 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 32B Instruct 128K](https://models.litellm.ai/models/qwen2p5-coder-32b-instruct-128k.md): $0.90 / $0.90 per 1M tokens, 128K context, 1 provider - [Qwen2p5 Coder 32B Instruct 32K Rope](https://models.litellm.ai/models/qwen2p5-coder-32b-instruct-32k-rope.md): $0.90 / $0.90 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Coder 32B Instruct 64K](https://models.litellm.ai/models/qwen2p5-coder-32b-instruct-64k.md): $0.90 / $0.90 per 1M tokens, 64K context, 1 provider - [Qwen2p5 Coder 3B](https://models.litellm.ai/models/qwen2p5-coder-3b.md): $0.10 / $0.10 per 1M tokens, 32K context, 1 provider - [Qwen2p5 Math 72B Instruct](https://models.litellm.ai/models/qwen2p5-math-72b-instruct.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Qwen2p5 VL 3B Instruct](https://models.litellm.ai/models/qwen2p5-vl-3b-instruct.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Qwen3 0p6b](https://models.litellm.ai/models/qwen3-0p6b.md): $0.10 / $0.10 per 1M tokens, 40K context, 1 provider - [Qwen3 1p7b](https://models.litellm.ai/models/qwen3-1p7b.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Qwen3 1p7b FP8 Draft](https://models.litellm.ai/models/qwen3-1p7b-fp8-draft.md): $0.10 / $0.10 per 1M tokens, 256K context, 1 provider - [Qwen3 1p7b FP8 Draft 131072](https://models.litellm.ai/models/qwen3-1p7b-fp8-draft-131072.md): $0.10 / $0.10 per 1M tokens, 128K context, 1 provider - [Qwen3 1p7b FP8 Draft 40960](https://models.litellm.ai/models/qwen3-1p7b-fp8-draft-40960.md): $0.10 / $0.10 per 1M tokens, 40K context, 1 provider - [Qwen3 30B A3B Instruct 2507](https://models.litellm.ai/models/qwen3-30b-a3b-instruct-2507.md): $0.10 / $0.30 per 1M tokens, 262K context, 3 providers - [Qwen3 30B A3B Thinking 2507](https://models.litellm.ai/models/qwen3-30b-a3b-thinking-2507.md): $0.90 / $0.90 per 1M tokens, 256K context, 1 provider - [Qwen3 Coder 480B Instruct](https://models.litellm.ai/models/qwen3-coder-480b-instruct.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Qwen3 Embedding 0p6b](https://models.litellm.ai/models/qwen3-embedding-0-6b.md): Free, 32K context, 3 providers - [Qwen3 Embedding 4B](https://models.litellm.ai/models/qwen3-embedding-4b.md): Free, 40K context, 1 provider - [Qwen3 Embedding 8B](https://models.litellm.ai/models/qwen3-embedding-8b.md): $0.01 per 1M tokens, 40K context, 5 providers - [Qwen3 Next 80B A3B](https://models.litellm.ai/models/qwen3-next-80b-a3b.md): $0.15 / $1.20 per 1M tokens, 256K context, 1 provider - [Qwen3 Reranker 0p6b](https://models.litellm.ai/models/qwen3-reranker-0p6b.md): $0 per 1M input tokens, 40K context, 1 provider - [Qwen3 Reranker 4B](https://models.litellm.ai/models/qwen3-reranker-4b.md): $0 per 1M input tokens, 40K context, 1 provider - [Qwen3 Reranker 8B](https://models.litellm.ai/models/qwen3-reranker-8b.md): $0.05 per 1M input tokens, 32K context, 2 providers - [Qwen3 VL 235B A22B](https://models.litellm.ai/models/qwen3-vl-235b-a22b.md): $0.53 / $2.66 per 1M tokens, 256K context, 1 provider - [Qwen3 VL 235B A22B Instruct](https://models.litellm.ai/models/qwen3-vl-235b-a22b-instruct.md): $0.40 / $1.60 per 1M tokens, 128K context, 8 providers - [Qwen3 VL 235B A22B Thinking](https://models.litellm.ai/models/qwen3-vl-235b-a22b-thinking.md): $0.40 / $4 per 1M tokens, 128K context, 5 providers - [Qwen3 VL 30B A3B Instruct](https://models.litellm.ai/models/qwen3-vl-30b-a3b-instruct.md): $0.15 / $0.60 per 1M tokens, 256K context, 3 providers - [Qwen3 VL 30B A3B Thinking](https://models.litellm.ai/models/qwen3-vl-30b-a3b-thinking.md): $0.15 / $0.60 per 1M tokens, 256K context, 2 providers - [Qwen3 VL 32B Instruct](https://models.litellm.ai/models/qwen3-vl-32b-instruct.md): $0.16 / $0.64 per 1M tokens, 128K context, 5 providers - [Qwen3 VL 8B Instruct](https://models.litellm.ai/models/qwen3-vl-8b-instruct.md): $0.08 / $0.50 per 1M tokens, 128K context, 3 providers - [Remove Background](https://models.litellm.ai/models/remove-background.md): $0.005 per image, 1 provider - [Replace Background And Relight](https://models.litellm.ai/models/replace-background-and-relight.md): $0.008 per image, 1 provider - [Rerank 2.5](https://models.litellm.ai/models/rerank-2.5.md): $0.05 per 1M input tokens, 32K context, 1 provider - [Rerank 2.5 Lite](https://models.litellm.ai/models/rerank-2.5-lite.md): $0.02 per 1M input tokens, 32K context, 1 provider - [Rolm Ocr](https://models.litellm.ai/models/rolm-ocr.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Salamandra 7B Instruct Tools 16K](https://models.litellm.ai/models/salamandra-7b-instruct-tools-16k.md): Free, 16K context, 1 provider - [SD3](https://models.litellm.ai/models/sd3.md): $0.065 per image, 1 provider - [SD3 Large Turbo](https://models.litellm.ai/models/sd3-large-turbo.md): $0.04 per image, 1 provider - [SD3 Medium](https://models.litellm.ai/models/sd3-medium.md): $0.035 per image, 1 provider - [Sd3.5 Large Turbo](https://models.litellm.ai/models/sd3.5-large-turbo.md): $0.04 per image, 1 provider - [Sd3.5 Medium](https://models.litellm.ai/models/sd3.5-medium.md): $0.035 per image, 1 provider - [Search And Recolor](https://models.litellm.ai/models/search-and-recolor.md): $0.005 per image, 1 provider - [Search And Replace](https://models.litellm.ai/models/search-and-replace.md): $0.005 per image, 1 provider - [Sketch](https://models.litellm.ai/models/sketch.md): $0.005 per image, 1 provider - [Snorkel Mistral 7B Pairrm Dpo](https://models.litellm.ai/models/snorkel-mistral-7b-pairrm-dpo.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Speech 02 HD](https://models.litellm.ai/models/speech-02-hd.md): $100 per 1M characters, 1 provider - [Speech 02 Turbo](https://models.litellm.ai/models/speech-02-turbo.md): $60 per 1M characters, 1 provider - [Speech 2.6 HD](https://models.litellm.ai/models/speech-2.6-hd.md): $100 per 1M characters, 1 provider - [Speech 2.6 Turbo](https://models.litellm.ai/models/speech-2.6-turbo.md): $60 per 1M characters, 1 provider - [Ssd 1B](https://models.litellm.ai/models/ssd-1b.md): $0.00013 per 1M input tokens, 4K context, 1 provider - [Stable Conservative Upscale](https://models.litellm.ai/models/stable-conservative-upscale.md): $0.40 per image, 77 context, 1 provider - [Stable Creative Upscale](https://models.litellm.ai/models/stable-creative-upscale.md): $0.60 per image, 77 context, 1 provider - [Stable Diffusion XL 1024 V1 0](https://models.litellm.ai/models/stable-diffusion-xl-1024-v1-0.md): $0.00013 per 1M input tokens, 4K context, 1 provider - [Stable Fast Upscale](https://models.litellm.ai/models/stable-fast-upscale.md): $0.03 per image, 77 context, 1 provider - [Stable Image Control Sketch](https://models.litellm.ai/models/stable-image-control-sketch.md): $0.07 per image, 77 context, 1 provider - [Stable Image Control Structure](https://models.litellm.ai/models/stable-image-control-structure.md): $0.07 per image, 77 context, 1 provider - [Stable Image Erase Object](https://models.litellm.ai/models/stable-image-erase-object.md): $0.07 per image, 77 context, 1 provider - [Stable Image Inpaint](https://models.litellm.ai/models/stable-image-inpaint.md): $0.07 per image, 77 context, 1 provider - [Stable Image Remove Background](https://models.litellm.ai/models/stable-image-remove-background.md): $0.07 per image, 77 context, 1 provider - [Stable Image Search Recolor](https://models.litellm.ai/models/stable-image-search-recolor.md): $0.07 per image, 77 context, 1 provider - [Stable Image Search Replace](https://models.litellm.ai/models/stable-image-search-replace.md): $0.07 per image, 77 context, 1 provider - [Stable Image Style Guide](https://models.litellm.ai/models/stable-image-style-guide.md): $0.07 per image, 77 context, 1 provider - [Stable Outpaint](https://models.litellm.ai/models/stable-outpaint.md): $0.06 per image, 77 context, 1 provider - [Stable Style Transfer](https://models.litellm.ai/models/stable-style-transfer.md): $0.08 per image, 77 context, 1 provider - [Stablecode 3B](https://models.litellm.ai/models/stablecode-3b.md): $0.10 / $0.10 per 1M tokens, 4K context, 1 provider - [Standard](https://models.litellm.ai/models/standard.md): $4 per 1M characters, 1 provider - [Starcoder 16B](https://models.litellm.ai/models/starcoder-16b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Starcoder 7B](https://models.litellm.ai/models/starcoder-7b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Starcoder2 15B](https://models.litellm.ai/models/starcoder2-15b.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Starcoder2 3B](https://models.litellm.ai/models/starcoder2-3b.md): $0.10 / $0.10 per 1M tokens, 16K context, 1 provider - [Starcoder2 7B](https://models.litellm.ai/models/starcoder2-7b.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Structure](https://models.litellm.ai/models/structure.md): $0.005 per image, 1 provider - [Style](https://models.litellm.ai/models/style.md): $0.005 per image, 1 provider - [Style Transfer](https://models.litellm.ai/models/style-transfer.md): $0.008 per image, 1 provider - [Text Embedding 3 Small Inference](https://models.litellm.ai/models/text-embedding-3-small-inference.md): 8K context, 1 provider - [Veo 3.1 Fast Generate 001](https://models.litellm.ai/models/veo-3.1-fast-generate-001.md): $0.10 per second, 1K context, 2 providers - [Veo 3.1 Generate 001](https://models.litellm.ai/models/veo-3.1-generate-001.md): $0.40 per second, 1K context, 2 providers - [Voxtral Mini 3B](https://models.litellm.ai/models/voxtral-mini-3b.md): $0.04 / $0.04 per 1M tokens, 32K context, 1 provider - [Voxtral Small 24B](https://models.litellm.ai/models/voxtral-small-24b.md): $0.10 / $0.30 per 1M tokens, 32K context, 1 provider - [Yi 34B](https://models.litellm.ai/models/yi-34b.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Yi 34B 200K Capybara](https://models.litellm.ai/models/yi-34b-200k-capybara.md): $0.90 / $0.90 per 1M tokens, 200K context, 1 provider - [Yi 6B](https://models.litellm.ai/models/yi-6b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Claude Opus 4.5](https://models.litellm.ai/models/claude-opus-4-5.md): $5 / $25 per 1M tokens, 200K context, 8 providers - [DeepSeek V3.2 Exp](https://models.litellm.ai/models/deepseek-v3.2-exp.md): $0.27 / $0.41 per 1M tokens, 160K context, 1 provider - [Dreamina V3.1](https://models.litellm.ai/models/dreamina-v3.1.md): $0.03 per image, 1 provider - [Eleven Multilingual V2](https://models.litellm.ai/models/eleven_multilingual_v2.md): $0.30 per 1M characters, 2 providers - [Embed Multilingual Light V3.0](https://models.litellm.ai/models/embed-multilingual-light-v3.0.md): $100 per 1M tokens, 512 context, 2 providers - [FLUX Schnell](https://models.litellm.ai/models/flux-schnell.md): $0.003 per image, 1 provider - [Gemini 3 Pro Image Preview](https://models.litellm.ai/models/gemini-3-pro-image-preview.md): $0.134 per image, 128K context, 2 providers - [Gemini 3 Pro Preview](https://models.litellm.ai/models/gemini-3-pro-preview.md): $2 / $12 per 1M tokens, 1M context, 2 providers - [Gemini Live 2.5 Flash Preview Native Audio](https://models.litellm.ai/models/gemini-live-2.5-flash-preview-native-audio.md): $0.50 / $2 per 1M tokens, 1M context, 2 providers - [Gen4 Image](https://models.litellm.ai/models/gen4_image.md): $0.05 per image, 1 provider - [Gen4 Image Turbo](https://models.litellm.ai/models/gen4_image_turbo.md): $0.02 per image, 1 provider - [GPT Audio](https://models.litellm.ai/models/gpt-audio.md): $2.50 / $10 per 1M tokens, 128K context, 2 providers - [GPT Audio Mini](https://models.litellm.ai/models/gpt-audio-mini.md): $0.60 / $2.40 per 1M tokens, 128K context, 2 providers - [GPT-4o Transcribe Diarize](https://models.litellm.ai/models/gpt-4o-transcribe-diarize.md): $0.006 per minute, 16K context, 2 providers - [GPT-5.1](https://models.litellm.ai/models/gpt-5.1.md): $1.25 / $10 per 1M tokens, 272K context, 5 providers - [GPT-5.1 Chat](https://models.litellm.ai/models/gpt-5.1-chat.md): $1.25 / $10 per 1M tokens, 128K context, 2 providers - [GPT-5.1 Codex](https://models.litellm.ai/models/gpt-5.1-codex.md): $1.25 / $10 per 1M tokens, 400K context, 2 providers - [GPT-5.1 Codex Mini](https://models.litellm.ai/models/gpt-5.1-codex-mini.md): $0.25 / $2 per 1M tokens, 400K context, 3 providers - [Grok 4.1 Fast](https://models.litellm.ai/models/grok-4.1-fast.md): $5 / $25 per 1M tokens, 128K context, 1 provider - [Grok 4.1 Fast Non Reasoning](https://models.litellm.ai/models/grok-4-1-fast-non-reasoning.md): $0.20 / $0.50 per 1M tokens, 128K context, 3 providers - [Grok 4.1 Fast Reasoning](https://models.litellm.ai/models/grok-4-1-fast-reasoning.md): $0.20 / $0.50 per 1M tokens, 128K context, 2 providers - [Imagen4 Preview Fast](https://models.litellm.ai/models/imagen4-preview-fast.md): $0.02 per image, 1 provider - [Imagen4 Preview Ultra](https://models.litellm.ai/models/imagen4-preview-ultra.md): $0.06 per image, 1 provider - [Kimi K2 Thinking](https://models.litellm.ai/models/kimi-k2-thinking.md): $0.60 / $2.50 per 1M tokens, 256K context, 9 providers - [MiniMax M2](https://models.litellm.ai/models/minimax-m2.md): $0.30 / $1.20 per 1M tokens, 200K context, 5 providers - [Prebuilt Document](https://models.litellm.ai/models/prebuilt-document.md): 1 provider - [Prebuilt Layout](https://models.litellm.ai/models/prebuilt-layout.md): 1 provider - [Prebuilt Read](https://models.litellm.ai/models/prebuilt-read.md): 1 provider - [Seedream V3](https://models.litellm.ai/models/seedream-v3.md): $0.03 per image, 1 provider - [Veo 3.0 Fast Generate 001](https://models.litellm.ai/models/veo-3.0-fast-generate-001.md): $0.10 per second, 1K context, 1 provider - [Veo 3.0 Generate 001](https://models.litellm.ai/models/veo-3.0-generate-001.md): $0.40 per second, 1K context, 1 provider - [Veo 3.1 Fast Generate Preview](https://models.litellm.ai/models/veo-3.1-fast-generate-preview.md): $0.10 per second, 1K context, 2 providers - [Veo 3.1 Generate Preview](https://models.litellm.ai/models/veo-3.1-generate-preview.md): $0.40 per second, 1K context, 2 providers - [Voyage 3.5](https://models.litellm.ai/models/voyage-3.5.md): $0.06 per 1M tokens, 32K context, 1 provider - [Voyage 3.5 Lite](https://models.litellm.ai/models/voyage-3.5-lite.md): $0.02 per 1M tokens, 32K context, 1 provider - [Allam 1 13B Instruct](https://models.litellm.ai/models/allam-1-13b-instruct.md): $1.80 / $1.80 per 1M tokens, 8K context, 1 provider - [Azure TTS](https://models.litellm.ai/models/azure-tts.md): $15 per 1M characters, 1 provider - [Azure TTS HD](https://models.litellm.ai/models/azure-tts-hd.md): $30 per 1M characters, 1 provider - [BGE Base En V1.5](https://models.litellm.ai/models/bge-base-en-v1.5.md): $0.008 per 1M tokens, 512 context, 1 provider - [Claude Haiku 4.5](https://models.litellm.ai/models/claude-haiku-4-5.md): $1 / $5 per 1M tokens, 200K context, 12 providers - [Claude Sonnet 4.5](https://models.litellm.ai/models/claude-sonnet-4-5.md): $3 / $15 per 1M tokens, 200K context, 9 providers - [Codestral 2](https://models.litellm.ai/models/codestral-2.md): $0.30 / $0.90 per 1M tokens, 128K context, 1 provider - [Command Plus](https://models.litellm.ai/models/command-plus.md): $1.56 / $1.56 per 1M tokens, 128K context, 1 provider - [DeepSeek V3.1 Terminus](https://models.litellm.ai/models/deepseek-v3.1-terminus.md): $0.27 / $1 per 1M tokens, 128K context, 3 providers - [Embed V4](https://models.litellm.ai/models/embed-v4.md): $0.12 per 1M tokens, 128K context, 1 provider - [Flan T5 XL 3B](https://models.litellm.ai/models/flan-t5-xl-3b.md): $0.60 / $0.60 per 1M tokens, 8K context, 1 provider - [FLUX Pro V1.1 Ultra](https://models.litellm.ai/models/flux-pro-v1.1-ultra.md): $0.06 per image, 1 provider - [Gemini 2.5 Flash Image](https://models.litellm.ai/models/gemini-2.5-flash-image.md): $0.039 per image, 64K context, 2 providers - [Gemini 2.5 Flash Lite Preview](https://models.litellm.ai/models/gemini-2.5-flash-lite-preview.md): $0.10 / $0.40 per 1M tokens, 1M context, 1 provider - [Gemini 2.5 Flash Preview](https://models.litellm.ai/models/gemini-2.5-flash-preview.md): $0.30 / $2.50 per 1M tokens, 1M context, 1 provider - [Gemini Flash](https://models.litellm.ai/models/gemini-flash.md): $0.75 / $3.75 per 1M tokens, 1M context, 1 provider - [Gemini Flash Lite](https://models.litellm.ai/models/gemini-flash-lite.md): $0.30 / $2.50 per 1M tokens, 1M context, 1 provider - [GLM 4.6](https://models.litellm.ai/models/glm-4.6.md): $0.60 / $2.20 per 1M tokens, 200K context, 7 providers - [GPT Image 1 Mini](https://models.litellm.ai/models/gpt-image-1-mini.md): $2 per 1M input tokens, 2 providers - [GPT OSS](https://models.litellm.ai/models/gpt-oss.md): Free, 128K context, 1 provider - [GPT OSS 120B Mxfp](https://models.litellm.ai/models/gpt-oss-120b-mxfp.md): Free, 128K context, 1 provider - [GPT OSS 20B Mxfp4](https://models.litellm.ai/models/gpt-oss-20b-mxfp4.md): Free, 128K context, 1 provider - [GPT Realtime Mini](https://models.litellm.ai/models/gpt-realtime-mini.md): $0.60 / $2.40 per 1M tokens, 32K context, 2 providers - [GPT-5 Pro](https://models.litellm.ai/models/gpt-5-pro.md): $15 / $120 per 1M tokens, 400K context, 2 providers - [Granite 13B Chat V2](https://models.litellm.ai/models/granite-13b-chat-v2.md): $0.60 / $0.60 per 1M tokens, 8K context, 1 provider - [Granite 13B Instruct V2](https://models.litellm.ai/models/granite-13b-instruct-v2.md): $0.60 / $0.60 per 1M tokens, 8K context, 1 provider - [Granite 3.3 8B Instruct](https://models.litellm.ai/models/granite-3-3-8b-instruct.md): $0.03 / $0.25 per 1M tokens, 8K context, 2 providers - [Granite 4 H Small](https://models.litellm.ai/models/granite-4-h-small.md): $0.0636 / $0.265 per 1M tokens, 128K context, 1 provider - [Granite Guardian 3.2 2B](https://models.litellm.ai/models/granite-guardian-3-2-2b.md): $0.10 / $0.10 per 1M tokens, 8K context, 1 provider - [Granite Guardian 3.3 8B](https://models.litellm.ai/models/granite-guardian-3-3-8b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Granite Ttm 1024 96 R2](https://models.litellm.ai/models/granite-ttm-1024-96-r2.md): $0.38 / $0.38 per 1M tokens, 512 context, 1 provider - [Granite Ttm 1536 96 R2](https://models.litellm.ai/models/granite-ttm-1536-96-r2.md): $0.38 / $0.38 per 1M tokens, 512 context, 1 provider - [Granite Ttm 512 96 R2](https://models.litellm.ai/models/granite-ttm-512-96-r2.md): $0.38 / $0.38 per 1M tokens, 512 context, 1 provider - [Granite Vision 3.2 2B](https://models.litellm.ai/models/granite-vision-3-2-2b.md): $0.10 / $0.10 per 1M tokens, 8K context, 1 provider - [Imagen4 Preview](https://models.litellm.ai/models/imagen4-preview.md): $0.0398 per image, 1 provider - [Jais 13B Chat](https://models.litellm.ai/models/jais-13b-chat.md): $500 / $2,000 per 1M tokens, 8K context, 1 provider - [Llama 3.2 Nv Rerankqa 1B V2](https://models.litellm.ai/models/llama-3_2-nv-rerankqa-1b-v2.md): $0 per 1M input tokens, 1 provider - [Llama 3.3 Nemotron Super 49B V1.5](https://models.litellm.ai/models/llama-3.3-nemotron-super-49b-v1.5.md): $0.10 / $0.40 per 1M tokens, 128K context, 1 provider - [Llama 4 Maverick 17B](https://models.litellm.ai/models/llama-4-maverick-17b.md): $0.371 / $1.484 per 1M tokens, 128K context, 1 provider - [Llama Guard 3 11B Vision](https://models.litellm.ai/models/llama-guard-3-11b-vision.md): $0.35 / $0.35 per 1M tokens, 128K context, 1 provider - [Mistral Document AI](https://models.litellm.ai/models/mistral-document-ai.md): 1 provider - [Mistral Ocr](https://models.litellm.ai/models/mistral-ocr.md): 3 providers - [Mt0 Xxl 13B](https://models.litellm.ai/models/mt0-xxl-13b.md): $1.908 / $1.908 per 1M tokens, 4K context, 1 provider - [Nv Rerankqa Mistral 4B V3](https://models.litellm.ai/models/nv-rerankqa-mistral-4b-v3.md): $0 per 1M input tokens, 1 provider - [Nvidia Nemotron Nano 9B V2](https://models.litellm.ai/models/nvidia-nemotron-nano-9b-v2.md): $0.04 / $0.16 per 1M tokens, 128K context, 3 providers - [Phi 4 Mini Reasoning](https://models.litellm.ai/models/phi-4-mini-reasoning.md): $0.075 / $0.30 per 1M tokens, 128K context, 1 provider - [Phi 4 Reasoning](https://models.litellm.ai/models/phi-4-reasoning.md): $0.125 / $0.50 per 1M tokens, 32K context, 1 provider - [Qwen3 4B Instruct 2507](https://models.litellm.ai/models/qwen3-4b-instruct-2507.md): $0.20 / $0.20 per 1M tokens, 256K context, 2 providers - [Qwen3 Coder 30B A3B Instruct](https://models.litellm.ai/models/qwen3-coder-30b-a3b-instruct.md): $0.07 / $0.27 per 1M tokens, 160K context, 5 providers - [Stable Diffusion V35 Medium](https://models.litellm.ai/models/stable-diffusion-v35-medium.md): $0.0398 per image, 1 provider - [Text To Image 3.2](https://models.litellm.ai/models/text-to-image-3.2.md): $0.0398 per image, 1 provider - [Titan Image Generator V1](https://models.litellm.ai/models/titan-image-generator-v1.md): $0.008 per image, 1 provider - [Titan Image Generator V2](https://models.litellm.ai/models/titan-image-generator-v2.md): $0.008 per image, 1 provider - [V3](https://models.litellm.ai/models/v3.md): $0.0398 per image, 1 provider - [Codestral Embed](https://models.litellm.ai/models/codestral-embed.md): $0.15 per 1M tokens, 8K context, 2 providers - [Doubao Embedding](https://models.litellm.ai/models/doubao-embedding.md): Free, 4K context, 1 provider - [Doubao Embedding Large](https://models.litellm.ai/models/doubao-embedding-large.md): Free, 4K context, 1 provider - [Doubao Embedding Large Text 240915](https://models.litellm.ai/models/doubao-embedding-large-text-240915.md): Free, 4K context, 1 provider - [Doubao Embedding Large Text 250515](https://models.litellm.ai/models/doubao-embedding-large-text-250515.md): Free, 4K context, 1 provider - [Doubao Embedding Text 240715](https://models.litellm.ai/models/doubao-embedding-text-240715.md): Free, 4K context, 1 provider - [GPT Realtime](https://models.litellm.ai/models/gpt-realtime.md): $4 / $16 per 1M tokens, 32K context, 2 providers - [GPT-5 Codex](https://models.litellm.ai/models/gpt-5-codex.md): $1.25 / $10 per 1M tokens, 272K context, 2 providers - [Grok 4 Fast](https://models.litellm.ai/models/grok-4-fast.md): $5 / $25 per 1M tokens, 128K context, 1 provider - [Grok 4 Fast Non Reasoning](https://models.litellm.ai/models/grok-4-fast-non-reasoning.md): $0.20 / $0.50 per 1M tokens, 1 provider - [Grok 4 Fast Reasoning](https://models.litellm.ai/models/grok-4-fast-reasoning.md): $0.20 / $0.50 per 1M tokens, 1 provider - [Grok Code Fast](https://models.litellm.ai/models/grok-code-fast.md): $1 / $2 per 1M tokens, 256K context, 1 provider - [Grok Code Fast 1](https://models.litellm.ai/models/grok-code-fast-1.md): $1 / $2 per 1M tokens, 256K context, 3 providers - [Llava V1.6 Mistral 7B HF](https://models.litellm.ai/models/llava-v1.6-mistral-7b-hf.md): $0.29 / $0.29 per 1M tokens, 32K context, 1 provider - [Mamba Codestral 7B V0.1](https://models.litellm.ai/models/mamba-codestral-7b-v0.1.md): $0.19 / $0.19 per 1M tokens, 256K context, 1 provider - [Marengo Embed 2.7](https://models.litellm.ai/models/marengo-embed-2-7.md): 77 context, 1 provider - [Pegasus 1.2](https://models.litellm.ai/models/pegasus-1-2.md): 1 provider - [Qwen Coder](https://models.litellm.ai/models/qwen-coder.md): $0.30 / $1.50 per 1M tokens, 1M context, 3 providers - [Qwen Flash](https://models.litellm.ai/models/qwen-flash.md): 998K context, 3 providers - [Qwen3 Coder 30B A3B](https://models.litellm.ai/models/qwen3-coder-30b-a3b.md): $0.15 / $0.60 per 1M tokens, 256K context, 2 providers - [Qwen3 Coder 480B A35B](https://models.litellm.ai/models/qwen3-coder-480b-a35b.md): $0.45 / $1.80 per 1M tokens, 128K context, 1 provider - [Qwen3 Coder Flash](https://models.litellm.ai/models/qwen3-coder-flash.md): 998K context, 3 providers - [Qwen3 Coder Plus](https://models.litellm.ai/models/qwen3-coder-plus.md): 998K context, 3 providers - [Qwen3 Max Preview](https://models.litellm.ai/models/qwen3-max-preview.md): 252K context, 3 providers - [Qwen3 Next 80B A3B Instruct](https://models.litellm.ai/models/qwen3-next-80b-a3b-instruct.md): $0.15 / $1.20 per 1M tokens, 256K context, 10 providers - [Qwen3 Next 80B A3B Thinking](https://models.litellm.ai/models/qwen3-next-80b-a3b-thinking.md): $0.15 / $1.20 per 1M tokens, 256K context, 9 providers - [QwQ Plus](https://models.litellm.ai/models/qwq-plus.md): $0.80 / $2.40 per 1M tokens, 96K context, 3 providers - [Veo 2.0 Generate 001](https://models.litellm.ai/models/veo-2.0-generate-001.md): $0.50 per second, 1K context, 1 provider - [Chronos Hermes 13B V2](https://models.litellm.ai/models/chronos-hermes-13b-v2.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Claude Opus 4.1](https://models.litellm.ai/models/claude-opus-4-1.md): $15 / $75 per 1M tokens, 200K context, 3 providers - [DeepSeek Prover V2 671B](https://models.litellm.ai/models/deepseek-prover-v2-671b.md): $0.70 / $2.50 per 1M tokens, 160K context, 1 provider - [DeepSeek R1 0528 Turbo](https://models.litellm.ai/models/deepseek-r1-0528-turbo.md): $1 / $3 per 1M tokens, 32K context, 1 provider - [DeepSeek R1 Turbo](https://models.litellm.ai/models/deepseek-r1-turbo.md): $0.70 / $2.50 per 1M tokens, 64K context, 2 providers - [DeepSeek V3.1](https://models.litellm.ai/models/deepseek-v3.1.md): Free, 160K context, 12 providers - [Dev](https://models.litellm.ai/models/dev.md): $0.033 per image, 1 provider - [FLUX 1.1 Pro](https://models.litellm.ai/models/flux-1.1-pro.md): $0.04 per image, 5K context, 1 provider - [FLUX Pro](https://models.litellm.ai/models/flux-pro.md): $0.05 per image, 2 providers - [FLUX Pro V1.1](https://models.litellm.ai/models/flux-pro-v1.1.md): $0.04 per image, 2 providers - [FLUX Realism](https://models.litellm.ai/models/flux-realism.md): $0.046 per image, 1 provider - [Flux.1 Kontext Pro](https://models.litellm.ai/models/flux.1-kontext-pro.md): $0.04 per image, 5K context, 1 provider - [GPT OSS 120B](https://models.litellm.ai/models/gpt-oss-120b.md): $0.03 / $0.17 per 1M tokens, 131K context, 22 providers - [GPT OSS 120B 1](https://models.litellm.ai/models/gpt-oss-120b-1.md): $0.15 / $0.60 per 1M tokens, 128K context, 1 provider - [GPT OSS 20B](https://models.litellm.ai/models/gpt-oss-20b.md): $0.0145 / $0.07 per 1M tokens, 128K context, 14 providers - [GPT OSS 20B 1](https://models.litellm.ai/models/gpt-oss-20b-1.md): $0.07 / $0.30 per 1M tokens, 128K context, 1 provider - [GPT-5](https://models.litellm.ai/models/gpt-5.md): $1.25 / $10 per 1M tokens, 272K context, 8 providers - [GPT-5 Chat](https://models.litellm.ai/models/gpt-5-chat.md): $1.25 / $10 per 1M tokens, 128K context, 2 providers - [GPT-5 Mini](https://models.litellm.ai/models/gpt-5-mini.md): $0.25 / $2 per 1M tokens, 272K context, 8 providers - [GPT-5 Nano](https://models.litellm.ai/models/gpt-5-nano.md): $0.05 / $0.40 per 1M tokens, 272K context, 7 providers - [Imagen 4.0 Ultra Generate 001](https://models.litellm.ai/models/imagen-4.0-ultra-generate-001.md): $0.078 per image, 1 provider - [L3 70B Euryale V2.1](https://models.litellm.ai/models/l3-70b-euryale-v2.1.md): $1.48 / $1.48 per 1M tokens, 8K context, 1 provider - [L3 8B Lunaris V1 Turbo](https://models.litellm.ai/models/l3-8b-lunaris-v1-turbo.md): $0.04 / $0.05 per 1M tokens, 8K context, 1 provider - [L3.1 70B Euryale V2.2](https://models.litellm.ai/models/l3.1-70b-euryale-v2.2.md): $0.85 / $0.85 per 1M tokens, 128K context, 1 provider - [L3.3 70B Euryale V2.3](https://models.litellm.ai/models/l3.3-70b-euryale-v2.3.md): $0.65 / $0.75 per 1M tokens, 128K context, 1 provider - [Mistral Nemo Instruct](https://models.litellm.ai/models/mistral-nemo-instruct.md): $0.019 / $0.03 per 1M tokens, 128K context, 5 providers - [Olmocr 7B](https://models.litellm.ai/models/olmocr-7b.md): $0.27 / $1.50 per 1M tokens, 16K context, 1 provider - [Qwen2 7B Instruct](https://models.litellm.ai/models/qwen2-7b-instruct.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [Qwen2.5 Coder 7B](https://models.litellm.ai/models/qwen2.5-coder-7b.md): $0.01 / $0.03 per 1M tokens, 32K context, 3 providers - [Qwen3 235B A22B Instruct 2507](https://models.litellm.ai/models/qwen3-235b-a22b-instruct-2507.md): $0.09 / $0.58 per 1M tokens, 128K context, 8 providers - [Qwen3 Coder 480B A35B Instruct](https://models.litellm.ai/models/qwen3-coder-480b-a35b-instruct.md): $0.22 / $1.80 per 1M tokens, 256K context, 7 providers - [Qwen3 Coder 480B A35B Instruct Turbo](https://models.litellm.ai/models/qwen3-coder-480b-a35b-instruct-turbo.md): $0.30 / $1 per 1M tokens, 256K context, 1 provider - [Schnell](https://models.litellm.ai/models/schnell.md): $0.004 per image, 1 provider - [Text To Image](https://models.litellm.ai/models/text-to-image.md): $0.052 per image, 1 provider - [V1.1 Ultra](https://models.litellm.ai/models/v1.1-ultra.md): $0.063 per image, 1 provider - [Voyage Context 3](https://models.litellm.ai/models/voyage-context-3.md): $0.18 per 1M tokens, 120K context, 1 provider - [DeepSeek Llama3.3 70B](https://models.litellm.ai/models/deepseek-llama3.3-70b.md): $0.20 / $0.60 per 1M tokens, 128K context, 1 provider - [DeepSeek Prover V2](https://models.litellm.ai/models/deepseek-prover-v2.md): $1.20 / $1.20 per 1M tokens, 160K context, 1 provider - [DeepSeek R1 0528 Qwen3 8B](https://models.litellm.ai/models/deepseek-r1-0528-qwen3-8b.md): $0.06 / $0.09 per 1M tokens, 128K context, 1 provider - [DeepSeek R1 671B](https://models.litellm.ai/models/deepseek-r1-671b.md): $0.80 / $0.80 per 1M tokens, 128K context, 1 provider - [Devstral Medium](https://models.litellm.ai/models/devstral-medium.md): $0.40 / $2 per 1M tokens, 256K context, 1 provider - [Gemini 2.5 Flash Lite](https://models.litellm.ai/models/gemini-2.5-flash-lite.md): $0.10 / $0.40 per 1M tokens, 1M context, 3 providers - [Gemma 2 27B IT](https://models.litellm.ai/models/gemma-2-27b-it.md): $0.80 / $0.80 per 1M tokens, 8K context, 1 provider - [Gemma 2 9B](https://models.litellm.ai/models/gemma-2-9b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Gemma 3 12B IT](https://models.litellm.ai/models/gemma-3-12b-it.md): $0.05 / $0.10 per 1M tokens, 128K context, 4 providers - [Gemma 3 4B IT](https://models.litellm.ai/models/gemma-3-4b-it.md): $0.04 / $0.08 per 1M tokens, 128K context, 3 providers - [GLM 4 32B](https://models.litellm.ai/models/glm-4-32b.md): $0.55 / $1.66 per 1M tokens, 32K context, 1 provider - [GLM 4.5](https://models.litellm.ai/models/glm-4.5.md): $0.60 / $2.20 per 1M tokens, 128K context, 5 providers - [GLM 4.5 Air](https://models.litellm.ai/models/glm-4.5-air.md): $0.20 / $1.10 per 1M tokens, 128K context, 6 providers - [Grok 4](https://models.litellm.ai/models/grok-4.md): $3 / $15 per 1M tokens, 128K context, 4 providers - [Hermes 2 Pro Llama 3 8B](https://models.litellm.ai/models/hermes-2-pro-llama-3-8b.md): $0.14 / $0.14 per 1M tokens, 8K context, 1 provider - [Hermes 3 Llama 3.1 405B](https://models.litellm.ai/models/hermes-3-llama-3.1-405b.md): $1 / $3 per 1M tokens, 128K context, 2 providers - [Hermes 3 Llama 3.1 70B](https://models.litellm.ai/models/hermes-3-llama-3.1-70b.md): $0.12 / $0.30 per 1M tokens, 32K context, 2 providers - [Hermes3 405B](https://models.litellm.ai/models/hermes3-405b.md): $0.80 / $0.80 per 1M tokens, 128K context, 1 provider - [Hermes3 70B](https://models.litellm.ai/models/hermes3-70b.md): $0.12 / $0.30 per 1M tokens, 128K context, 1 provider - [Hermes3 8B](https://models.litellm.ai/models/hermes3-8b.md): $0.025 / $0.04 per 1M tokens, 128K context, 1 provider - [Jais 30B Chat](https://models.litellm.ai/models/jais-30b-chat.md): $3,200 / $9,710 per 1M tokens, 8K context, 1 provider - [Jamba Large 1.7](https://models.litellm.ai/models/jamba-large-1.7.md): $2 / $8 per 1M tokens, 256K context, 1 provider - [Jamba Mini 1.7](https://models.litellm.ai/models/jamba-mini-1.7.md): $0.20 / $0.40 per 1M tokens, 256K context, 1 provider - [Kimi K2](https://models.litellm.ai/models/kimi-k2.md): $0.55 / $2.20 per 1M tokens, 128K context, 2 providers - [Kimi K2 Instruct](https://models.litellm.ai/models/kimi-k2-instruct.md): $0.50 / $2 per 1M tokens, 128K context, 6 providers - [Lfm 40B](https://models.litellm.ai/models/lfm-40b.md): $0.10 / $0.20 per 1M tokens, 128K context, 1 provider - [Lfm 7B](https://models.litellm.ai/models/lfm-7b.md): $0.025 / $0.04 per 1M tokens, 128K context, 1 provider - [Llama 3.1 Nemotron 70B Instruct](https://models.litellm.ai/models/llama-3.1-nemotron-70b-instruct.md): $0.60 / $0.60 per 1M tokens, 128K context, 2 providers - [Llama 3.1 Nemotron Ultra 253B V1](https://models.litellm.ai/models/llama-3_1-nemotron-ultra-253b-v1.md): $0.60 / $1.80 per 1M tokens, 128K context, 1 provider - [Llama 3.2 11B](https://models.litellm.ai/models/llama-3.2-11b.md): $0.16 / $0.16 per 1M tokens, 128K context, 1 provider - [Llama 3.2 90B](https://models.litellm.ai/models/llama-3.2-90b.md): $0.72 / $0.72 per 1M tokens, 128K context, 1 provider - [Llama 3.3 Nemotron Super 49B V1](https://models.litellm.ai/models/llama-3.3-nemotron-super-49b-v1.md): $0.10 / $0.40 per 1M tokens, 128K context, 1 provider - [Llama 4 Scout](https://models.litellm.ai/models/llama-4-scout.md): $0.10 / $0.30 per 1M tokens, 128K context, 1 provider - [Llama Guard 2 8B](https://models.litellm.ai/models/llama-guard-2-8b.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Llama Guard 4 12B](https://models.litellm.ai/models/llama-guard-4-12b.md): $0.18 / $0.18 per 1M tokens, 160K context, 1 provider - [Mai Ds R1](https://models.litellm.ai/models/mai-ds-r1.md): $1.35 / $5.40 per 1M tokens, 128K context, 1 provider - [Mercury Coder Small](https://models.litellm.ai/models/mercury-coder-small.md): $0.25 / $1 per 1M tokens, 32K context, 1 provider - [Ministral 8B](https://models.litellm.ai/models/ministral-8b.md): $0.15 / $0.15 per 1M tokens, 256K context, 2 providers - [Mistral 7B Instruct V0.3](https://models.litellm.ai/models/mistral-7b-instruct-v0.3.md): $0.10 / $0.10 per 1M tokens, 127K context, 2 providers - [Mistral Medium 3](https://models.litellm.ai/models/mistral-medium-3.md): $1.50 / $7.50 per 1M tokens, 256K context, 2 providers - [Moonshot V1 128K](https://models.litellm.ai/models/moonshot-v1-128k.md): $2 / $5 per 1M tokens, 128K context, 1 provider - [Moonshot V1 128K Vision Preview](https://models.litellm.ai/models/moonshot-v1-128k-vision-preview.md): $2 / $5 per 1M tokens, 128K context, 1 provider - [Moonshot V1 32K](https://models.litellm.ai/models/moonshot-v1-32k.md): $1 / $3 per 1M tokens, 32K context, 1 provider - [Moonshot V1 32K Vision Preview](https://models.litellm.ai/models/moonshot-v1-32k-vision-preview.md): $1 / $3 per 1M tokens, 32K context, 1 provider - [Moonshot V1 8K](https://models.litellm.ai/models/moonshot-v1-8k.md): $0.20 / $2 per 1M tokens, 8K context, 1 provider - [Moonshot V1 8K Vision Preview](https://models.litellm.ai/models/moonshot-v1-8k-vision-preview.md): $0.20 / $2 per 1M tokens, 8K context, 1 provider - [Moonshot V1 Auto](https://models.litellm.ai/models/moonshot-v1-auto.md): $2 / $5 per 1M tokens, 128K context, 1 provider - [Morph V3 Fast](https://models.litellm.ai/models/morph-v3-fast.md): $0.80 / $1.20 per 1M tokens, 16K context, 2 providers - [Morph V3 Large](https://models.litellm.ai/models/morph-v3-large.md): $0.90 / $1.90 per 1M tokens, 16K context, 2 providers - [Nous Hermes 2 Mixtral 8x7B Dpo](https://models.litellm.ai/models/nous-hermes-2-mixtral-8x7b-dpo.md): $0.50 / $0.50 per 1M tokens, 32K context, 2 providers - [Nova Lite V1](https://models.litellm.ai/models/nova-lite-v1.md): $0.06 / $0.24 per 1M tokens, 300K context, 1 provider - [Nova Micro V1](https://models.litellm.ai/models/nova-micro-v1.md): $0.035 / $0.14 per 1M tokens, 128K context, 1 provider - [Nova Pro V1](https://models.litellm.ai/models/nova-pro-v1.md): $0.80 / $3.20 per 1M tokens, 300K context, 1 provider - [o3 Deep Research](https://models.litellm.ai/models/o3-deep-research.md): $10 / $40 per 1M tokens, 200K context, 2 providers - [o4 Mini Deep Research](https://models.litellm.ai/models/o4-mini-deep-research.md): $2 / $8 per 1M tokens, 200K context, 1 provider - [Qwen 3 235B](https://models.litellm.ai/models/qwen-3-235b.md): $0.20 / $0.60 per 1M tokens, 40K context, 1 provider - [Qwen 3 30B](https://models.litellm.ai/models/qwen-3-30b.md): $0.10 / $0.30 per 1M tokens, 40K context, 1 provider - [Qwen Max](https://models.litellm.ai/models/qwen-max.md): $1.60 / $6.40 per 1M tokens, 30K context, 3 providers - [Qwen Plus](https://models.litellm.ai/models/qwen-plus.md): $0.40 / $1.20 per 1M tokens, 126K context, 3 providers - [Qwen Turbo](https://models.litellm.ai/models/qwen-turbo.md): $0.05 / $0.20 per 1M tokens, 126K context, 3 providers - [Qwen2.5 7B Instruct](https://models.litellm.ai/models/qwen2.5-7b-instruct.md): $0.04 / $0.10 per 1M tokens, 32K context, 3 providers - [Qwen2.5 VL 32B Instruct](https://models.litellm.ai/models/qwen2.5-vl-32b-instruct.md): $0.20 / $0.60 per 1M tokens, 128K context, 2 providers - [Qwen2.5 VL 72B Instruct](https://models.litellm.ai/models/qwen2.5-vl-72b-instruct.md): $0.25 / $0.75 per 1M tokens, 32K context, 5 providers - [Qwen25 Coder 32B Instruct](https://models.litellm.ai/models/qwen25-coder-32b-instruct.md): $0.05 / $0.10 per 1M tokens, 128K context, 1 provider - [Qwen2p5 VL 7B Instruct](https://models.litellm.ai/models/qwen2p5-vl-7b-instruct.md): $0.20 / $0.20 per 1M tokens, 128K context, 1 provider - [Qwen3 14B](https://models.litellm.ai/models/qwen3-14b.md): $0.08 / $0.24 per 1M tokens, 32K context, 4 providers - [Qwen3 235B A22B](https://models.litellm.ai/models/qwen3-235b-a22b.md): $0.18 / $0.54 per 1M tokens, 40K context, 5 providers - [Qwen3 235B A22B 2507](https://models.litellm.ai/models/qwen3-235b-a22b-2507.md): $0.22 / $0.88 per 1M tokens, 256K context, 2 providers - [Qwen3 235B A22B Thinking 2507](https://models.litellm.ai/models/qwen3-235b-a22b-thinking-2507.md): $0.22 / $0.88 per 1M tokens, 256K context, 3 providers - [Qwen3 30B A3B](https://models.litellm.ai/models/qwen3-30b-a3b.md): $0.09 / $0.20 per 1M tokens, 128K context, 9 providers - [Qwen3 4B](https://models.litellm.ai/models/qwen3-4b.md): $0.08 / $0.24 per 1M tokens, 32K context, 3 providers - [Qwen3 8B](https://models.litellm.ai/models/qwen3-8b.md): $0.04 / $0.14 per 1M tokens, 32K context, 3 providers - [Qwen3 Coder](https://models.litellm.ai/models/qwen3-coder.md): Free, 256K context, 2 providers - [Recraftv2](https://models.litellm.ai/models/recraftv2.md): $0.022 per image, 1 provider - [Recraftv3](https://models.litellm.ai/models/recraftv3.md): $0.04 per image, 1 provider - [Sarvam M](https://models.litellm.ai/models/sarvam-m.md): Free, 8K context, 1 provider - [Scribe V1](https://models.litellm.ai/models/scribe_v1.md): $0 per second, 1 provider - [Scribe V1 Experimental](https://models.litellm.ai/models/scribe_v1_experimental.md): $0 per second, 1 provider - [Toppy M 7B](https://models.litellm.ai/models/toppy-m-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 1 provider - [V0 1.0 Md](https://models.litellm.ai/models/v0-1.0-md.md): $3 / $15 per 1M tokens, 128K context, 2 providers - [V0 1.5 Lg](https://models.litellm.ai/models/v0-1.5-lg.md): $15 / $75 per 1M tokens, 512K context, 1 provider - [V0 1.5 Md](https://models.litellm.ai/models/v0-1.5-md.md): $3 / $15 per 1M tokens, 128K context, 2 providers - [Base](https://models.litellm.ai/models/base.md): $0 per second, 1 provider - [Base Conversationalai](https://models.litellm.ai/models/base-conversationalai.md): $0 per second, 1 provider - [Base Finance](https://models.litellm.ai/models/base-finance.md): $0 per second, 1 provider - [Base General](https://models.litellm.ai/models/base-general.md): $0 per second, 1 provider - [Base Meeting](https://models.litellm.ai/models/base-meeting.md): $0 per second, 1 provider - [Base Phonecall](https://models.litellm.ai/models/base-phonecall.md): $0 per second, 1 provider - [Base Video](https://models.litellm.ai/models/base-video.md): $0 per second, 1 provider - [Base Voicemail](https://models.litellm.ai/models/base-voicemail.md): $0 per second, 1 provider - [Claude 4 Opus](https://models.litellm.ai/models/claude-4-opus.md): $5 / $25 per 1M tokens, 200K context, 3 providers - [Claude 4 Sonnet](https://models.litellm.ai/models/claude-4-sonnet.md): $3 / $15 per 1M tokens, 200K context, 5 providers - [Codex Mini](https://models.litellm.ai/models/codex-mini.md): $1.50 / $6 per 1M tokens, 200K context, 2 providers - [Enhanced](https://models.litellm.ai/models/enhanced.md): $0 per second, 1 provider - [Enhanced Finance](https://models.litellm.ai/models/enhanced-finance.md): $0 per second, 1 provider - [Enhanced General](https://models.litellm.ai/models/enhanced-general.md): $0 per second, 1 provider - [Enhanced Meeting](https://models.litellm.ai/models/enhanced-meeting.md): $0 per second, 1 provider - [Enhanced Phonecall](https://models.litellm.ai/models/enhanced-phonecall.md): $0 per second, 1 provider - [Gemini 2.5 Flash](https://models.litellm.ai/models/gemini-2.5-flash.md): $0.30 / $2.50 per 1M tokens, 1M context, 8 providers - [Gemini 2.5 Pro](https://models.litellm.ai/models/gemini-2.5-pro.md): $1.25 / $10 per 1M tokens, 1M context, 7 providers - [Gemini Embedding 001](https://models.litellm.ai/models/gemini-embedding-001.md): $0.15 per 1M tokens, 2K context, 3 providers - [Grok 3 Mini](https://models.litellm.ai/models/grok-3-mini.md): $0.25 / $1.27 per 1M tokens, 128K context, 3 providers - [Magistral Medium](https://models.litellm.ai/models/magistral-medium.md): $1.50 / $7.50 per 1M tokens, 256K context, 2 providers - [Magistral Small](https://models.litellm.ai/models/magistral-small.md): $0.15 / $0.60 per 1M tokens, 256K context, 3 providers - [Mistral Small 3.2 24B Instruct](https://models.litellm.ai/models/mistral-small-3.2-24b-instruct.md): $0.075 / $0.20 per 1M tokens, 128K context, 3 providers - [Nova](https://models.litellm.ai/models/nova.md): $0 per second, 1 provider - [Nova 2](https://models.litellm.ai/models/nova-2.md): $0 per second, 1 provider - [Nova 2 Atc](https://models.litellm.ai/models/nova-2-atc.md): $0 per second, 1 provider - [Nova 2 Automotive](https://models.litellm.ai/models/nova-2-automotive.md): $0 per second, 1 provider - [Nova 2 Conversationalai](https://models.litellm.ai/models/nova-2-conversationalai.md): $0 per second, 1 provider - [Nova 2 Drivethru](https://models.litellm.ai/models/nova-2-drivethru.md): $0 per second, 1 provider - [Nova 2 Finance](https://models.litellm.ai/models/nova-2-finance.md): $0 per second, 1 provider - [Nova 2 General](https://models.litellm.ai/models/nova-2-general.md): $0 per second, 1 provider - [Nova 2 Meeting](https://models.litellm.ai/models/nova-2-meeting.md): $0 per second, 1 provider - [Nova 2 Phonecall](https://models.litellm.ai/models/nova-2-phonecall.md): $0 per second, 1 provider - [Nova 2 Video](https://models.litellm.ai/models/nova-2-video.md): $0 per second, 1 provider - [Nova 2 Voicemail](https://models.litellm.ai/models/nova-2-voicemail.md): $0 per second, 1 provider - [Nova 3](https://models.litellm.ai/models/nova-3.md): $0 per second, 1 provider - [Nova 3 General](https://models.litellm.ai/models/nova-3-general.md): $0 per second, 1 provider - [Nova 3 Medical](https://models.litellm.ai/models/nova-3-medical.md): $0 per second, 1 provider - [Nova General](https://models.litellm.ai/models/nova-general.md): $0 per second, 1 provider - [Nova Phonecall](https://models.litellm.ai/models/nova-phonecall.md): $0 per second, 1 provider - [o3 Pro](https://models.litellm.ai/models/o3-pro.md): $20 / $80 per 1M tokens, 200K context, 2 providers - [Whisper](https://models.litellm.ai/models/whisper.md): $0 per second, 4 providers - [Whisper Base](https://models.litellm.ai/models/whisper-base.md): $0 per second, 1 provider - [Whisper Large](https://models.litellm.ai/models/whisper-large.md): $0 per second, 1 provider - [Whisper Medium](https://models.litellm.ai/models/whisper-medium.md): $0 per second, 1 provider - [Whisper Small](https://models.litellm.ai/models/whisper-small.md): $0 per second, 1 provider - [Whisper Tiny](https://models.litellm.ai/models/whisper-tiny.md): $0 per second, 1 provider - [Claude Opus 4](https://models.litellm.ai/models/claude-opus-4.md): $15 / $75 per 1M tokens, 400K context, 4 providers - [Claude Sonnet 4](https://models.litellm.ai/models/claude-sonnet-4.md): $3 / $15 per 1M tokens, 200K context, 4 providers - [DeepSeek R1 Distill Llama 8B](https://models.litellm.ai/models/deepseek-r1-distill-llama-8b.md): $0.025 / $0.025 per 1M tokens, 128K context, 2 providers - [DeepSeek R1 Distill Qwen 1.5B](https://models.litellm.ai/models/deepseek-r1-distill-qwen-1.5b.md): $0.09 / $0.09 per 1M tokens, 128K context, 3 providers - [DeepSeek R1 Distill Qwen 14B](https://models.litellm.ai/models/deepseek-r1-distill-qwen-14b.md): $0.07 / $0.07 per 1M tokens, 128K context, 4 providers - [DeepSeek R1 Distill Qwen 32B](https://models.litellm.ai/models/deepseek-r1-distill-qwen-32b.md): $0.15 / $0.15 per 1M tokens, 80K context, 5 providers - [DeepSeek R1 Distill Qwen 7B](https://models.litellm.ai/models/deepseek-r1-distill-qwen-7b.md): $0.20 / $0.20 per 1M tokens, 128K context, 2 providers - [Devstral Small](https://models.litellm.ai/models/devstral-small.md): $0.10 / $0.30 per 1M tokens, 256K context, 3 providers - [Embed V4.0](https://models.litellm.ai/models/embed-v4.0.md): $0.12 per 1M tokens, 128K context, 4 providers - [Flux.1 Schnell](https://models.litellm.ai/models/flux.1-schnell.md): 1 provider - [Gemini 2.5 Flash Preview TTS](https://models.litellm.ai/models/gemini-2.5-flash-preview-tts.md): $0.50 per 1M input tokens, 8K context, 2 providers - [Gemini 2.5 Pro Preview TTS](https://models.litellm.ai/models/gemini-2.5-pro-preview-tts.md): $1 / $20 per 1M tokens, 8K context, 2 providers - [GPT-4o Mini TTS](https://models.litellm.ai/models/gpt-4o-mini-tts.md): $0.00025 per second, 2 providers - [Grok 3](https://models.litellm.ai/models/grok-3.md): $3 / $15 per 1M tokens, 128K context, 3 providers - [Llama 3.3 8B Instruct](https://models.litellm.ai/models/llama-3.3-8b-instruct.md): 128K context, 1 provider - [Llama 4 Maverick](https://models.litellm.ai/models/llama-4-maverick.md): $0.20 / $0.60 per 1M tokens, 128K context, 3 providers - [Llama 4 Maverick 17B 16e Instruct](https://models.litellm.ai/models/llama-4-maverick-17b-16e-instruct.md): $0.35 / $1.15 per 1M tokens, 1M context, 1 provider - [Llama 4 Scout 17B 128e Instruct](https://models.litellm.ai/models/llama-4-scout-17b-128e-instruct.md): $0.25 / $0.70 per 1M tokens, 10M context, 1 provider - [Llama Guard 3 8B](https://models.litellm.ai/models/llama-guard-3-8b.md): $0.055 / $0.055 per 1M tokens, 128K context, 5 providers - [Llama4 Maverick 17B Instruct](https://models.litellm.ai/models/llama4-maverick-17b-instruct.md): $0.24 / $0.97 per 1M tokens, 128K context, 1 provider - [Llama4 Scout 17B Instruct](https://models.litellm.ai/models/llama4-scout-17b-instruct.md): $0.17 / $0.66 per 1M tokens, 128K context, 1 provider - [Mistral Saba 24B](https://models.litellm.ai/models/mistral-saba-24b.md): $0.79 / $0.79 per 1M tokens, 32K context, 1 provider - [Qwen2.5 Coder 3B Instruct](https://models.litellm.ai/models/qwen2.5-coder-3b-instruct.md): $0.01 / $0.03 per 1M tokens, 32K context, 2 providers - [Qwen2.5 Coder 7B Instruct](https://models.litellm.ai/models/qwen2.5-coder-7b-instruct.md): $0.01 / $0.03 per 1M tokens, 32K context, 2 providers - [Qwen3 32B](https://models.litellm.ai/models/qwen3-32b.md): $0.08 / $0.23 per 1M tokens, 32K context, 11 providers - [Qwerky 72B](https://models.litellm.ai/models/qwerky-72b.md): 32K context, 1 provider - [Qwerky QwQ 32B](https://models.litellm.ai/models/qwerky-qwq-32b.md): 32K context, 1 provider - [QwQ 32B](https://models.litellm.ai/models/qwq-32b.md): $0.15 / $0.45 per 1M tokens, 32K context, 7 providers - [Sonar Deep Research](https://models.litellm.ai/models/sonar-deep-research.md): $2 / $8 per 1M tokens, 128K context, 1 provider - [Sonar Reasoning](https://models.litellm.ai/models/sonar-reasoning.md): $1 / $5 per 1M tokens, 128K context, 2 providers - [Sonar Reasoning Pro](https://models.litellm.ai/models/sonar-reasoning-pro.md): $2 / $8 per 1M tokens, 128K context, 2 providers - [Stable Diffusion XL Base 1.0](https://models.litellm.ai/models/stable-diffusion-xl-base-1.0.md): 1 provider - [Command A](https://models.litellm.ai/models/command-a.md): $2.50 / $10 per 1M tokens, 256K context, 3 providers - [Computer Use Preview](https://models.litellm.ai/models/computer-use-preview.md): $3 / $12 per 1M tokens, 8K context, 2 providers - [Databricks Meta Llama 3.3 70B Instruct](https://models.litellm.ai/models/databricks-meta-llama-3-3-70b-instruct.md): $0.50 / $1.50 per 1M tokens, 128K context, 1 provider - [DeepSeek R1 Basic](https://models.litellm.ai/models/deepseek-r1-basic.md): $0.55 / $2.19 per 1M tokens, 128K context, 1 provider - [GPT Image 1](https://models.litellm.ai/models/gpt-image-1.md): $5 per 1M input tokens, 2 providers - [GPT-4.1](https://models.litellm.ai/models/gpt-4.1.md): $2 / $8 per 1M tokens, 1M context, 6 providers - [GPT-4.1 Mini](https://models.litellm.ai/models/gpt-4.1-mini.md): $0.40 / $1.60 per 1M tokens, 1M context, 4 providers - [GPT-4.1 Nano](https://models.litellm.ai/models/gpt-4.1-nano.md): $0.10 / $0.40 per 1M tokens, 1M context, 4 providers - [GPT-4o Mini Transcribe](https://models.litellm.ai/models/gpt-4o-mini-transcribe.md): $0.003 per minute, 16K context, 2 providers - [GPT-4o Transcribe](https://models.litellm.ai/models/gpt-4o-transcribe.md): $0.006 per minute, 16K context, 2 providers - [Granite 3 8B Instruct](https://models.litellm.ai/models/granite-3-8b-instruct.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [Grok 3 Fast](https://models.litellm.ai/models/grok-3-fast.md): $5 / $25 per 1M tokens, 128K context, 2 providers - [Grok 3 Mini Fast](https://models.litellm.ai/models/grok-3-mini-fast.md): $0.60 / $4 per 1M tokens, 128K context, 2 providers - [Llama 4 Maverick 17B 128e Instruct](https://models.litellm.ai/models/llama-4-maverick-17b-128e-instruct.md): $0.35 / $1.15 per 1M tokens, 1M context, 9 providers - [Llama 4 Scout 17B 16e Instruct](https://models.litellm.ai/models/llama-4-scout-17b-16e-instruct.md): $0.05 / $0.10 per 1M tokens, 16K context, 10 providers - [Llama V3p1 405B Instruct](https://models.litellm.ai/models/llama-v3p1-405b-instruct.md): $3 / $3 per 1M tokens, 128K context, 1 provider - [Llama4 Maverick Instruct Basic](https://models.litellm.ai/models/llama4-maverick-instruct-basic.md): $0.22 / $0.88 per 1M tokens, 128K context, 1 provider - [Llama4 Scout Instruct Basic](https://models.litellm.ai/models/llama4-scout-instruct-basic.md): $0.15 / $0.60 per 1M tokens, 128K context, 1 provider - [Mistral Small 24B Instruct](https://models.litellm.ai/models/mistral-small-24b-instruct.md): $0.05 / $0.08 per 1M tokens, 32K context, 3 providers - [Mistral Small 3.1 24B Instruct](https://models.litellm.ai/models/mistral-small-3-1-24b-instruct.md): $0.106 / $0.318 per 1M tokens, 128K context, 2 providers - [Multimodalembedding](https://models.litellm.ai/models/multimodalembedding.md): $0.80 per 1M tokens, 2K context, 1 provider - [o3](https://models.litellm.ai/models/o3.md): $2 / $8 per 1M tokens, 200K context, 4 providers - [o4 Mini](https://models.litellm.ai/models/o4-mini.md): $1.10 / $4.40 per 1M tokens, 200K context, 4 providers - [Qwen2.5 72B Instruct Turbo](https://models.litellm.ai/models/qwen2.5-72b-instruct-turbo.md): $1.20 / $1.20 per 1M tokens, 128K context, 1 provider - [Qwen2.5 7B Instruct Turbo](https://models.litellm.ai/models/qwen2.5-7b-instruct-turbo.md): $0.30 / $0.30 per 1M tokens, 32K context, 1 provider - [Whisper Large V3](https://models.litellm.ai/models/whisper-large-v3.md): 2 providers - [Whisper Large V3 Turbo](https://models.litellm.ai/models/whisper-large-v3-turbo.md): $0 per second, 3 providers - [Arctic](https://models.litellm.ai/models/arctic.md): 4K context, 1 provider - [Gemini 2.0 Flash Lite](https://models.litellm.ai/models/gemini-2.0-flash-lite.md): $0.075 / $0.30 per 1M tokens, 1 provider - [Gemma 3 27B IT](https://models.litellm.ai/models/gemma-3-27b-it.md): Free, 128K context, 6 providers - [Gemma 7B](https://models.litellm.ai/models/gemma-7b.md): $0.20 / $0.20 per 1M tokens, 8K context, 2 providers - [GPT-4.5 Preview](https://models.litellm.ai/models/gpt-4.5-preview.md): $75 / $150 per 1M tokens, 128K context, 1 provider - [GPT-4o Mini Search Preview](https://models.litellm.ai/models/gpt-4o-mini-search-preview.md): $0.15 / $0.60 per 1M tokens, 128K context, 1 provider - [GPT-4o Search Preview](https://models.litellm.ai/models/gpt-4o-search-preview.md): $2.50 / $10 per 1M tokens, 128K context, 1 provider - [Jamba Large 1.6](https://models.litellm.ai/models/jamba-large-1.6.md): $2 / $8 per 1M tokens, 256K context, 1 provider - [Jamba Mini 1.6](https://models.litellm.ai/models/jamba-mini-1.6.md): $0.20 / $0.40 per 1M tokens, 256K context, 1 provider - [Learnlm 1.5 Pro Experimental](https://models.litellm.ai/models/learnlm-1.5-pro-experimental.md): Free, 33K context, 1 provider - [Llama 3.2 1B](https://models.litellm.ai/models/llama-3.2-1b.md): $0.10 / $0.10 per 1M tokens, 128K context, 2 providers - [Llama 3.2 3B](https://models.litellm.ai/models/llama-3.2-3b.md): $0.04 / $0.08 per 1M tokens, 128K context, 3 providers - [Llama3.1 405B](https://models.litellm.ai/models/llama-3.1-405b.md): $1.20 / $1.20 per 1M tokens, 128K context, 1 provider - [Mistral 7B](https://models.litellm.ai/models/mistral-7b.md): $0.20 / $0.20 per 1M tokens, 32K context, 2 providers - [Mistral Large2](https://models.litellm.ai/models/mistral-large2.md): $2 / $6 per 1M tokens, 128K context, 1 provider - [Mixtral 8x7B](https://models.litellm.ai/models/mixtral-8x7b.md): $0.50 / $0.50 per 1M tokens, 32K context, 2 providers - [Nova Canvas](https://models.litellm.ai/models/nova-canvas.md): $0.06 per image, 3K context, 1 provider - [o1 Pro](https://models.litellm.ai/models/o1-pro.md): $150 / $600 per 1M tokens, 200K context, 1 provider - [Phi 4 Mini Instruct](https://models.litellm.ai/models/phi-4-mini-instruct.md): $0.075 / $0.30 per 1M tokens, 128K context, 1 provider - [Phi 4 Multimodal Instruct](https://models.litellm.ai/models/phi-4-multimodal-instruct.md): $0.08 / $0.32 per 1M tokens, 128K context, 1 provider - [Reka Core](https://models.litellm.ai/models/reka-core.md): 32K context, 1 provider - [Reka Flash](https://models.litellm.ai/models/reka-flash.md): 100K context, 1 provider - [Text Embedding Large Exp 03 07](https://models.litellm.ai/models/text-embedding-large-exp-03-07.md): $0.10 per 1M tokens, 8K context, 1 provider - [Best](https://models.litellm.ai/models/best.md): $0 per second, 1 provider - [Claude 3.7 Sonnet](https://models.litellm.ai/models/claude-3-7-sonnet.md): $3 / $15 per 1M tokens, 200K context, 7 providers - [DeepSeek R1 Distill Llama 70B](https://models.litellm.ai/models/deepseek-r1-distill-llama-70b.md): $0.20 / $0.60 per 1M tokens, 128K context, 9 providers - [Gemini 2.0 Flash](https://models.litellm.ai/models/gemini-2.0-flash.md): $0.15 / $0.60 per 1M tokens, 1 provider - [Grok 2](https://models.litellm.ai/models/grok-2.md): $2 / $10 per 1M tokens, 128K context, 1 provider - [Grok 2 Vision](https://models.litellm.ai/models/grok-2-vision.md): $2 / $10 per 1M tokens, 32K context, 1 provider - [Jina Reranker V2 Base Multilingual](https://models.litellm.ai/models/jina-reranker-v2-base-multilingual.md): $0.05 per 1M input tokens, 1K context, 1 provider - [Llama3.3 70B](https://models.litellm.ai/models/llama-3.3-70b.md): $0.72 / $0.72 per 1M tokens, 128K context, 3 providers - [Nano](https://models.litellm.ai/models/nano.md): $0 per second, 1 provider - [o3 Mini](https://models.litellm.ai/models/o3-mini.md): $1.10 / $4.40 per 1M tokens, 200K context, 4 providers - [Phi 4](https://models.litellm.ai/models/phi-4.md): $0.07 / $0.14 per 1M tokens, 16K context, 2 providers - [Rerank](https://models.litellm.ai/models/rerank.md): $0 per 1M input tokens, 32K context, 1 provider - [Sonar](https://models.litellm.ai/models/sonar.md): $1 / $1 per 1M tokens, 128K context, 2 providers - [Sonar Pro](https://models.litellm.ai/models/sonar-pro.md): $3 / $15 per 1M tokens, 200K context, 2 providers - [Command R7B](https://models.litellm.ai/models/command-r7b.md): $0.0375 / $0.15 per 1M tokens, 128K context, 1 provider - [DeepSeek R1](https://models.litellm.ai/models/deepseek-r1.md): $0.55 / $2.19 per 1M tokens, 64K context, 16 providers - [DeepSeek Reasoner](https://models.litellm.ai/models/deepseek-reasoner.md): $0.28 / $0.42 per 1M tokens, 128K context, 1 provider - [DeepSeek V3](https://models.litellm.ai/models/deepseek-v3.md): $0.27 / $1.10 per 1M tokens, 64K context, 15 providers - [Llama 3.3 70B Instruct Turbo](https://models.litellm.ai/models/llama-3.3-70b-instruct-turbo.md): $0.10 / $0.32 per 1M tokens, 128K context, 2 providers - [Llama V3p1 8B Instruct](https://models.litellm.ai/models/llama-v3p1-8b-instruct.md): $0.10 / $0.10 per 1M tokens, 16K context, 1 provider - [Omni Moderation](https://models.litellm.ai/models/omni-moderation.md): Free, 32K context, 1 provider - [Pixtral Large](https://models.litellm.ai/models/pixtral-large.md): $2 / $6 per 1M tokens, 128K context, 3 providers - [Rerank 2](https://models.litellm.ai/models/rerank-2.md): $0.05 per 1M input tokens, 16K context, 1 provider - [Rerank 2 Lite](https://models.litellm.ai/models/rerank-2-lite.md): $0.02 per 1M input tokens, 8K context, 1 provider - [Sd3.5 Large](https://models.litellm.ai/models/sd3.5-large.md): $0.065 per image, 77 context, 2 providers - [Stable Image Core](https://models.litellm.ai/models/stable-image-core.md): $0.03 per image, 77 context, 2 providers - [Voyage 3](https://models.litellm.ai/models/voyage-3.md): $0.06 per 1M tokens, 32K context, 1 provider - [Voyage 3 Large](https://models.litellm.ai/models/voyage-3-large.md): $0.18 per 1M tokens, 32K context, 1 provider - [Voyage 3 Lite](https://models.litellm.ai/models/voyage-3-lite.md): $0.02 per 1M tokens, 32K context, 1 provider - [Voyage Code 3](https://models.litellm.ai/models/voyage-code-3.md): $0.18 per 1M tokens, 32K context, 1 provider - [Voyage Multimodal 3](https://models.litellm.ai/models/voyage-multimodal-3.md): $0.12 per 1M tokens, 32K context, 1 provider - [GPT-4o Mini Audio Preview](https://models.litellm.ai/models/gpt-4o-mini-audio-preview.md): $0.15 / $0.60 per 1M tokens, 128K context, 2 providers - [GPT-4o Mini Realtime Preview](https://models.litellm.ai/models/gpt-4o-mini-realtime-preview.md): $0.60 / $2.40 per 1M tokens, 128K context, 2 providers - [GPT-4o Realtime Preview](https://models.litellm.ai/models/gpt-4o-realtime-preview.md): $5 / $20 per 1M tokens, 128K context, 1 provider - [Llama 3.1 70B Instruct Turbo](https://models.litellm.ai/models/llama-3.1-70b-instruct-turbo.md): $0.40 / $0.40 per 1M tokens, 128K context, 2 providers - [Llama 3.1 8B Instruct Turbo](https://models.litellm.ai/models/llama-3.1-8b-instruct-turbo.md): $0.02 / $0.04 per 1M tokens, 128K context, 2 providers - [Llama 3.3 70B Instruct](https://models.litellm.ai/models/llama-3.3-70b-instruct.md): $0.12 / $0.30 per 1M tokens, 128K context, 18 providers - [Nova Lite](https://models.litellm.ai/models/nova-lite.md): $0.06 / $0.24 per 1M tokens, 300K context, 2 providers - [Nova Micro](https://models.litellm.ai/models/nova-micro.md): $0.035 / $0.14 per 1M tokens, 128K context, 2 providers - [Nova Pro](https://models.litellm.ai/models/nova-pro.md): $0.80 / $3.20 per 1M tokens, 300K context, 2 providers - [o1](https://models.litellm.ai/models/o1.md): $15 / $60 per 1M tokens, 200K context, 4 providers - [Qwen2.5 72B Instruct](https://models.litellm.ai/models/qwen2.5-72b-instruct.md): $0.12 / $0.30 per 1M tokens, 128K context, 6 providers - [Rerank V3.5](https://models.litellm.ai/models/rerank-v3.5.md): $0 per 1M input tokens, 4K context, 2 providers - [Text Embedding 005](https://models.litellm.ai/models/text-embedding-005.md): $0.025 per 1M tokens, 2K context, 2 providers - [Claude 3.5 Haiku](https://models.litellm.ai/models/claude-3-5-haiku.md): $0.80 / $4 per 1M tokens, 200K context, 6 providers - [Gemini Exp](https://models.litellm.ai/models/gemini-exp.md): $0.30 / $2.50 per 1M tokens, 1M context, 1 provider - [Llama3.2 11B Vision Instruct](https://models.litellm.ai/models/llama-3.2-11b-vision-instruct.md): $0.015 / $0.025 per 1M tokens, 128K context, 5 providers - [Ministral 3B](https://models.litellm.ai/models/ministral-3b.md): $0.10 / $0.10 per 1M tokens, 128K context, 3 providers - [Phi 3 Medium 128K Instruct](https://models.litellm.ai/models/phi-3-medium-128k-instruct.md): $0.17 / $0.68 per 1M tokens, 128K context, 1 provider - [Phi 3 Medium 4K Instruct](https://models.litellm.ai/models/phi-3-medium-4k-instruct.md): $0.17 / $0.68 per 1M tokens, 4K context, 1 provider - [Phi 3 Mini 128K Instruct](https://models.litellm.ai/models/phi-3-mini-128k-instruct.md): $0.10 / $0.10 per 1M tokens, 128K context, 2 providers - [Phi 3 Mini 4K Instruct](https://models.litellm.ai/models/phi-3-mini-4k-instruct.md): $0.13 / $0.52 per 1M tokens, 4K context, 1 provider - [Phi 3 Small 128K Instruct](https://models.litellm.ai/models/phi-3-small-128k-instruct.md): $0.15 / $0.60 per 1M tokens, 128K context, 1 provider - [Phi 3 Small 8K Instruct](https://models.litellm.ai/models/phi-3-small-8k-instruct.md): $0.15 / $0.60 per 1M tokens, 8K context, 1 provider - [Phi 3.5 Mini Instruct](https://models.litellm.ai/models/phi-3.5-mini-instruct.md): $0.13 / $0.52 per 1M tokens, 128K context, 1 provider - [Phi 3.5 MoE Instruct](https://models.litellm.ai/models/phi-3.5-moe-instruct.md): $0.16 / $0.64 per 1M tokens, 128K context, 1 provider - [Phi 3.5 Vision Instruct](https://models.litellm.ai/models/phi-3.5-vision-instruct.md): $0.13 / $0.52 per 1M tokens, 128K context, 1 provider - [Qwen2.5 Coder 32B Instruct](https://models.litellm.ai/models/qwen2.5-coder-32b-instruct.md): $0.12 / $0.30 per 1M tokens, 32K context, 6 providers - [SD3 Large](https://models.litellm.ai/models/sd3-large.md): $0.065 per image, 77 context, 2 providers - [Stable Image Ultra](https://models.litellm.ai/models/stable-image-ultra.md): $0.08 per image, 77 context, 2 providers - [Claude 3.5 Sonnet V2](https://models.litellm.ai/models/claude-3-5-sonnet-20241022-v2.md): $3 / $15 per 1M tokens, 1M context, 1 provider - [Cohere Embed V3 English](https://models.litellm.ai/models/cohere-embed-v3-english.md): $0.10 per 1M tokens, 512 context, 1 provider - [Cohere Embed V3 Multilingual](https://models.litellm.ai/models/cohere-embed-v3-multilingual.md): $0.10 per 1M tokens, 512 context, 1 provider - [Cohere Rerank V3 English](https://models.litellm.ai/models/cohere-rerank-v3-english.md): $0 per 1M input tokens, 4K context, 1 provider - [Cohere Rerank V3 Multilingual](https://models.litellm.ai/models/cohere-rerank-v3-multilingual.md): $0 per 1M input tokens, 4K context, 1 provider - [Gemini Flash Experimental](https://models.litellm.ai/models/gemini-flash-experimental.md): Free, 1M context, 1 provider - [GPT-4o Audio Preview](https://models.litellm.ai/models/gpt-4o-audio-preview.md): $2.50 / $10 per 1M tokens, 128K context, 2 providers - [Llama 3.2 1B Instruct](https://models.litellm.ai/models/llama-3.2-1b-instruct.md): $0.02 / $0.02 per 1M tokens, 131K context, 5 providers - [Llama 3.2 90B Vision Instruct](https://models.litellm.ai/models/llama-3.2-90b-vision-instruct.md): Free, 128K context, 3 providers - [Llama V3p2 11B Vision Instruct](https://models.litellm.ai/models/llama-v3p2-11b-vision-instruct.md): $0.20 / $0.20 per 1M tokens, 16K context, 1 provider - [Llama V3p2 1B Instruct](https://models.litellm.ai/models/llama-v3p2-1b-instruct.md): $0.10 / $0.10 per 1M tokens, 16K context, 1 provider - [Llama V3p2 3B Instruct](https://models.litellm.ai/models/llama-v3p2-3b-instruct.md): $0.10 / $0.10 per 1M tokens, 16K context, 1 provider - [Llama V3p2 90B Vision Instruct](https://models.litellm.ai/models/llama-v3p2-90b-vision-instruct.md): $0.90 / $0.90 per 1M tokens, 16K context, 1 provider - [Llama3 2 11B Instruct](https://models.litellm.ai/models/llama3-2-11b-instruct.md): $0.16 / $0.16 per 1M tokens, 128K context, 1 provider - [Llama3 2 90B Instruct](https://models.litellm.ai/models/llama3-2-90b-instruct.md): $0.72 / $0.72 per 1M tokens, 128K context, 1 provider - [Llama3.2 3B Instruct](https://models.litellm.ai/models/llama-3.2-3b-instruct.md): $0.015 / $0.025 per 1M tokens, 128K context, 8 providers - [Pixtral 12B](https://models.litellm.ai/models/pixtral-12b.md): $0.15 / $0.15 per 1M tokens, 128K context, 3 providers - [Rerank English V3.0](https://models.litellm.ai/models/rerank-english-v3.0.md): $0 per 1M input tokens, 4K context, 1 provider - [Rerank Multilingual V3.0](https://models.litellm.ai/models/rerank-multilingual-v3.0.md): $0 per 1M input tokens, 4K context, 1 provider - [Titan Embed Image V1](https://models.litellm.ai/models/titan-embed-image-v1.md): $0.80 per 1M tokens, 128 context, 1 provider - [Voyage Finance 2](https://models.litellm.ai/models/voyage-finance-2.md): $0.12 per 1M tokens, 32K context, 1 provider - [Gemma2 9B IT](https://models.litellm.ai/models/gemma2-9b-it.md): $0.20 / $0.20 per 1M tokens, 8K context, 1 provider - [GTE Base](https://models.litellm.ai/models/gte-base.md): $0.008 per 1M tokens, 512 context, 1 provider - [GTE Large](https://models.litellm.ai/models/gte-large.md): $0.016 per 1M tokens, 512 context, 1 provider - [GTE Large En](https://models.litellm.ai/models/gte-large-en.md): $0.13 per 1M tokens, 8K context, 1 provider - [Llama 3.1 8B](https://models.litellm.ai/models/llama-3.1-8b.md): $0.03 / $0.05 per 1M tokens, 128K context, 5 providers - [Llama3.1 70B](https://models.litellm.ai/models/llama3.1-70b.md): $0.60 / $0.60 per 1M tokens, 128K context, 3 providers - [Nomic Embed Text V1](https://models.litellm.ai/models/nomic-embed-text-v1.md): $0.008 per 1M tokens, 8K context, 1 provider - [Nomic Embed Text V1.5](https://models.litellm.ai/models/nomic-embed-text-v1.5.md): $0.008 per 1M tokens, 8K context, 1 provider - [o1 Mini](https://models.litellm.ai/models/o1-mini.md): $1.10 / $4.40 per 1M tokens, 128K context, 2 providers - [o1 Preview](https://models.litellm.ai/models/o1-preview.md): $16.50 / $66 per 1M tokens, 128K context, 1 provider - [Titan Text Premier V1](https://models.litellm.ai/models/titan-text-premier-v1.md): $0.50 / $1.50 per 1M tokens, 42K context, 1 provider - [Uae Large V1](https://models.litellm.ai/models/uae-large-v1.md): $0.016 per 1M tokens, 512 context, 1 provider - [Codegeex4](https://models.litellm.ai/models/codegeex4.md): Free, 32K context, 1 provider - [DeepSeek Coder V2 Base](https://models.litellm.ai/models/deepseek-coder-v2-base.md): Free, 8K context, 1 provider - [DeepSeek Coder V2 Lite Base](https://models.litellm.ai/models/deepseek-coder-v2-lite-base.md): Free, 8K context, 2 providers - [DeepSeek Coder V2 Lite Instruct](https://models.litellm.ai/models/deepseek-coder-v2-lite-instruct.md): Free, 32K context, 2 providers - [Embed English Light V3.0](https://models.litellm.ai/models/embed-english-light-v3.0.md): $0.10 per 1M tokens, 512 context, 2 providers - [Embed English V3.0](https://models.litellm.ai/models/embed-english-v3.0.md): $0.10 per 1M tokens, 512 context, 2 providers - [Embed Multilingual V3.0](https://models.litellm.ai/models/embed-multilingual-v3.0.md): $0.10 per 1M tokens, 512 context, 2 providers - [Imagen 3.0 Fast Generate 001](https://models.litellm.ai/models/imagen-3.0-fast-generate-001.md): $0.02 per image, 1 provider - [Imagen 3.0 Generate 001](https://models.litellm.ai/models/imagen-3.0-generate-001.md): $0.04 per image, 1 provider - [Internlm2 5 20B Chat](https://models.litellm.ai/models/internlm2_5-20b-chat.md): Free, 32K context, 1 provider - [Jamba 1.5](https://models.litellm.ai/models/jamba-1.5.md): $0.20 / $0.40 per 1M tokens, 256K context, 2 providers - [Jamba 1.5 Large](https://models.litellm.ai/models/jamba-1.5-large.md): $2 / $8 per 1M tokens, 256K context, 4 providers - [Jamba 1.5 Mini](https://models.litellm.ai/models/jamba-1.5-mini.md): $0.20 / $0.40 per 1M tokens, 256K context, 4 providers - [Mistral Large Instruct](https://models.litellm.ai/models/mistral-large-instruct.md): Free, 64K context, 1 provider - [Codestral Mamba](https://models.litellm.ai/models/codestral-mamba.md): $0.25 / $0.25 per 1M tokens, 256K context, 1 provider - [DeepSeek Coder V2 Instruct](https://models.litellm.ai/models/deepseek-coder-v2-instruct.md): Free, 32K context, 2 providers - [Firefunction V2](https://models.litellm.ai/models/firefunction-v2.md): $0.90 / $0.90 per 1M tokens, 8K context, 1 provider - [Gemini Gemma 2 27B IT](https://models.litellm.ai/models/gemini-gemma-2-27b-it.md): $0.35 / $1.05 per 1M tokens, 8K context, 1 provider - [Gemini Gemma 2 9B IT](https://models.litellm.ai/models/gemini-gemma-2-9b-it.md): $0.35 / $1.05 per 1M tokens, 8K context, 1 provider - [GPT-4o Mini](https://models.litellm.ai/models/gpt-4o-mini.md): $0.15 / $0.60 per 1M tokens, 128K context, 7 providers - [Jamba Instruct](https://models.litellm.ai/models/jamba-instruct.md): $0.50 / $0.70 per 1M tokens, 70K context, 3 providers - [Llama 3.1 405B Instruct](https://models.litellm.ai/models/llama-3.1-405b-instruct.md): $1 / $3 per 1M tokens, 128K context, 7 providers - [Llama 3.1 70B Instruct](https://models.litellm.ai/models/llama-3.1-70b-instruct.md): Free, 128K context, 11 providers - [Llama 3.1 8B Instruct](https://models.litellm.ai/models/llama-3.1-8b-instruct.md): Free, 128K context, 13 providers - [Llama3 405B Instruct](https://models.litellm.ai/models/llama3-405b-instruct.md): Free, 32K context, 1 provider - [Llama3.1](https://models.litellm.ai/models/llama3.1.md): Free, 8K context, 1 provider - [Medlm Large](https://models.litellm.ai/models/medlm-large.md): 8K context, 1 provider - [Medlm Medium](https://models.litellm.ai/models/medlm-medium.md): 32K context, 1 provider - [Mistral Nemo](https://models.litellm.ai/models/mistral-nemo.md): $0.04 / $0.17 per 1M tokens, 60K context, 3 providers - [Mixtral 8x22B Instruct HF](https://models.litellm.ai/models/mixtral-8x22b-instruct-hf.md): $1.20 / $1.20 per 1M tokens, 64K context, 1 provider - [Open Mistral Nemo](https://models.litellm.ai/models/open-mistral-nemo.md): $0.30 / $0.30 per 1M tokens, 128K context, 1 provider - [Qwen2 72B Instruct](https://models.litellm.ai/models/qwen2-72b-instruct.md): $0.90 / $0.90 per 1M tokens, 32K context, 2 providers - [TTS-1](https://models.litellm.ai/models/tts-1.md): $15 per 1M characters, 2 providers - [TTS-1 HD](https://models.litellm.ai/models/tts-1-hd.md): $30 per 1M characters, 2 providers - [Yi Large](https://models.litellm.ai/models/yi-large.md): $3 / $3 per 1M tokens, 32K context, 1 provider - [Claude 3.5 Sonnet](https://models.litellm.ai/models/claude-3-5-sonnet.md): $3 / $15 per 1M tokens, 200K context, 7 providers - [Codegemma](https://models.litellm.ai/models/codegemma.md): Free, 8K context, 1 provider - [Codestral](https://models.litellm.ai/models/codestral.md): $0.30 / $0.90 per 1M tokens, 128K context, 6 providers - [Text Embedding 004](https://models.litellm.ai/models/text-embedding-004.md): $0.10 per 1M tokens, 2K context, 1 provider - [Text Multilingual Embedding 002](https://models.litellm.ai/models/text-multilingual-embedding-002.md): $0.025 per 1M tokens, 2K context, 2 providers - [BGE Large En](https://models.litellm.ai/models/bge-large-en.md): $0.10 per 1M tokens, 512 context, 1 provider - [CodeLlama 70B Instruct HF](https://models.litellm.ai/models/codellama-70b-instruct-hf.md): $1 / $1 per 1M tokens, 4K context, 1 provider - [DBRX Instruct](https://models.litellm.ai/models/dbrx-instruct.md): $1.20 / $1.20 per 1M tokens, 32K context, 1 provider - [DeepSeek Chat](https://models.litellm.ai/models/deepseek-chat.md): $0.28 / $0.42 per 1M tokens, 128K context, 1 provider - [DeepSeek Coder](https://models.litellm.ai/models/deepseek-coder.md): $0.14 / $0.28 per 1M tokens, 128K context, 1 provider - [Firellava 13B](https://models.litellm.ai/models/firellava-13b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [GPT-4o](https://models.litellm.ai/models/gpt-4o.md): $2.50 / $10 per 1M tokens, 128K context, 7 providers - [Llama 2 13B](https://models.litellm.ai/models/llama-2-13b.md): $0.10 / $0.50 per 1M tokens, 4K context, 1 provider - [Llama 2 70B](https://models.litellm.ai/models/llama-2-70b.md): $0.65 / $2.75 per 1M tokens, 4K context, 1 provider - [Llama 2 7B](https://models.litellm.ai/models/llama-2-7b.md): $0.05 / $0.25 per 1M tokens, 4K context, 1 provider - [Llama 3 70B](https://models.litellm.ai/models/llama-3-70b.md): $0.59 / $0.79 per 1M tokens, 8K context, 3 providers - [Llama 3 8B](https://models.litellm.ai/models/llama-3-8b.md): $0.05 / $0.25 per 1M tokens, 8K context, 3 providers - [Llama3](https://models.litellm.ai/models/llama3.md): Free, 8K context, 1 provider - [Llama3 8B Instruct](https://models.litellm.ai/models/llama3-8b-instruct.md): Free, 32K context, 8 providers - [Mistral 7B Instruct V0.2](https://models.litellm.ai/models/mistral-7b-instruct-v0.2.md): Free, 32K context, 3 providers - [Mistral 7B V0.1](https://models.litellm.ai/models/mistral-7b-v0.1.md): $0.05 / $0.25 per 1M tokens, 4K context, 1 provider - [Mixtral 8x22B Instruct](https://models.litellm.ai/models/mixtral-8x22b-instruct.md): $1.20 / $1.20 per 1M tokens, 64K context, 2 providers - [Mixtral 8x22B Instruct V0.1](https://models.litellm.ai/models/mixtral-8x22b-instruct-v0.1.md): Free, 64K context, 3 providers - [Titan Embed Text V2](https://models.litellm.ai/models/titan-embed-text-v2.md): $0.02 per 1M tokens, 8K context, 2 providers - [WizardLM 2 8x22B](https://models.litellm.ai/models/wizardlm-2-8x22b.md): $0.48 / $0.48 per 1M tokens, 64K context, 2 providers - [Command R Plus](https://models.litellm.ai/models/command-r-plus.md): $2.50 / $10 per 1M tokens, 128K context, 4 providers - [Llama3 70B Instruct](https://models.litellm.ai/models/llama3-70b-instruct.md): Free, 32K context, 7 providers - [Mixtral 8x7B Instruct V0](https://models.litellm.ai/models/mixtral-8x7b-instruct-v0.md): $0.45 / $0.70 per 1M tokens, 32K context, 1 provider - [Text Embedding Preview](https://models.litellm.ai/models/text-embedding-preview.md): $0.00625 per 1M tokens, 3K context, 1 provider - [Voyage 2](https://models.litellm.ai/models/voyage-2.md): $0.10 per 1M tokens, 4K context, 1 provider - [Voyage Code 2](https://models.litellm.ai/models/voyage-code-2.md): $0.12 per 1M tokens, 16K context, 1 provider - [Voyage Large 2](https://models.litellm.ai/models/voyage-large-2.md): $0.12 per 1M tokens, 16K context, 1 provider - [Voyage Law 2](https://models.litellm.ai/models/voyage-law-2.md): $0.12 per 1M tokens, 16K context, 1 provider - [Voyage Lite 02 Instruct](https://models.litellm.ai/models/voyage-lite-02-instruct.md): $0.10 per 1M tokens, 4K context, 1 provider - [Claude 3 Haiku](https://models.litellm.ai/models/claude-3-haiku.md): $0.25 / $1.25 per 1M tokens, 200K context, 2 providers - [Claude 3 Opus](https://models.litellm.ai/models/claude-3-opus.md): $15 / $75 per 1M tokens, 200K context, 4 providers - [Claude 3 Sonnet](https://models.litellm.ai/models/claude-3-sonnet.md): $3 / $15 per 1M tokens, 200K context, 1 provider - [Command R](https://models.litellm.ai/models/command-r.md): $0.15 / $0.60 per 1M tokens, 128K context, 3 providers - [Gemma 7B IT](https://models.litellm.ai/models/gemma-7b-it.md): $0.15 / $0.15 per 1M tokens, 8K context, 2 providers - [GPT-35 Turbo Instruct](https://models.litellm.ai/models/gpt-35-turbo-instruct.md): $1.50 / $2 per 1M tokens, 4K context, 1 provider - [Mistral 7B Instruct V0](https://models.litellm.ai/models/mistral-7b-instruct-v0.md): $0.15 / $0.20 per 1M tokens, 32K context, 1 provider - [Sonar Medium Chat](https://models.litellm.ai/models/sonar-medium-chat.md): $0.60 / $1.80 per 1M tokens, 16K context, 1 provider - [Sonar Medium Online](https://models.litellm.ai/models/sonar-medium-online.md): $0 / $1.80 per 1M tokens, 12K context, 1 provider - [Sonar Small Chat](https://models.litellm.ai/models/sonar-small-chat.md): $0.07 / $0.28 per 1M tokens, 16K context, 1 provider - [Sonar Small Online](https://models.litellm.ai/models/sonar-small-online.md): $0 / $0.28 per 1M tokens, 12K context, 1 provider - [Whisper 1](https://models.litellm.ai/models/whisper-1.md): $0.0001 per second, 2 providers - [CodeLlama 70B Instruct](https://models.litellm.ai/models/codellama-70b-instruct.md): $0.70 / $2.80 per 1M tokens, 16K context, 1 provider - [Mistral Large](https://models.litellm.ai/models/mistral-large.md): $0.50 / $1.50 per 1M tokens, 256K context, 8 providers - [Mixtral 8x7B Instruct](https://models.litellm.ai/models/mixtral-8x7b-instruct.md): $0.07 / $0.28 per 1M tokens, 4K context, 2 providers - [Stable Diffusion XL](https://models.litellm.ai/models/stable-diffusion-xl.md): $0.04 per image, 77 context, 1 provider - [Stable Diffusion XL V0](https://models.litellm.ai/models/stable-diffusion-xl-v0.md): $0.018 per image, 77 context, 1 provider - [Ada](https://models.litellm.ai/models/ada.md): $0.10 per 1M tokens, 8K context, 1 provider - [CodeLlama 7B Instruct](https://models.litellm.ai/models/codellama-7b-instruct.md): $1.923 / $1.923 per 1M tokens, 4K context, 1 provider - [Command Light Text V14](https://models.litellm.ai/models/command-light-text-v14.md): $0.30 / $0.60 per 1M tokens, 4K context, 1 provider - [DALL·E 2](https://models.litellm.ai/models/dall-e-2.md): $0.026 per image, 2 providers - [DALL·E 3](https://models.litellm.ai/models/dall-e-3.md): $0.052 per image, 2 providers - [Dolphin 2p6 Mixtral 8x7B](https://models.litellm.ai/models/dolphin-2p6-mixtral-8x7b.md): $0.50 / $0.50 per 1M tokens, 32K context, 1 provider - [Embed English V3](https://models.litellm.ai/models/embed-english-v3.md): $0.10 per 1M tokens, 512 context, 1 provider - [Embed Multilingual V3](https://models.litellm.ai/models/embed-multilingual-v3.md): $0.10 per 1M tokens, 512 context, 1 provider - [GPT-35 Turbo](https://models.litellm.ai/models/gpt-35-turbo.md): $0.50 / $1.50 per 1M tokens, 4K context, 1 provider - [GPT-35 Turbo 16K](https://models.litellm.ai/models/gpt-35-turbo-16k.md): $3 / $4 per 1M tokens, 16K context, 1 provider - [GPT-4 0125 Preview](https://models.litellm.ai/models/gpt-4-0125-preview.md): $10 / $30 per 1M tokens, 128K context, 1 provider - [GPT-4 Turbo](https://models.litellm.ai/models/gpt-4-turbo.md): $10 / $30 per 1M tokens, 128K context, 3 providers - [GPT-4 Turbo Vision Preview](https://models.litellm.ai/models/gpt-4-turbo-vision-preview.md): $10 / $30 per 1M tokens, 128K context, 1 provider - [Llama 2 7B Chat](https://models.litellm.ai/models/llama-2-7b-chat.md): $1.923 / $1.923 per 1M tokens, 3K context, 2 providers - [Mistral Embed](https://models.litellm.ai/models/mistral-embed.md): $0.10 per 1M tokens, 8K context, 2 providers - [Mixtral 8x7B Instruct V0.1](https://models.litellm.ai/models/mixtral-8x7b-instruct-v0.1.md): Free, 32K context, 6 providers - [Text Embedding 3 Large](https://models.litellm.ai/models/text-embedding-3-large.md): $0.13 per 1M tokens, 8K context, 3 providers - [Text Embedding 3 Small](https://models.litellm.ai/models/text-embedding-3-small.md): $0.02 per 1M tokens, 8K context, 4 providers - [Text Embedding Ada 002 V2](https://models.litellm.ai/models/text-embedding-ada-002-v2.md): $0.10 per 1M tokens, 8K context, 1 provider - [Text Unicorn](https://models.litellm.ai/models/text-unicorn.md): $10 / $28 per 1M tokens, 8K context, 1 provider - [Titan Embed Text V1](https://models.litellm.ai/models/titan-embed-text-v1.md): $0.10 per 1M tokens, 8K context, 1 provider - [Voyage Lite 01](https://models.litellm.ai/models/voyage-lite-01.md): $0.10 per 1M tokens, 4K context, 1 provider - [Yi 34B Chat](https://models.litellm.ai/models/yi-34b-chat.md): $0.90 / $0.90 per 1M tokens, 4K context, 1 provider - [Gemini Pro](https://models.litellm.ai/models/gemini-pro.md): $2 / $12 per 1M tokens, 1M context, 1 provider - [Mistral Medium](https://models.litellm.ai/models/mistral-medium.md): $1.50 / $7.50 per 1M tokens, 256K context, 3 providers - [Mistral Small](https://models.litellm.ai/models/mistral-small.md): $0.10 / $0.30 per 1M tokens, 32K context, 6 providers - [Mistral Tiny](https://models.litellm.ai/models/mistral-tiny.md): $0.25 / $0.25 per 1M tokens, 32K context, 1 provider - [PPLX 70B Chat](https://models.litellm.ai/models/pplx-70b-chat.md): $0.70 / $2.80 per 1M tokens, 4K context, 1 provider - [PPLX 70B Online](https://models.litellm.ai/models/pplx-70b-online.md): $0 / $2.80 per 1M tokens, 4K context, 1 provider - [PPLX 7B Chat](https://models.litellm.ai/models/pplx-7b-chat.md): $0.07 / $0.28 per 1M tokens, 8K context, 1 provider - [PPLX 7B Online](https://models.litellm.ai/models/pplx-7b-online.md): $0 / $0.28 per 1M tokens, 4K context, 1 provider - [Text Embedding Ada 002](https://models.litellm.ai/models/text-embedding-ada-002.md): $0.10 per 1M tokens, 8K context, 4 providers - [CodeLlama](https://models.litellm.ai/models/codellama.md): Free, 4K context, 1 provider - [GPT-4 1106 Preview](https://models.litellm.ai/models/gpt-4-1106-preview.md): $10 / $30 per 1M tokens, 128K context, 2 providers - [Meta Textgeneration Llama 2 13B](https://models.litellm.ai/models/meta-textgeneration-llama-2-13b.md): Free, 4K context, 1 provider - [Meta Textgeneration Llama 2 13B F](https://models.litellm.ai/models/meta-textgeneration-llama-2-13b-f.md): Free, 4K context, 1 provider - [Meta Textgeneration Llama 2 70B](https://models.litellm.ai/models/meta-textgeneration-llama-2-70b.md): Free, 4K context, 1 provider - [Meta Textgeneration Llama 2 70B B F](https://models.litellm.ai/models/meta-textgeneration-llama-2-70b-b-f.md): Free, 4K context, 1 provider - [Meta Textgeneration Llama 2 7B](https://models.litellm.ai/models/meta-textgeneration-llama-2-7b.md): Free, 4K context, 1 provider - [Meta Textgeneration Llama 2 7B F](https://models.litellm.ai/models/meta-textgeneration-llama-2-7b-f.md): Free, 4K context, 1 provider - [Mistral](https://models.litellm.ai/models/mistral.md): Free, 8K context, 1 provider - [Orca Mini](https://models.litellm.ai/models/orca-mini.md): Free, 4K context, 1 provider - [Vicuna](https://models.litellm.ai/models/vicuna.md): Free, 2K context, 1 provider - [Zephyr 7B Beta](https://models.litellm.ai/models/zephyr-7b-beta.md): $0.15 / $0.15 per 1M tokens, 16K context, 2 providers - [Claude](https://models.litellm.ai/models/claude.md): $8 / $24 per 1M tokens, 100K context, 1 provider - [Claude Instant](https://models.litellm.ai/models/claude-instant.md): $0.80 / $2.40 per 1M tokens, 100K context, 1 provider - [Claude V2](https://models.litellm.ai/models/claude-v2.md): $8 / $24 per 1M tokens, 100K context, 1 provider - [CodeLlama 34B Instruct HF](https://models.litellm.ai/models/codellama-34b-instruct-hf.md): $1 / $1 per 1M tokens, 4K context, 1 provider - [Command Text V14](https://models.litellm.ai/models/command-text-v14.md): $1 / $2 per 1M tokens, 4K context, 1 provider - [Llama 2 13B Chat HF](https://models.litellm.ai/models/llama-2-13b-chat-hf.md): $0.25 / $0.25 per 1M tokens, 4K context, 1 provider - [Llama 2 70B Chat HF](https://models.litellm.ai/models/llama-2-70b-chat-hf.md): $1 / $1 per 1M tokens, 4K context, 1 provider - [Llama 2 7B Chat HF](https://models.litellm.ai/models/llama-2-7b-chat-hf.md): $0.15 / $0.15 per 1M tokens, 4K context, 1 provider - [Llama2](https://models.litellm.ai/models/llama2.md): Free, 4K context, 1 provider - [Llama2 Uncensored](https://models.litellm.ai/models/llama2-uncensored.md): Free, 4K context, 1 provider - [Mistral 7B Instruct](https://models.litellm.ai/models/mistral-7b-instruct.md): $0.07 / $0.28 per 1M tokens, 4K context, 1 provider - [Mistral 7B Instruct V0.1](https://models.litellm.ai/models/mistral-7b-instruct-v0.1.md): Free, 8K context, 4 providers - [Titan Text Express V1](https://models.litellm.ai/models/titan-text-express-v1.md): $1.30 / $1.70 per 1M tokens, 42K context, 1 provider - [Titan Text Lite V1](https://models.litellm.ai/models/titan-text-lite-v1.md): $0.30 / $0.40 per 1M tokens, 42K context, 1 provider - [Babbage 002](https://models.litellm.ai/models/babbage-002.md): $0.40 / $0.40 per 1M tokens, 16K context, 1 provider - [Chatdolphin](https://models.litellm.ai/models/chatdolphin.md): $0.50 / $0.50 per 1M tokens, 16K context, 1 provider - [Claude Haiku 5.5](https://models.litellm.ai/models/claude-haiku-5-5.md): $0.10 / $0.50 per 1M tokens, 1M context, 7 providers - [Claude Opus 4.8 Fast](https://models.litellm.ai/models/claude-opus-4.8-fast.md): 200K context, 1 provider - [CodeLlama 34B Instruct](https://models.litellm.ai/models/codellama-34b-instruct.md): $0.35 / $1.40 per 1M tokens, 16K context, 2 providers - [Command](https://models.litellm.ai/models/command.md): $1.56 / $1.56 per 1M tokens, 128K context, 1 provider - [Command Nightly](https://models.litellm.ai/models/command-nightly.md): $1 / $2 per 1M tokens, 4K context, 1 provider - [Davinci 002](https://models.litellm.ai/models/davinci-002.md): $2 / $2 per 1M tokens, 16K context, 1 provider - [Dolphin](https://models.litellm.ai/models/dolphin.md): $0.50 / $0.50 per 1M tokens, 16K context, 1 provider - [GPT Rosalind Discovery](https://models.litellm.ai/models/gpt-rosalind-discovery.md): $5 / $25 per 1M tokens, 2 providers - [GPT-3.5 Turbo](https://models.litellm.ai/models/gpt-3.5-turbo.md): $0.50 / $1.50 per 1M tokens, 16K context, 4 providers - [GPT-3.5 Turbo 16K](https://models.litellm.ai/models/gpt-3.5-turbo-16k.md): $3 / $4 per 1M tokens, 16K context, 1 provider - [GPT-3.5 Turbo Instruct](https://models.litellm.ai/models/gpt-3.5-turbo-instruct.md): $1.50 / $2 per 1M tokens, 8K context, 3 providers - [GPT-4](https://models.litellm.ai/models/gpt-4.md): $30 / $60 per 1M tokens, 8K context, 3 providers - [GPT-4 32K](https://models.litellm.ai/models/gpt-4-32k.md): $60 / $120 per 1M tokens, 32K context, 1 provider - [J2 Light](https://models.litellm.ai/models/j2-light.md): $3 / $3 per 1M tokens, 8K context, 1 provider - [J2 Mid](https://models.litellm.ai/models/j2-mid.md): $10 / $10 per 1M tokens, 8K context, 2 providers - [J2 Ultra](https://models.litellm.ai/models/j2-ultra.md): $15 / $15 per 1M tokens, 8K context, 2 providers - [Llama 2 13B Chat](https://models.litellm.ai/models/llama-2-13b-chat.md): $0.10 / $0.50 per 1M tokens, 4K context, 2 providers - [Llama 2 70B Chat](https://models.litellm.ai/models/llama-2-70b-chat.md): $0.65 / $2.75 per 1M tokens, 4K context, 4 providers - [Mai Code 1.1 Flash](https://models.litellm.ai/models/mai-code-1.1-flash.md): 128K context, 1 provider - [Mythomax L2 13B](https://models.litellm.ai/models/mythomax-l2-13b.md): $0.09 / $0.09 per 1M tokens, 4K context, 3 providers - [Nous Hermes Llama2 13B](https://models.litellm.ai/models/nous-hermes-llama2-13b.md): $0.20 / $0.20 per 1M tokens, 4K context, 1 provider - [Pegasus 1.5](https://models.litellm.ai/models/pegasus-1-5.md): 96K context, 1 provider