InferenceIndexerInferenceIndexer.ai
/
ModelsProvidersAPIEmbedFor agentsHarnessesMethodologyAboutLoginSign Up

Quality-adjusted price across 677 models

Grouped by quality tier, ranked within tier by Cost/IQ: verified price per million tokens per unit of AA Intelligence Index. Input, output, and blended prices shown per model. Full data via the API.

Quality here means intelligence only. Latency and uptime verification is in development; neither is scored on this page. Green means price down (cheaper), red means price up.

All models by creator

628 models across 74 creators. Every model's pricing page, grouped alphabetically.

ai21

  • AI21: Jamba Large 1.7

aion-labs

  • AionLabs: Aion-2.0
  • AionLabs: Aion-3.0
  • AionLabs: Aion-3.0-Mini
  • AionLabs: Aion 3.5
  • AionLabs: Aion 3.5 Mini
  • AionLabs: Aion-RP 1.0 (8B)

aionlabs

  • Aion 3.0
  • Aion 3.0 Mini

alibaba

  • Qwen3-14B
  • Qwen3 235B A22B
  • Qwen3-30B-A3B
  • Qwen 3 32B
  • Qwen 3.6 Max Preview
  • Qwen Coder Plus
  • Qwen Coder Turbo
  • Qwen Flash
  • Qwen Flash 2025 07 28
  • Qwen Flash 2025 07 28 Us
  • Qwen Flash Character
  • Qwen Flash Us
  • Qwen Omni Turbo 2025 01 19
  • Qwen Omni Turbo 2025 03 26
  • Qwen Omni Turbo Latest
  • Qwen Omni Turbo Realtime 2025 05 08
  • Qwen Omni Turbo Realtime Latest
  • Qwen Plus 2024 12 20
  • Qwen Plus 2025 01 12
  • Qwen Plus 2025 01 25
  • Qwen Plus 2025 04 28
  • Qwen Plus 2025 07 14
  • Qwen Plus 2025 07 28
  • Qwen Plus 2025 09 11
  • Qwen Plus 2025 12 01
  • Qwen Plus 2025 12 01 Us
  • Qwen Plus Character
  • Qwen Plus Character Ja
  • Qwen Plus Latest
  • Qwen Plus Us
  • Qwen Vl Max
  • Qwen Vl Ocr 2024 10 28
  • Qwen Vl Ocr 2025 04 13
  • Qwen Vl Ocr 2025 08 28
  • Qwen Vl Ocr 2025 11 20
  • Qwen Vl Ocr Latest
  • Qwen Vl Plus
  • Qwen2 Vl 72B Instruct
  • Qwen2.5 Omni 7B
  • Qwen3 VL 235B A22B Thinking
  • Qwen3 Coder 480B A35B Instruct
  • Qwen 3 Coder 30B A3B Instruct
  • Qwen3 Coder 30B A3B Instruct
  • Qwen3 Coder Flash 2025 07 28
  • Qwen3 Coder Next
  • Qwen3 Coder Plus
  • Qwen3 Coder Plus 2025 07 22
  • Qwen3 Coder Plus 2025 09 23
  • Qwen3 Max 2025 09 23
  • Qwen3 Max 2026 01 23
  • Qwen 3 Max Thinking
  • Qwen3 Omni Flash 2025 09 15
  • Qwen3 Omni Flash 2025 12 01
  • Qwen3 Omni Flash Realtime 2025 09 15
  • Qwen3 Omni Flash Realtime 2025 12 01
  • Qwen3 Vl 235B A22B Instruct
  • Qwen3 Vl 235B A22B Thinking
  • Qwen3 Vl 30B A3B Instruct
  • Qwen3 Vl 30B A3B Thinking
  • Qwen3 Vl 8B Instruct
  • Qwen3 Vl 8B Thinking
  • Qwen3 Vl Embedding
  • Qwen3 Vl Flash 2025 10 15
  • Qwen3 Vl Flash 2025 10 15 Us
  • Qwen3 Vl Flash 2026 01 22
  • Qwen3 Vl Flash 2026 01 22 Us
  • Qwen3 Vl Flash Us
  • Qwen3 VL 235B A22B Instruct
  • Qwen3 Vl Plus 2025 09 23
  • Qwen3 Vl Plus 2025 12 19
  • Qwen3 Vl Rerank
  • Qwen3 VL 235B A22B Thinking
  • Qwen3.5 Flash 2026 02 23
  • Qwen3.5 Omni Flash 2026 03 15
  • Qwen3.5 Omni Flash Realtime 2026 03 15
  • Qwen3.5 Omni Plus 2026 03 15
  • Qwen3.5 Omni Plus Realtime 2026 03 15
  • Qwen3.5 Plus 2026 02 15
  • Qwen3.5 Plus 2026 04 20
  • Qwen3.6 Flash 2026 04 16
  • Qwen3.6 Flash Us
  • Qwen3.6 Plus 2026 04 02
  • Qwen 3.7 Flash
  • Qwen3.7 Flash 2026 07 15
  • Qwen3.7 Max 2026 05 17
  • Qwen3.7 Max 2026 05 20
  • Qwen3.7 Max 2026 06 08
  • Qwen3.7 Max Us
  • Qwen3.7 Plus 2026 05 26
  • Qwen3.7 Plus Us
  • Qwen3.8 Max 0902
  • Qwen3.8 Max Prime
  • Qwen3.8 Omni Flash

allenai

  • AllenAI: Olmo 3 32B Think

amazon

  • Amazon: Nova Micro 1.0
  • Amazon: Nova Lite 1.0
  • Amazon: Nova Pro 1.0
  • Amazon: Nova Premier 1.0
  • Nova 2 Lite
  • Amazon: Nova 2 Lite
  • Nova Lite
  • Nova Micro
  • Nova Pro

anthracite-org

  • Magnum v4 72B

anthropic

  • Anthropic: Claude Sonnet 5.5
  • Anthropic: Claude 3 Haiku
  • Anthropic: Claude Sonnet 5
  • Anthropic: Claude Haiku 4.5
  • Anthropic: Claude Opus 5.5
  • Anthropic: Claude Opus 5
  • Anthropic: Claude Opus 4.8
  • Anthropic: Claude Sonnet 4.6
  • Anthropic: Claude Opus 4.7
  • Anthropic: Claude Sonnet 4.5
  • Anthropic: Claude Fable 5.1
  • Anthropic: Claude Opus 4.6
  • Anthropic: Claude Fable 5
  • Anthropic: Claude Opus 4.5
  • Claude Opus 5 (Fast)
  • claude haiku 4 5
  • Anthropic: Claude Opus 4
  • claude opus 4 7
  • claude opus 4 8
  • Anthropic: Claude Opus 4.1
  • Anthropic: Claude Opus 4.7 (Fast)
  • Anthropic: Claude Opus 4.8 (Fast)
  • Claude Opus 5.5
  • Anthropic: Claude Sonnet 4
  • claude sonnet 4 6

arcee-ai

  • Arcee AI: Trinity Large Thinking
  • Arcee AI: Virtuoso Large

baichuan

  • BaiChuan M2 32B

baidu

  • CoBuddy
  • ERNIE 4.5 21B A3B
  • Baidu: ERNIE 4.5 VL 424B A47B

bytedance

  • Seed 1.6
  • Seed 1.8
  • Seed 2.0 code
  • Seed 2.0 mini
  • Seed 2.0 pro
  • Seed 2.1 Turbo
  • ByteDance: UI-TARS 7B

bytedance-seed

  • ByteDance Seed: Seed 1.6
  • ByteDance Seed: Seed 1.6 Flash
  • ByteDance Seed: Seed 2.1 Turbo
  • ByteDance Seed: Seed-2.0-Code
  • ByteDance Seed: Seed-2.0-Lite
  • ByteDance Seed: Seed-2.0-Mini
  • Seed 2.1 Turbo

cognitivecomputations

  • Venice: Uncensored

cohere

  • Cohere: Command A+
  • Cohere: Command A
  • Cohere: Command R (08-2024)
  • Cohere: Command R+ (08-2024)
  • Cohere: Command R7B (12-2024)

deepcogito

  • Deep Cogito: Cogito v2.1 671B

deepseek

  • DeepSeek: DeepSeek V4 Flash 0423
  • DeepSeek: DeepSeek V4 Flash 0731
  • DeepSeek: DeepSeek V4.1 Flash
  • DeepSeek: DeepSeek V4 Flash Vision Exp
  • DeepSeek: DeepSeek V3.2
  • DeepSeek: DeepSeek V3.2 Exp
  • DeepSeek: DeepSeek V3.1 Terminus
  • DeepSeek: DeepSeek V4 Pro 0423
  • DeepSeek: DeepSeek V3 0324
  • DeepSeek: DeepSeek V4 Pro 0813
  • DeepSeek: DeepSeek V3.1
  • DeepSeek: R1 Distill Llama 70B
  • DeepSeek: R1 0528
  • DeepSeek: R1
  • DeepSeek V3
  • DeepSeek: DeepSeek V3
  • DeepSeek-OCR 2
  • DeepSeek R1 0528 Qwen3 8B
  • DeepSeek R1 (Turbo)
  • DeepSeek R1
  • DeepSeek V3 0324
  • DeepSeek V3 (Turbo)
  • DeepSeek V3.1
  • DeepSeek V3
  • deepseek/deepseek-v4-flash-0731-p
  • deepseek/deepseek-v4-pro-0813-p
  • DeepSeek V4.1 Flash DST
  • DeepSeek V4.1 Flash
  • DS F41 Flash

deepseek-ai

  • DeepSeek R1 0528
  • DeepSeek V3
  • DeepSeek V3 0324
  • DeepSeek V3.1
  • DeepSeek V3.2
  • DeepSeek V4 Flash
  • DeepSeek V4 Flash 0731
  • DeepSeek V4 Flash Vision Exp
  • DeepSeek V4 Pro
  • DeepSeek V4 Pro 0813
  • DeepSeek V4.1 Flash

fireworks

  • Fireworks: Ember-1

google

  • Google: Gemma 4 26B A4B
  • Google: Gemma 4 31B
  • Google: Gemma 3 4B
  • Google: Gemma 3 12B
  • Google: Gemini 3.8 Flash
  • Google: Gemini 2.5 Flash Lite
  • Google: Gemini 3.1 Flash Lite Preview
  • Google: Gemini 3.7 Flash
  • Google: Gemma 3 27B
  • Google: Gemini 3.6 Flash
  • Google: Gemini 3.1 Flash Lite
  • Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
  • Google: Gemini 3.5 Flash Lite
  • Google: Nano Banana (Gemini 2.5 Flash Image)
  • Google: Gemma 3n 4B
  • Google: Gemini 3 Flash Preview
  • Google: Nano Banana Pro (Gemini 3 Pro Image Preview)
  • Google: Gemini 2.5 Flash
  • Google: Gemini 3.5 Flash
  • Google: Gemini 3.1 Pro Preview Custom Tools
  • Google: Nano Banana Pro (Gemini 3 Pro Image)
  • Google: Gemini 3.1 Pro Preview
  • Google: Gemini 2.5 Pro Preview 05-06
  • Google: Gemini 2.5 Pro
  • Google: Gemini 2.5 Pro Preview 06-05
  • Gemini 3 Flash
  • Google: Nano Banana 2 (Gemini 3.1 Flash Image)
  • Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)
  • gemini 3.1 pro
  • Gemini Omni Flash Preview
  • Google: Gemma 2 27B
  • Gemma 4 31B
  • gemma 4 31B it turbo
  • gemma 4 31B it Ultra
  • gemma 4 E4B it
  • Gemma 4 Uncensored

gryphe

  • MythoMax 13B

hermes

  • hermes/mercury-oss-120b
  • hermes/mercury-oss-20b

ibm-granite

  • IBM: Granite 4.1 8B
  • IBM: Granite 4.2 8B
  • IBM: Granite 4.0 Micro
  • granite 4.2 30b
  • granite 4.2 3b

inception

  • Inception: Mercury 2.5
  • Inception: Mercury 2.5 Preview
  • Inception: Mercury 2
  • Mercury Coder Small Beta

inclusionai

  • inclusionAI: Ling 3.0 Flash
  • inclusionAI: Ling 3.0 Flash VL
  • inclusionAI: Ling 3.0 Flash Fin
  • inclusionAI: Ling-2.6-flash
  • inclusionAI: Ring-2.6-1T
  • inclusionAI: Ling-2.6-1T
  • Ling 3.0 Flash Fast

inference-net

  • Inference.net: Schematron V2 Small
  • Inference.net: Schematron V2 Turbo

interfaze

  • Interfaze Beta

jina-ai

  • Jina AI: Jina Clip v1
  • Jina AI: Jina Clip v2
  • Jina AI: Jina Embeddings v4
  • Jina AI: Jina Embeddings v5 Omni Nano
  • Jina AI: Jina Embeddings v5 Omni Small
  • Jina AI: Jina OCR v1
  • Jina AI: Jina VLM

kwaipilot

  • Kwaipilot: KAT-Coder-Pro V2
  • Kwaipilot: KAT-Coder-Pro V2.5
  • Kwaipilot: KAT-Coder-Air V2.5
  • Kat Coder Pro

mancer

  • Mancer: Weaver (alpha)

meituan

  • Meituan: LongCat 2.0
  • LongCat 2.5 Preview

meta

  • Meta: Muse Spark 1.3 Contributor
  • Meta: Muse Spark 1.2 Contributor
  • Meta: Muse Glimmer 30B
  • Meta: Muse Spark 1.3
  • Meta: Muse Spark 1.2
  • Meta: Muse Spark 1.1
  • Llama 3.1 70B Instruct
  • Llama 3.1 8B Instruct
  • Llama 3.3 70B Instruct
  • Llama 4 Maverick 17B Instruct
  • Llama 4 Scout 17B Instruct

meta-llama

  • Meta: Llama 3.1 8B Instruct
  • Meta: Llama 3.2 1B Instruct
  • Meta: Llama 3.2 3B Instruct
  • Meta: Llama 4 Scout
  • Meta: Llama 4 Maverick
  • Meta: Llama 3.1 70B Instruct
  • Meta: Llama 3.3 70B Instruct
  • Llama 3.2 3B
  • Llama 3.3 70B
  • Llama 3.3 70B Instruct Turbo
  • Llama 4 Maverick Instruct
  • Llama 4 Scout Instruct
  • Meta: Llama Guard 4 12B
  • Llama Prompt Guard 2 22M
  • Llama Prompt Guard 2 86M
  • Meta Llama 3.1 70B Instruct Turbo
  • Meta Llama 3.1 8B Instruct Turbo

meta-models

  • Muse Glimmer 30B

microsoft

  • Microsoft: Phi 4
  • WizardLM-2 8x22B

mindai

  • Macaron V1 Tall
  • Macaron V1 Venti

minimax

  • MiniMax: MiniMax M3
  • MiniMax: MiniMax M2.5
  • MiniMax: MiniMax M2.7
  • MiniMax: MiniMax M2
  • MiniMax: MiniMax M2-her
  • MiniMax: MiniMax M2.1
  • MiniMax: MiniMax-01
  • MiniMax: MiniMax M1
  • MiniMax M2.1 Lightning
  • MiniMax M2.5-highspeed
  • MiniMax M2.7-highspeed

mistral

  • Mistral Codestral
  • Ministral 14B
  • Ministral 3B
  • Mistral Large 3
  • Mistral Medium Latest
  • Mistral Small

mistralai

  • Mistral: Mistral Small 3
  • Mistral: Ministral 3 3B 2512
  • Mistral: Ministral 3 8B 2512
  • Mistral: Mistral Small 3.2 24B
  • Mistral: Ministral 3 14B 2512
  • Mistral: Saba
  • Mistral: Mistral Small 3.1 24B
  • Mistral: Mistral Small 4
  • Mistral: Mistral Medium 3.1
  • Mistral: Mistral Medium 3
  • Mistral: Devstral 2 2512
  • Mistral: Mistral Large 3 2512
  • Mistral: Mistral Medium 3.5
  • Mistral Large
  • Mistral Large 2407
  • Mistral: Mixtral 8x22B Instruct
  • Mistral: Codestral 2508
  • Mistral: Ministral 8B
  • Mistral: Mistral Nemo
  • Mistral Nemo Instruct 2407
  • Mistral Small 3.2 24B Instruct 2506
  • Mistral: Voxtral Small 24B 2507

mixedbread

  • Toast 1

moonshotai

  • MoonshotAI: Kimi K2 Thinking
  • MoonshotAI: Kimi K2.5
  • MoonshotAI: Kimi K2.6
  • MoonshotAI: Kimi K2.7 Code
  • MoonshotAI: Kimi K2 0711
  • MoonshotAI: Kimi K2 0905
  • MoonshotAI: Kimi K3
  • Kimi K2 Instruct
  • Kimi K2.6 Highspeed
  • Kimi K2.7 Code Fast
  • Kimi K2.7 Code Highspeed
  • Kimi K3 Fast
  • Moonshot V1 128K
  • Moonshot V1 128K Vision Preview
  • Moonshot V1 32K
  • Moonshot V1 32K Vision Preview
  • Moonshot V1 8K
  • Moonshot V1 8K Vision Preview

morph

  • Morph: Morph V3 Fast
  • Morph: Morph V3 Large

nex-agi

  • Nex AGI: Nex-N2-Pro
  • Nex AGI: Nex-N2-Mini
  • Nex AGI: Nex-N2.5-Mini
  • Nex AGI: Nex-N2.5-Pro

nousresearch

  • Nous: Hermes 3 70B Instruct
  • Nous: Hermes 4 405B
  • Hermes 2 Pro Llama 3 8B
  • Nous: Hermes 3 405B Instruct
  • Nous: Hermes 4 70B

nvidia

  • NVIDIA: Nemotron 3.5 Lightning
  • NVIDIA: Nemotron 3 Nano 30B A3B
  • NVIDIA: Nemotron 3 Super
  • NVIDIA: Nemotron 3 Ultra
  • NVIDIA: Nemotron 3.5 Content Safety
  • Nvidia Nemotron Nano 9B V2
  • NVIDIA Nemotron 3.5 Lightning

openai

  • OpenAI: GPT-6 Luna Pro
  • OpenAI: GPT-6 Luna
  • OpenAI: gpt-oss-20b
  • OpenAI: GPT-5 Nano
  • OpenAI: GPT-5.6 Luna
  • OpenAI: GPT-5.4 Nano
  • OpenAI: GPT-4.1 Nano
  • OpenAI: gpt-oss-120b
  • OpenAI: GPT-5.6 Luna Pro
  • OpenAI: GPT-5 Mini
  • OpenAI: GPT-4o-mini
  • OpenAI: GPT-5.1-Codex-Mini
  • OpenAI: GPT-4o-mini (2024-07-18)
  • OpenAI: GPT-5 Image Mini
  • OpenAI: GPT-6 Sol Pro
  • OpenAI: GPT-4.1 Mini
  • OpenAI: GPT-5.4 Mini
  • OpenAI: GPT-6 Sol
  • OpenAI: o4 Mini
  • OpenAI: o4 Mini High
  • OpenAI: GPT-5.1
  • OpenAI: GPT-3.5 Turbo
  • OpenAI: GPT-5.6 Terra
  • OpenAI: o3 Mini
  • OpenAI: GPT-5.1-Codex
  • OpenAI: o3
  • OpenAI: o3 Mini High
  • OpenAI: GPT-5.4
  • OpenAI: GPT-5
  • OpenAI: GPT-5.1-Codex-Max
  • OpenAI: GPT-3.5 Turbo (older v0613)
  • OpenAI: GPT-5.2
  • OpenAI: GPT-5.6 Sol
  • OpenAI: GPT-5.2-Codex
  • OpenAI: GPT-3.5 Turbo Instruct
  • OpenAI: GPT-5.3-Codex
  • OpenAI: GPT-5.6 Terra Pro
  • OpenAI: GPT-5.2 Chat
  • OpenAI: GPT-5 Image
  • OpenAI: GPT-4.1
  • OpenAI: GPT-6 Astra Pro
  • OpenAI: GPT-5.4 Image 2
  • OpenAI: GPT-5.5
  • OpenAI: GPT-6 Astra
  • OpenAI: GPT-5.6 Sol Pro
  • OpenAI: GPT-3.5 Turbo 16k
  • OpenAI: GPT-4o
  • OpenAI: GPT-4o (2024-08-06)
  • OpenAI: GPT-4o (2024-11-20)
  • OpenAI: GPT-4o (2024-05-13)
  • OpenAI: o3 Pro
  • OpenAI: o1
  • OpenAI: GPT-4 Turbo
  • OpenAI: GPT-4 Turbo Preview
  • OpenAI: GPT-5 Pro
  • OpenAI: GPT-5.2 Pro
  • OpenAI: GPT-5.4 Pro
  • OpenAI: GPT-5.5 Pro
  • OpenAI: GPT-4
  • OpenAI: o1-pro
  • OpenAI: GPT-5.3 Chat
  • OpenAI: GPT Audio
  • OpenAI: GPT Audio Mini
  • gpt oss 120b Turbo
  • gpt oss 120b Ultra
  • GPT OSS Safeguard 120B
  • OpenAI: gpt-oss-safeguard-20b

openrelay

  • Deepseek V4 Flash

paddlepaddle

  • PaddleOCR-VL

perplexity

  • Perplexity: Sonar
  • Perplexity: Sonar Reasoning Pro
  • Perplexity: Sonar Deep Research
  • Perplexity: Sonar Pro
  • Perplexity: Sonar Pro Search

poolside

  • Poolside: Laguna S 2.1
  • Poolside: Laguna XS 2.1

prism-ml

  • PrismML: Ternary Bonsai 2 27B

quiverai

  • Arrow 2
  • Arrow 2 Telos

qwen

  • Qwen: Qwen3.5-9B
  • Qwen: Qwen3 14B
  • Qwen: Qwen3 Coder 30B A3B Instruct
  • Qwen: Qwen3 30B A3B Instruct 2507
  • Qwen: Qwen3 VL 32B Instruct
  • Qwen: Qwen3 32B
  • Qwen: Qwen3.7 Plus
  • Qwen: Qwen3.6 35B A3B
  • Qwen: Qwen3 8B
  • Qwen: Qwen3.5-35B-A3B
  • Qwen: Qwen3 235B A22B Instruct 2507
  • Qwen: Qwen3 30B A3B
  • Qwen: Qwen3.8 27B
  • Qwen2.5 72B Instruct
  • Qwen: Qwen3 VL 30B A3B Instruct
  • Qwen: Qwen3 VL 8B Instruct
  • Qwen: Qwen3.6 Plus
  • Qwen: Qwen3.5-27B
  • Qwen: Qwen3 Next 80B A3B Instruct
  • Qwen: Qwen3 VL 235B A22B Instruct
  • Qwen: Qwen3 Next 80B A3B Thinking
  • Qwen: Qwen3 Coder Next
  • Qwen: Qwen3.8 Max
  • Qwen: Qwen3 Coder 480B A35B
  • Qwen: Qwen3.6 27B
  • Qwen: Qwen3.8 Max (0902)
  • Qwen: Qwen3.5-122B-A10B
  • Qwen: Qwen3.8 2.4T A95B
  • Qwen: Qwen3.7 Max
  • Qwen: Qwen3.5 397B A17B
  • Qwen2.5 Coder 32B Instruct
  • Qwen: Qwen3 235B A22B
  • Qwen: Qwen3 VL 30B A3B Thinking
  • Qwen: Qwen3.6 Max Preview
  • Qwen: Qwen3 Max Thinking
  • Qwen: Qwen3 VL 8B Thinking
  • Qwen: Qwen3 30B A3B Thinking 2507
  • Qwen: Qwen3 235B A22B Thinking 2507
  • Qwen: Qwen3.8 Max Prime
  • Qwen: Qwen3 Max
  • Qwen: Qwen3 VL 235B A22B Thinking
  • Qwen: Qwen2.5 7B Instruct
  • Qwen 3.6 Plus Uncensored
  • Qwen 3.7 Max
  • Qwen 3.7 Plus
  • Qwen 3.8 Max
  • Qwen MT Plus
  • Qwen: Qwen-Plus
  • Qwen: Qwen Plus 0728
  • Qwen: Qwen Plus 0728 (thinking)
  • Qwen2.5 72B Instruct
  • Qwen 2.5 7B
  • Qwen: Qwen2.5 VL 72B Instruct
  • Qwen3 235B A22B
  • Qwen3 235B A22B Instruct 2507
  • Qwen3 Coder 480B A35B Instruct
  • Qwen3 Coder 480B A35B Instruct Turbo
  • Qwen: Qwen3 Coder Flash
  • Qwen: Qwen3 Coder Plus
  • Qwen 3 Next 80b
  • Qwen3 Omni 30B A3B Instruct
  • Qwen3 Omni 30B A3B Thinking
  • Qwen: Qwen3.5-Flash
  • Qwen: Qwen3.5 Plus 2026-02-15
  • Qwen: Qwen3.5 Plus 2026-04-20
  • Qwen: Qwen3.6 Flash
  • Qwen: Qwen3.7 Flash
  • Qwen: Qwen3.8 Flash
  • Qwen3.8 Flash Next
  • Qwen: Qwen3.8 Omni Flash

rekaai

  • Reka Flash 3
  • Reka Edge

relace

  • Relace: Relace Apply 3
  • Relace: Relace Search

sakana

  • Sakana: Fugu Max
  • Sakana: Fugu Ultra
  • Sakana: Fugu Ultra v2
  • Sakana: Namazu
  • Sakana: Sakana Namazu

sambanova

  • DeepSeek V3.1
  • DeepSeek V3.2
  • Meta Llama 3.3 70B Instruct

sao10k

  • Sao10K: Llama 3 8B Lunaris
  • Sao10K: Llama 3.3 Euryale 70B
  • Sao10K: Llama 3.1 Euryale 70B v2.2
  • L3 70B Euryale V2.1
  • Sao10k L3 8B Lunaris
  • L3 8B Lunaris v1 Turbo
  • L3 8B Stheno V3.2
  • L3.1 70B Euryale v2.2
  • L31 70B Euryale V2.2

sarvam

  • Sarvam 105B
  • Sarvam 105B Conversations

spacexai

  • Grok 4.1 Fast Non-Reasoning
  • Grok 4.1 Fast Reasoning
  • Grok 4.20 Multi Agent Beta
  • Grok 4.20 Non-Reasoning
  • Grok 4.20 Beta Non-Reasoning
  • Grok 4.20 Reasoning
  • Grok 4.20 Beta Reasoning

stepfun

  • StepFun: Step 3.5 Flash
  • StepFun: Step 3.7 Flash
  • Step 5 Preview

tencent

  • Tencent: Hy3
  • Tencent: Hy3 preview
  • Tencent: Hunyuan A13B Instruct
  • Tencent: Hy-MT2-1.8B
  • Tencent: Hy-MT2-30B-A3B
  • Tencent: Hy-MT2-7B
  • Tencent Hy-MT2-Lite
  • Tencent Hy-MT2-Plus
  • Tencent Hy-MT2-Pro

thedrummer

  • TheDrummer: UnslopNemo 12B
  • TheDrummer: Cydonia 24B V4.1
  • TheDrummer: Rocinante 12B
  • TheDrummer: Skyfall 36B V2

thinkingmachines

  • Thinking Machines: Inkling Small
  • Thinking Machines: Inkling

thudm

  • GLM-4-32B-0414

unbiased

  • Pareto

undi95

  • ReMM SLERP 13B

upstage

  • Upstage: Solar Pro 4
  • Upstage: Solar Mini 4
  • Upstage: Solar Pro 3

venice

  • Venice Uncensored 1.2
  • Venice Role Play Uncensored

writer

  • Writer: Palmyra X5

x-ai

  • SpaceXAI: Grok 4.20
  • SpaceXAI: Grok 4.3
  • SpaceXAI: Grok 4.20 Multi-Agent
  • SpaceXAI: Grok 4.7
  • SpaceXAI: Grok 4.6
  • SpaceXAI: Grok 4.5
  • Grok 4.7
  • SpaceXAI: Grok Build 0.1

xiaomi

  • Xiaomi: MiMo-V2.6-Flash
  • Xiaomi: MiMo-V2.5
  • Xiaomi: MiMo-V2.6-Pro
  • Xiaomi: MiMo-V2.5-Pro
  • Xiaomi: MiMo-V2.6-Pro-UltraSpeed

z-ai

  • Z.ai: GLM 5.3 Flash
  • Z.ai: GLM 4.7 Flash
  • Z.ai: GLM 5.3 FlashX
  • Z.ai: GLM 4.5 Air
  • Z.ai: GLM 5.3
  • Z.ai: GLM 4.7
  • Z.ai: GLM 5
  • Z.ai: GLM 4.6V
  • Z.ai: GLM 5.2
  • Z.ai: GLM 4.6
  • Z.ai: GLM 5 Turbo
  • Z.ai: GLM 4.5
  • Z.ai: GLM 5.1
  • Z.ai: GLM 5V Turbo
  • Z.ai: GLM 4.5V
  • Z.ai: GLM 5.3 Prime
  • Glm 4.5 Airx
  • Glm 4.5 X
  • Glm 4.6V Flashx
  • GLM 5.2 Fast
  • Glm Ocr

zai

  • GLM 4.7 FlashX

Quality scores: source Artificial Analysis (artificialanalysis.ai). Tier groupings and rankings are InferenceIndexer's own; not endorsed by Artificial Analysis.

Get the data via API → View API documentation
InferenceIndexerInferenceIndexer.ai · Inference Recommendation Engine
ProvidersModel TypeMethodologyAPI DocsFor AgentsHarnessesData QualityAboutPrivacy PolicyTerms of Service@inferenceindex
677 models · 75 providers