Workload (input : output ratio)
Latency sensitivity
Your location
Monthly usage (M tokens)
AI Value = log₁₀(quality / blended $) − log₁₀((ms + k/4) / (k + k/4))
ms = TTFT + city→region RTT + α·gen_time · bonus below knee k, penalty above · +1.0 ≈ 10× value
Cheapest Input
per 1M tokens
Best AI Value (chat)
AI value score
Fastest from Vilnius 🇱🇹
estimated RTT
Best Reasoning AI Value
AI value score
EU-Native Models
with European endpoints

🏆 Best AI Value per Category

Loading…
Provider Model In / 1M Out / 1M Est $ / mo Ctx Latency 🇱🇹 Quality Index AI Value Links
Google
text-embedding-004 (legacy)
text-embedding-004
$0.013 $0.00 2k ~60ms 40 3.78
Cohere
Embed v3 (English)
embed-english-v3.0
$0.100 $0.00 0k ~60ms 43 2.92
Cohere
Embed v3 (Multilingual)
embed-multilingual-v3.0
$0.100 $0.00 0k ~60ms 42 2.91
Mistral AI
Mistral Embed
mistral-embed
$0.100 $0.00 8k ~49ms 36 2.89
Google
Gemini Embedding
gemini-embedding-001
$0.150 $0.00 2k ~60ms 45 2.76
OpenAI
text-embedding-3-large
text-embedding-3-large
$0.130 $0.00 8k ~175ms 45 2.48
Poolside
Laguna XS 2.1
laguna-xs-2.1
$0.060 $0.12 256k ~175ms 39 1.58
DeepSeek
DeepSeek V4 Flash
deepseek-v4-flash
$0.140 $0.28 1000k ~280ms 52 1.43
DeepSeek
DeepSeek V4 Flash (chat alias)
deepseek-chat
$0.140 $0.28 128k ~280ms 52 1.43
DeepSeek
DeepSeek V4 Flash (reasoner alias)
deepseek-reasoner
$0.140 $0.28 128k ~280ms 42 1.11
Poolside
Laguna S 2.1
laguna-s-2.1
$0.100 $0.20 1049k ~175ms 45 0.98
OpenAI
GPT-5.4 nano
gpt-5.4-nano
$0.200 $1.25 400k ~175ms 40 0.93
Google
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
$0.300 $2.50 1000k ~60ms 37 0.92
Kwaipilot
KAT-Coder-Air V2.5
kat-coder-air-v2.5
$0.150 $0.60 256k ~260ms 43 0.75
MiniMax
MiniMax M3
MiniMax-M3
$0.300 $1.20 1000k ~270ms 45 0.68
DeepSeek
DeepSeek V4 Pro
deepseek-v4-pro
$0.435 $0.87 1000k ~280ms 45 0.67
ByteDance
Doubao 2.0 Pro
doubao-2.0-pro
$0.300 $0.80 256k ~250ms 36 0.61
Meta (API)
Muse Spark 1.1
muse-spark-1.1
$1.250 $4.25 1050k ~170ms 53 0.53
Qwen
Qwen3.7 Plus
qwen3.7-plus
$0.400 $1.16 1000k ~260ms 39 0.49
OpenAI
GPT-5.6 Luna
gpt-5.6-luna
$1.000 $6.00 1050k ~175ms 52 0.36
Google
Gemini 3.6 Flash
gemini-3.6-flash
$1.500 $7.50 1000k ~60ms 52 0.34
Google
Gemini 3.5 Flash
gemini-3.5-flash
$1.500 $9.00 1000k ~60ms 52 0.33
Z.ai
GLM-5.2
glm-5.2
$1.400 $4.40 256k ~270ms 53 0.31
Qwen
Qwen3.7 Max
qwen3.7-max
$2.500 $7.50 1000k ~260ms 47 0.19
xAI
Grok 4.3
grok-4.3
$1.250 $2.50 1000k ~175ms 38 0.13
Fireworks AI
GLM-5 (Fireworks)
accounts/fireworks/models/glm-5
$1.000 $3.20 131k ~65ms 41 0.10
SiliconFlow
GLM-5 (SiliconFlow Pro)
Pro/zai-org/GLM-5
$0.560 $3.08 131k ~260ms 41 0.10
Fireworks AI
Kimi K2.5 (Fireworks)
accounts/fireworks/models/kimi-k2-5
$0.600 $3.00 256k ~65ms 36 0.09
SiliconFlow
Kimi K2.5 (SiliconFlow Pro)
Pro/moonshotai/Kimi-K2.5
$0.560 $2.94 256k ~260ms 36 0.07
Z.ai
GLM-5
glm-5
$1.000 $3.20 200k ~270ms 41 0.06
Thinking Machines
Inkling
inkling
$1.870 $4.68 256k ~175ms 42 0.06
Moonshot AI
Kimi K2.6
kimi-k2.6
$0.950 $4.00 256k ~260ms 45 0.02
OpenAI
GPT-5.3 chat-latest
gpt-5.3-chat-latest
$1.750 $14.00 400k ~175ms 50 -0.01
Azure OpenAI
GPT-5.4 mini (Sweden Central)
gpt-5.4-mini
$0.750 $4.50 400k ~48ms 41 -0.02
Fireworks AI
GLM-5.1 (Fireworks)
accounts/fireworks/models/glm-5-1
$1.400 $4.40 131k ~65ms 41 -0.04
Google
Gemini 3.1 Pro (Preview)
gemini-3.1-pro-preview
$2.000 $12.00 1000k ~60ms 48 -0.04
OpenAI
GPT-5.4 mini
gpt-5.4-mini
$0.750 $4.50 400k ~175ms 41 -0.05
Z.ai
GLM-5.1
glm-5.1
$1.400 $4.40 200k ~270ms 41 -0.07
xAI
Grok 4.5
grok-4.5
$2.000 $6.00 500k ~175ms 56 -0.09
xAI
Grok 4.20 Multi-Agent
grok-4.20-multi-agent-0309
$2.000 $6.00 2000k ~180ms 50 -0.11
Fireworks AI
Kimi K2.5 Turbo (Fireworks)
accounts/fireworks/models/kimi-k2-5-turbo
$0.990 $4.94 256k ~65ms 36 -0.13
Kwaipilot
KAT-Coder-Pro V2.5
kat-coder-pro-v2.5
$0.740 $2.96 256k ~260ms 48 -0.14
Moonshot AI
Kimi K2.7 Code
kimi-k2.7-code
$0.950 $4.00 256k ~260ms 43 -0.14
OpenAI
GPT-5.6 Terra
gpt-5.6-terra
$2.500 $15.00 1050k ~175ms 57 -0.15
xAI
Grok 4.20 Reasoning
grok-4.20-0309-reasoning
$2.000 $6.00 2000k ~180ms 38 -0.23
OpenAI
GPT-5.3 Codex
gpt-5.3-codex
$1.750 $14.00 400k ~175ms 46 -0.27
Anthropic
Claude Sonnet 5
claude-sonnet-5
$3.000 $15.00 1000k ~180ms 55 -0.32
Azure OpenAI
GPT-5 (Sweden Central)
gpt-5
$1.250 $10.00 400k ~48ms 35 -0.43
Azure OpenAI
GPT-5.4 (Sweden Central)
gpt-5.4
$2.500 $15.00 400k ~48ms 53 -0.43
OpenRouter
GPT-5 (OpenRouter)
openai/gpt-5
$1.250 $10.00 400k ~90ms 35 -0.44
OpenAI
GPT-5 (legacy)
gpt-5
$1.250 $10.00 400k ~175ms 35 -0.45
Google
Gemini 3 Pro
gemini-3-pro
$2.000 $12.00 1000k ~60ms 41 -0.45
OpenAI
GPT-5.4
gpt-5.4
$2.500 $15.00 400k ~175ms 53 -0.46
Together AI
Kimi K3 (Together)
moonshotai/Kimi-K3
$3.000 $15.00 1050k ~65ms 60 -0.56
Fireworks AI
Kimi K3 (Fireworks)
accounts/fireworks/models/kimi-k3
$3.000 $15.00 1050k ~65ms 60 -0.56
OpenRouter
Kimi K3 (OpenRouter)
moonshotai/kimi-k3
$3.000 $15.00 1050k ~130ms 60 -0.56
Moonshot AI
Kimi K3
kimi-k3
$3.000 $15.00 1050k ~260ms 60 -0.58
SiliconFlow
Kimi K3 (SiliconFlow)
moonshotai/Kimi-K3
$3.000 $15.00 1049k ~260ms 60 -0.58
AWS Bedrock
Claude Sonnet 4.6 (eu-central-1)
eu.anthropic.claude-sonnet-4-6-v1:0
$3.000 $15.00 200k ~41ms 37 -0.59
Anthropic
Claude Sonnet 4.6
claude-sonnet-4-6
$3.000 $15.00 1000k ~180ms 37 -0.62
AWS Bedrock
Claude Opus 4.7 (eu-central-1)
eu.anthropic.claude-opus-4-7-v1:0
$5.000 $25.00 200k ~41ms 55 -0.64
OpenAI
GPT-5.6 Sol
gpt-5.6-sol
$5.000 $30.00 1050k ~175ms 61 -0.64
Anthropic
Claude Opus 4.8
claude-opus-4-8
$5.000 $25.00 1000k ~180ms 57 -0.65
Anthropic
Claude Opus 5
claude-opus-5
$5.000 $25.00 1000k ~180ms 63 -0.66
Anthropic
Claude Opus 4.7
claude-opus-4-7
$5.000 $25.00 1000k ~180ms 55 -0.67
OpenAI
o3 Deep Research
o3-deep-research
$5.000 $20.00 200k ~175ms 42 -0.69
OpenAI
GPT-5.5
gpt-5.5
$5.000 $30.00 400k ~175ms 56 -0.73
OpenRouter
Claude Opus 4.6 (OpenRouter)
anthropic/claude-opus-4.6
$5.000 $25.00 1000k ~90ms 39 -0.80
Anthropic
Claude Opus 4.5
claude-opus-4-5
$5.000 $25.00 200k ~180ms 36 -0.86
Anthropic
Claude Fable 5
claude-fable-5
$10.000 $50.00 1000k ~180ms 62 -0.90
OpenAI
GPT-5 Pro
gpt-5-pro
$15.000 $120.00 400k ~175ms 50 -1.38
OpenAI
GPT-5.4 Pro
gpt-5.4-pro
$30.000 $180.00 400k ~175ms 60 -1.48
📊 Methodology: Quality = Artificial Analysis Intelligence Index (rebased 2026, top frontier ~57–60). Cost = workload-weighted blend of input & output $/1M tokens. Latency = TTFT (inference) + estimated RTT from your selected city to the model's datacenter region, then a symmetric log adjustment around the sensitivity knee (bonus below, penalty above). Throughput (tok/s) is shown per model and folded into typical response time for the chosen workload.
Formula: AI Value = log₁₀(quality_index / blended_cost) − log₁₀((latency_ms + knee/4) / (knee + knee/4)). Absolute score — no rescaling. LMSYS Chatbot Arena ELO shown separately for human-preference context. Auto-refreshed every 6h.