Cheapest Input
—
per 1M tokens
Best AI Value (chat)
—
AI value score
Fastest from Vilnius 🇱🇹
—
estimated RTT
Best Reasoning AI Value
—
AI value score
EU-Native Models
—
with European endpoints
🏆 Best AI Value per Category
Loading…
| Provider | Model | In / 1M | Out / 1M | Est $ / mo | Latency 🇱🇹 | AI Value |
|---|---|---|---|---|---|---|
|
text-embedding-004 (legacy)
text-embedding-004
|
$0.013 | $0.00 | ~60ms | 3.78 | ||
| Cohere |
Embed v3 (English)
embed-english-v3.0
|
$0.100 | $0.00 | ~60ms | 2.92 | |
| Cohere |
Embed v3 (Multilingual)
embed-multilingual-v3.0
|
$0.100 | $0.00 | ~60ms | 2.91 | |
| Mistral AI |
Mistral Embed
mistral-embed
|
$0.100 | $0.00 | ~49ms | 2.89 | |
|
Gemini Embedding
gemini-embedding-001
|
$0.150 | $0.00 | ~60ms | 2.76 | ||
| OpenAI |
text-embedding-3-large
text-embedding-3-large
|
$0.130 | $0.00 | ~175ms | 2.48 | |
| Poolside |
Laguna XS 2.1
laguna-xs-2.1
|
$0.060 | $0.12 | ~175ms | 1.58 | |
| DeepSeek |
DeepSeek V4 Flash
deepseek-v4-flash
|
$0.140 | $0.28 | ~280ms | 1.43 | |
| DeepSeek |
DeepSeek V4 Flash (chat alias)
deepseek-chat
|
$0.140 | $0.28 | ~280ms | 1.43 | |
| DeepSeek |
DeepSeek V4 Flash (reasoner alias)
deepseek-reasoner
|
$0.140 | $0.28 | ~280ms | 1.11 | |
| Poolside |
Laguna S 2.1
laguna-s-2.1
|
$0.100 | $0.20 | ~175ms | 0.98 | |
| OpenAI |
GPT-5.4 nano
gpt-5.4-nano
|
$0.200 | $1.25 | ~175ms | 0.93 | |
|
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
|
$0.300 | $2.50 | ~60ms | 0.92 | ||
| Kwaipilot |
KAT-Coder-Air V2.5
kat-coder-air-v2.5
|
$0.150 | $0.60 | ~260ms | 0.75 | |
| MiniMax |
MiniMax M3
MiniMax-M3
|
$0.300 | $1.20 | ~270ms | 0.68 | |
| DeepSeek |
DeepSeek V4 Pro
deepseek-v4-pro
|
$0.435 | $0.87 | ~280ms | 0.67 | |
| ByteDance |
Doubao 2.0 Pro
doubao-2.0-pro
|
$0.300 | $0.80 | ~250ms | 0.61 | |
| Meta (API) |
Muse Spark 1.1
muse-spark-1.1
|
$1.250 | $4.25 | ~170ms | 0.53 | |
| Qwen |
Qwen3.7 Plus
qwen3.7-plus
|
$0.400 | $1.16 | ~260ms | 0.49 | |
| OpenAI |
GPT-5.6 Luna
gpt-5.6-luna
|
$1.000 | $6.00 | ~175ms | 0.36 | |
|
Gemini 3.6 Flash
gemini-3.6-flash
|
$1.500 | $7.50 | ~60ms | 0.34 | ||
|
Gemini 3.5 Flash
gemini-3.5-flash
|
$1.500 | $9.00 | ~60ms | 0.33 | ||
| Z.ai |
GLM-5.2
glm-5.2
|
$1.400 | $4.40 | ~270ms | 0.31 | |
| Qwen |
Qwen3.7 Max
qwen3.7-max
|
$2.500 | $7.50 | ~260ms | 0.19 | |
| xAI |
Grok 4.3
grok-4.3
|
$1.250 | $2.50 | ~175ms | 0.13 | |
| Fireworks AI |
GLM-5 (Fireworks)
accounts/fireworks/models/glm-5
|
$1.000 | $3.20 | ~65ms | 0.10 | |
| SiliconFlow |
GLM-5 (SiliconFlow Pro)
Pro/zai-org/GLM-5
|
$0.560 | $3.08 | ~260ms | 0.10 | |
| Fireworks AI |
Kimi K2.5 (Fireworks)
accounts/fireworks/models/kimi-k2-5
|
$0.600 | $3.00 | ~65ms | 0.09 | |
| SiliconFlow |
Kimi K2.5 (SiliconFlow Pro)
Pro/moonshotai/Kimi-K2.5
|
$0.560 | $2.94 | ~260ms | 0.07 | |
| Z.ai |
GLM-5
glm-5
|
$1.000 | $3.20 | ~270ms | 0.06 | |
| Thinking Machines |
Inkling
inkling
|
$1.870 | $4.68 | ~175ms | 0.06 | |
| Moonshot AI |
Kimi K2.6
kimi-k2.6
|
$0.950 | $4.00 | ~260ms | 0.02 | |
| OpenAI |
GPT-5.3 chat-latest
gpt-5.3-chat-latest
|
$1.750 | $14.00 | ~175ms | -0.01 | |
| Azure OpenAI |
GPT-5.4 mini (Sweden Central)
gpt-5.4-mini
|
$0.750 | $4.50 | ~48ms | -0.02 | |
| Fireworks AI |
GLM-5.1 (Fireworks)
accounts/fireworks/models/glm-5-1
|
$1.400 | $4.40 | ~65ms | -0.04 | |
|
Gemini 3.1 Pro (Preview)
gemini-3.1-pro-preview
|
$2.000 | $12.00 | ~60ms | -0.04 | ||
| OpenAI |
GPT-5.4 mini
gpt-5.4-mini
|
$0.750 | $4.50 | ~175ms | -0.05 | |
| Z.ai |
GLM-5.1
glm-5.1
|
$1.400 | $4.40 | ~270ms | -0.07 | |
| xAI |
Grok 4.5
grok-4.5
|
$2.000 | $6.00 | ~175ms | -0.09 | |
| xAI |
Grok 4.20 Multi-Agent
grok-4.20-multi-agent-0309
|
$2.000 | $6.00 | ~180ms | -0.11 | |
| Fireworks AI |
Kimi K2.5 Turbo (Fireworks)
accounts/fireworks/models/kimi-k2-5-turbo
|
$0.990 | $4.94 | ~65ms | -0.13 | |
| Kwaipilot |
KAT-Coder-Pro V2.5
kat-coder-pro-v2.5
|
$0.740 | $2.96 | ~260ms | -0.14 | |
| Moonshot AI |
Kimi K2.7 Code
kimi-k2.7-code
|
$0.950 | $4.00 | ~260ms | -0.14 | |
| OpenAI |
GPT-5.6 Terra
gpt-5.6-terra
|
$2.500 | $15.00 | ~175ms | -0.15 | |
| xAI |
Grok 4.20 Reasoning
grok-4.20-0309-reasoning
|
$2.000 | $6.00 | ~180ms | -0.23 | |
| OpenAI |
GPT-5.3 Codex
gpt-5.3-codex
|
$1.750 | $14.00 | ~175ms | -0.27 | |
| Anthropic |
Claude Sonnet 5
claude-sonnet-5
|
$3.000 | $15.00 | ~180ms | -0.32 | |
| Azure OpenAI |
GPT-5 (Sweden Central)
gpt-5
|
$1.250 | $10.00 | ~48ms | -0.43 | |
| Azure OpenAI |
GPT-5.4 (Sweden Central)
gpt-5.4
|
$2.500 | $15.00 | ~48ms | -0.43 | |
| OpenRouter |
GPT-5 (OpenRouter)
openai/gpt-5
|
$1.250 | $10.00 | ~90ms | -0.44 | |
| OpenAI |
GPT-5 (legacy)
gpt-5
|
$1.250 | $10.00 | ~175ms | -0.45 | |
|
Gemini 3 Pro
gemini-3-pro
|
$2.000 | $12.00 | ~60ms | -0.45 | ||
| OpenAI |
GPT-5.4
gpt-5.4
|
$2.500 | $15.00 | ~175ms | -0.46 | |
| Together AI |
Kimi K3 (Together)
moonshotai/Kimi-K3
|
$3.000 | $15.00 | ~65ms | -0.56 | |
| Fireworks AI |
Kimi K3 (Fireworks)
accounts/fireworks/models/kimi-k3
|
$3.000 | $15.00 | ~65ms | -0.56 | |
| OpenRouter |
Kimi K3 (OpenRouter)
moonshotai/kimi-k3
|
$3.000 | $15.00 | ~130ms | -0.56 | |
| Moonshot AI |
Kimi K3
kimi-k3
|
$3.000 | $15.00 | ~260ms | -0.58 | |
| SiliconFlow |
Kimi K3 (SiliconFlow)
moonshotai/Kimi-K3
|
$3.000 | $15.00 | ~260ms | -0.58 | |
| AWS Bedrock |
Claude Sonnet 4.6 (eu-central-1)
eu.anthropic.claude-sonnet-4-6-v1:0
|
$3.000 | $15.00 | ~41ms | -0.59 | |
| Anthropic |
Claude Sonnet 4.6
claude-sonnet-4-6
|
$3.000 | $15.00 | ~180ms | -0.62 | |
| AWS Bedrock |
Claude Opus 4.7 (eu-central-1)
eu.anthropic.claude-opus-4-7-v1:0
|
$5.000 | $25.00 | ~41ms | -0.64 | |
| OpenAI |
GPT-5.6 Sol
gpt-5.6-sol
|
$5.000 | $30.00 | ~175ms | -0.64 | |
| Anthropic |
Claude Opus 4.8
claude-opus-4-8
|
$5.000 | $25.00 | ~180ms | -0.65 | |
| Anthropic |
Claude Opus 5
claude-opus-5
|
$5.000 | $25.00 | ~180ms | -0.66 | |
| Anthropic |
Claude Opus 4.7
claude-opus-4-7
|
$5.000 | $25.00 | ~180ms | -0.67 | |
| OpenAI |
o3 Deep Research
o3-deep-research
|
$5.000 | $20.00 | ~175ms | -0.69 | |
| OpenAI |
GPT-5.5
gpt-5.5
|
$5.000 | $30.00 | ~175ms | -0.73 | |
| OpenRouter |
Claude Opus 4.6 (OpenRouter)
anthropic/claude-opus-4.6
|
$5.000 | $25.00 | ~90ms | -0.80 | |
| Anthropic |
Claude Opus 4.5
claude-opus-4-5
|
$5.000 | $25.00 | ~180ms | -0.86 | |
| Anthropic |
Claude Fable 5
claude-fable-5
|
$10.000 | $50.00 | ~180ms | -0.90 | |
| OpenAI |
GPT-5 Pro
gpt-5-pro
|
$15.000 | $120.00 | ~175ms | -1.38 | |
| OpenAI |
GPT-5.4 Pro
gpt-5.4-pro
|
$30.000 | $180.00 | ~175ms | -1.48 |
📊 Methodology:
Quality = Artificial Analysis Intelligence Index (rebased 2026, top frontier ~57–60).
Cost = workload-weighted blend of input & output $/1M tokens.
Latency = TTFT (inference) + estimated RTT from your selected city to the model's datacenter region, then a symmetric log adjustment around the sensitivity knee (bonus below, penalty above).
Throughput (tok/s) is shown per model and folded into typical response time for the chosen workload.
Formula:
Formula:
AI Value = log₁₀(quality_index / blended_cost) − log₁₀((latency_ms + knee/4) / (knee + knee/4)).
Absolute score — no rescaling. LMSYS Chatbot Arena ELO shown separately for human-preference context. Auto-refreshed every 6h.