LLM leaderboard

Which model, at what price? Context windows and per-1M-token pricing for the major models, alongside model-related buzz — pick the best value for your task.

# Model Provider Context Input Output Strengths
1 GPT-5
gpt-5
OpenAI 400K $1.25 $10 综合能力标杆,工具调用与复杂推理最稳。
2 Claude Opus 4.5
claude-opus-4-5
Anthropic 200K $5 $25 长文写作与代码重构质量最高,Agent 任务稳定。
3 Claude Sonnet 5
claude-sonnet-5
Anthropic 200K $3 $15 性价比主力:接近旗舰的质量,一半价格。
4 Gemini 2.5 Pro
gemini-2-5-pro
Google 1M $1.25 $10 百万级上下文 + 原生多模态,长文档首选。
5 DeepSeek-V3.2
deepseek-v3-2
DeepSeek 128K $0.28 $0.42 开源旗舰:推理对标闭源第一梯队,价格零头。
6 Qwen3-Max
qwen3-max
Alibaba 256K $0.6 $2.4 中文理解与生成第一梯队,开源生态完整。
7 Llama 4 Maverick
llama-4-maverick
Meta 1M $0.27 $0.85 完全开放权重,自托管场景的默认选择。
8 Mistral Large 3
mistral-large-3
Mistral AI 128K $0.5 $1.5 欧洲合规友好,多语言均衡,轻量高效。
9 Grok 4
grok-4
xAI 256K $3 $15 实时信息接入 X 平台,时效性问题有优势。

Prices in USD per 1M tokens (OpenRouter list price). Data: seed cache; live refresh via /api/refresh.