LLM leaderboard
Which model, at what price? Context windows and per-1M-token pricing for the major models, alongside model-related buzz — pick the best value for your task.
| # | Model | Provider | Context | Input | Output | Strengths |
|---|---|---|---|---|---|---|
| 1 | GPT-5 gpt-5 | OpenAI | 400K | $1.25 | $10 | 综合能力标杆,工具调用与复杂推理最稳。 |
| 2 | Claude Opus 4.5 claude-opus-4-5 | Anthropic | 200K | $5 | $25 | 长文写作与代码重构质量最高,Agent 任务稳定。 |
| 3 | Claude Sonnet 5 claude-sonnet-5 | Anthropic | 200K | $3 | $15 | 性价比主力:接近旗舰的质量,一半价格。 |
| 4 | Gemini 2.5 Pro gemini-2-5-pro | 1M | $1.25 | $10 | 百万级上下文 + 原生多模态,长文档首选。 | |
| 5 | DeepSeek-V3.2 deepseek-v3-2 | DeepSeek | 128K | $0.28 | $0.42 | 开源旗舰:推理对标闭源第一梯队,价格零头。 |
| 6 | Qwen3-Max qwen3-max | Alibaba | 256K | $0.6 | $2.4 | 中文理解与生成第一梯队,开源生态完整。 |
| 7 | Llama 4 Maverick llama-4-maverick | Meta | 1M | $0.27 | $0.85 | 完全开放权重,自托管场景的默认选择。 |
| 8 | Mistral Large 3 mistral-large-3 | Mistral AI | 128K | $0.5 | $1.5 | 欧洲合规友好,多语言均衡,轻量高效。 |
| 9 | Grok 4 grok-4 | xAI | 256K | $3 | $15 | 实时信息接入 X 平台,时效性问题有优势。 |
Prices in USD per 1M tokens (OpenRouter list price). Data: seed cache; live refresh via /api/refresh.