LLM 模型榜
哪个大模型值得用、多少钱?下表汇总主流模型的上下文窗口与每百万 tokens 输入/输出价格,配合模型相关热点,帮你按任务选性价比最优的模型。
| # | 模型 | 厂商 | 上下文 | 输入价 | 输出价 | 强项 |
|---|---|---|---|---|---|---|
| 1 | GPT-5 gpt-5 | OpenAI | 400K | $1.25 | $10 | 综合能力标杆,工具调用与复杂推理最稳。 |
| 2 | Claude Opus 4.5 claude-opus-4-5 | Anthropic | 200K | $5 | $25 | 长文写作与代码重构质量最高,Agent 任务稳定。 |
| 3 | Claude Sonnet 5 claude-sonnet-5 | Anthropic | 200K | $3 | $15 | 性价比主力:接近旗舰的质量,一半价格。 |
| 4 | Gemini 2.5 Pro gemini-2-5-pro | 1M | $1.25 | $10 | 百万级上下文 + 原生多模态,长文档首选。 | |
| 5 | DeepSeek-V3.2 deepseek-v3-2 | DeepSeek | 128K | $0.28 | $0.42 | 开源旗舰:推理对标闭源第一梯队,价格零头。 |
| 6 | Qwen3-Max qwen3-max | Alibaba | 256K | $0.6 | $2.4 | 中文理解与生成第一梯队,开源生态完整。 |
| 7 | Llama 4 Maverick llama-4-maverick | Meta | 1M | $0.27 | $0.85 | 完全开放权重,自托管场景的默认选择。 |
| 8 | Mistral Large 3 mistral-large-3 | Mistral AI | 128K | $0.5 | $1.5 | 欧洲合规友好,多语言均衡,轻量高效。 |
| 9 | Grok 4 grok-4 | xAI | 256K | $3 | $15 | 实时信息接入 X 平台,时效性问题有优势。 |
价格为美元/百万 tokens(OpenRouter 牌价)。当前展示种子缓存数据,可通过 /api/refresh 实时刷新。