综合榜
数据更新于 2026-09-01
(每月滚动复核,非实时拉取)
厂商
参考价 = 公开定价(输入 / 输出,每 1M tokens),编辑整理、以官方为准;视频模型按生成计费未列入。
🥇
#1
Claude Fable 5
Anthropic
1507分
$15 / $75
🥈
#2
Claude Opus 4.7
Anthropic
1502分
$15 / $75
| 排名 | 模型 | 评分 | 参考价 | 上下文 | 特性 | 亮点 |
|---|---|---|---|---|---|---|
| 1 | Claude Fable 5 Anthropic |
1507 | $15 / $75 | 1M | 对话推理多模态 | 综合体验与长上下文领先 |
| 2 | Claude Opus 4.7 Anthropic |
1502 | $15 / $75 | 1M | 推理Agent | Agent 与复杂推理标杆 |
| 3 | 月之暗面 |
1489 | ¥1 / ¥4 | 200万 | 长文本推理 | 超长上下文,开源权重可选 |
| 4 | Gemini 3.1 Pro Google |
1487 | $1.25 / $10 | 1M | 多模态长上下文 | 原生多模态与超长上下文 |
| 5 | GPT-5.5 OpenAI |
1482 | $10 / $30 | 1.1M | 通用编码 | 复杂推理与编码强劲 |
| 6 | 智谱 AI |
1484 | ¥1 / ¥5 | 1M | 推理开源 | 国产推理强项,开源友好 |
| 7 | 阿里巴巴 |
1478 | ¥3.6 / ¥12 | 1M | 中文开源 | 中文理解顶级,生态完善 |
| 8 | 百度 |
1476 | ¥0.8 / ¥3.2 | 256K | 中文全模态 | 中文第一梯队,原生全模态 |
| 9 | Grok 4.2 xAI |
1480 | $5 / $25 | 1M | 实时多智能体 | 实时信息与多智能体协作 |
| 10 | DeepSeek |
1467 | $0.55 / $2.19 | 128K | 推理开源性价比 | 开源旗舰,价格仅闭源零头 |
| 11 | 腾讯 |
1450 | ¥0.8 / ¥2 | 256K | 中文多模态 | 中文与多模态均衡 |
| 12 | MiniMax M2.7 MiniMax |
1455 | ¥1 / ¥4 | 1M | 性价比长程 | 低成本长程任务高分 |
数据说明:综合 LMArena 文本/编程/视觉竞技场、Artificial Analysis 智能指数、OpenCompass 司南及厂商官方公布的基准,由编辑交叉整理。评分为相对指数,仅供选型参考,非实时拉取,实际以各官方榜单为准。