提交工具

编码榜

数据更新于 2026-09-01 (每月滚动复核,非实时拉取)
厂商

参考价 = 公开定价(输入 / 输出,每 1M tokens),编辑整理、以官方为准;视频模型按生成计费未列入。

评分口径:SWE-bench Verified 通过率 真实 GitHub 问题自主修复通过率,衡量工程编码能力
🥇
#1
Claude Opus 4.7
Anthropic
87.6
$15 / $75
🥈
#2
GPT-5.4 Codex
OpenAI
85
$20 / $80
🥉
#3
DeepSeek V4 Pro
DeepSeek
80.6
$0.55 / $2.19
排名 模型 评分 参考价 上下文 特性 亮点
1
Claude Opus 4.7
Anthropic
87.6 $15 / $75 1M Agent重构 跨文件理解与重构领先
2
GPT-5.4 Codex
OpenAI
85 $20 / $80 1.1M 自主修复 自主修复 PR 能力强
3
DeepSeek
80.6 $0.55 / $2.19 128K 开源低成本 开源中编码第一梯队
4
Gemini 3.1 Pro
Google
78.8 $1.25 / $10 1M 多语言 多语言工程均衡
5
智谱 AI
77.8 ¥1 / ¥5 1M 推理 推理赋能编码
6
月之暗面
78 ¥1 / ¥4 200万 长上下文 超长上下文利于大库理解
7
阿里巴巴
76.4 ¥3.6 / ¥12 1M 开源 开源编码生态完善
8
百度
72 ¥0.8 / ¥3.2 256K 中文 中文业务代码友好
9
腾讯
70 ¥0.8 / ¥2 256K 工程 工程实践适配
10
阿里巴巴
68 订阅制 IDE IDE 集成 IDE 内编码助手

数据说明:综合 LMArena 文本/编程/视觉竞技场、Artificial Analysis 智能指数、OpenCompass 司南及厂商官方公布的基准,由编辑交叉整理。评分为相对指数,仅供选型参考,非实时拉取,实际以各官方榜单为准。