Skip to content
DOGPAY NEWS LEADERBOARD

AI 模型排行榜

从写代码到改仓库,看模型能不能把软件做出来。

3 项评测·3 家机构·10/01 14:05 更新

编程榜TOP 30

按多项公开评测的共同证据排名
可按列重排的前 30 名模型
模型
01Claude Fable 5.1Anthropic证据敏感 · 2 项评测官方 $10 / $50DogRouter $5 / $2592.2
02Claude Opus 5Anthropic较充分 · 3 项评测官方 $5 / $25DogRouter $2.5 / $12.590.1
03GPT-6 AstraOpenAI证据敏感 · 3 项评测官方 $10 / $50DogRouter $5 / $2587.8
04Claude Fable 5Anthropic证据敏感 · 3 项评测官方 $10 / $50DogRouter $5 / $2587.5
05DeepSeek V4.1 FlashDeepSeek证据敏感 · 2 项评测官方 $0.3 / $1.2DogRouter $0.3 / $1.287.1
06GPT-5.6 SolOpenAI证据敏感 · 3 项评测官方 $4 / $20DogRouter $2.8 / $1486.7
07Gemini 3.8 FlashGoogle证据敏感 · 3 项评测官方 $0.75 / $3.7586.6
08GLM-5.3Z.ai较充分 · 3 项评测官方 $1.4 / $4.4DogRouter $1.4 / $4.482.3
09GPT-5.6 TerraOpenAI证据敏感 · 3 项评测官方 $2 / $12DogRouter $1 / $677.1
10Kimi K3Moonshot AI证据敏感 · 3 项评测官方 $2.98 / $14.92DogRouter $2.85 / $14.2576.8
11Gemini 3.7 FlashGoogle证据敏感 · 2 项评测官方 $0.75 / $3.7570.4
12GPT-5.5OpenAI证据敏感 · 2 项评测官方 $5 / $30DogRouter $2.5 / $1570.0
13Grok 4.6xAI证据敏感 · 3 项评测官方 $2 / $6DogRouter $1.8 / $5.467.8
14GLM-5.3 FlashZ.ai证据敏感 · 3 项评测官方 $0.119 / $0.418DogRouter $0.15 / $0.563.2
15Claude Opus 4.8Anthropic证据敏感 · 3 项评测官方 $5 / $25DogRouter $2.5 / $12.559.3
16Qwen3.8 MaxAlibaba证据敏感 · 3 项评测官方 $1.79 / $5.3759.2
17GPT-5.6 LunaOpenAI证据敏感 · 3 项评测官方 $0.2 / $1.2DogRouter $0.1 / $0.658.5
18Claude Sonnet 5Anthropic证据敏感 · 3 项评测官方 $2 / $10DogRouter $1 / $555.8
19Qwen3.8 27 BAlibaba证据敏感 · 2 项评测官方 $0.447 / $1.7949.1
20Muse Spark 1.1Meta证据敏感 · 2 项评测官方 $1.25 / $4.2545.3
21Muse Spark 1.2Meta证据敏感 · 2 项评测官方 $1.25 / $4.2544.9
22DeepSeek V4 Pro 0813DeepSeek证据敏感 · 2 项评测官方 $1.34 / $4.0342.9
23DeepSeek V4 Pro PreviewDeepSeek证据敏感 · 2 项评测官方 $0.435 / $0.8742.7
24Grok 4.5xAI证据敏感 · 3 项评测官方 $2 / $6DogRouter $1.9 / $5.740.9
25GPT-5.4OpenAI证据敏感 · 2 项评测官方 $2.5 / $1539.8
26DeepSeek V4 Flash PreviewDeepSeek证据敏感 · 2 项评测官方 $0.14 / $0.2839.3
27Gemini 3.6 FlashGoogle证据敏感 · 2 项评测官方 $0.75 / $3.7537.5
28GLM-5.2Z.ai证据敏感 · 2 项评测官方 $1.19 / $4.18DogRouter $1.12 / $3.5236.5
29Gemini 3.5 FlashGoogle证据敏感 · 2 项评测官方 $1.5 / $927.7
30Claude Sonnet 4.6Anthropic证据敏感 · 2 项评测官方 $3 / $1520.3

每个榜单最多展示 30 个模型

共识指数不是正确率;同分仍按共同证据确定的名次展示。

如何看这张榜

综合多家公开评测,不同模型的参评覆盖不同。价格不参与排名,缺测不记零分,指数不是正确率。

了解计算方法 →

关于价格

API 价格默认以美元 / 百万 Token 展示。厂商官方价与 DogRouter 参考价分列;后者是 Dogpay 旗下服务的转发价,带核验日期与价格页链接,不参与排名,也不写成折扣。人民币牌价按 2026-09-30 汇率(欧洲央行)折算成美元。缓存价格指命中后的输入价格,缓存写入、存储及订阅费用另计。