Skip to content
DOGPAY NEWS LEADERBOARD

AI 模型排行榜

金融分析、法律咨询与银行业务,看专业任务能否完成。

2 项评测·2 家机构·10/01 14:05 更新

专业办公榜TOP 30

按多项公开评测的共同证据排名
可按列重排的前 30 名模型
模型
01gemini-4-argonGoogle证据敏感 · 2 项评测官方 —99.9
02claude-sonnet-5.5anthropic证据敏感 · 2 项评测官方 —99.7
03Claude Opus 5.5Anthropic证据敏感 · 2 项评测官方 $4 / $20DogRouter $2 / $1099.7
04Claude Fable 5.1Anthropic证据敏感 · 2 项评测官方 $10 / $50DogRouter $5 / $2599.5
05Gemini 3.7 FlashGoogle证据敏感 · 2 项评测官方 $0.75 / $3.7599.2
06Claude Opus 5Anthropic证据敏感 · 2 项评测官方 $5 / $25DogRouter $2.5 / $12.598.5
07Grok 4.6xAI证据敏感 · 2 项评测官方 $2 / $6DogRouter $1.8 / $5.496.9
08GPT-6 AstraOpenAI证据敏感 · 2 项评测官方 $10 / $50DogRouter $5 / $2595.5
09Gemini 3.8 FlashGoogle证据敏感 · 2 项评测官方 $0.75 / $3.7595.1
10Claude Fable 5Anthropic证据敏感 · 2 项评测官方 $10 / $50DogRouter $5 / $2591.7
11Qwen3.8 MaxAlibaba证据敏感 · 2 项评测官方 $1.79 / $5.3787.4
12gpt-6.1-sol—证据敏感 · 2 项评测官方 —86.7
13Muse Spark 1.3Meta证据敏感 · 2 项评测官方 $1.25 / $4.2586.0
14GPT-5.6 TerraOpenAI证据敏感 · 2 项评测官方 $2 / $12DogRouter $1 / $681.3
15GLM-5.3Z.ai证据敏感 · 2 项评测官方 $1.4 / $4.4DogRouter $1.4 / $4.479.2
16Grok 4.5xAI证据敏感 · 2 项评测官方 $2 / $6DogRouter $1.9 / $5.773.7
17DeepSeek V4 Flash 0731DeepSeek证据敏感 · 2 项评测官方 $0.447 / $1.34DogRouter $0.396 / $1.1972.7
18GPT-5.5OpenAI证据敏感 · 2 项评测官方 $5 / $30DogRouter $2.5 / $1571.9
19Grok 4.7xAI证据敏感 · 2 项评测官方 $2 / $669.8
20Claude Sonnet 5Anthropic证据敏感 · 2 项评测官方 $2 / $10DogRouter $1 / $568.9
21GPT-6 SolOpenAI证据敏感 · 2 项评测官方 $2 / $10DogRouter $1 / $562.5
22GLM-5.3 FlashZ.ai证据敏感 · 2 项评测官方 $0.119 / $0.418DogRouter $0.15 / $0.561.6
23GPT-5.6 SolOpenAI证据敏感 · 2 项评测官方 $4 / $20DogRouter $2.8 / $1455.0
24Kimi K3Moonshot AI证据敏感 · 2 项评测官方 $2.98 / $14.92DogRouter $2.85 / $14.2552.3
25Claude Opus 4.7Anthropic证据敏感 · 2 项评测官方 $5 / $25DogRouter $3.5 / $17.545.6
26Claude Opus 4.8Anthropic证据敏感 · 2 项评测官方 $5 / $25DogRouter $2.5 / $12.544.7
27Qwen3.8 27 BAlibaba证据敏感 · 2 项评测官方 $0.447 / $1.7938.6
28DeepSeek V4 Pro 0813DeepSeek证据敏感 · 2 项评测官方 $1.34 / $4.0336.8
29Gemini 3.6 FlashGoogle证据敏感 · 2 项评测官方 $0.75 / $3.7536.0
30GLM-5.2Z.ai证据敏感 · 2 项评测官方 $1.19 / $4.18DogRouter $1.12 / $3.5230.5

每个榜单最多展示 30 个模型

共识指数不是正确率;同分仍按共同证据确定的名次展示。

如何看这张榜

当前覆盖金融分析、专业咨询与银行业务,尚不能代表所有文档、表格和演示文稿任务。价格不参与排名,缺测不记零分,指数不是正确率。

了解计算方法 →

关于价格

API 价格默认以美元 / 百万 Token 展示。厂商官方价与 DogRouter 参考价分列;后者是 Dogpay 旗下服务的转发价,带核验日期与价格页链接,不参与排名,也不写成折扣。人民币牌价按 2026-09-30 汇率(欧洲央行)折算成美元。缓存价格指命中后的输入价格,缓存写入、存储及订阅费用另计。