模型对标

可从模型库、排行榜、评测页或模型详情页加入对标

数据快照:2026-08-20(基于公开数据) 当前页:2026-08-20

04

模型效果

在权威榜单与典型任务上的表现,结果均保留来源原始得分。

数据来源:公开评测与厂商官方数据完整度:10/18
Artificial Analysis Intelligence Index
60.7
55.9
50.2
44.3
GDPval-AA v2%
68.1%
56.3%
42.2%
40.3%
τ³-Banking%
30.3%
30.6%
25.4%
25.8%
Terminal-Bench v2.1%
89.1%
87.3%
78.7%
64.0%
SciCode%
55.7%
56.9%
53.1%
50.0%
AA-LCR%
70.0%
68.3%
69.3%
66.3%
AA-Omniscience
31.3
19.8
22.7
-10.0
Humanity's Last Exam%
52.6%
44.1%
41.0%
35.9%
GPQA Diamond%
93.2%
92.8%
92.2%
88.8%
CritPt%
29.1%
25.7%
13.1%
12.9%
Agent 能力指数
暂无公开数据
48.5
37.4
36.4
编码能力指数
暂无公开数据
77.2
70.1
59.4
金融与会计
暂无公开数据
47.6
43.4
36.8
战略与运营
暂无公开数据
47.7
41.4
38.1
法律
暂无公开数据
48.9
49.3
36.9
医疗
暂无公开数据
42.9
39.0
33.1
工程
暂无公开数据
56.8
51.5
45.8
经济学
暂无公开数据
52.5
52.3
42.7
说明:得分均为来源方原始得分,不做跨榜单标准化或综合排名。已选 4 个模型;继续添加后会自动横向滚动。