性价比榜单

由AA Intelligence、ECI、LMArena 三方权威榜单数据,从综合能力、行情价、混合价多维度对比测算,各模型价值对比以 claude-fable-5 为基准参照模型,性价比分越高模型成本效益越优

划算区(绿色区域)域内为高性价比模型,推荐试用;散点越靠近图表左上方↖,价格越低、综合能力越高,性价比越高
全部能力
图像能力
函数调用
思考能力
全部品牌
OpenAI
排行模型性价比综合能力 行情价 混合价 立即体验
暂无数据
性价比(CP)计算方法展开更多

性价比(CP)计算方法

性价比统计选取主流热门语言大模型为样本,结合 AA Intelligence、ECI、LM Arena 三大权威榜单数据源,由综合能力、输入输出加权混合价、LOWESS 拟合行情价多维度对比测算,所有模型以 deepseek-r1 作为标准化参照基准

1综合能力

综合能力分由 AA Intelligence(40%)、ECI 归一分数(30%)、LM Arena 归一分数(30%)加权算出,多权威榜单交叉校验,综合能力分越高模型越强

公式:

2行情价

基于全池样本(I,P)执行 LOWESS 局部加权回归拟合 (参数 frac=0.8, it=2 ),经 指数还原生成基准行情线;当模型综合能力为 I 时,由全池模型拟合得出的理论公允市场参考价格,该参考价格定义为行情价R(I)

公式:

3混合价

混合价由 输入价格(75%)、输出价格(25%)折算,便于对比各模型的综合定价

公式:

公式:
deepseek-r1基准
60
80
综合能力
¥42
行情价
¥35
混合价
CP=( 6 / 5 ) / ( 6 / 5 ) × 60=60
Claude Opus 4.8示例
83.33
90
综合能力
¥35
行情价
¥21
混合价
CP=( 5 / 3 ) / ( 6 / 5 ) × 60=83.33
性价比>60,模型性价比高;性价比= 60,基准线左侧区域模型性价比更划算

基准模型

选定基准模型为 deepseek-r1 ,设定其性价比分值为 60;作为对比锚点,用于与其他模型开展横向对比分析

参数定义:Io为基准模型 deepseek-r1 综合能力分;Po为基准模型 deepseek-r1 混合价

基准行情线(绿色虚线)

基于全池样本(I,P)执行 LOWESS 局部加权回归拟合(参数 frac=0.8, it=2 ),经 指数还原生成平滑曲线;该曲线即为基准行情线,代表不同综合能力水平对应的市场基准定价

划算区(绿色区域)

基准行情线左侧覆盖区域为划算区。当模型散点处于划算区内,表示同等综合能力条件下,该模型实际混合售价低于行情价(R(I)),性价比更高

归一化

线性归一化是将原始指标数值按比例线性映射至标准区间的数据预处理方式。本次对 ECI、LM Arena 原始得分执行线性归一化,各指标原始取值区间:LM Arena:[800, 1800],ECI:[45, 200]

公式:

综合能力榜

由 AA Intelligence(40%)、ECI 归一分数(30%)、LM Arena 归一分数(30%)加权算出,多权威榜单交叉校验,综合能力分越高模型越强

支持品牌厂商筛选,可直观对比同品牌各模型差异,如 Claude、GPT 系列内部机型横向选型

全部品牌
OpenAI
排行模型综合能力 混合价 立即体验
claude-fable-5
67.62
推荐
0 / 1M tokens立即体验
claude-opus-4-8基准
64.78
推荐
0 / 1M tokens立即体验
kimi-k3
64.78
推荐
0 / 1M tokens立即体验
4
grok-4.5
62.61
0 / 1M tokens立即体验
5
claude-sonnet-5
61.98
0 / 1M tokens立即体验
6
gemini-3.5-flash
61.45
0 / 1M tokens立即体验
7
gemini-3.1-pro-preview
60.25
0 / 1M tokens立即体验
8
claude-sonnet-4-6
59.91
0 / 1M tokens立即体验
9
qwen3.7-max
59.58
0 / 1M tokens立即体验
10
gpt-5.4
57.1
0 / 1M tokens立即体验
11
MiniMax-M3
56.78
0 / 1M tokens立即体验
12
qwen3.6-plus
55.47
0 / 1M tokens立即体验
13
gemini-3-pro-preview
54.73
¥5.95 / 1M tokens立即体验
14
glm-5.1
54.5
0 / 1M tokens立即体验
15
kimi-k2.6
54.34
0 / 1M tokens立即体验
16
glm-5.2
54.27
0 / 1M tokens立即体验
17
grok-4.3
53.78
0 / 1M tokens立即体验
18
MiniMax-M2.7
53.19
0 / 1M tokens立即体验
19
deepseek-v4-pro
52.16
0 / 1M tokens立即体验
20
glm-5
52.13
0 / 1M tokens立即体验
21
qwen3.5-397b-a17b
51.8
0 / 1M tokens立即体验
22
gemini-3-flash-preview
51.44
0 / 1M tokens立即体验
23
kimi-k2.5
51.08
¥8.2425 / 1M tokens立即体验
24
MiniMax-M2.5
51.08
0 / 1M tokens立即体验
25
gpt-5.2
50.47
0 / 1M tokens立即体验
26
gemini-2.5-pro
49.33
0 / 1M tokens立即体验
27
deepseek-v3.2
48.41
0 / 1M tokens立即体验
28
mistral-medium-latest
48.31
0 / 1M tokens立即体验
29
o4-mini
47.75
0 / 1M tokens立即体验
30
gpt-5.1
47.43
0 / 1M tokens立即体验
31
gpt-5.4-mini
46.38
0 / 1M tokens立即体验
32
o1
46.17
0 / 1M tokens立即体验
33
deepseek-r1
44.27
0 / 1M tokens立即体验
34
grok-3
43.74
0 / 1M tokens立即体验
35
mistral-large-latest
39.57
0 / 1M tokens立即体验
36
llama-4-maverick
38.45
0 / 1M tokens立即体验
37
mistral-small-latest
37.11
0 / 1M tokens立即体验
38
llama-4-scout
36.24
0 / 1M tokens立即体验
39
gpt-5.6-sol
19.56
0 / 1M tokens立即体验
40
claude-haiku-4-5-20251001
0.4
¥92.75 / 1M tokens立即体验

响应速度榜

以首字延迟(TTFT)作为统一衡量标准,数值越低代表模型响应速度越快

实时对话、流式、高频调用场景中更看重响应速度,低延迟模型体验优于高分慢速模型

排行模型首字延迟 混合价 立即体验
暂无数据

代码能力榜

由 ECI Software Engineering归一分数(60%)、LM Arena Coding 归一分数(40%)加权算出,多权威榜单交叉校验,代码能力分越高模型越强,写代码、修 Bug、Vibe Coding 首选

DeepSeek R1 兼顾推理与代码能力,高性价比;Claude 系列代码最工整规范

排行模型代码能力 混合价 立即体验
claude-opus-4-7
73.81
0 / 1M tokens立即体验
glm-5.2
73.01
0 / 1M tokens立即体验
claude-sonnet-5
72.74
0 / 1M tokens立即体验
4
claude-sonnet-4-6
71.86
0 / 1M tokens立即体验
5
glm-5.1
69.37
0 / 1M tokens立即体验
6
kimi-k2.6
69.24
0 / 1M tokens立即体验
7
gemini-3.5-flash
68.9
0 / 1M tokens立即体验
8
MiniMax-M3
67.73
0 / 1M tokens立即体验
9
gemini-3.1-pro-preview
67.61
0 / 1M tokens立即体验
10
gemini-3-pro-preview
67.52
¥5.95 / 1M tokens立即体验
11
gemini-3-flash-preview
66.89
0 / 1M tokens立即体验
12
gpt-5.4
66.38
0 / 1M tokens立即体验
13
gpt-5.2
66.09
0 / 1M tokens立即体验
14
deepseek-v4-pro
65.51
0 / 1M tokens立即体验
15
glm-5
65.27
0 / 1M tokens立即体验
16
kimi-k2.5
64.56
¥8.2425 / 1M tokens立即体验
17
MiniMax-M2.7
62.89
0 / 1M tokens立即体验
18
MiniMax-M2.5
62.68
0 / 1M tokens立即体验
19
gpt-5.1
61.63
0 / 1M tokens立即体验
20
deepseek-v3.2
60.3
0 / 1M tokens立即体验
21
gemini-2.5-pro
55.12
0 / 1M tokens立即体验
22
qwen3.7-max
40.69
0 / 1M tokens立即体验
23
o4-mini
38.75
0 / 1M tokens立即体验
24
o1
37.49
0 / 1M tokens立即体验
25
deepseek-r1
36.85
0 / 1M tokens立即体验
26
grok-3
36.61
0 / 1M tokens立即体验
27
kimi-k3
35.12
0 / 1M tokens立即体验
28
llama-4-maverick
32.79
0 / 1M tokens立即体验
29
gpt-5.6-sol
30.39
0 / 1M tokens立即体验
30
grok-4.5
30.28
0 / 1M tokens立即体验
31
qwen3.6-plus
26.32
0 / 1M tokens立即体验
32
gpt-5.4-mini
23.87
0 / 1M tokens立即体验
33
qwen3.5-397b-a17b
23.83
0 / 1M tokens立即体验
34
grok-4.3
22.41
0 / 1M tokens立即体验
35
mistral-medium-latest
18.67
0 / 1M tokens立即体验
36
mistral-large-latest
16.94
0 / 1M tokens立即体验

多模态能力榜

由LM Arena Vision归一分数(60%)、 AA Multimodal(40%)加权算出,多权威榜单交叉校验,多模态得分越高,图像识别、图文理解、视觉问答表现越好

支持截图识别、图表解析、扫描件读取,上传图片直接提问,无需文字描述内容

排行模型多模态能力 混合价 立即体验
claude-fable-5基准
55.05
推荐
0 / 1M tokens立即体验
claude-opus-4-7
51.96
0 / 1M tokens立即体验
claude-opus-4-8
51.55
0 / 1M tokens立即体验
4
claude-sonnet-5
49.54
0 / 1M tokens立即体验
5
gemini-3.5-flash
49.22
0 / 1M tokens立即体验
6
claude-sonnet-4-6
47.27
0 / 1M tokens立即体验
7
gemini-3.1-pro-preview
47.04
0 / 1M tokens立即体验
8
gpt-5.4
44.29
0 / 1M tokens立即体验
9
MiniMax-M3
43.98
0 / 1M tokens立即体验
10
gemini-3-pro-preview
42.55
¥5.95 / 1M tokens立即体验
11
kimi-k2.6
41.9
0 / 1M tokens立即体验
12
grok-4.3
41.14
0 / 1M tokens立即体验
13
qwen3.5-397b-a17b
39.79
0 / 1M tokens立即体验
14
gemini-3-flash-preview
38.97
0 / 1M tokens立即体验
15
kimi-k2.5
38.51
¥8.2425 / 1M tokens立即体验
16
gemini-2.5-pro
37.12
0 / 1M tokens立即体验
17
gpt-5.2
36.16
0 / 1M tokens立即体验
18
mistral-medium-latest
35.94
0 / 1M tokens立即体验
19
o4-mini
34.47
0 / 1M tokens立即体验
20
gpt-5.1
34.26
0 / 1M tokens立即体验
21
gpt-5.4-mini
34.05
0 / 1M tokens立即体验
22
o1
32.77
0 / 1M tokens立即体验
23
mistral-large-latest
31.01
0 / 1M tokens立即体验
24
llama-4-maverick
26.38
0 / 1M tokens立即体验
25
mistral-small-latest
25.68
0 / 1M tokens立即体验
26
llama-4-scout
23.67
0 / 1M tokens立即体验
27
kimi-k3
22.8
0 / 1M tokens立即体验
28
grok-4.5
21.6
0 / 1M tokens立即体验
29
qwen3.7-max
18.4
0 / 1M tokens立即体验
30
qwen3.6-plus
16
0 / 1M tokens立即体验
31
MiniMax-M2.7
15.2
0 / 1M tokens立即体验
32
glm-5.1
14
0 / 1M tokens立即体验
33
glm-5.2
13.6
0 / 1M tokens立即体验
34
MiniMax-M2.5
13.6
0 / 1M tokens立即体验
35
glm-5
12.8
0 / 1M tokens立即体验
36
deepseek-v4-pro
12.4
0 / 1M tokens立即体验
37
deepseek-v3.2
10
0 / 1M tokens立即体验
38
deepseek-r1
8
0 / 1M tokens立即体验
39
grok-3
7.2
0 / 1M tokens立即体验
40
gpt-5.6-sol
4.4
0 / 1M tokens立即体验
41
claude-haiku-4-5-20251001
0.4
¥92.75 / 1M tokens立即体验

视觉能力榜

以302.AI基准实验室实测作为统一衡量标准,排名越靠前,图像、视频处理综合能力越强

图像排行榜
claude-fable-5

价格: 免费
gpt-5.5

价格: 免费
gpt-5.6-sol

价格: 免费
音视频排行榜
gpt-5.6-sol

价格: 免费
claude-fable-5

价格: 免费
gpt-5.5

价格: 免费
4
gpt-4o

价格: ¥0.21 / 次