302.AI 模型排行榜
快速测算成本,筛选高性价比模型,多模型能力对比,按需精准选型,一键试用
50+热门模型 | 17+品牌厂商 | 6+评测维度
更新时间:2026-08-08
性价比榜单
由AA Intelligence、ECI、LMArena 三方权威榜单数据,从综合能力、行情价、混合价多维度对比测算,各模型价值对比以 claude-fable-5 为基准参照模型,性价比分越高模型成本效益越优
性价比(CP)计算方法
性价比统计选取主流热门语言大模型为样本,结合 AA Intelligence、ECI、LM Arena 三大权威榜单数据源,由综合能力、输入输出加权混合价、LOWESS 拟合行情价多维度对比测算,所有模型以 deepseek-r1 作为标准化参照基准
综合能力分由 AA Intelligence(40%)、ECI 归一分数(30%)、LM Arena 归一分数(30%)加权算出,多权威榜单交叉校验,综合能力分越高模型越强
公式:
基于全池样本(I,P)执行 LOWESS 局部加权回归拟合 (参数 frac=0.8, it=2 ),经 指数还原生成基准行情线;当模型综合能力为 I 时,由全池模型拟合得出的理论公允市场参考价格,该参考价格定义为行情价R(I)
公式:
混合价由 输入价格(75%)、输出价格(25%)折算,便于对比各模型的综合定价
公式:
CP=( 6 / 5 ) / ( 6 / 5 ) × 60=60CP=( 5 / 3 ) / ( 6 / 5 ) × 60=83.33基准模型
选定基准模型为 deepseek-r1 ,设定其性价比分值为 60;作为对比锚点,用于与其他模型开展横向对比分析
参数定义:Io为基准模型 deepseek-r1 综合能力分;Po为基准模型 deepseek-r1 混合价
基准行情线(绿色虚线)
基于全池样本(I,P)执行 LOWESS 局部加权回归拟合(参数 frac=0.8, it=2 ),经 指数还原生成平滑曲线;该曲线即为基准行情线,代表不同综合能力水平对应的市场基准定价
划算区(绿色区域)
基准行情线左侧覆盖区域为划算区。当模型散点处于划算区内,表示同等综合能力条件下,该模型实际混合售价低于行情价(R(I)),性价比更高
归一化
线性归一化是将原始指标数值按比例线性映射至标准区间的数据预处理方式。本次对 ECI、LM Arena 原始得分执行线性归一化,各指标原始取值区间:LM Arena:[800, 1800],ECI:[45, 200]
公式:
综合能力榜
由 AA Intelligence(40%)、ECI 归一分数(30%)、LM Arena 归一分数(30%)加权算出,多权威榜单交叉校验,综合能力分越高模型越强
支持品牌厂商筛选,可直观对比同品牌各模型差异,如 Claude、GPT 系列内部机型横向选型
响应速度榜
以首字延迟(TTFT)作为统一衡量标准,数值越低代表模型响应速度越快
实时对话、流式、高频调用场景中更看重响应速度,低延迟模型体验优于高分慢速模型
代码能力榜
由 ECI Software Engineering归一分数(60%)、LM Arena Coding 归一分数(40%)加权算出,多权威榜单交叉校验,代码能力分越高模型越强,写代码、修 Bug、Vibe Coding 首选
DeepSeek R1 兼顾推理与代码能力,高性价比;Claude 系列代码最工整规范
多模态能力榜
由LM Arena Vision归一分数(60%)、 AA Multimodal(40%)加权算出,多权威榜单交叉校验,多模态得分越高,图像识别、图文理解、视觉问答表现越好
支持截图识别、图表解析、扫描件读取,上传图片直接提问,无需文字描述内容
