| # | 模型 | 智能指数 | 性价比分 |
|---|
性价比分 = 智能指数 ÷ 单任务成本(美元)。用未四舍五入的成本计算,例如 50.1 ÷ 0.0328 ≈ 1527。页面显示的成本会做取舍。
取 Artificial Analysis 智能指数,综合编程、智能体、通用能力与科学推理等测试。版本见页尾备注;评测项目与权重会调整,不同版本的分数不能直接比较。
采用 AA 提供的每任务加权平均成本,按各项评测的任务成本与权重汇总。输入、输出、推理和缓存费用按其统计口径计入;不代表每一种实际工作都花同样的钱。
入围门槛由本榜设定,随数据标注。它是筛选条件,不保证所有任务都能完成;评分体系更新后需重新审视门槛。
同一模型的不同推理力度(low / high / max…)视为不同商品,在够到门槛的档位里取性价比最高的一档上榜,档位名标注在模型名旁。