← 返回模型列表

gemini-3-1-pro-previewgemini-3-1-pro-previewhigh

第 24 名
当前排名
12%±1%
能力得分
$2.14
平均运行成本
28k
平均输出量
76
平均执行步数
113
参与测试数量

测试详情

推理档位high

95% 置信区间10.2% - 13.2%

Pass@428.3%

尝试次数452

通过任务数53

至少通过一次的任务数32

平均输入量2404k

中位峰值上下文50k

中位运行成本$1.72

中位输出量26k

平均运行时长14 分钟

重复测试轮次4

任务集规模113

数据更新时间2026-08-13

数据生成时间2026-08-13