Finance Benchmark

Leaderboard / openai/gpt-5.5-pro

gpt-5.5-pro

openai · Tasks passed 61.6% · Finance Index 43.9

Tasks passed

61.6%

Overall accuracy

60.3%

Finance Index

43.9

Consistency

1.8/3 avg

Est. eval cost

$101.61

Median latency

14.3s

Median output speed

1 tok/s

Harness version
0.2.0
Task set
v2
Runs per task
3
Evaluated
7/15/2026, 10:54:29 PM
Run ID
df2aac0f-301f-4f13-a54b-d3510f535ea0
Results file
Download JSON

Pass@1 by Difficulty

Easy

Medium

Hard

Scores by domain

Tasks passed (%) · top 1 models

Quant

Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.