Leaderboard / openai/gpt-5.5-pro
gpt-5.5-pro
openai · Tasks passed 61.6% · Finance Index 43.9
Tasks passed
61.6%
Overall accuracy
60.3%
Finance Index
43.9
Consistency
1.8/3 avg
Est. eval cost
$101.61
Median latency
14.3s
Median output speed
1 tok/s
- Harness version
- 0.2.0
- Task set
- v2
- Runs per task
- 3
- Evaluated
- 7/15/2026, 10:54:29 PM
- Run ID
- df2aac0f-301f-4f13-a54b-d3510f535ea0
- Results file
- Download JSON
Pass@1 by Difficulty
Easy
—
Medium
—
Hard
—
Scores by domain
Tasks passed (%) · top 1 models
Quant
Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.