Leaderboard / openai/gpt-5.5
gpt-5.5
openai · Tasks passed 89.0% · Finance Index 91.1
Tasks passed
89.0%
Overall accuracy
84.5%
Finance Index
91.1
Consistency
2.5/3 avg
Est. eval cost
$0.95
Median latency
—
Median output speed
—
- Harness version
- 0.1.0
- Task set
- v2
- Runs per task
- 3
- Evaluated
- 6/15/2026, 7:20:53 AM
- Run ID
- 759d5928-03c0-4d2a-9f86-f8cfcadfa51b
- Results file
- Download JSON
Pass@1 by Difficulty
Easy
—
Medium
—
Hard
—
Scores by domain
Tasks passed (%) · top 1 models
Quant
Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.