Finance Benchmark

Leaderboard / openai/gpt-5.5

gpt-5.5

openai · Tasks passed 89.0% · Finance Index 91.1

Tasks passed

89.0%

Overall accuracy

84.5%

Finance Index

91.1

Consistency

2.5/3 avg

Est. eval cost

$0.95

Median latency

Median output speed

Harness version
0.1.0
Task set
v2
Runs per task
3
Evaluated
6/15/2026, 7:20:53 AM
Run ID
759d5928-03c0-4d2a-9f86-f8cfcadfa51b
Results file
Download JSON

Pass@1 by Difficulty

Easy

Medium

Hard

Scores by domain

Tasks passed (%) · top 1 models

Quant

Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.