Finance Benchmark

Leaderboard / openai/gpt-5.6-sol

gpt-5.6-sol

openai · Tasks passed 91.8% · Finance Index 93.3

Tasks passed

91.8%

Overall accuracy

89.0%

Finance Index

93.3

Consistency

2.7/3 avg

Est. eval cost

$1.08

Median latency

3.7s

Median output speed

5 tok/s

Harness version
0.2.0
Task set
v2
Runs per task
3
Evaluated
7/15/2026, 9:25:03 PM
Run ID
af4dc55e-ce54-4eb6-9a79-35b8d412d394
Results file
Download JSON

Pass@1 by Difficulty

Easy

Medium

Hard

Scores by domain

Tasks passed (%) · top 1 models

Quant

Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.