Leaderboard / openai/gpt-5.6-sol
gpt-5.6-sol
openai · Tasks passed 91.8% · Finance Index 93.3
Tasks passed
91.8%
Overall accuracy
89.0%
Finance Index
93.3
Consistency
2.7/3 avg
Est. eval cost
$1.08
Median latency
3.7s
Median output speed
5 tok/s
- Harness version
- 0.2.0
- Task set
- v2
- Runs per task
- 3
- Evaluated
- 7/15/2026, 9:25:03 PM
- Run ID
- af4dc55e-ce54-4eb6-9a79-35b8d412d394
- Results file
- Download JSON
Pass@1 by Difficulty
Easy
—
Medium
—
Hard
—
Scores by domain
Tasks passed (%) · top 1 models
Quant
Per-attempt drill-down requires a local result JSON in `results/`. Aggregate scores are shown from the published leaderboard.