Release Date: Nov 13, 2025

Developer OpenAIΒ πŸ‡ΊπŸ‡Έ
Context Window 400k
Max Output Tokens 128k
Token Costs (in/out) $1.25/10.00
Weights Private
Input Modalities

Accuracy

64.96 %

Avg. Cost (In/Out)

$ 1.25 / $ 10.00

Latency

6 min 42 s

Vals Index
BenchmarksAccuracyRankings

0.0%

Β±2.15
10/86

0.0%

Β±1.94
5/87

0.0%

Β±0.93
59/96

0.0%

Β±3.16
40/77

0.0%

Β±0.85
25/141

0.0%

Β±4.25
50/86

0.0%

Β±1.71
39/135

0.0%

Β±7.34
21/62

0.0%

Β±0.98
20/140

0.0%

Β±0.40
15/139

0.0%

Β±0.34
40/135

0.0%

Β±0.90
30/90

0.0%

Β±2.06
63/86
Proprietary BenchmarksAcademic BenchmarksIndustry Partners
Vals
Default Provider : OpenAI
Temperature: Default
Top P: Default
Top K: Default
Max Output Tokens: 128,000
Reasoning Effort: high

Updates

Nov 14, 2025

We just evaluated GPT 5.1 on all benchmarks. Our findings are below: