Release Date: Nov 13, 2025

Developer OpenAIΒ πŸ‡ΊπŸ‡Έ
Context Window 400k
Max Output Tokens 128k
Token Costs (in/out) $1.25/10.00
Weights Private
Input Modalities

Accuracy

68.31 %

Avg. Cost (In/Out)

$ 1.25 / $ 10.00

Latency

4 min 58 s

Vals Index
BenchmarksAccuracyRankings

0.0%

Β±2.15
11/92

0.0%

Β±1.94
8/94

0.0%

Β±0.93
61/98

0.0%

Β±3.16
43/81

0.0%

Β±0.85
27/145

0.0%

Β±4.25
58/95

0.0%

Β±1.71
41/138

0.0%

Β±0.98
22/143

0.0%

Β±0.40
17/144

0.0%

Β±0.34
42/138

0.0%

Β±0.90
33/93

0.0%

Β±2.06
65/88

0.0%

Β±5.30
25/67
Proprietary BenchmarksAcademic BenchmarksIndustry Partners
Vals
Default Provider : OpenAI
Temperature: Default
Top P: Default
Top K: Default
Max Output Tokens: 128,000
Reasoning Effort: high

Updates

Nov 14, 2025

We just evaluated GPT 5.1 on all benchmarks. Our findings are below: