o3

Release date

Models

Release Date: 4/16/2025

Accuracy (Average)

71.23%

Latency (Average)

33.47s

Avg. Cost (In/Out)

2 / 8

Context Window

200k

Max Output Tokens

100k

Input Modality

Hyperparameter settings

Default Provider : OpenAI

Temperature

Default

Top P

Default

Top K

Default

Max Output Tokens

100,000

Reasoning Effort

high

Benchmarks

Accuracy

Rankings

0.0%

± 0.96

54/ 110

0.0%

± 2.16

17/ 62

0.0%

± 1.87

34/ 61

0.0%

± 0.93

28/ 78

0.0%

± 3.31

30/ 59

0.0%

± 0.85

18/ 116

0.0%

± 1.86

31/ 110

0.0%

± 1.03

27/ 115

0.0%

± 0.42

26/ 113

0.0%

± 0.34

33/ 109

0.0%

± 0.95

27/ 74

Contact us

Proprietary Benchmarks (contact us to get access)

Academic Benchmarks

Read about our methodology.