Accuracy (Vals Index)
67.95% ± 1.54
Latency (Vals Index)
681.75s
Cost/Test (Vals Index)
$4.60
Context Window
1M
Max Output Tokens
128k
Input Modality
Hyperparameter settings
Default Provider :
OpenAI
Some benchmarks may use different provider and parameters. Please refer to the benchmark page for more information.
Temperature
Default
Top P
Default
Top K
Default
Max Output Tokens
128,000
Reasoning Effort
xhigh