Release Date: Jun 4, 2026

Developer NVIDIAΒ πŸ‡ΊπŸ‡Έ
Context Window 1M
Max Output Tokens 128k
Token Costs (in/out) N/A
Weights Open
Input Modalities

Accuracy

27.39 % Β± 0.95

Avg. Cost (In/Out)

N/A

Latency

32 min 28 s

Vals Index
BenchmarksAccuracyRankings

0.0%

Β±0.95
44/53

0.0%

Β±1.59
52/56

0.0%

Β±2.81
43/53

0.0%

Β±0.15
45/56

0.0%

Β±2.51
42/56

0.0%

Β±2.00
57/90

0.0%

Β±0.87
53/145

0.0%

Β±2.78
77/91

0.0%

Β±1.74
44/138

0.0%

Β±0.99
24/143

0.0%

Β±0.46
69/142

0.0%

Β±0.34
55/138

0.0%

Β±0.00
33/43

0.0%

Β±2.07
68/88

0.0%

Β±2.92
46/61
Proprietary BenchmarksAcademic BenchmarksIndustry Partners
Vals
Default Provider : Nvidia
Temperature: Default
Top P: 0.95
Top K: Default
Max Output Tokens: 128,000

Updates

Jun 4, 2026

The model is text-only, with a 1M-token context window and 128k max output tokens. We ran it via the NVIDIA API with top_p set to 0.95.