Models20in catalog
Largest context1MNemotron 3 Ultra

Avg context

281K

Cheapest input

$0.040/M

Nvidia Nemotron Nano 9b

Largest output

262K

Nemotron 3 Super (free)

Speed tiers

balanced 8fast 11deep 1

Capabilities

What Nvidia models support across the catalog.

Vision

5 / 20

25% of models

Tool use

16 / 20

80% of models

Function calling

16 / 20

80% of models

Extended thinking

15 / 20

75% of models

Streaming

20 / 20

100% of models

Prompt caching

3 / 20

15% of models

All Nvidia models

Sorted by context window, largest first. Tap a row for full specs.

ModelContext
Nemotron 3 Ultra1M
Nemotron 3 Ultra (free)1M
Nemotron 3 Ultra (batch)512K
Nemotron 3 Nano 30B A3B262K
Nemotron 3 Super262K
Nemotron 3 Super (free)262K
Nvidia Nemotron Nano 3 30b262K
Nemotron 3 120b A12b256K
Nemotron 3 Nano 30B A3B (free)256K
Nemotron 3 Nano Omni (free)256K
Nvidia Nemotron Super 3 120b256K
Llama 3.1 Nemotron 70B Instruct131K
Nemotron Nano 12B 2 VL131K
Nemotron Nano 9B V2131K
Nvidia Nemotron Nano 9b131K
Nemotron 3.5 Content Safety (free)128K
Nemotron Nano 12B 2 VL (free)128K
Nemotron Nano 9B V2 (free)128K
Nvidia Nemotron Nano 12b128K
Nemotron Nano V2 12b Vl4K

See rankings

How Nvidia models rank against the full catalog.