Nemotron Nano 2 9B is NVIDIA's language model with a 131K context window and up to 8K output tokens, available from 4 providers, starting at $0.04 / 1M input and $0.16 / 1M output. A 9B-parameter hybrid LLM from NVIDIA's Nemotron Nano v2 series, trained from scratch as a unified model for both reasoning and non-reasoning workloads.
Specifications
Canonical IDnvidia-nemotron-nano-2-9b
TypeLanguage
StatusDeprecated
CreatorNVIDIANVIDIA
Providers
Context Window131K tokens
Max Output8K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters9B
Release Date · 11 months ago
Knowledge Cutoff · 1 year ago
Deprecation Date
Benchmarks
Intelligence Index
7.4
#362
Math Index
62.3
#106
MMLU-Pro
0.7
#179
GPQA
0.6
#310
HLE
0.0
#417
LiveCodeBench
0.7
#62
IFBench
0.3
#358
Time to First Token
1.72s
#431
SciCode
0.2
#356
AIME 2025
0.6
#106
LCR
0.2
#256
TerminalBench Hard
0.0
#342
TAU2
0.2
#283
Output TPS
94.1
#133

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities4/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardBatchFlexPriority
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Amazon Bedrock logo
Amazon Bedrock
nvidia.nemotron-nano-9b-v2
$0.06$0.23$0.03$0.12$0.03$0.12$0.11$0.4
DeepInfra logo
DeepInfra
deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2
$0.04$0.16
Fireworks AI logo
Fireworks AI
fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
$0.2$0.2
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-nano-9b-v2
$0.06$0.23

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Nano 2 9B, ranked by cheapest on-demand price. The model needs about 22 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
g2-standard-4GCPnvidia-l424 GB$0.705/hrus-east4
g6.xlargeAWSL422 GB$0.805/hrus-east-1
g2-standard-8GCPnvidia-l424 GB$0.851/hrus-east4
7 more instances can run Nemotron Nano 2 9B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron Super 3 120B A12B1.0M$0.080$0.450Available
Nemotron Nano 3 30B A3B262K$0.050$0.200Available
Nemotron 3 Ultra$0.600$2.40Available
Nemotron Nano 2 12B131K$0.200$0.200Available
Nemotron Nano 2 9B131K$0.040$0.160Current

Model IDs

accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2
fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
nvidia-nemotron-nano-2-9b
nvidia-nemotron-nano-9b-v2
nvidia-nemotron-nano-9b-v2-reasoning
nvidia.nemotron-nano-9b-v2
nvidia/nemotron-nano-9b-v2
nvidia/nemotron-nano-9b-v2:free
nvidia/NVIDIA-Nemotron-Nano-9B-v2