Nemotron Nano 2 9B is NVIDIA's language model with a 131K context window and up to 8K output tokens, available from 4 providers, starting at $0.04 / 1M input and $0.16 / 1M output. A 9B-parameter hybrid LLM from NVIDIA's Nemotron Nano v2 series, trained from scratch as a unified model for both reasoning and non-reasoning workloads.
Specifications
Canonical IDnvidia-nemotron-nano-2-9b
TypeLanguage
StatusDeprecated
CreatorNVIDIANVIDIA
Providers
Context Window131K tokens
Max Output8K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters9B
Release Date · 9 months ago
Knowledge Cutoff · 1 year ago
Deprecation Date
Benchmarks
Intelligence Index
#383
Math Index
#128
MMLU-Pro
#197
GPQA
#356
HLE
#373
LiveCodeBench
#66
IFBench
#376
Time to First Token
#428
SciCode
#393
AIME 2025
#128
LCR
#302
TerminalBench Hard
#346
TAU2
#304
Output TPS
#28

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities4/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardFlexFastBatch
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Amazon Bedrock logo
Amazon Bedrock
nvidia.nemotron-nano-9b-v2
$0.06$0.23$0.03$0.12$0.11$0.4$0.03$0.12
DeepInfra logo
DeepInfra
deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2
$0.04$0.16
Fireworks AI logo
Fireworks AI
fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
$0.2$0.2
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-nano-9b-v2
$0.06$0.23

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Nano 2 9B, ranked by cheapest on-demand price. The model needs about 22 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
g2-standard-4GCPnvidia-l424 GB$0.705/hr
g6.xlargeAWSL422 GB$0.805/hr
g2-standard-8GCPnvidia-l424 GB$0.851/hr
7 more instances can run Nemotron Nano 2 9B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron Super 3 120B A12B1.0M$0.085$0.400Available
Nemotron Nano 3 30B A3B262K$0.050$0.200Available
Nemotron 3 Ultra262K$0.600$2.40Available
Nemotron Lightning 3.5 30B A3B262K$0.050$0.200Available
Nemotron Nano 2 9B131K$0.040$0.160Current
Nemotron Nano 2 12B131K$0.200$0.200Available

Model IDs

accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
deepinfra/nvidia/NVIDIA-Nemotron-Nano-9B-v2
fireworks_ai/accounts/fireworks/models/nvidia-nemotron-nano-9b-v2
nvidia-nemotron-nano-2-9b
nvidia-nemotron-nano-9b-v2
nvidia-nemotron-nano-9b-v2-reasoning
nvidia.nemotron-nano-9b-v2
nvidia/nemotron-nano-9b-v2
nvidia/nemotron-nano-9b-v2:free
nvidia/NVIDIA-Nemotron-Nano-9B-v2