Nemotron Nano 3 30B A3B is NVIDIA's language model with a 262K context window and up to 236K output tokens, available from 5 providers, starting at $0.05 / 1M input and $0.2 / 1M output. A 30B-parameter hybrid MoE Nemotron Nano 3 model with 3B active parameters, combining Mamba-Transformer architecture for efficient reasoning and agentic tasks.
Specifications
Canonical IDnvidia-nemotron-nano-3-30b-a3b
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Providers
Context Window262K tokens
Max Output236K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters30B
HuggingFace Likes767
HuggingFace Downloads (30d)1,129,029
HuggingFace Downloads (all-time)6,131,226
Release Date · 9 months ago
Deprecation Date
Benchmarks
Intelligence Index
#281
Coding Index
#167
Math Index
#28
MMLU-Pro
#138
GPQA
#206
HLE
#191
LiveCodeBench
#56
IFBench
#59
Time to First Token
#382
SciCode
#299
AIME 2025
#28
LCR
#259
TerminalBench Hard
#197
TAU2
#214
Output TPS
#14

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
DeepInfra logo
DeepInfra
deepinfra/nvidia/Nemotron-3-Nano-30B-A3B
$0.05$0.2$0.025
Nebius logo
Nebius
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B
$0.06$0.24N/A
Novita logo
Novita
novita/nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2N/A
OpenRouter logo
OpenRouter
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2$0.025
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.24N/A

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Nano 3 30B A3B, ranked by cheapest on-demand price. The model needs about 72 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hr
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hr
Standard_NC24ads_A100_v4AzureNVIDIA A10080 GB$3.67/hr
7 more instances can run Nemotron Nano 3 30B A3B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron Super 3 120B A12B1.0M$0.085$0.400Available
Nemotron Nano 3 30B A3B262K$0.050$0.200Current
Nemotron 3 Ultra262K$0.600$2.40Available
Nemotron Lightning 3.5 30B A3B262K$0.050$0.200Available
Nemotron Nano 2 9B131K$0.040$0.160Deprecated
Nemotron Nano 2 12B131K$0.200$0.200Available

Model IDs

accounts/fireworks/models/nemotron-nano-3-30b-a3b
deepinfra/nvidia/Nemotron-3-Nano-30B-A3B
nemotron-3-nano-30b-a3b
novita/nvidia/nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b-reasoning
nvidia-nemotron-nano-3-30b-a3b
nvidia/nemotron-3-nano-30b-a3b
nvidia/Nemotron-3-Nano-30B-A3B
nvidia/nemotron-3-nano-30b-a3b:free
nvidia/nvidia-nemotron-3-nano-30b-a3b-bf16