Nemotron Nano 3 30B A3B is NVIDIA's language model with a 262K context window and up to 236K output tokens, available from 5 providers, starting at $0.05 / 1M input and $0.2 / 1M output. A 30B-parameter hybrid MoE Nemotron Nano 3 model with 3B active parameters, combining Mamba-Transformer architecture for efficient reasoning and agentic tasks.
Specifications
Canonical IDnvidia-nemotron-nano-3-30b-a3b
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Providers
Context Window262K tokens
Max Output236K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters30B
HuggingFace Likes767
HuggingFace Downloads (30d)1,129,029
HuggingFace Downloads (all-time)6,131,226
Release Date · 10 months ago
Deprecation Date
Benchmarks
Intelligence Index
#340
Coding Index
#174
Math Index
#28
MMLU-Pro
#138
GPQA
#214
HLE
#207
LiveCodeBench
#56
IFBench
#58
Time to First Token
#379
SciCode
#308
AIME 2025
#28
LCR
#280
TerminalBench Hard
#198
TAU2
#215
Output TPS
#14

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs✓
Native JSON Schema✓
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching✓
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
DeepInfra logo
DeepInfra
deepinfra/nvidia/Nemotron-3-Nano-30B-A3B
$0.05$0.2$0.025
Nebius logo
Nebius
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B
$0.06$0.24N/A
Novita logo
Novita
novita/nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2N/A
OpenRouter logo
OpenRouter
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2$0.03
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2$0.025

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Nano 3 30B A3B, ranked by cheapest on-demand price. The model needs about 72 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hr
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hr
Standard_NC24ads_A100_v4AzureNVIDIA A10080 GB$3.67/hr
7 more instances can run Nemotron Nano 3 30B A3B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron Super 3 120B A12B1.0M$0.080$0.400Available
Nemotron Nano 3 30B A3B262K$0.050$0.200Current
Nemotron 3 Ultra—262K$0.600$2.40Available
Nemotron Lightning 3.5 30B A3B—262K$0.050$0.200Available
Nemotron Nano 2 9B131K$0.040$0.160Deprecated
Nemotron Nano 2 12B131K$0.200$0.200Available

Model IDs

accounts/fireworks/models/nemotron-nano-3-30b-a3b
deepinfra/nvidia/Nemotron-3-Nano-30B-A3B
nebius/nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B
nemotron-3-nano-30b-a3b
novita/nvidia/nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b-reasoning
nvidia-nemotron-nano-3-30b-a3b
nvidia/nemotron-3-nano-30b-a3b
nvidia/Nemotron-3-Nano-30B-A3B
nvidia/nemotron-3-nano-30b-a3b:free
nvidia/nvidia-nemotron-3-nano-30b-a3b-bf16
openrouter/nvidia/nemotron-3-nano-30b-a3b