Nemotron Nano 3 30B A3B is NVIDIA's language model with a 262K context window and up to 228K output tokens, available from 3 providers, starting at $0.05 / 1M input and $0.2 / 1M output. A 30B-parameter hybrid MoE Nemotron Nano 3 model with 3B active parameters, combining Mamba-Transformer architecture for efficient reasoning and agentic tasks.
Specifications
Canonical IDnvidia-nemotron-nano-3-30b-a3b
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Providers
Context Window262K tokens
Max Output228K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters30B
HuggingFace Likes767
HuggingFace Downloads (30d)1,129,029
HuggingFace Downloads (all-time)6,131,226
Release Date · 7 months ago
Benchmarks
Intelligence Index
7.4
#363
Math Index
13.3
#218
MMLU-Pro
0.6
#253
GPQA
0.4
#391
HLE
0.0
#353
LiveCodeBench
0.4
#180
IFBench
0.4
#267
Time to First Token
0.53s
#285
SciCode
0.2
#336
AIME 2025
0.1
#218
LCR
0.1
#333
TerminalBench Hard
0.1
#189
TAU2
0.3
#269
Output TPS
112.9
#101

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities4/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Nebius logo
Nebius
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B
$0.06$0.24
OpenRouter logo
OpenRouter
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.2
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-3-nano-30b-a3b
$0.05$0.24

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Nano 3 30B A3B, ranked by cheapest on-demand price. The model needs about 72 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hreastus
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hrus-east-1
Standard_NC24ads_A100_v4AzureNVIDIA A10080 GB$3.67/hreastus
7 more instances can run Nemotron Nano 3 30B A3B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron Super 3 120B A12B1.0M$0.080$0.450Available
Nemotron Nano 3 30B A3B262K$0.050$0.200Current
Nemotron 3 Ultra$0.600$2.40Available
Nemotron Nano 2 12B131K$0.200$0.200Available
Nemotron Nano 2 9B131K$0.040$0.160Deprecated

Model IDs

accounts/fireworks/models/nemotron-nano-3-30b-a3b
nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b
nvidia-nemotron-3-nano-30b-a3b-reasoning
nvidia-nemotron-nano-3-30b-a3b
nvidia/nemotron-3-nano-30b-a3b
nvidia/Nemotron-3-Nano-30B-A3B
nvidia/nemotron-3-nano-30b-a3b:free
nvidia/nvidia-nemotron-3-nano-30b-a3b-bf16