Nemotron 3 Ultra is NVIDIA's language model with a 262K context window and up to 33K output tokens, available from 2 providers, starting at $0.6 / 1M input and $2.40 / 1M output. A frontier-scale Nemotron large language model from NVIDIA designed for strong agentic, reasoning, and conversational capabilities at extreme parameter counts.
Specifications
Canonical IDnvidia-nemotron-3-ultra
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs✓
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Fireworks AI logo
Fireworks AI
fireworks_ai/nemotron-3-ultra-nvfp4
$0.6$2.40$0.12
Hugging Face logo
Hugging Face
fireworks_ai:accounts/fireworks/models/nemotron-3-ultra-nvfp4
$0.6$2.40N/A

Cost Calculator

US Dollar ($)
Preset:

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
Nemotron Super 3 120B A12B—1.0M$0.080$0.400
Nemotron Nano 3 30B A3B—262K$0.050$0.200
Nemotron Lightning 3.5 30B A3B——262K$0.050$0.200
Nemotron Nano 2 9B—131K$0.040$0.160
Nemotron Nano 2 12B—131K$0.200$0.200

Model IDs

accounts/fireworks/models/nemotron-3-ultra-bf16
accounts/fireworks/models/nemotron-3-ultra-nvfp4
fireworks_ai/accounts/fireworks/models/nemotron-3-ultra-nvfp4
fireworks_ai/nemotron-3-ultra-nvfp4
nvidia-nemotron-3-ultra