Nemotron 4 15B is NVIDIA's language model. A 15B-parameter multilingual LLM from NVIDIA's Nemotron-4 generation, trained on 8 trillion tokens for text generation, coding, and multilingual tasks.
Specifications
Canonical IDnvidia-nemotron-4-15b
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Input ModalitiesText
Output ModalitiesText
Parameters15B

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron 4 15B, ranked by cheapest on-demand price. The model needs about 36 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP10sAzureAMD Alveo U250 FPGA (64GB)64 GB$1.65/hreastus
g6e.xlargeAWSL40S45 GB$1.86/hrus-east-1
Standard_NV32as_v4AzureAMD Radeon Instinct MI2564 GB$1.86/hreastus
7 more instances can run Nemotron 4 15B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron 4 15BCurrent
Nemotron 3 Ultra 550B A55B1.0M$0.500$2.20Available
Nemotron 3.5 Content Safety128KAvailable
Nemotron Nano 3 30B A3B Omni Reasoning256KAvailable
Nemotron Super 3 120B256K$0.150$0.650Available
Nemotron Nano 3 30B262K$0.060$0.240Available
Nemotron Nano 3 30B A3B OmniAvailable
Nemotron Nano 3 30B A3B ReasoningAvailable
Nemotron Nano 3 4BAvailable
Nemotron 3Available
Nemotron 3 Nano 30B A3BAvailable

Model IDs

nvidia-nemotron-4-15b
nvidia-nemotron-4-15b-nim