Nemotron 3.5 Lightning 30B is NVIDIA's language model with a 1.0M context window and up to 33K output tokens. A hybrid Mixture-of-Experts LLM with interleaved Mamba-2 and MoE layers, built for reasoning and tool-use workloads with implicit caching support.
Specifications
Canonical IDnvidia-nemotron-3-5-lightning
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Context Window1.0M tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Release Date · 15 days ago

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron 4 15BAvailable
Nemotron 3.5 Lightning 30B1.0MCurrent
Nemotron Lightning 3.51.0M$0.050$0.200Available
Nemotron 3 Ultra 550B A55B1.0M$0.600$2.40Available
Nemotron 3.5 Content Safety128KAvailable
Nemotron Nano 3 30B A3B Omni Reasoning256KAvailable
Nemotron Super 3 120B256K$0.150$0.650Available
Nemotron Nano 3 30B262K$0.060$0.240Available
Nemotron Nano 3 30B A3B OmniAvailable
Nemotron Nano 3 30B A3B ReasoningAvailable
Nemotron Nano 3 4BAvailable

Model IDs

nvidia-nemotron-3-5-lightning
nvidia/nemotron-3.5-lightning-free