Nemotron Lightning 3.5 is NVIDIA's language model with a 1.0M context window and up to 236K output tokens, available from 4 providers, starting at $0.05 / 1M input and $0.2 / 1M output. NVIDIA's fast open model targeting always-on agents and high-volume specialized tasks with strong agentic capability.
Specifications
Canonical IDnvidia-nemotron-lightning-3-5
TypeLanguage
StatusActive
CreatorNVIDIANVIDIA
Providers
Context Window1.0M tokens
Max Output236K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters31.6B
HuggingFace Likes120
HuggingFace Downloads (30d)15,740
HuggingFace Downloads (all-time)15,740
Release Date · 23 days ago
Benchmarks
Intelligence Index
#178
Coding Index
#119
GPQA
#219
HLE
#211
Time to First Token
#379
SciCode
#281
LCR
#197
Output TPS
#12

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardFree
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
DeepInfra logo
DeepInfra
deepinfra/nvidia/NVIDIA-Nemotron-3.5-Lightning
$0.08$0.2$0.04
Nebius logo
Nebius
nvidia/Nemotron-3_5-Lightning
$0.06$0.24N/A
OpenRouter logo
OpenRouter
nvidia/nemotron-3.5-lightning
$0.08$0.2$0.04N/AN/A
OpenRouter logo
OpenRouter
nvidia/nemotron-3.5-lightning:free
$N/A$N/A
Vercel AI Gateway logo
Vercel AI Gateway
nvidia/nemotron-3.5-lightning
$0.05$0.2$0.01

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Nemotron Lightning 3.5, ranked by cheapest on-demand price. The model needs about 76 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hr
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hr
Standard_NC24ads_A100_v4AzureNVIDIA A10080 GB$3.67/hr
7 more instances can run Nemotron Lightning 3.5
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Nemotron 4 15BAvailable
Nemotron Lightning 3.51.0M$0.050$0.200Current
Nemotron 3.5 Lightning 30B1.0MAvailable
Nemotron 3 Ultra 550B A55B1.0M$0.500$2.20Deprecated
Nemotron 3.5 Content Safety131K$0.200$0.200Available
Nemotron Nano 3 30B A3B Omni Reasoning256KAvailable
Nemotron Super 3 120B256K$0.150$0.650Available
Nemotron Nano 3 30B262K$0.060$0.240Available
Nemotron Nano 3 30B A3B OmniAvailable
Nemotron Nano 3 30B A3B ReasoningAvailable
Nemotron Nano 3 4BAvailable

Model IDs

deepinfra/nvidia/NVIDIA-Nemotron-3.5-Lightning
nemotron-3-5-lightning
nvidia-nemotron-lightning-3-5
nvidia/nemotron-3.5-lightning
nvidia/nemotron-3.5-lightning:free
nvidia/NVIDIA-Nemotron-3.5-Lightning
openrouter/nvidia/nemotron-3.5-lightning