Sarvam 30B is Sarvam's language model. A 30-billion-parameter language model from Sarvam AI optimized for Indian language understanding and generation.
Specifications
Canonical IDsarvam-30b
TypeLanguage
StatusActive
CreatorSarvamSarvam
Input ModalitiesText
Output ModalitiesText
Parameters30B
Benchmarks
Intelligence Index
6.6
#384
GPQA
0.6
#261
HLE
0.1
#219
IFBench
0.3
#363
Time to First Token
0.00s
#327
SciCode
0.2
#368
LCR
0.0
#415
TerminalBench Hard
0.0
#312
TAU2
0.3
#218
Output TPS
0.0
#455

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Cheapest Instances to Run It

Cloud GPU instances that can host Sarvam 30B, ranked by cheapest on-demand price. The model needs about 72 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hrwestus2
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hrus-east-1
Standard_NC24ads_A100_v4AzureNVIDIA A10080 GB$3.67/hrwestus2
7 more instances can run Sarvam 30B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Sarvam 30BCurrent
Sarvam 105BAvailable
Sarvam M ReasoningAvailable
Sarvam M8KAvailable

Model IDs

sarvam-30b