Kokoro 82M is Kokoro's language model. A lightweight open-weight TTS model with 82 million parameters that delivers quality comparable to larger models while being significantly faster and more cost-efficient.
Specifications
Canonical IDkokoro-82m
TypeLanguage
StatusActive
CreatorKokoro
Input ModalitiesText
Output ModalitiesText
Parameters0.08B
HuggingFace Likes6,357
HuggingFace Downloads (30d)13,558,358
HuggingFace Downloads (all-time)80,449,693

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Cheapest Instances to Run It

Cloud GPU instances that can host Kokoro 82M, ranked by cheapest on-demand price. The model needs about 0 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
g6f.largeAWSL43 GB$0.202/hrus-east-1
Standard_NV4as_v4AzureAMD Radeon Instinct MI2516 GB$0.233/hrwestus2
g6f.xlargeAWSL43 GB$0.237/hrus-east-1
7 more instances can run Kokoro 82M
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Kokoro 1 82MAvailable
Kokoro 82MCurrent

Model IDs

hexgrad/Kokoro-82M
kokoro-82m