Gemma 4 E4B Instruct is Google's language model with a 131K context window, starting at $0.02 / 1M input and $0.1 / 1M output. An instruction-tuned, efficiency-optimized 4B-class variant of Gemma 4 designed for on-device and resource-constrained deployments.
Specifications
Canonical IDgoogle-gemma-4-e4b-instruct
TypeLanguage
StatusActive
CreatorGoogleGoogle
Providers
Context Window131K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities2/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
DeepInfra logo
DeepInfra
deepinfra/google/gemma-4-E4B-it
$0.02$0.1

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Gemma 4 E4B Instruct131K$0.020$0.100Current
Gemma 4 31B256K$0.140$0.400Available
Gemma 4 26B A4B256K$0.130$0.400Available
Gemma 4 31BAvailable
Gemma 4 12BAvailable
Gemma 4 26B A4BAvailable
Gemma 4 E4BAvailable
Gemma 4 E2B128K$0.040$0.080Available
Gemma 4Available
Gemma 4 E4BAvailable
Gemma 4 E2BAvailable

Model IDs

deepinfra/google/gemma-4-E4B-it
google-gemma-4-e4b-instruct
google/gemma-4-E4B-it
huggingface-vlm-gemma-4-e4b-it