Gemma 4 E4B Instruct is Google's language model with a 131K context window, starting at $0.02 / 1M input and $0.1 / 1M output. An instruction-tuned, efficiency-optimized 4B-class variant of Gemma 4 designed for on-device and resource-constrained deployments.
Specifications
Canonical IDgoogle-gemma-4-e4b-instruct
TypeLanguage
StatusActive
CreatorGoogleGoogle
Providers
Context Window131K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities2/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
DeepInfra logo
DeepInfra
deepinfra/google/gemma-4-E4B-it
$0.02$0.1

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Gemma 4 E4B Instruct—131K$0.020$0.100Current
Gemma 4 31B————Available
Gemma 4 26B A4B————Available
Gemma 4 31B—256K$0.140$0.400Available
Gemma 4 26B A4B—256K$0.130$0.400Available
Gemma 4 12B————Available
Gemma 4 E4B————Available
Gemma 4 E4B————Available
Gemma 4 E2B—128K$0.040$0.080Available
Gemma 4————Available
Gemma 4 E2B————Available

Model IDs

deepinfra/google/gemma-4-E4B-it
google-gemma-4-e4b-instruct
google/gemma-4-E4B-it
huggingface-vlm-gemma-4-e4b-it