Agnes 2.5 Flash is Agnes's language model with a 512K context window and up to 66K output tokens, starting at $0.03 / 1M input and $0.15 / 1M output. A fast-tier conversational LLM optimized for low-latency responses within the Agnes model family.
Specifications
Canonical IDagnes-2-5-flash
TypeLanguage
StatusActive
CreatorAgnes
Providers
Context Window512K tokens
Max Output66K tokens
Input ModalitiesImage
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text·
Image✓
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities1/13
Reasoning✓
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Aihubmix
aihubmix/agnes-2.5-flash
$0.03$0.15

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Agnes 3.0 Flash————Available
Agnes 2.5 Flash—512K$0.030$0.150Current
Agnes Image 2.0 Flash————Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
Agnes Video 2.0—————
Agnes 2.5 Pro BetaPro————
Agnes 2.5 Pro AlphaPro————
Agnes 2.5 ProPro—1.0M$0.450$0.900

Model IDs

agnes-2-5-flash
aihubmix/agnes-2.5-flash