Qwen3 ASR Flash is Alibaba's language model. A fast-tier Qwen3-based automatic speech recognition model for efficient audio transcription.
Capabilities
Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·
Pricing by Provider
US Dollar ($)
Per 1M tokens
| Provider | Standard |
|---|---|
| Audio In $ / sec | |
| $0.000035 |
Cost Calculator
US Dollar ($)
Preset:
Versions
| Version | Released | Context | Input / 1M | Output / 1M | Status |
|---|---|---|---|---|---|
| Qwen Audio 3 Flash ASR | — | — | — | — | Available |
| Qwen Audio 3 Flash ASR Filetrans | — | — | — | — | Available |
| Qwen Audio 3 Flash ASR Streaming | — | — | — | — | Available |
| Qwen Audio 3 Flash Realtime | — | — | $0.450 | $4.50 | Available |
| Qwen3.8-Flash-Next | 1.0M | $0.120 | $0.400 | Available | |
| Qwen3 ASR Flash | — | — | — | — | Current |
| Qwen3.5 Omni Flash | — | — | $0.400 | $3.00 | Available |
| Qwen Flash Character | — | — | $0.050 | $0.400 | Available |
| Qwen TTS Flash | — | — | $0.230 | $1.43 | Available |
Other Models
| Model | Tier | Released | Context | Input / 1M | Output / 1M |
|---|---|---|---|---|---|
| Qwen3.8 2.4T A95B | — | 1.0M | $2.00 | $6.00 | |
| Qwen Image 3 | — | — | — | — | — |
| Qwen Audio 3 Plus Realtime | Plus | — | — | $0.800 | $6.40 |
| Qwen Audio 3 Plus TTS | Plus | — | — | — | — |
| Qwen Image 3.0 Pro | Pro | — | — | — | — |
| EAGLE Qwen 2.5 3B Instruct | — | — | — | — | — |
| DeepSeek R1 Qwen3 8B | — | — | — | — | — |
| Qwen3.8 27B | — | 1.0M | $0.400 | $2.55 | |
| Qwen3.8 Max | Max | 1.0M | $1.65 | $4.95 | |
| Qwen3.7 Plus | Plus | 1.0M | $0.320 | $1.28 |