Qwen3.6 35B A3B is Alibaba's language model with a 262K context window and up to 236K output tokens, available from 9 providers, starting at $0.1 / 1M input and $0.45 / 1M output. Alibaba's flagship Qwen3.6 MoE model with 35B total parameters and 3B activated per token, built with 256 experts and direct community feedback integration.
Specifications
Canonical IDalibaba-qwen3-6-35b-a3b
TypeLanguage
StatusActive
CreatorAlibabaAlibaba
Providers
Context Window262K tokens
Max Output236K tokens
Input ModalitiesImageTextVideo
Output ModalitiesText
Reasoning Effortsdefault
Parameters35B
HuggingFace Likes1,495
HuggingFace Downloads (30d)1,510,129
HuggingFace Downloads (all-time)1,510,129
Release Date · 4 months ago
Benchmarks
Intelligence Index
#116
Coding Index
#88
GPQA
#107
HLE
#108
IFBench
#101
Time to First Token
#450
SciCode
#227
LCR
#128
TerminalBench Hard
#69
TAU2
#26
Output TPS
#76

Capabilities

Input3/5
Text
Image
Audio·
Video
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardBatch
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
Alibaba Qwen logo
Alibaba Qwen
qwen3.6-35b-a3b
$0.375$2.25N/A$0.188$1.13
DeepInfra logo
DeepInfra
deepinfra/Qwen/Qwen3.6-35B-A3B
$0.1$0.95N/A
Hugging Face logo
Hugging Face
scaleway:qwen3.6-35b-a3b
$0.285$1.71N/A
Libertai
libertai/qwen3.6-35b-a3b
$0.15$0.5N/A
Novita logo
Novita
novita/qwen/qwen3.6-35b-a3b
$0.248$1.49N/A
OpenRouter logo
OpenRouter
qwen/qwen3.6-35b-a3b
$0.1$0.9$0.05
Pinstripes
pinstripes/ps/qwen3.6-35b-a3b
$0.14$0.45N/A
Scaleway logo
Scaleway
scaleway/qwen/qwen3.6-35b-a3b
$0.25$1.50N/A
Weights & Biases logo
Weights & Biases
wandb/Qwen/Qwen3.6-35B-A3B
$0.25$1.25N/A

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Qwen3.6 35B A3B, ranked by cheapest on-demand price. The model needs about 84 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hr
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hr
g2-standard-48GCP4× nvidia-l496 GB$3.99/hr
7 more instances can run Qwen3.6 35B A3B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Qwen3.8 2.4T A95B1.0M$2.00$6.00Available
Qwen Audio 3 Flash ASRAvailable
Qwen Audio 3 Flash ASR FiletransAvailable
Qwen Audio 3 Flash ASR StreamingAvailable
Qwen Audio 3 Flash Realtime$0.450$4.50Available
Qwen Audio 3 Plus Realtime$0.800$6.40Available
Qwen Audio 3 Plus TTSAvailable
Qwen Image 3Available
Qwen Image 3.0 ProAvailable
EAGLE Qwen 2.5 3B InstructAvailable
Qwen3.6 35B A3B262K$0.100$0.450Current

Model IDs

accounts/fireworks/models/qwen3p6-35b-a3b
alibaba-qwen3-6-35b-a3b
deepinfra/Qwen/Qwen3.6-35B-A3B
huggingface-vlm-qwen3-6-35b-a3b
libertai/qwen3.6-35b-a3b
novita/qwen/qwen3.6-35b-a3b
pinstripes/ps/qwen3.6-35b-a3b
qwen/qwen3.6-35b-a3b
Qwen/Qwen3.6-35B-A3B
qwen3-6-35b-a3b
qwen3-6-35b-a3b-non-reasoning
qwen3.6-35b-a3b
scaleway/qwen/qwen3.6-35b-a3b
wandb/Qwen/Qwen3.6-35B-A3B