Qwen3.6 35B A3B is Alibaba's language model with a 262K context window and up to 16K output tokens, available from 6 providers, starting at $0.14 / 1M input and $0.45 / 1M output. Alibaba's flagship Qwen3.6 MoE model with 35B total parameters and 3B activated per token, built with 256 experts and direct community feedback integration.
Specifications
Canonical IDalibaba-qwen3-6-35b-a3b
TypeLanguage
StatusActive
CreatorAlibabaAlibaba
Providers
Context Window262K tokens
Max Output16K tokens
Input ModalitiesImageTextVideo
Output ModalitiesText
Reasoning Effortsdefault
Parameters35B
HuggingFace Likes1,495
HuggingFace Downloads (30d)1,510,129
HuggingFace Downloads (all-time)1,510,129
Release Date · 3 months ago
Benchmarks
Intelligence Index
31.6
#89
Coding Index
41.9
#60
GPQA
0.8
#79
HLE
0.2
#79
IFBench
0.6
#93
Time to First Token
1.42s
#415
SciCode
0.4
#183
LCR
0.6
#80
TerminalBench Hard
0.3
#62
TAU2
1.0
#22
Output TPS

Capabilities

Input3/5
Text
Image
Audio·
Video
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardBatch
Input
$ / 1M
Output
$ / 1M
Input
$ / 1M
Output
$ / 1M
Alibaba Qwen logo
Alibaba Qwen
qwen3.6-35b-a3b
$0.375$2.25$0.188$1.13
Hugging Face logo
Hugging Face
scaleway:qwen3.6-35b-a3b
$0.285$1.71
Libertai
libertai/qwen3.6-35b-a3b
$0.15$0.5
OpenRouter logo
OpenRouter
qwen/qwen3.6-35b-a3b
$0.14$1.00
Pinstripes
pinstripes/ps/qwen3.6-35b-a3b
$0.14$0.45
Scaleway logo
Scaleway
scaleway/qwen/qwen3.6-35b-a3b
$0.25$1.50

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Qwen3.6 35B A3B, ranked by cheapest on-demand price. The model needs about 84 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NP20sAzure2× AMD Alveo U250 FPGA (64GB)128 GB$3.30/hrwestus2
g7e.2xlargeAWSRTX PRO Server 600096 GB$3.36/hrus-east-1
g2-standard-48GCP4× nvidia-l496 GB$3.99/hrus-east4
7 more instances can run Qwen3.6 35B A3B
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Qwen Audio 3 Flash Realtime$0.413$4.13Available
Qwen Audio 3 Plus Realtime$0.688$5.50Available
Qwen Audio 3 Plus TTSAvailable
EAGLE Qwen 2.5 3B InstructAvailable
Qwen3.7 Plus1.0M$0.320$1.28Available
Qwen3.7 Max1.0M$1.25$3.75Available
Qwen3.6 35B A3B262K$0.140$0.450Current
Qwen3.6 Max Preview262K$1.04$6.24Available
Qwen3.6 27B262K$0.150$0.500Available
Qwen3.6 Plus1.0M$0.325$1.95Available
Qwen3 Max Thinking262K$0.780$3.90Available

Model IDs

accounts/fireworks/models/qwen3p6-35b-a3b
alibaba-qwen3-6-35b-a3b
huggingface-vlm-qwen3-6-35b-a3b
libertai/qwen3.6-35b-a3b
pinstripes/ps/qwen3.6-35b-a3b
qwen/qwen3.6-35b-a3b
Qwen/Qwen3.6-35B-A3B
qwen3-6-35b-a3b
qwen3-6-35b-a3b-non-reasoning
qwen3.6-35b-a3b
scaleway/qwen/qwen3.6-35b-a3b