Together AI
Build what's next on the AI Native Cloud. Full-stack AI platform for inference, fine-tuning, and GPU clusters — powered by cutting-edge research. Inference platform · OpenAI-compatible API · Dedicated Endpoints · Fine Tuning · Open Source · Serverless
Intelligence vs Price
Best value among Together AI models on this chart: GLM-5.3 · GLM-5.3 Flash · Qwen3.5 9B (and 2 more on the dashed frontier). Prices use each model's lowest available Together AI price across regions. Hover any dot for full pricing, or click a creator in the legend to isolate.
Together AI models
86 models in Global, 86 with pricing| Select | Model | Creator | Input Price, $ | Output Price, $ | Context | Max Output | Inference Providers | Intelligence | Coding |
|---|---|---|---|---|---|---|---|---|---|
| GLM-5.3 | 1.40 | 4.40 | 1.3M | 944K | #1 | #2 | |||
| Kimi K3 | 3.00 | 15.00 | 1.0M | 944K | #2 | #1 | |||
| GLM-5.3 Flash | 0.15 | 0.5 | 1.3M | 944K | #3 | #4 | |||
| Qwen3.8 2.4T A95B | 2.00 | 6.00 | 1.0M | 909K | #4 | #3 | |||
| DeepSeek V4.1 Flash Expires Exp | 0.3 | 1.20 | 1.0M | 393K | #5 | N/A | |||
| DeepSeek V4 Pro | 1.74 | 3.48 | 1.0M | 944K | #6 | #5 | |||
| GLM-5.2 | 1.40 | 4.40 | 1.0M | 944K | #7 | #6 | |||
| Qwen3.7 Max | 1.50 | 4.50 | 1.0M | 131K | #8 | #7 | |||
| MiniMax M3 | 0.3 | 1.20 | 1.0M | 524K | #9 | #10 | |||
| GLM-5 | 1.00 | 3.20 | 1.0M | 131K | #10 | N/A | |||
| Inkling Small | Thinkingmachines | 0.5 | 1.20 | 1.0M | 262K | #11 | #14 | ||
| Qwen3.6 Plus | 0.5 | 3.00 | 1.0M | 66K | #12 | #13 | |||
| Kimi K2.6 | 1.20 | 4.50 | 262K | 236K | #13 | #8 | |||
| GLM-5.1 | 1.40 | 4.40 | 205K | 203K | #14 | #12 | |||
| Kimi K2.7 Code | 0.95 | 4.00 | 262K | 236K | #15 | #9 | |||
| Qwen3.7 Plus | 0.32 | 1.28 | 1.0M | 131K | #16 | #11 | |||
| Inkling | Thinkingmachines | 1.00 | 4.05 | 1.0M | 472K | #17 | #16 | ||
| Kimi K2.5 | 0.5 | 2.80 | 262K | 236K | #18 | #19 | |||
| Nemotron 3 Ultra 550B A55B | 0.6 | 3.60 | 1.0M | 461K | #19 | #17 | |||
| MiniMax M2.7 | 0.3 | 1.20 | 1.0M | 131K | #20 | #15 | |||
| GLM-4.7 | 0.45 | 2.00 | 205K | 131K | #21 | #21 | |||
| Qwen3.5 397B A17B | 0.6 | 3.60 | 262K | 236K | #22 | #18 | |||
| GLM-4.6 | 0.6 | 2.20 | 205K | 131K | #23 | #20 | |||
| Qwen3.5 9B | 0.17 | 0.25 | 262K | 236K | #24 | #24 | |||
| DeepSeek V3.1 | 0.6 | 1.70 | 164K | 128K | #25 | N/A | |||
| DeepSeek R1 | 3.00 | 7.00 | 164K | 66K | #26 | #25 | |||
| GPT OSS 120B | 0.15 | 0.6 | 131K | 131K | #27 | #23 | |||
| GPT OSS 20B | 0.05 | 0.2 | 131K | 131K | #28 | #27 | |||
| Qwen3 Next 80B A3B Instruct | 0.15 | 1.50 | 262K | 236K | #29 | N/A | |||
| QwQ 32B | 1.20 | 1.20 | 131K | 16K | #30 | N/A | |||
| Qwen3 Coder Next | 0.5 | 1.20 | 262K | 236K | #31 | #22 | |||
| DeepSeek V3 | 1.25 | 1.25 | 164K | 82K | #32 | #26 | |||
| Qwen3 VL 32B Instruct | 0.5 | 1.50 | 262K | 33K | #33 | N/A | |||
| DeepSeek R1 Distill Llama 70B | 2.00 | 2.00 | 131K | 8K | #34 | N/A | |||
| DeepSeek R1 Distill Qwen 14B | 1.60 | 1.60 | 131K | 16K | #35 | N/A | |||
| Qwen2.5 72B Instruct | 1.20 | 1.20 | 131K | 16K | #36 | N/A | |||
| Nemotron Nano 2 9B | 0.06 | 0.25 | 131K | 8K | #37 | N/A | |||
| Qwen3 VL 8B Instruct | 0.18 | 0.68 | 262K | 33K | #38 | N/A | |||
| Llama 3.1 405B Instruct | 3.50 | 3.50 | 131K | 16K | #39 | N/A | |||
| Llama 3.1 Nemotron 70B Instruct | 0.88 | 0.88 | 131K | 16K | #41 | N/A | |||
| Llama 3.1 8B Instruct | 0.18 | 0.18 | 200K | 128K | #40 | #28 | |||
| Qwen2.5 Coder 32B Instruct | 0.8 | 0.8 | 131K | 29K | #42 | N/A | |||
| Llama 3.1 70B Instruct | 0.88 | 0.88 | 131K | 16K | #43 | N/A | |||
| Qwen2 72B Instruct | 0.9 | 0.9 | 33K | N/A | #44 | N/A | |||
| Llama 3.2 3B Instruct | 0.06 | 0.06 | 131K | 118K | #45 | N/A | |||
| DeepSeek R1 Distill Qwen 1.5B | 0.18 | 0.18 | 131K | N/A | #46 | N/A | |||
| Mixtral 8x7B Instruct | 0.6 | 0.6 | 33K | 16K | #47 | N/A | |||
| Mistral 7B Instruct | 0.2 | 0.2 | 127K | 16K | #48 | N/A | |||
| Llama 3.2 1B Instruct | 0.06 | 0.06 | 131K | 54K | #49 | N/A | |||
| Llama 3 8B Instruct | 0.2 | 0.2 | 32K | 8K | #50 | N/A | |||
| Arcee Trinity Mini | 0.045 | 0.15 | 131K | N/A | N/A | N/A | |||
| BGE Base EN V1.5 | Baai | 0.008 | N/A | 154K | N/A | N/A | N/A | ||
| DeepSeek Coder 33B Instruct | 0.8 | 0.8 | 16K | 16K | N/A | N/A | |||
| DeepSeek R1 528 | 3.00 | 7.00 | 164K | 33K | N/A | N/A | |||
| DeepSeek R1 528B | 0.55 | 2.19 | 128K | 16K | N/A | N/A | |||
| DeepSeek V4 731 Flash | 0.14 | 0.28 | 1.3M | 944K | N/A | N/A | |||
| DeepSeek V4 Pro | 1.32 | 3.96 | 1.0M | 944K | N/A | N/A | |||
| Gemma 2 27B Instruct | 0.8 | 0.8 | 8K | 8K | N/A | N/A | |||
| Gemma 3N E4B IT | 0.06 | 0.12 | 33K | 2K | N/A | N/A | |||
| Gemma 4 31B IT | 0.28 | 0.86 | 262K | 131K | N/A | N/A | |||
| GLM-4.5 Air FP8 | 0.2 | 1.10 | 131K | N/A | N/A | N/A | |||
| Hermes 2 Mixtral 8x7B DPO | 0.6 | 0.6 | 33K | N/A | N/A | N/A | |||
| Kimi K2 Instruct | 1.00 | 3.00 | 262K | 100K | N/A | N/A | |||
| Kimi K2.5 FP4 | 0.5 | 2.80 | 262K | N/A | N/A | N/A | |||
| Llama 3 70B Instruct Turbo | 0.88 | 0.88 | N/A | N/A | N/A | N/A | |||
| Llama 3 8B Chat | 0.2 | 0.2 | N/A | N/A | N/A | N/A | |||
| Llama 3.3 70B Instruct Turbo | 1.04 | 1.04 | 131K | N/A | N/A | N/A | |||
| Llama 4 17B Maverick Instruct | 0.27 | 0.85 | 1.0M | 16K | N/A | N/A | |||
| Llama 4 17B Scout Instruct | 0.18 | 0.59 | 10.0M | 16K | N/A | N/A | |||
| LlamaGuard 4 12B | 0.2 | 0.2 | 1.0M | 16K | N/A | N/A | |||
| Ministral 3 14B Instruct | 0.2 | 0.2 | 262K | 8K | N/A | N/A | |||
| Mistral Small 24B Instruct | 0.1 | 0.3 | 33K | 16K | N/A | N/A | |||
| Multilingual E5 Large Instruct | 0.02 | 0.02 | 514 | N/A | N/A | N/A | |||
| Muse Glimmer 30B | 0.35 | 1.50 | 131K | 118K | N/A | N/A | |||
| Qwen2 1.5B Instruct | 0.02 | 0.02 | 33K | N/A | N/A | N/A | |||
| Qwen2 VL 72B Instruct | 1.20 | 1.20 | 131K | 2K | N/A | N/A | |||
| Qwen2.5 14B Instruct | 0.8 | 0.8 | 33K | 8K | N/A | N/A | |||
| Qwen2.5 Turbo 72B Instruct | 1.20 | 1.20 | 131K | N/A | N/A | N/A | |||
| Qwen2.5 Turbo 7B Instruct | 0.3 | 0.3 | 33K | N/A | N/A | N/A | |||
| Qwen2.5 VL 72B Instruct | 1.95 | 8.00 | 131K | 128K | N/A | N/A | |||
| Qwen3 235B A22B FP8 Tput | 0.2 | 0.6 | 40K | N/A | N/A | N/A | |||
| Qwen3 235B A22B Instruct Tput | 0.2 | 6.00 | 262K | N/A | N/A | N/A | |||
| Qwen3 235B A22B Thinking | 0.65 | 3.00 | 262K | 118K | N/A | N/A | |||
| Qwen3 Coder 480B A35B Instruct FP8 | 2.00 | 2.00 | 262K | N/A | N/A | N/A | |||
| Qwen3 Next 80B A3B Thinking | 0.15 | 1.50 | 262K | 236K | N/A | N/A | |||
| Qwen3.8 Flash | 0.09 | 0.282 | 1.0M | 131K | N/A | N/A |