Together AI
Build what's next on the AI Native Cloud. Full-stack AI platform for inference, fine-tuning, and GPU clusters — powered by cutting-edge research. Inference platform · OpenAI-compatible API · Dedicated Endpoints · Fine Tuning · Open Source · Serverless
Intelligence vs Price
Best value among Together AI models on this chart: Kimi K3 · GLM-5.3 · GLM-5.3 Flash (and 2 more on the dashed frontier). Prices use each model's lowest available Together AI price across regions. Hover any dot for full pricing, or click a creator in the legend to isolate.
Together AI models
50 models in Global, 50 with pricing| Select | Model | Creator | Input Price, $ | Output Price, $ | Context | Max Output | Inference Providers | Intelligence | Coding |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 | 3.00 | 15.00 | 1.0M | 944K | #1 | #1 | |||
| GLM-5.3 | 1.40 | 4.40 | 1.3M | 131K | #2 | #2 | |||
| Qwen3.8 2.4T A95B | 2.50 | 6.25 | 1.0M | 262K | #3 | #3 | |||
| GLM-5.3 Flash | 0.15 | 0.5 | 1.3M | 131K | #4 | #4 | |||
| DeepSeek V4 Pro | 1.74 | 3.48 | 1.0M | 393K | #5 | #5 | |||
| GLM-5.2 | 1.40 | 4.40 | 1.0M | 262K | #6 | #6 | |||
| Qwen3.7 Max | 2.50 | 7.50 | 1.0M | 131K | #7 | #7 | |||
| MiniMax M3 | 0.3 | 1.20 | 1.0M | 512K | #8 | #9 | |||
| Kimi K2.7 Code | 0.95 | 4.00 | 262K | 236K | #9 | #8 | |||
| Inkling | Thinkingmachines | 1.00 | 4.05 | 1.0M | 472K | #10 | #13 | ||
| Inkling Small | Thinkingmachines | 0.5 | 1.20 | 1.0M | 262K | #11 | #12 | ||
| Qwen3.6 Plus | 0.5 | 3.00 | 1.0M | 66K | #12 | #11 | |||
| Qwen3.7 Plus | 0.32 | 1.28 | 1.0M | 131K | #13 | #10 | |||
| Nemotron 3 Ultra 550B A55B | 0.6 | 3.60 | 1.0M | 461K | #14 | #14 | |||
| Kimi K2.5 | 0.5 | 2.80 | 262K | 236K | #15 | #16 | |||
| GLM-4.7 | 0.45 | 2.00 | 205K | 131K | #16 | #18 | |||
| Qwen3.5 397B A17B | 0.6 | 3.60 | 262K | 66K | #17 | #15 | |||
| GLM-4.6 | 0.6 | 2.20 | 205K | 131K | #18 | #17 | |||
| GPT OSS 120B | 0.15 | 0.6 | 131K | 131K | #19 | #19 | |||
| Qwen3.5 9B | 0.17 | 0.25 | 262K | 236K | #20 | #20 | |||
| DeepSeek V3.1 | 0.6 | 1.70 | 164K | 128K | #21 | N/A | |||
| DeepSeek R1 | 3.00 | 7.00 | 164K | 66K | #22 | #21 | |||
| GPT OSS 20B | 0.05 | 0.2 | 131K | 131K | #23 | #23 | |||
| DeepSeek V3 | 1.25 | 1.25 | 164K | 82K | #24 | #22 | |||
| Qwen3 Next 80B A3B Instruct | 0.15 | 1.50 | 262K | 236K | #25 | N/A | |||
| Llama 3.1 405B Instruct | 3.50 | 3.50 | 131K | 16K | #26 | N/A | |||
| Llama 3.1 8B Instruct | 0.18 | 0.18 | 200K | 128K | #27 | #24 | |||
| Llama 3.1 70B Instruct | 0.88 | 0.88 | 131K | 16K | #28 | N/A | |||
| Mixtral 8x7B Instruct | 0.6 | 0.6 | 33K | 16K | #29 | N/A | |||
| BGE Base EN V1.5 | Baai | 0.008 | N/A | 154K | N/A | N/A | N/A | ||
| DeepSeek R1 528B | 0.55 | 2.19 | 128K | 16K | N/A | N/A | |||
| DeepSeek V4 731 Flash | 0.14 | 0.28 | 1.3M | 944K | N/A | N/A | |||
| DeepSeek V4 Pro | 1.32 | 3.96 | 1.0M | 944K | N/A | N/A | |||
| Gemma 3N E4B IT | 0.06 | 0.12 | 33K | 2K | N/A | N/A | |||
| Gemma 4 31B IT | 0.28 | 0.86 | 262K | 131K | N/A | N/A | |||
| GLM-4.5 Air FP8 | 0.2 | 1.10 | 128K | N/A | N/A | N/A | |||
| Kimi K2 Instruct | 1.00 | 3.00 | 262K | 100K | N/A | N/A | |||
| Llama 3.3 70B Instruct Turbo | 1.04 | 1.04 | 131K | N/A | N/A | N/A | |||
| Llama 4 17B Maverick Instruct | 0.27 | 0.85 | 1.0M | 16K | N/A | N/A | |||
| Llama 4 17B Scout Instruct | 0.18 | 0.59 | 10.0M | 16K | N/A | N/A | |||
| LlamaGuard 4 12B | 0.2 | 0.2 | 1.0M | 16K | N/A | N/A | |||
| Multilingual E5 Large Instruct | 0.02 | 0.02 | 514 | N/A | N/A | N/A | |||
| Muse Glimmer 30B | 0.35 | 1.50 | 131K | 118K | N/A | N/A | |||
| Qwen2 1.5B Instruct | 0.1 | 0.1 | 33K | N/A | N/A | N/A | |||
| Qwen3 235B A22B FP8 Tput | 0.2 | 0.6 | 40K | N/A | N/A | N/A | |||
| Qwen3 235B A22B Instruct Tput | 0.2 | 6.00 | 262K | N/A | N/A | N/A | |||
| Qwen3 235B A22B Thinking | 0.65 | 3.00 | 262K | 118K | N/A | N/A | |||
| Qwen3 Coder 480B A35B Instruct FP8 | 2.00 | 2.00 | 262K | N/A | N/A | N/A | |||
| Qwen3 Next 80B A3B Thinking | 0.15 | 1.50 | 262K | 66K | N/A | N/A | |||
| Qwen3.8 Flash | 0.15 | 0.47 | 1.0M | 131K | N/A | N/A |