TA
Together AI
together
· 14 models · synced never
Open-weight model hosting with serverless endpoints.
| Model | Type | Input $/MTok | Output $/MTok | Context | Upstream ID |
|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 deepseek | LLM | $0.14 | $0.28 | 1.0M | deepseek/deepseek-v4-flash-0731 |
| GLM 5.3 Flash (batch) z-ai | LLM | $0.15 | $0.5 | 1.0M | z-ai/glm-5.3-flash |
| gpt-oss-120b (batch) openai | LLM | $0.15 | $0.6 | 131K | openai/gpt-oss-120b |
| Qwen3.5-9B qwen | LLM | $0.17 | $0.25 | 262K | qwen/qwen3.5-9b |
| DeepSeek V4.1 Flash (batch) deepseek | LLM | $0.3 | $1.20 | 1.0M | deepseek/deepseek-v4.1-flash |
| MiniMax M3 minimax | LLM | $0.3 | $1.20 | 524K | minimax/minimax-m3 |
| Muse Glimmer 30B meta | LLM | $0.35 | $1.50 | 131K | meta/muse-glimmer-30b |
| Inkling (free) thinkingmachines | STT | $1.00 | $4.05 | 524K | thinkingmachines/inkling |
| Llama 3.3 70B Instruct meta-llama | LLM | $1.04 | $1.04 | 131K | meta-llama/llama-3.3-70b-instruct |
| DeepSeek V4 Pro 0813 deepseek | LLM | $1.32 | $3.96 | 1.0M | deepseek/deepseek-v4-pro-0813 |
| GLM 5.2 (free) z-ai | LLM | $1.40 | $4.40 | 1.0M | z-ai/glm-5.2 |
| GLM 5.3 (batch) z-ai | LLM | $1.40 | $4.40 | 1.0M | z-ai/glm-5.3 |
| Qwen3.8 2.4T A95B qwen | LLM | $2.00 | $6.00 | 1.0M | qwen/qwen3.8-2.4t-a95b |
| Kimi K3 (batch) moonshotai | LLM | $3.00 | $15.00 | 1.0M | moonshotai/kimi-k3 |