Together AI adds Llama 4 Maverick at $0.85, revamps GPU pricing
What changed
Reserved GPU duration requirement changed from 'between 1-180 days' to 'above 6 days'
Llama 4 Maverick OUTPUT price introduced at $0.85; Dedicated Inference pricing restructured [H100 80GB increased $3.36→$3.99; H200 141GB increased $4.99→$5.49; B200 180GB added at $9.95; GPU Clusters hourly rates increased: H100 $2.99→$3.49, H200 $3.79→$4.19, B200 $5.50→$7.49; GPU Clusters 1-week rates changed: H100 $2.50→$2.69, H200 $3.45→$3.19, B200 $4.90→$5.49; Reserved pricing periods restructured from 3 time bands to 5 bands]
Removed model options from Serverless Inference [Llama 3 70B Instruct Reference removed; Llama 3.1 70B removed; DeepSeek-R1-0528 Throughput removed; Qwen3 235B A22B FP8 Throughput removed; Qwen2.5 72B removed]
Before and after
Mar 2, 2026 vs Mar 9, 2026Reserved GPU duration requirement changed from 'between 1-180 days' to 'above 6 days'
Sign in to view the full comparison
See the before/after screenshots and every marked-up change.
More from Together AI
Full history →- Week 41, 2026·improvedTogether AI adds Tev1 4B Experimental at $0.04 input with free output
- Week 39, 2026·increaseTogether AI: Qwen3.7-Max inference price increased 25% ($2.00→$2.50)
- Week 38, 2026·improvedTogether AI: Qwen3.7-Max price hike + new DeepSeek V4.1 Flash model
- Week 34, 2026·improvedTogether AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...
- Week 32, 2026·increaseTogether AI: HGX H100 GPU price increase + Kimi K3 & Inkling Small models added
