Pricing change·May 18 → May 25, 2026·Week 22, 2026·AI & Machine Learning
Together AI reveals H200 GPU rates and adds Qwen3.7-Max inference
What changed
Price revealed
NVIDIA HGX H200 GPU pricing made public: on-demand now $6.79/hour (was Contact us); reserved pricing now $5.95/$4.99/$4.55/hour for 7-30/31-90/91-180 days.
Feature added
Qwen3.7-Max model added to Serverless Inference Chat pricing at $2.50 input / $7.50 output per 1M tokens.
Before and after
May 18, 2026 vs May 25, 2026Pulse.
100%
Change 1 of 2 · price revealed
NVIDIA HGX H200 GPU pricing made public: on-demand now $6.79/hour (was Contact us); reserved pricing now $5.95/$4.99/$4.55/hour for 7-30/31-90/91-180 days.
Sign in to view the full comparison
See the before/after screenshots and every marked-up change.
Week 17, 2026 · Together AI Triples Gemma 3n E4B Pricing to $0.06/$0.12 per 1M TokensTogether AI cuts Qwen3 inference prices 50%, adds caching · Week 23, 2026
More from Together AI
Full history →- Week 41, 2026·improvedTogether AI adds Tev1 4B Experimental at $0.04 input with free output
- Week 39, 2026·increaseTogether AI: Qwen3.7-Max inference price increased 25% ($2.00→$2.50)
- Week 38, 2026·improvedTogether AI: Qwen3.7-Max price hike + new DeepSeek V4.1 Flash model
- Week 34, 2026·improvedTogether AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...
- Week 32, 2026·increaseTogether AI: HGX H100 GPU price increase + Kimi K3 & Inkling Small models added
