Packaging change·Jul 6 → Jul 13, 2026·Week 29, 2026·AI & Machine Learning
Together AI: New Provisioned Throughput pricing + GPU rate cuts
Added Provisioned Throughput (PTU) reserved-capacity pricing ($0.05/PTU/min, MiniMax M3 & GLM-5.2); Dedicated Inference on-demand GPU rates decreased (H100 $6.49->$5.49/hr, HGX B200 $11.95->$8.99/hr)
What changed
Package change
Added Provisioned Throughput (PTU) pricing ($0.05/PTU/min, MiniMax M3 & GLM-5.2); Dedicated Inference on-demand GPU rates cut (H100 $6.49->$5.49/hr, HGX B200 $11.95->$8.99/hr)
Before and after
Jul 6, 2026 vs Jul 13, 2026Pulse.
100%
What changed
Added Provisioned Throughput (PTU) pricing ($0.05/PTU/min, MiniMax M3 & GLM-5.2); Dedicated Inference on-demand GPU rates cut (H100 $6.49->$5.49/hr, HGX B200 $11.95->$8.99/hr)
Sign in to view the full comparison
See the before/after screenshots and every marked-up change.
Week 27, 2026 · Together AI drops GLM-5 from serverless inference pricingTogether AI: 3 new models added to Serverless Inference pricing · Week 30, 2026
More from Together AI
Full history →- Week 41, 2026·improvedTogether AI adds Tev1 4B Experimental at $0.04 input with free output
- Week 39, 2026·increaseTogether AI: Qwen3.7-Max inference price increased 25% ($2.00→$2.50)
- Week 38, 2026·increaseTogether AI: Qwen3.7-Max price hike + new DeepSeek V4.1 Flash model
- Week 34, 2026·improvedTogether AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...
- Week 32, 2026·improvedTogether AI: HGX H100 GPU price increase + Kimi K3 & Inkling Small models added
