Skip to content

PricingSaaS joins Willingness to PayRead the announcement →

Packaging change·Aug 10 → Aug 17, 2026·Week 34, 2026·AI & Machine Learning

Together AI unveils Qwen3.8-2.4T-A95B, Muse Glimmer, DeepSeek V4 Pro pricing on ...

Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached); Provisioned Throughput per-PTU capacity increased: MiniMax M3 TPM/PTU rose from 138,840/694,200/23,140 to 166,667/833,333/41,667; GLM-5.2 output TPM/PTU rose 9,620 to 11,364. Price unchanged, $0.0

Together AIPackagingFeature addedLimit increase

What changed

Feature added

Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached)

Limit increase

Provisioned Throughput per-PTU capacity increased: MiniMax M3 TPM/PTU rose from 138,840/694,200/23,140 to 166,667/833,333/41,667; GLM-5.2 output TPM/PTU rose 9,620 to 11,364. Price unchanged, $0.05/PTU/min.

Before and after

Aug 10, 2026 vs Aug 17, 2026
Pulse.
100%
Change 1 of 2 · feature added

Three new models added to Serverless Inference Chat pricing: Qwen3.8-2.4T-A95B ($2.50/$6.25, $0.50 cached), Muse Glimmer 30B ($0.35/$1.50, $0.04 cached), DeepSeek V4 Pro 0813 ($1.32/$3.96, $0.13 cached)

Sign in to view the full comparison

See the before/after screenshots and every marked-up change.