Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
14X faster. OpenAI's new Ultrafast tier hits 750 tokens/sec—powered by Cerebras.

Why it matters
A new API service tier fundamentally changes latency economics for practitioners building real-time AI applications. Speed at scale shifts what's viable in production.
The key facts
6 to knowGPT-5.6 Sol model available in Ultrafast tier
Up to 14X speed improvement over standard tier
750 output tokens per second throughput
Powered by Cerebras hardware partnership
New API service tier (pricing/availability change)
Published August 2026
Go to the source
OpenAI Blogopenai.com
Publisher excerpt: Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.