ToolsAugust 13, 2026via OpenAI Blog
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed
Why it matters
A new API service tier fundamentally changes latency economics for practitioners building real-time AI applications. Speed at scale shifts what's viable in production.
Key signals
- GPT-5.6 Sol model available in Ultrafast tier
- Up to 14X speed improvement over standard tier
- 750 output tokens per second throughput
- Powered by Cerebras hardware partnership
- New API service tier (pricing/availability change)
- Published August 2026
The hook
14X faster. OpenAI's new Ultrafast tier hits 750 tokens/sec—powered by Cerebras.
Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.