ToolsAugust 13, 2026via OpenAI Blog

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed

Why it matters

A new API service tier fundamentally changes latency economics for practitioners building real-time AI applications. Speed at scale shifts what's viable in production.

Key signals

  • GPT-5.6 Sol model available in Ultrafast tier
  • Up to 14X speed improvement over standard tier
  • 750 output tokens per second throughput
  • Powered by Cerebras hardware partnership
  • New API service tier (pricing/availability change)
  • Published August 2026

The hook

14X faster. OpenAI's new Ultrafast tier hits 750 tokens/sec—powered by Cerebras.

Preview Ultrafast, a new OpenAI API service tier that runs GPT-5.6 Sol up to 14× faster. Powered by Cerebras, it delivers up to 750 output tokens per second.

The week's key stories, every Friday.

For practitioners and enthusiasts — free, in your inbox.

Free forever. No spam.

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed | KeyNews.AI