openai OpenAI News ·

OpenAI previews Ultrafast mode for GPT-5.6 Sol API, enabling 14x faster inference

aipreviewengineer
feature

OpenAI is previewing Ultrafast mode, a new API service tier designed to significantly accelerate GPT-5.6 Sol inference. This mode delivers up to 14 times faster performance, generating up to 750 output tokens per second. Powered by Cerebras technology, it aims to enhance throughput for developers utilizing the GPT-5.6 Sol model.

Features (1)
  • Ultrafast mode for GPT-5.6 Sol API

    OpenAI is previewing a new Ultrafast API service tier for GPT-5.6 Sol, offering up to 14 times faster inference. This mode can generate up to 750 output tokens per second and is powered by Cerebras technology.

Read the original announcement →

https://openai.com/index/previewing-ultrafast

Related releases