Inference at Warp Speed
OpenAI previews GPT-5.6 Sol 'Ultrafast' mode at up to 750 tok/s via Cerebras
OpenAI announced Ultrafast, a new API service tier running GPT-5.6 Sol up to 14x faster than standard inference, reaching 750 output tokens per second on Cerebras hardware. The limited preview targets latency-sensitive enterprise use cases including real-time voice, financial analysis, and customer support.




