OpenAI Ultrafast on Cerebras

Published: August 2026 — The Next Web

Independent tech coverage: Ultrafast is a serving tier not a new model; wafer-scale keeps entire model on one chip vs GPU memory shuttle; limited preview Aug 13; pricing undisclosed — likely premium latency tier. Notes diversification away from sole Nvidia dependence for inference.