OpenAI Ultrafast on Cerebras
Published: August 2026 — The Next Web
Independent tech coverage: Ultrafast is a serving tier not a new model; wafer-scale keeps entire model on one chip vs GPU memory shuttle; limited preview Aug 13; pricing undisclosed — likely premium latency tier. Notes diversification away from sole Nvidia dependence for inference.