OpenAI's GPT-5.6 Sol targets 750 tokens per second via Cerebras wafer-scale compute, potentially outperforming GPU clusters by 15x in AI inference tasks.

OpenAI's GPT-5.6 Sol targets 750 tokens per second via Cerebras wafer-scale compute, potentially outperforming GPU clusters by 15x in AI inference tasks.

More intelligence from every token, stronger performance per dollar, and more capability on demand for your hardest work.