Cerebras Systems anunció el martes que sus chips de AI a escala de lámina ahora impulsan el modelo GPT-5.6 Sol de OpenAI en un modo ultrafrecuente capaz de generar 750 tokens por segundo.
La integración aprovecha los sistemas CS-3 de Cerebras, que utilizan los procesadores Wafer-Scale Engine 3 (WSE-3) de la compañía, para acelerar la inferencia para el modelo más reciente de OpenAI. La configuración está diseñada para aplicaciones en tiempo real que requieren baja latencia y alta tasa de transferencia, según Cerebras.
El modelo GPT-5.6 Sol es una variante de la serie GPT-5 de la compañía, optimizada para velocidad y eficiencia en entornos de alta demanda como el AI conversacional y los flujos de trabajo empresariales. Cerebras no divulgó términos comerciales ni cronogramas de implementación más allá de la capacidad técnica.
El anuncio destaca la creciente dependencia de hardware especializado para satisfacer las demandas computacionales de modelos de AI avanzados. Competidores como Nvidia y AMD también han desarrollado chips diseñados para cargas de trabajo de AI, pero Cerebras enfatiza su arquitectura a escala de lámina como un diferenciador en rendimiento bruto.
Cerebras Systems, una subsidiaria de Cerebras AI, es una empresa privada que no ha divulgado cifras de ingresos. La compañía ha colaborado previamente con OpenAI en iniciativas de investigación, aunque este es el primer anuncio público de integración de hardware para inferencia a gran escala en producción.












