Cerebras lanza el CS-4, su primer sistema multi-wafer, aunque el chip en su interior no es nuevo.
Cerebras ha colocado tres de sus procesadores del tamaño de un plato de cena en un solo rack por primera vez. El CS-4, presentado el martes en el evento Supernova de la compañía y que se enviará este trimestre, se presenta como una máquina de inferencia para modelos de frontera, y Cerebras dice que los ejecuta hasta 30 veces más rápido que los sistemas basados en GPU.
El lanzamiento se produce cinco días después de que el modo Ultrafast de OpenAI, que ejecuta GPT-5.6 Sol aproximadamente 14 veces más rápido en silicio de Cerebras, se pusiera en marcha. También es el primer hardware que la compañía ha enviado desde su debut en Nasdaq de $5.55 mil millones en mayo, la mayor cotización tecnológica de EE. UU. desde Snowflake.
Sobre el papel, el sistema es formidable. Cada CS-4 lleva tres obleas WSE-3 Turbo para un total combinado de 750 petaflops de computación FP16 dispersa, 129.6 petabytes por segundo de ancho de banda de memoria y soporte para modelos de más de 50 billones de parámetros.
La latencia de oblea a oblea cae a dos microsegundos desde cinco, y el rack utiliza la mitad de componentes que su predecesor. Cerebras ha movido la conversión de energía, en su propia frase, cien veces más cerca de los procesadores, montándola en una mochila extraíble en la parte trasera del chasis.
Lo que es menos claro es si el chip interno es realmente nuevo. El WSE-3 Turbo lleva los mismos cuatro billones de transistores, los mismos 900,000 núcleos, los mismos 44GB de SRAM en chip y el mismo nodo de 5nm de TSMC que el WSE-3 que reemplaza.
The Register concluyó que no es un silicio nuevo tanto como el die existente empujado de aproximadamente 1.4GHz a 2.8GHz. La computación y el ancho de banda por oblea se duplican exactamente, lo que es la firma de un aumento de reloj en lugar de un rediseño, y Cerebras tiene una generación genuinamente nueva programada para 2027 de todos modos.
La afirmación de 30 veces mide tokens por segundo por usuario en un solo modelo, gpt-oss-120b, contra sistemas GPU no nombrados, y los 250 petaflops por oblea son un número FP16 disperso frente a 25 petaflops densos.
Donde el diseño parece genuinamente diferenciado es en el consumo de energía. The Register estima que el CS-4 consume entre 120 y 140 kilovatios por rack, aproximadamente la mitad de lo que consumen los sistemas de rack comparables de AMD y Nvidia, lo que da un punto de partida plausible para el aumento de diez veces en el rendimiento por vatio.
Andrew Feldman, el director ejecutivo, enmarcó el lanzamiento en torno a la latencia en lugar del rendimiento bruto. “En IA, la velocidad es productividad”, dijo en el anuncio, y le dijo a Reuters que la compañía espera ser “cuatro veces más rápida entre ahora y finales de 2027, y 20 veces más rendimiento”.
Sean Lie, el director de tecnología, vinculó el argumento de velocidad a agentes en lugar de chatbots. Ser 30 veces más rápido, dijo, “da a un sistema agente espacio para más de un orden de magnitud de razonamiento, verificación o uso de herramientas”, que es la parte de la propuesta dirigida a compradores empresariales en lugar de tablas de referencia.
Cerebras nombró a OpenAI, G42, MBZUAI y AWS junto con el lanzamiento, aunque no divulgó acuerdos de clientes del CS-4 ni precios.
El rack Helios de AMD, presentado en julio, figura en la lista de socios, lo que es consistente con una compañía que ha dicho que trabajará con todos en hardware de IA excepto Nvidia.
El panorama financiero es mixto. Los ingresos del segundo trimestre fueron de $180.1 millones, un aumento del 74% interanual con ingresos en la nube casi cuadruplicándose, pero cayeron secuencialmente desde $193.4 millones en el primer trimestre, y la presión sobre el margen que Cerebras señaló en junio no ha disminuido.
El trimestre produjo una pérdida neta GAAP de $450.5 millones, una pérdida ajustada de $6.9 millones y $25.4 mil millones en obligaciones de rendimiento restantes. Cerebras guía a ingresos de $880 millones a $890 millones para todo el año y 600 megavatios de capacidad de centro de datos en funcionamiento y bajo contrato para finales de 2027.
La concentración sigue siendo la cuestión estructural. G42 y la Universidad Mohamed bin Zayed de Inteligencia Artificial representaron juntos alrededor del 86% de los ingresos de 2025, y el contrato de OpenAI firmado en enero, por más de $10 mil millones en la firma, es la respuesta de la compañía a eso, junto con adiciones del segundo trimestre que incluyen Cognition, Lovable, CrowdStrike, Block y Figma.
Los primeros envíos del CS-4 están programados para antes de que termine el trimestre. La prueba más difícil llegará en 2027, cuando la próxima generación tendrá que llegar en un nuevo silicio en lugar de un reloj más rápido.
Otros artículos
Cerebras lanza el CS-4, su primer sistema multi-wafer, aunque el chip en su interior no es nuevo.
El CS-4 de Cerebras agrupa tres obleas en un solo rack y afirma tener una velocidad de GPU 30 veces mayor. Sin embargo, el procesador interno es un WSE-3 con una frecuencia de reloj más alta.
