Cerebras lanza el CS-4, su primer sistema multi-wafer, aunque el chip en su interior no es nuevo.

Cerebras lanza el CS-4, su primer sistema multi-wafer, aunque el chip en su interior no es nuevo.

      Cerebras ha colocado tres de sus procesadores del tamaño de un plato de cena en un solo rack por primera vez. El CS-4, presentado el martes en el evento Supernova de la compañía y que se enviará este trimestre, se presenta como una máquina de inferencia para modelos de frontera, y Cerebras dice que los ejecuta hasta 30 veces más rápido que los sistemas basados en GPU.

      El lanzamiento se produce cinco días después de que el modo Ultrafast de OpenAI, que ejecuta GPT-5.6 Sol aproximadamente 14 veces más rápido en silicio de Cerebras, se pusiera en marcha. También es el primer hardware que la compañía ha enviado desde su debut en Nasdaq de $5.55 mil millones en mayo, la mayor cotización tecnológica de EE. UU. desde Snowflake.

      Sobre el papel, el sistema es formidable. Cada CS-4 lleva tres obleas WSE-3 Turbo para un total combinado de 750 petaflops de computación FP16 dispersa, 129.6 petabytes por segundo de ancho de banda de memoria y soporte para modelos de más de 50 billones de parámetros.

      La latencia de oblea a oblea cae a dos microsegundos desde cinco, y el rack utiliza la mitad de componentes que su predecesor. Cerebras ha movido la conversión de energía, en su propia frase, cien veces más cerca de los procesadores, montándola en una mochila extraíble en la parte trasera del chasis.

      Lo que es menos claro es si el chip interno es realmente nuevo. El WSE-3 Turbo lleva los mismos cuatro billones de transistores, los mismos 900,000 núcleos, los mismos 44GB de SRAM en chip y el mismo nodo de 5nm de TSMC que el WSE-3 que reemplaza.

      The Register concluyó que no es un silicio nuevo tanto como el die existente empujado de aproximadamente 1.4GHz a 2.8GHz. La computación y el ancho de banda por oblea se duplican exactamente, lo que es la firma de un aumento de reloj en lugar de un rediseño, y Cerebras tiene una generación genuinamente nueva programada para 2027 de todos modos.

      La afirmación de 30 veces mide tokens por segundo por usuario en un solo modelo, gpt-oss-120b, contra sistemas GPU no nombrados, y los 250 petaflops por oblea son un número FP16 disperso frente a 25 petaflops densos.

      Donde el diseño parece genuinamente diferenciado es en el consumo de energía. The Register estima que el CS-4 consume entre 120 y 140 kilovatios por rack, aproximadamente la mitad de lo que consumen los sistemas de rack comparables de AMD y Nvidia, lo que da un punto de partida plausible para el aumento de diez veces en el rendimiento por vatio.

      Andrew Feldman, el director ejecutivo, enmarcó el lanzamiento en torno a la latencia en lugar del rendimiento bruto. “En IA, la velocidad es productividad”, dijo en el anuncio, y le dijo a Reuters que la compañía espera ser “cuatro veces más rápida entre ahora y finales de 2027, y 20 veces más rendimiento”.

      Sean Lie, el director de tecnología, vinculó el argumento de velocidad a agentes en lugar de chatbots. Ser 30 veces más rápido, dijo, “da a un sistema agente espacio para más de un orden de magnitud de razonamiento, verificación o uso de herramientas”, que es la parte de la propuesta dirigida a compradores empresariales en lugar de tablas de referencia.

      Cerebras nombró a OpenAI, G42, MBZUAI y AWS junto con el lanzamiento, aunque no divulgó acuerdos de clientes del CS-4 ni precios.

      El rack Helios de AMD, presentado en julio, figura en la lista de socios, lo que es consistente con una compañía que ha dicho que trabajará con todos en hardware de IA excepto Nvidia.

      El panorama financiero es mixto. Los ingresos del segundo trimestre fueron de $180.1 millones, un aumento del 74% interanual con ingresos en la nube casi cuadruplicándose, pero cayeron secuencialmente desde $193.4 millones en el primer trimestre, y la presión sobre el margen que Cerebras señaló en junio no ha disminuido.

      El trimestre produjo una pérdida neta GAAP de $450.5 millones, una pérdida ajustada de $6.9 millones y $25.4 mil millones en obligaciones de rendimiento restantes. Cerebras guía a ingresos de $880 millones a $890 millones para todo el año y 600 megavatios de capacidad de centro de datos en funcionamiento y bajo contrato para finales de 2027.

      La concentración sigue siendo la cuestión estructural. G42 y la Universidad Mohamed bin Zayed de Inteligencia Artificial representaron juntos alrededor del 86% de los ingresos de 2025, y el contrato de OpenAI firmado en enero, por más de $10 mil millones en la firma, es la respuesta de la compañía a eso, junto con adiciones del segundo trimestre que incluyen Cognition, Lovable, CrowdStrike, Block y Figma.

      Los primeros envíos del CS-4 están programados para antes de que termine el trimestre. La prueba más difícil llegará en 2027, cuando la próxima generación tendrá que llegar en un nuevo silicio en lugar de un reloj más rápido.

Otros artículos

Este EV de 1918 tenía 42 baterías y más autonomía que un Leaf de 2011. Este EV de 1918 tenía 42 baterías y más autonomía que un Leaf de 2011. Un Detroit Electric de 1918 ofrecido en Monterey afirmaba tener un alcance de 80 millas, más que el primer Nissan Leaf. Lo que lo mató fue el precio, no el alcance. Alphabet recauda A$5.5 mil millones en Australia, más del doble de un récord establecido por Apple en 2015. Alphabet recauda A$5.5 mil millones en Australia, más del doble de un récord establecido por Apple en 2015. Alphabet fijó el precio de su primer bono en dólares australianos en A$5.5 mil millones (US$3.9 mil millones), la mayor venta de bonos corporativos en la historia de Australia y un aumento respecto a los A$5 mil millones esperados. La planta de baterías Lansing de LG, valorada en 2 mil millones de dólares, ahora está fabricando celdas. La planta de baterías Lansing de LG, valorada en 2 mil millones de dólares, ahora está fabricando celdas. LG Energy Solution ha comenzado la producción en Lansing, Michigan, en una planta que GM planeó, cofinanció y vendió. Sus clientes ahora son Toyota y Tesla. Un ganador del Premio Turing dice que la solución de la industria para quedarse sin datos es 'un gran error' Un ganador del Premio Turing dice que la solución de la industria para quedarse sin datos es 'un gran error' Richard Sutton dice que el giro de la industria hacia los datos sintéticos es “un gran error”. Su objeción es más estrecha y más interesante de lo que sugiere el titular. OpenAI está reescribiendo sus reglas de seguridad después de la violación de Hugging Face. OpenAI está reescribiendo sus reglas de seguridad después de la violación de Hugging Face. OpenAI está reescribiendo el Marco de Preparación después de que Astra se acercara a un umbral cibernético crítico. Su nuevo monitoreo cuesta aproximadamente el 20% del costo de computación. Medly AI recauda 8 millones de dólares para poner un tutor de IA frente a cada estudiante de examen en el Reino Unido. Medly AI recauda 8 millones de dólares para poner un tutor de IA frente a cada estudiante de examen en el Reino Unido. Medly AI ha recaudado 8 millones de dólares en una ronda semilla liderada por Felix Capital, semanas después de ganar un contrato del gobierno del Reino Unido por 300,000 libras para probar la tutoría de IA en alumnos que se están quedando atrás.

Cerebras lanza el CS-4, su primer sistema multi-wafer, aunque el chip en su interior no es nuevo.

El CS-4 de Cerebras agrupa tres obleas en un solo rack y afirma tener una velocidad de GPU 30 veces mayor. Sin embargo, el procesador interno es un WSE-3 con una frecuencia de reloj más alta.