Chip congelado de Google: Gemini integrado en el silicio

Chip congelado de Google: Gemini integrado en el silicio

      La mayoría de los chips de IA son de propósito general. Cargas un modelo en ellos y lo ejecutan. Google está supuestamente intentando algo más extraño: un chip que es el modelo, con el plano de Gemini grabado en el hardware mismo.

      El proyecto, llamado informalmente “Frozen v2”, fue reportado por The Information y recogido por Reuters y Bloomberg Law. Las acciones de Alphabet subieron hasta un 3.7% con la noticia. Google no ha confirmado el proyecto, y el chip está a años de distancia. Pero la idea detrás de esto es una apuesta seria sobre hacia dónde va la infraestructura de IA a continuación.

      Lo que significa 'congelado'

      Los chips de hoy mantienen el modelo en memoria y trasladan sus datos de un lado a otro. Esa flexibilidad cuesta energía y tiempo.

      Frozen v2 incorporaría la arquitectura de red neuronal de Gemini directamente en el circuito. El hardware se ajusta a la forma del diseño actual de IA de Google. Los ingenieros aún pueden actualizar el modelo cargando nuevos pesos, pero la estructura subyacente permanece fija, o “congelada”. Se dice que aún se está decidiendo cuánto del modelo se integrará de forma permanente.

      La recompensa es la eficiencia. The Information informa que el chip podría ser de 6 a 10 veces más eficiente que los últimos chips de IA personalizados de Google, medido por tokens servidos por unidad de energía. Sería una nueva línea de silicio, separada de los TPU de Google en lugar de un reemplazo. Se espera que la implementación sea tan pronto como en 2028.

      Por qué es importante

      El momento no es aleatorio. The Information dice que Frozen v2 es en parte una respuesta a una crisis de capacidad de IA dentro de Google. La presión es lo suficientemente severa como para que Google Cloud haya rechazado a algunos clientes externos, y ha generado tensiones internas.

      La eficiencia es el juego completo en este momento. Ejecutar modelos de IA es fabulosamente costoso, y cada vatio ahorrado a escala de centro de datos es dinero. Un chip ajustado para un modelo puede eliminar gran parte de la sobrecarga que lleva un chip general.

      También sería rápido. Debido a que el diseño es fijo, el chip puede responder con muy poco retraso. Como señaló un observador, eso se adapta a usos en tiempo real como los asistentes de voz, donde el retraso es el enemigo.

      También hay un ángulo estratégico. Google ya diseña sus propios TPU para reducir su dependencia de Nvidia. Un chip específico de Gemini llevaría esa autosuficiencia aún más lejos, profundizando un esfuerzo que también ha visto a Google diversificar sus órdenes de chips entre proveedores.

      Google no está solo

      El enfoque no es exclusivo de Google. Una startup llamada Taalas ya está vendiendo la idea, imprimiendo los pesos y la arquitectura de un modelo directamente en un chip que llama Hardcore.

      Los números que se afirman son llamativos. Taalas dice que su parte sirve hasta 17,000 tokens por segundo, en comparación con aproximadamente 150 por usuario en una GPU de Nvidia de alta gama. Dice que no necesita memoria de alto ancho de banda costosa, lo que aliviaría la presión de memoria que está apretando a la industria.

      Esa es la apuesta más amplia. Si un modelo puede vivir en silicio, intercambias flexibilidad por velocidad, costo y energía. Para una empresa que sirve un modelo a miles de millones de personas, ese intercambio puede tener sentido. Es el mismo instinto detrás de los esfuerzos por reducir modelos a teléfonos.

      El inconveniente

      El riesgo obvio es la rigidez. La IA se mueve rápido, y un chip construido alrededor del Gemini de hoy podría parecer anticuado para 2028. El diseño de Google intenta suavizar eso manteniendo los pesos actualizables, pero la arquitectura aún está establecida de antemano.

      Luego está el pequeño asunto de la confirmación. Google no ha reconocido el proyecto. Un portavoz dijo solo que sus equipos experimentan con ideas de alta eficiencia, y que no todos los proyectos de laboratorio llegan a producción.

      Así que trata Frozen v2 como una señal, no como un producto en producción. La señal es lo suficientemente clara. La carrera por el silicio de IA personalizado está pasando de ejecutar cualquier modelo a fusionar un modelo con el metal. Si Google lo logra, sus rivales tendrán que responder.

Otros artículos

Los vehículos eléctricos superaron en ventas a los de gasolina y diésel en Alemania por primera vez. La cuna del automóvil acaba de cambiar su combustible. Los vehículos eléctricos superaron en ventas a los de gasolina y diésel en Alemania por primera vez. La cuna del automóvil acaba de cambiar su combustible. Alemania registró 84,057 vehículos eléctricos en junio, superando a los híbridos (83,315), gasolina (60,796) y diésel (33,862). Los vehículos eléctricos ahora representan el 28.4% del mercado. El Tesla Model Y lideró. El viejo internet construyó un museo para los sonidos de tecnología en extinción, y de alguna manera sigue vivo. El viejo internet construyó un museo para los sonidos de tecnología en extinción, y de alguna manera sigue vivo. Este maravilloso museo en línea, datado, preserva módems de acceso telefónico, unidades de disquete, melodías de inicio de Windows y otros sonidos que desaparecieron silenciosamente a medida que nuestros dispositivos se volvieron más suaves, rápidos y mucho menos habladores. Los solteros están utilizando ChatGPT y Claude para escribir sus mensajes de citas. Las aplicaciones no tienen planes de detenerlo. Los solteros están utilizando ChatGPT y Claude para escribir sus mensajes de citas. Las aplicaciones no tienen planes de detenerlo. El 26% de los adultos en EE. UU. han utilizado IA para ayuda en citas. Match, Hinge y Bumble dicen que no están filtrando mensajes escritos por IA. El fenómeno se llama chatfishing. Z.AI construyó un gigantesco centro de datos de IA con chips fabricados en China. Z.AI construyó un gigantesco centro de datos de IA con chips fabricados en China. El laboratorio chino Z.AI ha completado un centro de datos de 1GW que funciona únicamente con chips fabricados en China para entrenar sus modelos GLM, sin Nvidia en su interior. Lo que esto significa para la IA. IA en Hollywood: Netflix, Nolan y la lucha por quién paga IA en Hollywood: Netflix, Nolan y la lucha por quién paga Netflix utilizó IA en 300 títulos, una actriz de IA consiguió un papel principal, y Nolan lo llamó un caballo de Troya. Dentro de la lucha por la IA en Hollywood. Seguridad de agentes de IA: cuatro ataques en julio, un fallo compartido Seguridad de agentes de IA: cuatro ataques en julio, un fallo compartido Cuatro equipos de investigación rompieron agentes de IA de cuatro maneras en diez días, desde Claude para Chrome hasta memoria envenenada. La brecha de seguridad de los agentes de IA, explicada.

Chip congelado de Google: Gemini integrado en el silicio

Un informe dice que el chip Google Frozen integraría a Gemini en silicio para lograr hasta 10 veces más eficiencia para 2028. Lo que significa para la IA.