El servidor de IA gratuito de ZML funciona en cualquier chip importante.

El servidor de IA gratuito de ZML funciona en cualquier chip importante.

      Una startup de París quiere aflojar el control de Nvidia sobre la IA, no con un nuevo chip, sino con software. ZML ha lanzado una herramienta gratuita que ejecuta modelos de código abierto rápidamente en silicio de Nvidia, AMD, Google, Apple e Intel por igual.

      Nvidia todavía domina el hardware de IA, pero sus muros siguen debilitándose. ZML, una startup de París respaldada por el pionero de la IA Yann LeCun, ha lanzado un software gratuito que ejecuta modelos de lenguaje de código abierto en una mezcla de chips, informa TechCrunch. La lista abarca cinco objetivos: Nvidia, AMD, los TPU de Google, Intel y Apple.

      La herramienta, ZML/LLMD, es un servidor de inferencia. Inferencia significa ejecutar un modelo entrenado para responder a solicitudes, la parte de la IA que ahora consume la mayor parte del cómputo. El fundador Steeve Morin dice que el objetivo es romper los silos que bloquean a los usuarios con un solo proveedor y exprimir cada chip a su máxima velocidad.

      Por qué importa una mezcla de chips

      El costo es el motor. A medida que las facturas de IA aumentan, las empresas y las nubes quieren la libertad de elegir silicio más barato o menos hambriento de energía para un trabajo determinado. “La idea es devolver a las personas el poder de crear su propio sistema”, dijo Morin. Hacerlo bien, y se lee menos como una característica y más como una cuña bajo el foso de Nvidia.

      También podría impulsar una ola de nuevos fabricantes de chips, muchos de ellos europeos. Morin mencionó a Axelera, Fractile, Kalray, SiPearl, VSORA y otros. Un software que trata sus chips como de primera clase, no como de segunda, ofrece a los compradores una razón real para probarlos.

      Una carrera abarrotada y costosa

      Morin no descarta a Nvidia y dice que ZML tiene una buena relación con el gigante de los chips. Pero el campo está abarrotado. La "fiebre del oro de la inferencia" ha acuñado rivales como Baseten, recientemente valorada en $13 mil millones, además de los equipos detrás de los proyectos de código abierto vLLM y SGLang. Todos persiguen el mismo premio: hacer que la IA sea más barata de ejecutar.

      Morin cree que ZML llega más lejos. “Hemos llegado al punto en que estamos co-diseñando silicio”, dijo. Su equipo ágil de 20 personas ha entregado rápidamente, con más lanzamientos por venir.

      Por qué importa

      LLMD se entrega gratis por ahora para recopilar uso, aún no es un producto de pago. Su raíz inusual es la señal más grande. Una herramienta construida para aflojar el control de Nvidia y respaldar la propia pila de IA de Europa llegó desde París, no desde Silicon Valley. Morin, quien recaudó $20 millones de inversores, incluidos Kima Ventures de Xavier Niel, lo expresó claramente. “No podría hacer ZML en ningún otro lugar que no sea París”, dijo.

Otros artículos

GPT-Live de OpenAI: ChatGPT voz que escucha y habla OpenAI ha lanzado GPT-Live, una voz de ChatGPT de dúplex completo que escucha y habla al mismo tiempo, con traducción en vivo. Se implementa para todos los usuarios, también los gratuitos. El error de GhostApproval rompe 6 principales agentes de codificación de IA El error de GhostApproval rompe 6 principales agentes de codificación de IA El 'GhostApproval' de Wiz utiliza un viejo truco de symlink para hacer que seis agentes de codificación de IA, desde Amazon Q hasta Cursor, escriban fuera del sandbox y entreguen la caja. La OTAN selecciona a Accenture y Leonardo para una nube segura de 200 millones de euros. La OTAN selecciona a Accenture y Leonardo para una nube segura de 200 millones de euros. La OTAN firma un contrato de ~200 millones de euros, por siete años, con Accenture y Leonardo para construir una infraestructura de nube segura, la Red Empresarial Protegida, para la Alianza. El CEO de ElevenLabs sobre los $600 millones en ingresos y los laboratorios de IA El CEO de ElevenLabs sobre los $600 millones en ingresos y los laboratorios de IA En la cumbre RAISE en París, el CEO de ElevenLabs, Mati Staniszewski, detalló un camino hacia unos ingresos reportados de $600 millones y cómo la startup de voz planea superar a los laboratorios de IA. Solo el 6% de los gerentes del Reino Unido creen que la Generación Z está lista para trabajar. Solo el 6% de los gerentes del Reino Unido creen que la Generación Z está lista para trabajar. Un informe de CMI encuentra que el 45% de la Generación Z del Reino Unido se siente listo para trabajar, pero solo el 6% de los gerentes está de acuerdo, y el 82% de esos gerentes fueron promovidos sin ninguna capacitación. Solo el 6% de los gerentes del Reino Unido piensan que la Generación Z está lista para trabajar. Solo el 6% de los gerentes del Reino Unido piensan que la Generación Z está lista para trabajar. Un informe de CMI encuentra que el 45% de la Generación Z del Reino Unido se siente listo para trabajar, pero solo el 6% de los gerentes está de acuerdo, y el 82% de esos gerentes fueron promovidos sin capacitación alguna.

El servidor de IA gratuito de ZML funciona en cualquier chip importante.

ZML de Francia lanza ZML/LLMD, un servidor de inferencia gratuito que ejecuta IA de código abierto en chips de Nvidia, AMD, Google, Intel y Apple a máxima velocidad.