El servidor de IA gratuito de ZML funciona en cualquier chip importante.

El servidor de IA gratuito de ZML funciona en cualquier chip importante.

      Una startup de París quiere aflojar el control de Nvidia sobre la IA, no con un nuevo chip, sino con software. ZML ha lanzado una herramienta gratuita que ejecuta modelos de código abierto rápidamente en silicio de Nvidia, AMD, Google, Apple e Intel por igual.

      Nvidia todavía domina el hardware de IA, pero sus muros siguen debilitándose. ZML, una startup de París respaldada por el pionero de la IA Yann LeCun, ha lanzado un software gratuito que ejecuta modelos de lenguaje de código abierto en una mezcla de chips, informa TechCrunch. La lista abarca cinco objetivos: Nvidia, AMD, los TPU de Google, Intel y Apple.

      La herramienta, ZML/LLMD, es un servidor de inferencia. Inferencia significa ejecutar un modelo entrenado para responder a solicitudes, la parte de la IA que ahora consume la mayor parte del cómputo. El fundador Steeve Morin dice que el objetivo es romper los silos que bloquean a los usuarios con un solo proveedor y exprimir cada chip a su máxima velocidad.

      Por qué importa una mezcla de chips

      El costo es el motor. A medida que las facturas de IA aumentan, las empresas y las nubes quieren la libertad de elegir silicio más barato o menos hambriento de energía para un trabajo determinado. “La idea es devolver a las personas el poder de crear su propio sistema”, dijo Morin. Hacerlo bien, y se lee menos como una característica y más como una cuña bajo el foso de Nvidia.

      También podría impulsar una ola de nuevos fabricantes de chips, muchos de ellos europeos. Morin mencionó a Axelera, Fractile, Kalray, SiPearl, VSORA y otros. Un software que trata sus chips como de primera clase, no como de segunda, ofrece a los compradores una razón real para probarlos.

      Una carrera abarrotada y costosa

      Morin no descarta a Nvidia y dice que ZML tiene una buena relación con el gigante de los chips. Pero el campo está abarrotado. La "fiebre del oro de la inferencia" ha acuñado rivales como Baseten, recientemente valorada en $13 mil millones, además de los equipos detrás de los proyectos de código abierto vLLM y SGLang. Todos persiguen el mismo premio: hacer que la IA sea más barata de ejecutar.

      Morin cree que ZML llega más lejos. “Hemos llegado al punto en que estamos co-diseñando silicio”, dijo. Su equipo ágil de 20 personas ha entregado rápidamente, con más lanzamientos por venir.

      Por qué importa

      LLMD se entrega gratis por ahora para recopilar uso, aún no es un producto de pago. Su raíz inusual es la señal más grande. Una herramienta construida para aflojar el control de Nvidia y respaldar la propia pila de IA de Europa llegó desde París, no desde Silicon Valley. Morin, quien recaudó $20 millones de inversores, incluidos Kima Ventures de Xavier Niel, lo expresó claramente. “No podría hacer ZML en ningún otro lugar que no sea París”, dijo.

Otros artículos

Los clientes prefieren ChatGPT a los chatbots de la empresa, según Gartner. Los clientes prefieren ChatGPT a los chatbots de la empresa, según Gartner. Los clientes tienen 3 veces más probabilidades de utilizar GenAI de terceros como ChatGPT que los chatbots de la empresa para soporte, según Gartner, ya que los retornos de IA retrasan el gasto. Perplexity está construyendo silenciosamente una herramienta de codificación de IA. Perplexity está construyendo silenciosamente una herramienta de codificación de IA. Perplexity ha construido una herramienta de codificación interna con el nombre en clave "Teammate" que podría competir con Cursor y Claude Code, informa Business Insider. Un lanzamiento no está confirmado. GPT-Live de OpenAI: ChatGPT voz que escucha y habla OpenAI ha lanzado GPT-Live, una voz de ChatGPT de dúplex completo que escucha y habla al mismo tiempo, con traducción en vivo. Se implementa para todos los usuarios, incluidos los gratuitos. GPT-Live de OpenAI: ChatGPT voz que escucha y habla OpenAI ha lanzado GPT-Live, una voz de ChatGPT de dúplex completo que escucha y habla al mismo tiempo, con traducción en vivo. Se implementa para todos los usuarios, también los gratuitos. La OTAN elige a Accenture y Leonardo para una nube segura de 200 millones de euros. La OTAN elige a Accenture y Leonardo para una nube segura de 200 millones de euros. La OTAN firma un contrato de ~200 millones de euros, por siete años, con Accenture y Leonardo para construir una infraestructura de nube segura, la Red Empresarial Protegida, para la Alianza. GPT-Live de OpenAI: ChatGPT voz que escucha y habla OpenAI ha lanzado GPT-Live, una voz de ChatGPT de dúplex completo que escucha y habla al mismo tiempo, con traducción en vivo. Se implementa para todos los usuarios, también los gratuitos.

El servidor de IA gratuito de ZML funciona en cualquier chip importante.

ZML de Francia lanza ZML/LLMD, un servidor de inferencia gratuito que ejecuta IA de código abierto en chips de Nvidia, AMD, Google, Intel y Apple a máxima velocidad.