Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K.

Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K.

      Google

      

      

      

       Generar un video corto de IA es una cosa; hacer que varias tomas realmente parezcan pertenecer al mismo video es un problema mucho más difícil. Google está intentando nuevamente con Gemini Omni 1.1 Flash, su último modelo de video generativo destinado a dar a los creadores y desarrolladores mucho más control sobre lo que sucede entre el primer fotograma y el último.

      El cambio más grande es cuánto de un video existente puede recordar Gemini cuando le pides que continúe una escena. Omni 1.1 puede mirar hasta 10 segundos de metraje previo para contexto, en lugar de depender solo del último segundo. Eso debería ayudar a mantener a los personajes, los entornos y la dirección general de una escena más consistentes en lugar de adivinar efectivamente lo que debería suceder a continuación.

      Tus videos de IA no tienen que terminar tan rápido

      Google también está dando a los creadores considerablemente más espacio para mantener esas escenas en marcha. Los videos se pueden extender en fragmentos de 10 segundos hasta alcanzar una longitud total de 40 segundos. Eso puede no sonar particularmente largo en comparación con un video tradicional, pero abre mucho más espacio para secuencias generadas por IA con un verdadero principio, medio y fin.

      Shimul Sood / Digital Trends

      Los creadores también pueden proporcionar tanto el primer como el último fotograma que desean para una toma. Gemini luego genera todo lo necesario para conectar los dos. Eso podría ser útil para crear un movimiento de cámara alrededor de un sujeto, haciendo zoom suavemente entre composiciones, o construyendo un clip diseñado para repetirse sin un salto obvio. También se admiten referencias de video. Puedes alimentar a Gemini hasta tres segundos de metraje existente para darle al modelo contexto visual adicional, lo que Google dice que debería ayudar a mantener cosas como la apariencia de los personajes a través de escenas generadas.

      No necesitas renderizar todo en 4K

      No todos los experimentos necesitan comenzar en calidad máxima, y una de las adiciones más prácticas de Omni 1.1 reconoce exactamente eso. Los desarrolladores pueden generar vistas previas de 360p que Google afirma son hasta un 60% más rápidas que su salida regular de 720p, mientras que cuestan aproximadamente un tercio. Eso facilita probar rápidamente una idea, ajustar indicaciones o trabajar en varias versiones antes de gastar más tiempo y dinero en el resultado final. Una vez que estés satisfecho con ello, Omni 1.1 puede producir metraje de 1080p o escalar el video terminado hasta 4K.

      Google

      La compañía ya está haciendo que Omni 1.1 Flash esté disponible para desarrolladores a través de la API de Gemini en Google AI Studio, mientras que las empresas pueden acceder a ella a través de la Plataforma de Agentes empresariales de Google. No necesariamente necesitas estar construyendo una aplicación para probar algunos de estos trucos, tampoco. Omni 1.1 se está implementando globalmente en Google Flow para suscriptores de AI Plus, Pro y Ultra. La extensión de escenas también llegará a esos suscriptores directamente dentro de la aplicación Gemini, haciendo que una de las habilidades más interesantes del modelo sea considerablemente más fácil de probar.

      

      

      

      

      

      

      

      

      

      

       Shimul es colaborador en Digital Trends, con más de cinco años de experiencia en el ámbito tecnológico.

      

      

      

      

      

      

       Anthropic presenta un nuevo estándar para agilizar las conexiones de IA a máquinas

      

       El Estándar de Hardware de Modelo proporciona una capa de traducción universal, dando a los agentes de IA controles estándar para operar equipos de laboratorio y máquinas de fábrica.

      

       Anthropic ha lanzado una vista previa de investigación de su Estándar de Hardware de Modelo (MHS), una especificación compartida diseñada para permitir que los agentes de IA controlen de manera segura instrumentos de laboratorio y equipos de fábrica. La compañía afirma que el MHS reduce el tiempo necesario para integrar maquinaria compleja con IA de meses a horas o minutos. El estándar está actualmente disponible para laboratorios de investigación y fabricantes seleccionados a través de una lista de espera, pero Anthropic planea hacerlo de código abierto en el futuro.

      Cómo el estándar conecta la IA a dispositivos físicos

      

       Leer más

      

      

      

       Por qué pensar como un ingeniero es esencial para los niños en la era de la IA

      

       Quizás el mejor regalo que puedes dar a tus hijos es la experiencia del fracaso. Suena radical, quizás incluso un poco incómodo, particularmente cuando gran parte de la crianza implica tratar de proteger a los niños de la frustración y la decepción. Sin embargo, al intervenir cada vez que algo se vuelve difícil, también podemos estar quitando oportunidades para que desarrollen las habilidades que necesitarán para navegar en un mundo cada vez más impredecible.

      La pregunta se ha vuelto más urgente a medida que la inteligencia artificial cambia la forma en que pensamos sobre el trabajo. En una conversación anterior de Trending Forward, exploré qué sucede cuando la IA comienza a hacerse cargo de tareas y habilidades que antes requerían años de capacitación. El desafío no es simplemente predecir qué trabajos podrían desaparecer. Se trata de averiguar cómo preparar a las personas para un mercado laboral donde las habilidades que son valiosas hoy pueden no parecer tan valiosas dentro de una o dos décadas.

      

       Leer más

      

      

      

       Microduck de Pollen Robotics tiene como objetivo hacer que el entrenamiento de IA física sea mucho menos frágil y más barato

      

       Microduck es un bípedo diminuto de $399 construido para que los desarrolladores experimenten con IA física, ofreciendo una forma asequible de entrenar y probar nuevos comportamientos robóticos sin arriesgar hardware costoso.

      

       Pollen Robotics y Hugging Face están de vuelta con otro robot, y este es deliciosamente desquiciado. Microduck es un bípedo de 25 cm de altura que se mueve de manera torpe, diseñado para llevar la IA de tu pantalla a tu escritorio. Las preordenes se abren hoy, con las primeras entregas programadas antes de Navidad de 2026.

      A diferencia de su predecesor, el Reachy Mini, Microduck está construido completamente en torno a la acción. Funciona con 15 motores, tiene un pico articulado para recoger objetos, una cámara, un sensor de profundidad, dos IMUs y suficiente equilibrio para caminar, agacharse e incluso patinar.

      

       Leer más

Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K. Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K.

Otros artículos

Gemini Omni ahora puede extender videos a 40 segundos y mejorarlos a 4K.

La caja de herramientas de video de Gemini se ha vuelto mucho más grande, con clips más largos, salida en 4K y mucho más control sobre cada toma.