Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K

Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K

      Google

      

      

      

       Gestire un breve video AI è una cosa; ottenere che diverse riprese sembrino effettivamente appartenere allo stesso video è un problema molto più difficile. Google sta tentando di affrontare nuovamente questo aspetto con Gemini Omni 1.1 Flash, il suo ultimo modello di video generativo mirato a dare ai creatori e agli sviluppatori molto più controllo su ciò che accade tra il primo fotogramma e l'ultimo.

      Il cambiamento più grande è quanto di un video esistente Gemini può ricordare quando gli chiedi di continuare una scena. Omni 1.1 può guardare fino a 10 secondi di riprese precedenti per il contesto, invece di fare affidamento solo sull'ultimo secondo. Questo dovrebbe aiutarlo a mantenere i personaggi, gli ambienti e la direzione generale di una scena più coerenti invece di indovinare effettivamente cosa dovrebbe accadere dopo.

      I tuoi video AI non devono finire così rapidamente

      Google sta anche dando ai creatori notevolmente più spazio per mantenere quelle scene in corso. I video possono essere estesi in blocchi di 10 secondi fino a raggiungere una lunghezza totale di 40 secondi. Questo potrebbe non sembrare particolarmente lungo rispetto a un video tradizionale, ma apre molto più spazio per sequenze generate dall'AI con un vero inizio, mezzo e fine.

      Shimul Sood / Digital Trends

      I creatori possono anche fornire sia il primo che l'ultimo fotogramma che desiderano per una ripresa. Gemini genera quindi tutto il necessario per collegare i due. Questo potrebbe essere utile per creare un movimento della telecamera attorno a un soggetto, zoomando dolcemente tra le composizioni o costruendo un clip progettato per ripetersi senza un salto evidente. Anche i riferimenti video sono supportati. Puoi fornire a Gemini fino a tre secondi di riprese esistenti per dare al modello un contesto visivo aggiuntivo, il che, secondo Google, dovrebbe aiutare a mantenere elementi come l'aspetto del personaggio attraverso le scene generate.

      Non è necessario renderizzare tutto in 4K

      Non ogni esperimento deve iniziare alla massima qualità, e una delle aggiunte più pratiche di Omni 1.1 riconosce esattamente questo. Gli sviluppatori possono generare anteprime a 360p che Google afferma essere fino al 60% più veloci rispetto all'output regolare a 720p, costando circa un terzo. Questo rende più facile testare rapidamente un'idea, modificare i prompt o lavorare su diverse versioni prima di spendere più tempo e denaro sul risultato finale. Una volta che sei soddisfatto, Omni 1.1 può produrre riprese a 1080p o ingrandire il video finito fino a 4K.

      Google

      L'azienda sta già rendendo disponibile Omni 1.1 Flash agli sviluppatori tramite l'API Gemini in Google AI Studio, mentre le aziende possono accedervi tramite la piattaforma Agent di Google per le imprese. Non è necessario costruire un'app per provare alcuni di questi trucchi. Omni 1.1 sta venendo distribuito a livello globale in Google Flow per gli abbonati AI Plus, Pro e Ultra. L'estensione delle scene arriverà anche a quegli abbonati direttamente all'interno dell'app Gemini, rendendo una delle nuove capacità più interessanti del modello notevolmente più facile da provare.

      

      

      

      

      

      

      

      

      

      

       Shimul è un collaboratore di Digital Trends, con oltre cinque anni di esperienza nel settore tecnologico.

      

      

      

      

      

      

       Anthropic presenta un nuovo standard per semplificare le connessioni AI-macchina

      

       Lo Standard Hardware del Modello fornisce uno strato di traduzione universale, dando agli agenti AI controlli standard per gestire attrezzature da laboratorio e macchine industriali.

      

       Anthropic ha lanciato un'anteprima di ricerca del suo Standard Hardware del Modello (MHS), una specifica condivisa progettata per consentire agli agenti AI di controllare in modo sicuro strumenti da laboratorio e attrezzature industriali. L'azienda afferma che il MHS riduce il tempo necessario per integrare macchinari complessi con l'AI da mesi a ore o minuti. Lo standard è attualmente disponibile per alcuni laboratori di ricerca e produttori tramite una lista d'attesa, ma Anthropic prevede di renderlo open-source in futuro.

      Come lo standard collega l'AI ai dispositivi fisici

      

       Leggi di più

      

      

      

       Perché pensare come un ingegnere è essenziale per i bambini nell'era dell'AI

      

       Forse il miglior regalo che puoi fare ai tuoi figli è l'esperienza del fallimento. Suona radicale, forse anche un po' scomodo, in particolare quando gran parte della genitorialità comporta cercare di proteggere i bambini dalla frustrazione e dalla delusione. Eppure, intervenendo ogni volta che qualcosa diventa difficile, potremmo anche togliere loro opportunità di sviluppare le stesse abilità di cui avranno bisogno per navigare in un mondo sempre più imprevedibile.

      La questione è diventata più urgente man mano che l'intelligenza artificiale cambia il modo in cui pensiamo al lavoro. In una precedente conversazione di Trending Forward, ho esplorato cosa succede quando l'AI inizia a prendere il controllo di compiti e abilità che una volta richiedevano anni di formazione. La sfida non è semplicemente prevedere quali lavori potrebbero scomparire. Si tratta di capire come preparare le persone per un mercato del lavoro in cui le abilità che oggi sono preziose potrebbero non sembrare così preziose tra un decennio o due.

      

       Leggi di più

      

      

      

       Il Microduck di Pollen Robotics mira a rendere l'addestramento dell'AI fisica molto meno fragile e più economico

      

       Microduck è un bipede piccolo da $399 costruito per consentire agli sviluppatori di sperimentare con l'AI fisica, offrendo un modo conveniente per addestrare e testare nuovi comportamenti robotici senza rischiare hardware costoso.

      

       Pollen Robotics e Hugging Face sono tornati con un altro robot, e questo è deliziosamente slegato. Microduck è un bipede di 25 cm di altezza progettato per portare l'AI fuori dallo schermo e sulla tua scrivania. Gli ordini anticipati aprono oggi, con le prime consegne previste prima di Natale 2026.

      A differenza del suo predecessore, il Reachy Mini, Microduck è costruito interamente attorno all'azione. Funziona con 15 motori, ha un becco articolato per raccogliere oggetti, una telecamera, un sensore di profondità, due IMU e abbastanza equilibrio per camminare, accovacciarsi e persino pattinare.

Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K

Altri articoli

Gemini Omni può ora estendere i video a 40 secondi e migliorarli a 4K

La cassetta degli attrezzi video di Gemini è appena diventata molto più grande, con clip più lunghe, output 4K e molto più controllo su ogni ripresa.