Il nuovo modello Flash elabora testi, immagini e audio per generare clip fotorealistiche, rispettare le leggi della fisica e creare avatar digitali personalizzati.
Google compie un passo decisivo nell'evoluzione dell'intelligenza artificiale con il lancio di Gemini Omni, un modello di nuova generazione sviluppato da Google DeepMind in cui la capacità di ragionamento logico si fonde con la creatività pura. Costruito fin dall'inizio come un'architettura nativamente multimodale, Omni è in grado di elaborare qualsiasi combinazione di input – testi, immagini, video e file audio – per generare video ad altissima fedeltà ancorati alla conoscenza del mondo reale. La prima versione della famiglia a debuttare sul mercato è Gemini Omni Flash, rilasciata globalmente per gli abbonati ai piani Google AI Plus, Pro e Ultra all'interno dell'app Gemini e di Google Flow, oltre a essere integrata gratuitamente per gli utenti di YouTube Shorts e dell'app YouTube Create.
La principale innovazione di Gemini Omni risiede nella possibilità di effettuare l'editing video attraverso una normale conversazione. Utilizzando il linguaggio naturale, l'utente può istruire il modello per modificare l'azione, inserire nuovi personaggi o alterare la materia degli oggetti, ad esempio trasformando una scultura in bolle di sapone o facendo increspare uno specchio come fosse un liquido. Ogni comando si sviluppa in modo sequenziale basandosi sul precedente: il sistema garantisce la perfetta coerenza dei personaggi e della fisica della scena, ricordando ciò che è accaduto nei fotogrammi antecedenti e permettendo di affinare il risultato su più passaggi consecutivi senza mai perdere il filo della narrazione originale.
Il modello si distingue dai tradizionali sistemi di pattern matching per la sua profonda comprensione del contesto e delle leggi della natura. Omni vanta una sensibilità intuitiva migliorata verso forze come la gravità, l'energia cinetica e la dinamica dei fluidi, che si traduce in effetti visivi dai movimenti estremamente realistici. Sfruttando l'enorme bagaglio di conoscenze storiche, scientifiche e culturale di Gemini, il software è in grado di creare video esplicativi complessi a partire da brevi descrizioni testuali – come la spiegazione del ripiegamento proteico in stile claymation (stop-motion con la plastilina) – unendo la precisione concettuale a una resa estetica impeccabile.
Parallelamente alle funzioni di editing, Google ha introdotto una funzionalità per la creazione di video tramite il proprio avatar digitale, consentendo agli utenti di generare contenuti video e tracce vocali che riproducono fedelmente le proprie sembianze e la propria voce. Sul fronte della sicurezza e della trasparenza, fondamentale per contrastare la diffusione di falsi d'autore, Google ha annunciato che tutti i contenuti generati con la nuova tecnologia includeranno la filigrana digitale impercettibile SynthID e le credenziali C2PA. Questa tracciabilità consentirà a chiunque di verificare la natura sintetica del video in modo rapido e sicuro attraverso l'app Gemini, Chrome e la Ricerca Google, integrandosi nei sistemi aziendali prima del prossimo rilascio del modello agli sviluppatori tramite API.
Gemini Omni Flash è in fase di rilascio per tutti gli abbonati a Google AI Pro e Ultra a livello globale attraverso l'app Gemini e Google Flow. A partire da questa settimana, sarà disponibile gratuitamente anche per gli utenti di YouTube Shorts e dell'app YouTube Create.
Esplora altri articoli su questi argomenti
Se questo articolo ti è piaciuto e vuoi rimanere sempre informato
Promosso dal Politecnico di Torino e dall'ITCILO delle Nazioni Unite, il corso punta a colmare un deficit di competenze digitali che oggi riguarda il 60% dei lavoratori italiani.
24-08-2026
L'operazione segna l'avvio del piano d'investimento Sophocles da 507 milioni di euro per Sunprime, mentre per Starlight rappresenta il completamento di una piattaforma di oltre 300 MW sviluppata in sei anni.
24-08-2026
Nelle tenute tra Veneto e Friuli la viticoltura di precisione unisce sensori, droni e piattaforme digitali per ridurre i consumi idrici, tagliare i trattamenti fitosanitari e valorizzare al massimo la qualità delle uve.
23-08-2026
Secondo una ricerca di The Trade Desk e PA Consulting, il 95% del tempo digitale si svolge al di fuori degli ambienti AI. Sebbene il 77% degli utenti utilizzi i motori di ricerca intelligenti, per le decisioni importanti la scelta finale premia i media premium e l'open web.
22-08-2026
Secondo i dati diffusi da Terna, la domanda mensile ha raggiunto quota 32,5 TWh a causa delle temperature eccezionalmente elevate. Crescono anche la produzione industriale e il fotovoltaico, che porta le rinnovabili a coprire il 41,5% del fabbisogno.
La nuova piattaforma introduce livelli di accesso governati, prestazioni record nella ricerca delle vulnerabilità e una vasta rete di partner strategici per proteggere le organizzazioni dalle minacce digitali.
GenBio AI ("GenBio") è una società specializzata in IA per uso scientifico, cofondata dal premio Nobel David Baker, dallo scienziato leader in ambito IA Eric Xing e da altri importanti ricercatori n...
Nanochon, azienda produttrice di dispositivi medici che ha sviluppato Chondrograft™, un nuovo impianto brevettato per il trattamento dei difetti della cartilagine articolare del ginocchio, oggi ha a...