Il nuovo modello Flash elabora testi, immagini e audio per generare clip fotorealistiche, rispettare le leggi della fisica e creare avatar digitali personalizzati.
Google compie un passo decisivo nell'evoluzione dell'intelligenza artificiale con il lancio di Gemini Omni, un modello di nuova generazione sviluppato da Google DeepMind in cui la capacità di ragionamento logico si fonde con la creatività pura. Costruito fin dall'inizio come un'architettura nativamente multimodale, Omni è in grado di elaborare qualsiasi combinazione di input – testi, immagini, video e file audio – per generare video ad altissima fedeltà ancorati alla conoscenza del mondo reale. La prima versione della famiglia a debuttare sul mercato è Gemini Omni Flash, rilasciata globalmente per gli abbonati ai piani Google AI Plus, Pro e Ultra all'interno dell'app Gemini e di Google Flow, oltre a essere integrata gratuitamente per gli utenti di YouTube Shorts e dell'app YouTube Create.
La principale innovazione di Gemini Omni risiede nella possibilità di effettuare l'editing video attraverso una normale conversazione. Utilizzando il linguaggio naturale, l'utente può istruire il modello per modificare l'azione, inserire nuovi personaggi o alterare la materia degli oggetti, ad esempio trasformando una scultura in bolle di sapone o facendo increspare uno specchio come fosse un liquido. Ogni comando si sviluppa in modo sequenziale basandosi sul precedente: il sistema garantisce la perfetta coerenza dei personaggi e della fisica della scena, ricordando ciò che è accaduto nei fotogrammi antecedenti e permettendo di affinare il risultato su più passaggi consecutivi senza mai perdere il filo della narrazione originale.
Il modello si distingue dai tradizionali sistemi di pattern matching per la sua profonda comprensione del contesto e delle leggi della natura. Omni vanta una sensibilità intuitiva migliorata verso forze come la gravità, l'energia cinetica e la dinamica dei fluidi, che si traduce in effetti visivi dai movimenti estremamente realistici. Sfruttando l'enorme bagaglio di conoscenze storiche, scientifiche e culturale di Gemini, il software è in grado di creare video esplicativi complessi a partire da brevi descrizioni testuali – come la spiegazione del ripiegamento proteico in stile claymation (stop-motion con la plastilina) – unendo la precisione concettuale a una resa estetica impeccabile.
Parallelamente alle funzioni di editing, Google ha introdotto una funzionalità per la creazione di video tramite il proprio avatar digitale, consentendo agli utenti di generare contenuti video e tracce vocali che riproducono fedelmente le proprie sembianze e la propria voce. Sul fronte della sicurezza e della trasparenza, fondamentale per contrastare la diffusione di falsi d'autore, Google ha annunciato che tutti i contenuti generati con la nuova tecnologia includeranno la filigrana digitale impercettibile SynthID e le credenziali C2PA. Questa tracciabilità consentirà a chiunque di verificare la natura sintetica del video in modo rapido e sicuro attraverso l'app Gemini, Chrome e la Ricerca Google, integrandosi nei sistemi aziendali prima del prossimo rilascio del modello agli sviluppatori tramite API.
Gemini Omni Flash è in fase di rilascio per tutti gli abbonati a Google AI Pro e Ultra a livello globale attraverso l'app Gemini e Google Flow. A partire da questa settimana, sarà disponibile gratuitamente anche per gli utenti di YouTube Shorts e dell'app YouTube Create.
Esplora altri articoli su questi argomenti
Se questo articolo ti è piaciuto e vuoi rimanere sempre informato
L'’intelligenza artificiale nella GDO italiana è una necessità operativa, anche se nel retail mancano le competenze interne e il grave ritardo normativo: la maggioranza delle insegne hanno ancora affrontato la compliance rispetto all'AI Act europeo.
11-07-2026
Basato sulla potente famiglia di modelli GPT-5.6, il nuovo agente trasforma gli obiettivi in risultati concreti, operando direttamente su file e applicazioni per rivoluzionare il flusso di lavoro professionale.
10-07-2026
Una soluzione d’avanguardia per migliorare la qualità dell’aria e proteggere la sicurezza dei pazienti, riducendo drasticamente i costi del Servizio Sanitario Nazionale.
10-07-2026
Imprenditrice trentaseienne, esponente del manifatturiero: la nomina riflette l’identità della Società Benefit di Assolombarda, tra spinta all’innovazione, valorizzazione dei giovani e parità di genere. Affiancherà alla guida della società l'AD Alessandro Scarabelli e la DG Alessandra Scipioni
09-07-2026
Lo studio presentato dal prof. Salvatore Di Somma a Torino apre nuove frontiere: l'ambiente estremo dello spazio accelera i processi di invecchiamento, trasformandosi in un laboratorio naturale per individuare malattie croniche, tumori e infarti prima che si manifestino.
Il nuovo monitoraggio CIRO rivela una regione dinamica, leader nello sviluppo industriale e nei trasporti, ma frenata da criticità strutturali nel consumo di suolo e nelle performance del comparto agricolo.
In questo contributo, a cura di Umberto Arcangeli, Amministratore Delegato Dassault Systèmes Italia, EUROMED Managing Director Dassault Systèmes, viene posto l'accento su come i virtual twin, l'intelligenza artificiale e altre soluzioni digitali possono migliorare tutto l'iter farmacologico, dalla scoperta ai trial clinici. Interessante è anche il ruolo di Dassault Systèmes all'interno del consorzio internazionale BioPhorum.
L'iniziativa trasformerà 50.000 ettari di terreno degradato nell'Eastern Cape attraverso la piantumazione di 180 milioni di arbusti di spekboom, generando migliaia di posti di lavoro e crediti di carbonio di alta qualità.