Laptop con editor video AI e avatar olografico luminoso su scrivania minimalista, intelligenza artificiale per creazione video aziendale

Google Vids: avatar AI personali e editing video con Gemini Omni

Google trasforma il suo strumento di creazione video aziendale in una piattaforma completa di produzione con due aggiornamenti annunciati il 16 luglio 2026: l’arrivo di Gemini Omni per generare e modificare clip tramite prompt e la possibilità di creare un avatar digitale personale che riproduce volto e voce dell’utente. La mossa sposta Vids dal perimetro delle presentazioni assistite al territorio presidiato da startup come HeyGen, Synthesia, Captions e D-ID, portando l’intelligenza artificiale multimodale direttamente dentro Google Workspace.

Come Gemini Omni trasforma l’editing video in Vids

Gemini Omni consente di generare video di alta qualità partendo da un prompt testuale in linguaggio naturale, con la possibilità di aggiungere riferimenti visivi — una foto o uno schizzo — per maggiore precisione. Il modello combina testo e immagini per produrre clip che rispecchiano la visione dell’utente.

L’editing diventa conversazionale: invece di ricominciare da zero, si può modificare il video passo dopo passo descrivendo a parole ciò che si vuole cambiare. Tra le operazioni supportate ci sono:

  • Sostituzione dello sfondo
  • Correzione dell’illuminazione in riprese fatte con lo smartphone
  • Aggiunta di effetti visivi

Basta digitare un’istruzione per ottenere la modifica desiderata, senza toccare timeline o strumenti di post-produzione tradizionali.

Avatar personali: come creare il proprio doppio digitale

La seconda novità è la possibilità di mettere sé stessi al centro del video senza accendere una telecamera. Per creare l’avatar personale servono due elementi:

Laptop con editor video AI e avatar olografico luminoso su scrivania minimalista, intelligenza artificiale per creazione video aziendale
Con Gemini Omni, Google Vids permette di generare clip video tramite prompt e creare avatar digitali personali che replicano volto e voce.
  1. Un selfie
  2. Una breve registrazione vocale

Caricati questi due asset, l’utente può digitare il testo del messaggio e l’avatar lo reciterà con la propria voce e il proprio aspetto. L’avatar è vincolato all’identità del titolare dell’account Google e non può essere utilizzato per impersonare altre persone.

TechCrunch riporta che l’accesso agli avatar personali è limitato a utenti di almeno 18 anni e solo in alcune aree geografiche. La scelta di Google punta a contenere i rischi di uso improprio, in un momento in cui il settore è sotto osservazione: la testata ricorda che Sora di OpenAI, ora non più disponibile, aveva permesso agli utenti di generare video con il volto del CEO Sam Altman.

Disponibilità e trasparenza: chi può usare le nuove funzioni

Le due funzionalità sono attive per gli abbonati a Google AI Pro e Ultra e per i clienti Google Workspace business. Ogni clip generata con l’AI include un watermark digitale invisibile SynthID, che permette di verificare l’origine sintetica del contenuto — una misura pensata per garantire trasparenza nella condivisione dei video.

Oltre le presentazioni: Vids diventa una piattaforma di creazione video

L’aggiornamento segna un’evoluzione nella strategia di Google. Vids era nato come strumento di supporto alle presentazioni in ambito lavorativo; con Gemini Omni e gli avatar personali si trasforma in un ambiente completo per produrre video aziendali, formativi e di comunicazione interna senza competenze di montaggio.

La combinazione di editing conversazionale e avatar personalizzati riduce due attriti classici della produzione video: la complessità tecnica della post-produzione e la riluttanza a comparire in video. Per team distribuiti, formatori e responsabili HR che devono produrre aggiornamenti o messaggi su scala, il guadagno in velocità è immediato.

La competizione con le startup specializzate in avatar AI non sarà sul piano della nicchia tecnica, ma sull’integrazione: chi già lavora in Workspace trova ora queste capacità dentro lo stesso ecosistema, senza strumenti aggiuntivi. Il vero banco di prova sarà la qualità percepita degli avatar e la fedeltà dell’editing conversazionale su progetti complessi con scene multiple — terreno su cui i player verticali hanno accumulato vantaggio.

Fonti

Francesco Leone
Francesco Leone

Francesco Leone è un esperto in Intelligenza Artificiale con una profonda conoscenza in Machine Learning e Deep Learning. Attraverso la sua esperienza, ha contribuito allo sviluppo di soluzioni innovative in ambito di elaborazione del linguaggio naturale e visione artificiale, mirando a trasformare il modo in cui interagiamo con la tecnologia. Attivo nel settore con pubblicazioni e progetti su https://ital-ia.it/, Francesco si dedica alla ricerca e all'applicazione di algoritmi avanzati per rendere i sistemi più intelligenti e accessibili.

Articoli: 567

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *