🤖 Cosa cambia
- Gemini Omni 1.1 Flash genera gratuitamente video 1080p dentro Google Vids, con controllo su scene, durata e transizioni.
- Connected Apps aggiunge Adobe, Airtable, Linear, monday.com, Webflow, Peloton e altri servizi controllabili direttamente dalla conversazione.
- Gemini 3.8 TTS, Beam e MedGemma mostrano la stessa architettura AI applicata rispettivamente a voce, presenza remota e sanità.
Google ha pubblicato nello stesso giorno una serie di aggiornamenti che, letti separatamente, sembrano appartenere a prodotti differenti; letti insieme mostrano invece la trasformazione di Gemini in un livello operativo comune. Il modello genera video in Vids, controlla applicazioni esterne attraverso Connected Apps, produce voci personalizzabili con Gemini 3.8 TTS, alimenta comunicazione tridimensionale attraverso Beam e fornisce modelli open-weight specializzati alla sanità tramite MedGemma. Google non sta più semplicemente aggiungendo “funzioni AI” alle applicazioni: sta facendo convergere applicazioni, modelli e servizi attorno alla stessa infrastruttura conversazionale e multimodale.
Cosa leggere
Google Vids porta Gemini Omni gratuito nella produzione video 1080p
La novità più visibile arriva da Google Vids. Google apre a qualunque account Google la generazione video con Gemini Omni 1.1 Flash, permettendo di creare gratuitamente scene fino a 1080p dal desktop. Il sistema permette di controllare durata delle singole scene, transizioni e struttura del filmato attraverso prompt, riducendo la necessità di utilizzare una timeline tradizionale. Ogni clip generata dall’AI include inoltre un watermark digitale dichiarato da Google per segnalarne l’origine sintetica. La funzione completa un percorso già iniziato con Google Vids integrato in Slides e la progressiva espansione della generazione video. La differenza è economica e distributiva: Gemini Omni non è più confinato a un’esperienza premium o sperimentale, ma entra in uno strumento accessibile agli account Google ordinari.
Leggi anche: NotebookLM diventa Gemini Notebook mentre Vids riceve avatar e Connected Apps
Connected Apps trasforma Gemini in un pannello di controllo per servizi esterni
Il secondo sviluppo è ancora più importante sul piano agentico. Con le nuove Connected Apps di Gemini, Google aggiunge servizi che non appartengono direttamente al proprio ecosistema: Airtable, Linear, monday.com, PandaDoc, Zoho, Adobe, Picsart, Squarespace, Webflow, Experian, Peloton e SeatGeek sono tra le integrazioni in rollout. L’utente può collegare il servizio dalle impostazioni oppure richiamarlo direttamente nella conversazione attraverso una @mention. Gemini diventa quindi il livello nel quale un’attività viene descritta e l’applicazione sottostante lo strumento che la esegue. È l’evoluzione della Gemini Extended Thinking che aveva già iniziato a collegare Canva, Instacart e OpenTable. Il valore non risiede nel numero delle integrazioni, ma nell’erosione del confine tra chatbot e interfaccia delle applicazioni: se il modello conosce l’intenzione e possiede l’autorizzazione necessaria, l’utente deve sempre meno sapere quale menu utilizzare.
Gemini 3.8 TTS trasforma la voce in un oggetto programmabile
Google ha contemporaneamente presentato Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS. I due modelli permettono di creare voci da zero attraverso linguaggio naturale e di controllare linea per linea ritmo, emozione, accento, pause e segnali conversazionali. Flash TTS è orientato alla direzione creativa e alla costruzione di personaggi; Flash-Lite TTS punta invece a grandi volumi di dubbing, contenuti audio e voice agent con costi inferiori. I modelli vengono distribuiti attraverso Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook e Google Vids.
La voce entra così nello stesso stack utilizzato da Gemini 3.8 Live per gli agenti vocali e il ragionamento in tempo reale. Non è più soltanto l’output finale di un assistente: diventa un componente programmabile del prodotto, controllabile attraverso prompt e utilizzabile per podcast, videogiochi, audiolibri e interfacce conversazionali.
Beam porta la stessa AI nella presenza remota
Sul versante hardware Google sta intanto ampliando Google Beam in Stati Uniti, Canada, Regno Unito, Francia, Germania e Giappone, con una rete di 18 partner di canale. Beam utilizza sistemi di imaging e AI per creare una rappresentazione tridimensionale dell’interlocutore senza richiedere un visore. Il dato interessante non è soltanto l’espansione geografica: Google sta tentando di far uscire il progetto dalla fase dimostrativa e inserirlo negli spazi di lavoro reali, anche attraverso una partnership con Industrious. Video generativo e telepresenza sembrano prodotti lontani, ma condividono lo stesso principio: la rappresentazione visiva viene sempre più mediata da modelli computazionali, sia quando viene generata dal nulla sia quando deve ricostruire una persona fisicamente distante.
MedGemma mostra perché Google tiene aperta anche la strada open-weight
La quinta novità arriva dalla sanità. Nel nuovo aggiornamento dedicato a MedGemma, Google mostra come i propri modelli open-weight specializzati su testo e immagini mediche vengano utilizzati per screening, triage e supporto clinico in diversi Paesi.
Il modello viene impiegato in progetti che vanno dallo screening del carcinoma cervicale in Zambia alla lotta contro la tubercolosi in Indonesia e ad applicazioni di screening oculare in India. Google presenta MedGemma come fondazione adattabile da sviluppatori e organizzazioni sanitarie, non come sostituto autonomo del medico.
È un ramo diverso rispetto a Gemini commerciale, ma strategicamente complementare. Il Google Cloud ha già integrato Gemini e MedGemma nello stack enterprise, mentre i modelli open-weight permettono deployment controllati e specializzazione nei settori dove inviare continuamente dati a un servizio generalista non è sempre accettabile.
Continua con:
Gemini arriva su Windows mentre Google porta i plugin dentro gli agenti cloud
Googlebook collega Android, Pixel e Gemini 3.8 nello stesso ambiente operativo
Gemini non è più un prodotto ma il collante dell’ecosistema Google
La quantità di annunci pubblicati il 23 settembre rischia di nascondere la trasformazione principale. Google sta facendo a Gemini quello che per anni ha fatto con Search, Android e Chrome: renderlo un’infrastruttura trasversale invece di lasciarlo confinato in un singolo prodotto. Vids utilizza Gemini per creare immagini in movimento, TTS per trasformare testo in voce, Connected Apps per agire sui servizi, Beam per mediare la presenza e MedGemma per offrire fondamenta specializzate nel settore sanitario. L’interfaccia cambia, il dispositivo cambia e cambia persino il modello utilizzato, ma il principio resta identico: l’utente esprime un’intenzione e l’ecosistema decide quale componente debba trasformarla in un’azione. È questo, più del singolo benchmark, il vantaggio che Google sta tentando di costruire.
Iscriviti alla Newsletter
Non perdere le analisi settimanali: Entra nella Matrice Digitale.
Matrice Digitale partecipa al Programma Affiliazione Amazon EU. In qualità di Affiliato Amazon, ricevo un guadagno dagli acquisti idonei. Questo non influenza i prezzi per te.









