Gemini 3 rafforza l’offerta di Google con tre funzioni chiave: generazione 3D da una singola foto, piattaforma video Flow e modalità di ragionamento avanzato Deep Think, pensate per progettisti, creativi e ricercatori.
La prima novità riguarda l’uso di Gemini per creare modelli 3D “stile plastico da stampante 3D” partendo dalla sola facciata di un edificio. Tramite strumenti come Nano Banana in Google AI Studio, un prompt preconfigurato permette di ricostruire volumi, proporzioni, finestre e materiali, generando un modello game-ready con illuminazione fisicamente accurata e vista isometrica a 45°, su sfondo bianco, pronto per motori di gioco e visualizzazioni architettoniche.
Flow, lanciato nel 2025, è invece la piattaforma di “AI filmmaking” che integra i modelli Veo per il video, Imagen per le immagini e Gemini per il testo. Consente di trasformare descrizioni in linguaggio naturale in clip cinematografiche, con controllo su angolazioni, movimenti di camera e coerenza tra le scene. La funzione Scenebuilder permette di espandere le sequenze riutilizzando personaggi e ambienti, garantendo continuità narrativa in spot, cortometraggi e contenuti social.
Sul fronte del ragionamento, Gemini 3 Deep Think – disponibile nella app Gemini solo per gli abbonati Google AI Ultra – è oggi il modello Google con le performance più alte su benchmark come Humanity’s Last Exam e ARC-AGI-2, dove raggiunge il 45,1% grazie all’uso intensivo di “reasoning token” e codice eseguibile. È progettato per affrontare problemi matematici, scientifici e logici che mettono in difficoltà i modelli generativi tradizionali.
Queste capacità aprono nuove opportunità ma richiedono garanzie etiche: uso responsabile dei video generati per evitare deepfake, tracciabilità dei contenuti sintetici, tutela dei dati usati per l’addestramento e valutazioni d’impatto sul lavoro creativo e tecnico. Regolatori, sviluppatori e utenti dovranno cooperare per trasformare la potenza di Gemini in innovazione sostenibile e non in nuove asimmetrie di potere.
Approfondimento e cronologia dei fatti collegati
- Dicembre 2023–2024: espansione della famiglia Gemini
Google introduce progressivamente i modelli Gemini e strumenti collegati, tra cui flussi dedicati a immagini, video e sviluppo. blog.google - 2024–2025: modelli 3D da una singola foto
Con Nano Banana su Google AI Studio, basato su Gemini 2.5, è possibile generare modelli 3D “3D-printed” di edifici a partire da foto di facciata o Street View, grazie a prompt ottimizzati. Landscape Architecture - 20 maggio 2025: presentazione ufficiale di Flow
Google annuncia Flow come piattaforma di AI filmmaking costruita intorno a Veo, Imagen e Gemini, pensata per cineasti e creator. blog.googl - Ottobre 2025: Veo 3.1 in anteprima a pagamento
Veo 3.1 e Veo 3.1 Fast arrivano tramite Gemini API, con video 8 secondi in 720p/1080p, audio nativo e maggiore controllo narrativo, poi integrati in Flow e nella app Gemini. developers.googleblog.com - Novembre–dicembre 2025: lancio di Gemini 3 e Deep Think
Google presenta Gemini 3 e, pochi giorni dopo, rende disponibile la modalità Deep Think agli abbonati AI Ultra, con risultati di punta su ARC-AGI-2 e altri benchmark di ragionamento. ARC blog.google+3blog.google
Fonti autorevoli
- Google – Blog ufficiale Gemini 3 e Deep Think (prodotti e benchmark)
- ARC Prize – Leaderboard e analisi dei risultati ARC-AGI-2
- Google Labs / Flow – documentazione ufficiale su Flow e Veo 3.1
- Google AI Studio – guide per l’uso di Gemini/Nano Banana per modelli 3D
Consigli di approfondimento (con link)
- Post ufficiale Google su Gemini 3 e Deep Think
– https://blog.google/products/gemini/gemini-3 blog.google - Annuncio “Gemini 3 Deep Think is now available in the Gemini app”
– https://blog.google/products/gemini/gemini-3-deep-think blog.google - Pagina ufficiale Flow (AI filmmaking tool)
– https://labs.google/flow/about labs.google - Veo 3.1 e guida video nella Gemini API
– https://developers.googleblog.com/introducing-veo-3-1-and-new-creative-capabilities-in-the-gemini-apidevelopers.googleblog.com - Leaderboard e analisi ARC-AGI-2 (ARC Prize)
– https://arcprize.org/leaderboard ARC Prize
Abstract – Pro, rischi e possibili conseguenze
Le nuove funzioni di Gemini mostrano un forte potenziale positivo:
- Pro: democratizzazione degli strumenti di modellazione 3D e video professionale; velocizzazione di pre-vis, prototipazione e storytelling; supporto al problem solving avanzato in ambito scientifico, ingegneristico e legale; maggiore coerenza e qualità dei contenuti generati.
- Rischi: aumento del rischio di deepfake e manipolazione visiva, soprattutto con video di qualità cinematografica; concentrazione del potere tecnologico in poche piattaforme; possibile sostituzione di competenze tecniche e creative routinarie; dipendenza crescente da modelli opachi nel prendere decisioni critiche.
A livello etico e sociale, la diffusione di strumenti come Flow e Deep Think rende urgente l’adozione di marcatori di contenuto sintetico, audit indipendenti dei modelli, limiti d’uso in ambiti sensibili (politica, sicurezza, minori) e nuove competenze digitali per utenti e professionisti. In prospettiva, l’iterazione sociale tra norme, mercati e pratiche creative determinerà se Gemini diventerà un abilitatore di innovazione inclusiva o un acceleratore di disuguaglianze e disinformazione.







