Quella che si sta chiudendo è stata una settimana molto importante per tutto ciò che ruota attorno a Gemini, quello che noi spesso identifichiamo solo con l’assistente di Google basato sull’intelligenza artificiale ma che in realtà corrisponde a una vasta gamma di modelli che sfruttano l’IA per gli scopi più disparati.
Nella giornata di ieri, il colosso di Mountain View ha annunciato l’integrazione di Gemini su Google Traduttore e nella Ricerca, con l’obiettivo di migliorare e rendere più fluida e coerente le esperienze di traduzione, ma anche miglioramenti ai modelli Gemini Audio per potenziare le interazioni vocali. Andiamo a scoprire tutti i dettagli.
Indice:
Segui TuttoAndroid su Google Discover
Google integra Gemini in Traduttore per portare la traduzione al livello successivo
Come anticipato in apertura, Google ha annunciato importanti novità per la traduzione, integrando le capacità di Gemini all’interno di Google Tranduttore e nei risultati della Ricerca Google.
Stiamo introducendo una qualità di traduzione del testo all’avanguardia. Questo significa che otterrai traduzioni di testo molto più intelligenti, naturali e accurate, ovunque tu stia effettuando una ricerca. Stiamo anche lanciando una nuova versione beta della traduzione in tempo reale, che offre traduzioni in tempo reale e dal suono naturale direttamente sulle tue cuffie, grazie alle nuove funzionalità di traduzione vocale nativa di Gemini. Inoltre, stiamo aggiungendo altre lingue con cui esercitarti nell’app Traduttore.
Traduzioni più intelligenti e naturali
La prima novità riguarda la semplice traduzione, quella che il colosso di Mountain View mette a disposizione tra i risultati di ricerca ma anche attraverso le funzioni di base di Google Traduttore.
Grazie le capacità di Gemini, la traduzione migliora per rendere in maniera corretta le frasi con sfumature, modi di dire, espressioni locali o slang. L’assistente analizzerà il contesto per fornire la traduzione che catturi il vero significato dell’espressione.

Traduzione vocale in tempo reale
Google Traduttore integra le nuove capacità di traduzione vocale in tempo reale dei modelli Gemini Audio (ne parleremo poco sotto) per fornire una nuova esperienza di traduzione in tempo reale “in cuffia” per l’utente.
Il parlato “tradotto” preserverà tono, enfasi e cadenza dei vari oratori, rendendo le interazioni più naturali. Questa funzione prende il posto (o prenderà, spoiler, dato che non arriva in Italia) della modalità Conversazione.
Modalità “Fai pratica” di Google Traduttore
Ci sono novità anche per Fai pratica, la funzionalità per l’apprendimento di Google Traduttore basata su Gemini, che recentemente è arrivata anche in Italia (dove supporta l’apprendimento della lingua inglese) e ha ricevuto il supporto a nuove lingue.



Oltre alle nuove lingue e all’espansione “territoriale”, Fai pratica ha introdotto un nuovo meccanismo per mettere alla prova gli utenti e spingerli a raggiungere i propri obiettivi di apprendimento, monitorando i progressi (ad esempio i giorni consecutivi di studio) e la costanza nel tempo.
Segui Google su Telegram, ricevi news e offerte per primo
Google potenzia i modelli Gemini Audio per migliorare le interazioni vocali
Sulla scia dell’aggiornamento dei modelli Gemini 2.5 Pro e Flash Text-to-Speech, Google ha recentemente pubblicato una versione aggiornata del modello Gemini 2.5 Flash Native Audio che punta a migliorare la capacità del modello di gestire i flussi di lavoro più complessi, navigare tra le istruzioni fornite dall’utente e sostenere conversioni più naturali.
Agenti vocali dal vivo
Il modello Gemini 2.5 Flash Native Audio è in grado di offrire un’ampia gamma di esperienze conversazionali grazie a miglioramenti in tre aree chiave:
- Chiamate di funzioni più precise – l’assistente è in grado di identificare con maggiore precisione le situazioni in cui è necessario recuparare informazioni in tempo reale durante una conversazione e inserire i dati recuperati nella risposta senza interrompere il flusso.
- Affidabilità delle istruzioni – migliora la gestione delle istruzioni complesse e ciò si traduce in risposte più complete e affidabili.
- Conversazioni più fluide – l’assistente è in grado di recuperare il contesto dei vari passaggi della conversazione per fornire risposte successive più contestuali e sensate.
Traduzione vocale dal vivo
Parlando delle novità legate alla traduzione, abbiamo parlato della traduzione vocale dal vivo e questa potenzialità sfrutta le potenzialità del modello Gemini 2.5 Flash Native Audio, sia nel caso delle conversazioni monodirezionali che nel caso delle conversazioni bidirezionali.
La traduzione in tempo reale di Gemini sfrutta le seguenti funzioni chiave:
- Copertura linguistica – traduce il parlato in oltre 70 lingue e in 2.000 coppie di lingue, combinando conoscenza e capacità multilingue con le capacità audio native.
- Trasferimento di stile – riesce a comprendere il tono della conversazione e renderlo anche nella traduzione, preservando intonazione, ritmo e tono del parlante.
- Input multilingue – il modello è in grado di comprendere più lingue contemporaneamente in un’unica sessione, senza interruzioni, facendo in modo che l’utente non debba cambiare alcun settaggio per poter prendere parte a una conversazione con intorno persone che parlano più lingue.
- Rilevamento automatico – il modello è in grado di identificare automaticamente la lingua parlata dall’interlocutore e avviare la traduzione senza la necessità di impostare una lingua specifica.
- Robustezza al rumore – il modello è in grado di filtrare i rumori ambientali per far sì che la funzionalità di traduzione in tempo reale possa essere sfruttata anche in ambienti rumorosi e all’aperto.
Disponibilità di queste nuove potenzialità di Gemini
Giunti alla fine, andiamo a vedere dove arrivano e per chi sono disponibili queste novità annunciate da Google, partendo da quelle relative alla traduzione:
- Traduzioni più intelligenti e naturali – disponibile negli Stati Uniti e in India, nell’app Google Translate e sul Web, dall’inglese a quasi 20 lingue.
- Nuova modalità conversazionale in cuffia – disponibile in beta su Android negli Stati Uniti, in Messico e in India con supporto a oltre 70 lingue; arriverà su iOS e in altri Paesi nel 2026.
- Modalità “Fai pratica” – disponibile in beta su Android e su iOS; arriva in nuovi Paesi (20 in totale), inclusa l’Italia, per traduzioni dall’inglese al tedesco e al portoghese o da svariate lingue (incluso l’italiano) all’inglese.
Passando alle novità audio, gli agenti vocali del modello Gemini 2.5 Flash Native Audio possono essere provati su Vertex AI, in anteprima nell’API di Gemini che può essere provata tramite Google AI Studio. Il modello aggiornato è anche in distribuzione su Gemini Live e Search Live della AI Mode. I modelli di sisntesi vocale Gemini 2.5 Flash e Gemini 2.5 Pro, invece, sono disponibili tramite l’API di Gemini in Google AI Studio.

