Gemini è in pieno fermento e quasi ogni giorno introduce o prepara qualche novità. Nella sola giornata di oggi c’è stata l’integrazione di NotebookLM e quella di SynthID, lo strumento che permette di distinguere quali sono i video generati dall’intelligenza artificiale di Google. Due novità importanti alle quali ora si aggiunge una nuova modalità per interagire con l’AI. Si tratta di Mark up, una funzione presente nell’editor visivo di Nano Banana che consente di interagire direttamente con le immagini all’interno di Gemini. Questa funzione è disponibile sia nella versione web che in quella mobile (per Android e iOS) di Gemini.

Segui TuttoAndroid su Google Discover

L’interazione diretta con le immagini

L’ultima novità in casa Gemini riguarda la possibilità di disegnare direttamente sulle immagini per dare comandi all’AI, senza dover digitare del testo nella barra del prompt. Una volta caricata una foto, l’utente può selezionarla per accedere a un nuovo editor chiamato “Mark up”. L’editor permette di disegnare linee a mano libera, cerchiare, sottolineare o scrivere brevi annotazioni direttamente sull’immagine.

In questo modo, è possibile indicare con precisione il punto o l’elemento su cui si desidera ricevere una risposta o un approfondimento. L’intelligenza artificiale di Gemini, tramite Nano Banana, è in grado di interpretare queste annotazioni visive come veri e propri input, avviando l’elaborazione anche in assenza di testo.

Si tratta di una novità particolarmente interessante non solo perché semplifica l’utilizzo dell’AI, rendendola più accessibile anche a chi preferisce un’interazione grafica o ha difficoltà a formulare prompt testuali dettagliati, ma anche perché mostra ulteriormente le potenzialità dei modelli AI di Google. Va inoltre sottolineata l’importanza di questo approccio nel rendere l’AI utilizzabile da un pubblico più ampio. Il fatto di poter indicare aree dell’immagine con un gesto grafico permette di superare le barriere legate all’uso del linguaggio testuale, facilitando l’interazione anche per chi predilige modalità più visive o intuitive.

La nuova funzionalità non elimina la possibilità di interagire tramite prompt testuali, permettendo anzi di combinare le due modalità, offrendo un ulteriore livello di personalizzazione nell’interazione.