Google modificherà dal 9 ottobre l’accesso ai modelli e i limiti di utilizzo dell’app Gemini, riducendo la disponibilità dei sistemi che richiedono maggiori risorse di calcolo nei piani gratuiti e meno costosi e concentrando invece i modelli e le funzioni di ragionamento più avanzate negli abbonamenti superiori. Gli utenti gratuiti potranno utilizzare esclusivamente il modello Flash-Lite, mentre anche il piano AI Plus perderà l’accesso ai modelli Pro e offrirà soltanto Flash-Lite e Flash. I modelli Pro resteranno quindi disponibili esclusivamente agli abbonati AI Pro e AI Ultra. La nuova organizzazione introduce una separazione più netta tra i livelli di abbonamento non soltanto per quantità di utilizzo, ma anche per classe di modello accessibile. Google non ha invece specificato, nell’ambito di questa modifica, in quali piani verrà inserito Gemini 4 Argon, il nuovo modello di fascia più alta recentemente presentato, né quali saranno esattamente le condizioni per accedervi.
Parallelamente alla riduzione dell’accesso ai modelli Pro nelle fasce inferiori, Google amplia le capacità disponibili con AI Pro introducendo Deep Think, funzione precedentemente riservata agli utenti AI Ultra. Deep Think utilizza il modello Pro e affronta i problemi seguendo contemporaneamente molteplici percorsi di ragionamento, impiegando quindi una quantità di calcolo superiore rispetto alla normale modalità di inferenza per risolvere attività particolarmente complesse. Gli utenti potranno inoltre scegliere l’intensità del ragionamento utilizzata dai diversi modelli: per domande relativamente semplici sarà possibile selezionare un livello inferiore, limitando il consumo di risorse, mentre attività più difficili potranno essere eseguite aumentando l’intensità del ragionamento e quindi la capacità computazionale dedicata alla risposta. La scelta diventa così parte del controllo diretto dell’utente, che può adattare il livello di elaborazione alla complessità del compito e alla qualità della risposta richiesta, mentre Deep Think rappresenta il livello destinato alle attività per le quali l’esplorazione parallela di differenti strategie di soluzione può produrre risultati migliori.
Anche la gestione dei limiti d’uso di Gemini segue una logica basata sul consumo effettivo delle risorse e non semplicemente sul numero di prompt inviati. La quantità di utilizzo disponibile può cambiare infatti in funzione della complessità delle richieste, del modello e delle funzioni utilizzate e della lunghezza complessiva della conversazione. I limiti collegati al consumo computazionale vengono amministrati su base settimanale, con un ripristino parziale delle risorse ogni cinque ore; Google si riserva inoltre la possibilità di limitare, in determinati periodi, il numero di prompt, le conversazioni o l’utilizzo di specifiche funzioni per preservare la qualità complessiva del servizio. Secondo la struttura precedente dei limiti, AI Plus dispone di una capacità pari a circa il doppio rispetto al piano gratuito, mentre AI Pro raggiunge un livello quattro volte superiore. AI Ultra aumenta ulteriormente la disponibilità e, a seconda della formula sottoscritta, può offrire una quantità di utilizzo cinque oppure venti volte superiore rispetto ad AI Pro. Le differenze diventano particolarmente rilevanti nelle attività che producono elevati consumi computazionali, dal coding all’elaborazione di file e alle sessioni di ragionamento più lunghe, perché il limite effettivo non coincide necessariamente con un numero predeterminato e costante di richieste.
La segmentazione riguarda anche la dimensione della finestra di contesto, cioè la quantità di informazioni che Gemini può mantenere contemporaneamente disponibili durante un’elaborazione. Il livello gratuito offre una finestra da 32.000 token, mentre AI Plus sale a 128.000 token; AI Pro e AI Ultra supportano invece fino a un milione di token. Questa differenza incide direttamente sui lavori che richiedono l’analisi simultanea di documenti molto lunghi, numerosi file o grandi quantità di materiale all’interno della stessa sessione, rendendo le offerte superiori strutturalmente più adatte alle elaborazioni estese. La nuova organizzazione crea quindi una distinzione su più livelli: gli utenti gratuiti e AI Plus dispongono dei modelli Flash, differenti quantità di utilizzo e finestre di contesto più limitate, mentre AI Pro e AI Ultra mantengono i modelli Pro, possono gestire contesti sensibilmente più grandi e ricevono l’accesso alle funzioni di ragionamento computazionalmente più costose. La decisione arriva peraltro dopo che Google aveva adottato una direzione opposta su un’altra categoria di funzionalità, rendendo recentemente disponibili anche agli utenti gratuiti le Skills destinate all’automazione delle attività ripetitive: l’accesso alle funzionalità applicative viene quindi esteso anche verso il basso, mentre quello alle risorse computazionali dei modelli più avanzati viene separato più nettamente sulla base dell’abbonamento.
L’annuncio della modifica ha provocato reazioni negative soprattutto tra gli utenti del piano gratuito e di AI Plus sulle community internazionali, comprese Reddit e X. Una delle critiche riguarda la rimozione di una funzionalità precedentemente disponibile, cioè l’accesso ai modelli Pro, interpretata da alcuni utenti come una strategia di “bait and switch” finalizzata a indirizzare verso gli abbonamenti più costosi persone che avevano scelto il servizio sulla base delle condizioni precedenti. Le proteste interessano in particolare chi utilizzava i modelli Pro tramite le formule meno costose per attività impegnative come programmazione e analisi di file e che, con il nuovo schema, dovrà passare almeno ad AI Pro per continuare ad accedervi. Alle contestazioni sulla modifica dei piani si aggiungono quelle relative alla trasparenza dei limiti del piano AI Pro da 19,99 dollari al mese: proprio perché il consumo non viene espresso esclusivamente attraverso un numero fisso di prompt ma dipende da modello, complessità, lunghezza della conversazione, funzioni impiegate e quantità di elaborazione richiesta, alcuni utenti ritengono difficile prevedere in anticipo quanta capacità effettiva sia compresa nell’abbonamento. Dal 9 ottobre, pertanto, la differenza tra i piani Gemini non dipenderà più soltanto da quanto frequentemente sia possibile utilizzare il servizio, ma in maniera ancora più marcata da quali modelli, quantità di contesto e livelli di ragionamento siano effettivamente disponibili per ciascuna fascia di abbonamento.
Questo articolo è stato redatto con il supporto di strumenti di intelligenza artificiale (AI)
