Gemini 3.5 Flash delude nei test Android: il nuovo modello Google costa di più ma viene superato da versioni precedenti

Gemini 3.5 Flash delude nei test Android: il nuovo modello Google costa di più ma viene superato da versioni precedenti

I test Android Bench hanno evidenziato problemi per Gemini 3.5 Flash, il nuovo modello AI di Google. Nonostante le aspettative, si è classificato sesto dietro a GPT 5.5, GPT 5.4 e Gemini 3.1 Pro Preview. Inoltre risulta il modello più costoso della classifica, mettendo in dubbio il vantaggio rispetto alle versioni precedenti

di pubblicata il , alle 16:01 nel canale Web
Gemini
 

I primi risultati dei test dedicati allo sviluppo Android hanno messo in evidenza alcune difficoltà inattese per Gemini 3.5 Flash, il nuovo modello di intelligenza artificiale di Google. Nonostante la posizione premium e le aspettative elevate dell'azienda, i benchmark mostrano che il sistema non riesce a superare modelli più vecchi in determinati compiti legati alla programmazione Android.

La classifica Android Bench, utilizzata per valutare la capacità dei modelli AI nel completare attività di sviluppo mobile, ha inserito Gemini 3.5 Flash per la prima volta. Tuttavia, il nuovo modello di Google non è riuscito a entrare tra i primi cinque classificati. Al vertice della graduatoria si è posizionato GPT 5.5 di OpenAI con un punteggio di 74, seguito da GPT 5.4 e da Gemini 3.1 Pro Preview, entrambi con 72,4 punti. Anche alcune varianti più recenti di Claude hanno ottenuto risultati superiori rispetto al modello Flash.

Gemini 3.5 Flash ha raggiunto un punteggio di 63,7, classificandosi al sesto posto. L'aspetto più sorprendente riguarda però il rapporto tra prestazioni e costo. Secondo i dati del benchmark, il modello ha utilizzato una quantità media di circa 355,9 token complessivi per esecuzione, arrivando a un costo medio stimato di 147,1 dollari per test. Questo lo rende il modello più costoso presente nella graduatoria, nonostante risultati inferiori rispetto ad alcune alternative.

Gemini 3.5 Flash e ulteriori dettagli sulle difficoltà nei benchmark

La situazione appare particolare considerando la filosofia storica della famiglia Flash di Google, generalmente associata a velocità e maggiore convenienza economica rispetto ai modelli più avanzati. Durante Google I/O 2026, l'azienda aveva presentato Gemini 3.5 Flash come una delle versioni più potenti della serie, sottolineando miglioramenti nella programmazione, negli agenti AI e nella gestione di processi complessi.

Google aveva inoltre dichiarato che il modello avrebbe superato Gemini 3.1 Pro in diversi test interni e garantito tempi di risposta molto più rapidi rispetto ad altri sistemi concorrenti. Tuttavia, i risultati specifici dedicati allo sviluppo Android raccontano una situazione diversa.

Il precedente Gemini 3.1 Pro Preview, infatti, ha ottenuto prestazioni migliori in questo ambito con un costo molto più contenuto. Questo ha sollevato dubbi sulla reale efficacia del nuovo modello per gli sviluppatori Android e sulla capacità di Google di mantenere le promesse fatte durante la presentazione. Resta da capire se futuri aggiornamenti riusciranno a migliorare Gemini 3.5 Flash oppure se sarà il prossimo Gemini 3.5 Pro a rappresentare il vero salto generazionale.

6 Commenti
Gli autori dei commenti, e non la redazione, sono responsabili dei contenuti da loro inseriti - info
jepessen16 Giugno 2026, 16:28 #1
A me delude il generale aumento stratosferico dei costi delle IA...

Posso capire che una tariffa flat possa non essere conveniente se si hanno utenti con agent che vanno h24 eh, ma io avro' usato al massimo per qualche ora copilot questo mese e gia' sono al 90% della quota mensile senza aver fatto niente di concreto. Inoltre i moltiplicatori di token sono tutti aumentati, claude e' passato addirittura a 9x... Praticamente utilizzare un abbonamento normale per lavoro e' diventato impossibile, occorre spendere molti piu' soldi.
supertigrotto16 Giugno 2026, 16:56 #2
Originariamente inviato da: jepessen
A me delude il generale aumento stratosferico dei costi delle IA...

Posso capire che una tariffa flat possa non essere conveniente se si hanno utenti con agent che vanno h24 eh, ma io avro' usato al massimo per qualche ora copilot questo mese e gia' sono al 90% della quota mensile senza aver fatto niente di concreto. Inoltre i moltiplicatori di token sono tutti aumentati, claude e' passato addirittura a 9x... Praticamente utilizzare un abbonamento normale per lavoro e' diventato impossibile, occorre spendere molti piu' soldi.


Non hai capito il giochino?
Le prime dosi sono gratis,poi paghi sempre di più.
Quando le persone non sapranno usare più nessuno strumento perché hanno disimparato a programmare, disegnare,ritoccare foto,dimensionare e quant'altro (la sparizione dei dipendenti junior deve far riflettere) e tutti saranno costretti a passare dalla IA,aumenteranno il costo per token etc.
Pensa se riusciranno a creare smartphone senza un vero SO e app,come proposto da Altman,senza abbonamento IA ti ritrovi con un bel mattoncino inutile in mano......
DanieleG16 Giugno 2026, 17:13 #3
Originariamente inviato da: supertigrotto
Non hai capito il giochino?
Le prime dosi sono gratis,poi paghi sempre di più.
Quando le persone non sapranno usare più nessuno strumento perché hanno disimparato a programmare, disegnare,ritoccare foto,dimensionare e quant'altro (la sparizione dei dipendenti junior deve far riflettere) e tutti saranno costretti a passare dalla IA,aumenteranno il costo per token etc.
Pensa se riusciranno a creare smartphone senza un vero SO e app,come proposto da Altman,senza abbonamento IA ti ritrovi con un bel mattoncino inutile in mano......


La stessa dinamica del cloud, com'era ovvio.
r134816 Giugno 2026, 18:02 #4
Originariamente inviato da: jepessen
A me delude il generale aumento stratosferico dei costi delle IA...

Posso capire che una tariffa flat possa non essere conveniente se si hanno utenti con agent che vanno h24 eh, ma io avro' usato al massimo per qualche ora copilot questo mese e gia' sono al 90% della quota mensile senza aver fatto niente di concreto. Inoltre i moltiplicatori di token sono tutti aumentati, claude e' passato addirittura a 9x... Praticamente utilizzare un abbonamento normale per lavoro e' diventato impossibile, occorre spendere molti piu' soldi.


E pensa che te li stanno ancora offrendo sottocosto.
Chi pensi che pagherà le centinaia di miliardi spesi in datacenter?
giovanni6917 Giugno 2026, 08:12 #5
Originariamente inviato da: jepessen
A me delude il generale aumento stratosferico dei costi delle IA...

Posso capire che una tariffa flat possa non essere conveniente se si hanno utenti con agent che vanno h24 eh, ma io avro' usato al massimo per qualche ora copilot questo mese e gia' sono al 90% della quota mensile senza aver fatto niente di concreto. Inoltre i moltiplicatori di token sono tutti aumentati, claude e' passato addirittura a 9x... Praticamente utilizzare un abbonamento normale per lavoro e' diventato impossibile, occorre spendere molti piu' soldi.


ICYMI:
https://www.hwupgrade.it/forum/show...16#post49278016
jepessen17 Giugno 2026, 09:33 #6
Originariamente inviato da: r1348
E pensa che te li stanno ancora offrendo sottocosto.
Chi pensi che pagherà le centinaia di miliardi spesi in datacenter?


Nesssuno sinceramente. Se un prodotto diventa troppo caro anche se ne traggo beneficio non lo compro, e come me faranno lo stesso tanti altri utenti, e anche se puntassero ai grossi clienti come Google/Microsoft, anche se fossero in grado di pagare gli abbonamenti non sarebbe comunque abbastanza. Quindi rimarremo con i modelli vecchi più economici, sia perchè computazionalmente sono meno onerosi, sia perchè con l'hardware moderno occorrono meno CPU/GPU/corrente per mantenerli. E anche con il blocco di Fable, ho come l'impressione che stiamo per arrivare alla saturazione delle capacità delle IA, almeno per l'utilizzo consumer/piccole aziende.

Devi effettuare il login per poter commentare
Se non sei ancora registrato, puoi farlo attraverso questo form.
Se sei già registrato e loggato nel sito, puoi inserire il tuo commento.
Si tenga presente quanto letto nel regolamento, nel rispetto del "quieto vivere".

La discussione è consultabile anche qui, sul forum.
 
^