Torna indietro   Hardware Upgrade Forum > Hardware Upgrade > News

realme 16 Pro Harry Potter Edition: il nuovo midrange ha uno stemma di Hogwarts che cambia colore al sole!
realme 16 Pro Harry Potter Edition: il nuovo midrange ha uno stemma di Hogwarts che cambia colore al sole!
Hogwarts arriva in fascia media grazie a realme, con una special edition che unisce la Quadra Light-Sensing Color-changing Tech, un baule in stile Hogwarts Express pieno di collezionabili e una scheda tecnica sostanzialmente identica al 16 Pro di partenza: ecco cosa cambia davvero, come si comporta nell'uso quotidiano e quanto vale in base al prezzo di 699,99 euro
Recensione REDMI Note 17 Pro: il midrange con batteria da 8.340 mAh e ricarica veloce
Recensione REDMI Note 17 Pro: il midrange con batteria da 8.340 mAh e ricarica veloce
REDMI Note 17 Pro porta in fascia media una batteria da 8.340 mAh con ricarica HyperCharge a 67W, un display AMOLED da 6,83 pollici capace di picchi di luminosità molto elevati e una struttura certificata TÜV SÜD contro cadute e infiltrazioni d'acqua, il tutto racchiuso in una scocca da 223 grammi. Lo abbiamo provato per diversi giorni tra fotocamera, prestazioni, autonomia e prezzo sul mercato italiano
Insta360 Luna Ultra: la potenza del sensore da 1 pollice incontra la portabilità estrema
Insta360 Luna Ultra: la potenza del sensore da 1 pollice incontra la portabilità estrema
Insta360 Luna Ultra integra un sensore da 1 pollice 8K, ottiche Leica e triplo chip IA. Tra schermo OLED rimovibile, workflow I-Log a 10 bit e stabilizzazione a tre assi, analizziamo le doti tecniche di una gimbal camera pensata per i professionisti
Tutti gli articoli Tutte le news

Vai al Forum
Rispondi
 
Strumenti
Old 08-08-2026, 08:31   #1
Redazione di Hardware Upg
www.hwupgrade.it
 
Iscritto dal: Jul 2001
Messaggi: 75166
Link alla notizia: https://www.hwupgrade.it/news/scienz...re_157221.html

Per qualche giorno ho trasformato un ASUS NUC 16 Pro in un laboratorio di intelligenza artificiale casalinga: prima un modello gigantesco da 744 miliardi di parametri, poi uno più piccolo che gira sulla scheda grafica integrata, alla fine un agente vero e proprio a cui scrivo da Telegram e che mi apre le pagine, raccoglie le fonti e mi consegna un lavoro che posso controllare.

Click sul link per visualizzare la notizia.
Redazione di Hardware Upg è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 09:26   #2
Sandro kensan
Senior Member
 
L'Avatar di Sandro kensan
 
Iscritto dal: Dec 2011
Messaggi: 3352
Molto interessante, un lavorone e poi con questo caldo risolvere problemi è ancora più difficile.
__________________
Utente Linux: Mageia 7. Sito: www.kensan.it
Sandro kensan è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 09:59   #3
bonzoxxx
Senior Member
 
L'Avatar di bonzoxxx
 
Iscritto dal: Aug 2008
Città: N.P.
Messaggi: 15453
Bravo Luciano, stesse cose che sto sperimentando io, pari pari.

Io uso un modello da 9B che gira sulla 3080 e faccio oltre 90 token/s.
Il tuo è più di un esperimento, è una prova tangibile che un modello abbastanza grande, e 27B è ottimo per usarlo con Hermes, è fattibile in casa.

Col 9B mi trovo bene, non è super intelligente ma va bene. Proverò Colibrì (che conoscevo ma non ho implementato) per vedere se riesco a superare il limite molto stringente dei 10GB di vram.
__________________
Sto cercando di disintossicarmi dall'Hardware... ma non ci sono ancora riuscito
battutona ci gira Cyberpunk?

Ultima modifica di bonzoxxx : 08-08-2026 alle 10:30.
bonzoxxx è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 13:04   #4
WarDuck
Senior Member
 
L'Avatar di WarDuck
 
Iscritto dal: May 2001
Messaggi: 13043
Quote:
Originariamente inviato da bonzoxxx Guarda i messaggi
Bravo Luciano, stesse cose che sto sperimentando io, pari pari.

Io uso un modello da 9B che gira sulla 3080 e faccio oltre 90 token/s.
Il tuo è più di un esperimento, è una prova tangibile che un modello abbastanza grande, e 27B è ottimo per usarlo con Hermes, è fattibile in casa.

Col 9B mi trovo bene, non è super intelligente ma va bene. Proverò Colibrì (che conoscevo ma non ho implementato) per vedere se riesco a superare il limite molto stringente dei 10GB di vram.
Se hai poca VRAM conviene usare modelli MoE (Mixture of Experts), dove solo una parte dei parametri è coinvolta nella computazione per ogni token.

Io uso llama-cpp su Linux.

Tanto per dirti, con una 1060 6GB e 16 GB ram di sistema, riesco a far girare Gemma4 26B-A4B (QAT con quantizzazione Q4) sui 17/18 token/s (che in genere è più che sufficiente per la chat).

Su un sistema più decente con 5070 Ti Mobile 12gb e 64 gb di RAM, Qwen3.6 35B-A3B con quantizzazione IQ4_XS va intorno ai 90 token/s .

Colibrì è al momento un po' limitato nel supporto dei modelli e nell'accelerazione CUDA.
WarDuck è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 13:15   #5
virtualdj
Senior Member
 
Iscritto dal: Oct 2004
Messaggi: 898
Grazie anche per l'articolo di questa settimane e buone ferie!
Non mollarci al ritorno, però, eh! Che è stata una grande idea il tuo ritorno su HWUpgrade in veste di articolista.
virtualdj è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 13:36   #6
bonzoxxx
Senior Member
 
L'Avatar di bonzoxxx
 
Iscritto dal: Aug 2008
Città: N.P.
Messaggi: 15453
Quote:
Originariamente inviato da WarDuck Guarda i messaggi
Se hai poca VRAM conviene usare modelli MoE (Mixture of Experts), dove solo una parte dei parametri è coinvolta nella computazione per ogni token.

Io uso llama-cpp su Linux.

Tanto per dirti, con una 1060 6GB e 16 GB ram di sistema, riesco a far girare Gemma4 26B-A4B (QAT con quantizzazione Q4) sui 17/18 token/s (che in genere è più che sufficiente per la chat).

Su un sistema più decente con 5070 Ti Mobile 12gb e 64 gb di RAM, Qwen3.6 35B-A3B con quantizzazione IQ4_XS va intorno ai 90 token/s .

Colibrì è al momento un po' limitato nel supporto dei modelli e nell'accelerazione CUDA.

Interessante, anche io uso llama-cpp ma su win11 ma si vede che il modello che ho usato ora non è MoE. Approfondisco. Ti ringrazio
__________________
Sto cercando di disintossicarmi dall'Hardware... ma non ci sono ancora riuscito
battutona ci gira Cyberpunk?
bonzoxxx è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 14:37   #7
Nui_Mg
Senior Member
 
L'Avatar di Nui_Mg
 
Iscritto dal: Jan 2007
Messaggi: 7001
Per i miei progetti casalinghi con AI locale, uso l'open source Unsloth studio: nonostante ancora in fase beta, è più comodo e completo di Ollama ma veloce come LLaMA_C++. Usa tutti i modelli in formato GGuFFnon e SafeTensors (Hugging Face), non fa solo inferenza ma anche finetuning (voce Train), tool coding e ricerche pre-integrate, varie ottimizzazioni di quantizzazione, community tecnicamente forte, documentazione molto buona.
Usando sotto unsloth anche modelli piccolini si possono ottenere già buone qualità delle risposte perché vanno oltre la risposta del modello base (che in casi di modelli piccoli e non specifici può non fornirtene alcuna) con l'apporto della web search (veramente buona la sintesi della risposta; le sue ricerche funzionano decisamente meglio di quelle di Ollama) e il tool coding.

Per una cosa che gira localmente (costo zero, privacy, meno spreco risorse, ecc.) e ancora in fase beta, lo trovo già molto buono.
__________________
E come disse Peppone appena svegliatosi in Parlamento, "Fasciiisti!!!"
Nui_Mg è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 15:39   #8
NewEconomy
Senior Member
 
Iscritto dal: Dec 2018
Messaggi: 1084
Avete provato LFM2.5 2.6B di LiquidAI?
Io lo sto trovando spettacolare
https://huggingface.co/collections/LiquidAI/lfm25
NewEconomy è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 15:47   #9
TorettoMilano
Senior Member
 
L'Avatar di TorettoMilano
 
Iscritto dal: Dec 2008
Messaggi: 18812
in pochi giorni hai sfornato due articoli di livello assoluto, complimenti luciano
TorettoMilano è online   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 18:42   #10
mozzarello
Senior Member
 
L'Avatar di mozzarello
 
Iscritto dal: Oct 2025
Messaggi: 2229
Bell'articolo, io sono zero esperto di modelli locali, anche perché non ho bisogno di fargli fare nulla, quindi sarebbe al massimo uno sfizio, ma chiedo a chi li usa: il vantaggio rispetto al cloud è solo lato privacy o c'è altro?
mozzarello è online   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 19:59   #11
NewEconomy
Senior Member
 
Iscritto dal: Dec 2018
Messaggi: 1084
Quote:
Originariamente inviato da mozzarello Guarda i messaggi
Bell'articolo, io sono zero esperto di modelli locali, anche perché non ho bisogno di fargli fare nulla, quindi sarebbe al massimo uno sfizio, ma chiedo a chi li usa: il vantaggio rispetto al cloud è solo lato privacy o c'è altro?
Principalmente si.. Una volta c’era anche il vantaggio economico, ma ultimamente con i prezzi enormemente scesi (vedasi DeepSeek V4 Flash aggiornato oppure Xiaomi MiMo) non è scontato sia conveniente l’inferenza locale (a patto di avere energia gratuita quello si).

In futuro probabilmente i prezzi torneranno a salire quindi sul lungo termine sono positivo…

Altro vantaggio è che puoi farci quello che vuoi con i modelli, non hanno inutili guardrail con la scusa safety
NewEconomy è offline   Rispondi citando il messaggio o parte di esso
Old 08-08-2026, 20:26   #12
Sandro kensan
Senior Member
 
L'Avatar di Sandro kensan
 
Iscritto dal: Dec 2011
Messaggi: 3352
Quote:
Originariamente inviato da mozzarello Guarda i messaggi
Bell'articolo, io sono zero esperto di modelli locali, anche perché non ho bisogno di fargli fare nulla, quindi sarebbe al massimo uno sfizio, ma chiedo a chi li usa: il vantaggio rispetto al cloud è solo lato privacy o c'è altro?
Anch'io non me ne intendo ma mi ha colpito la notizia seguente:

When we started the log analysis, we first used frontier models behind commercial APIs. This did not work: the analysis requires submitting large volumes of real attack commands, exploit payloads, and C2 artifacts, and these requests were blocked by the providers' safety guardrails, which cannot distinguish an incident responder from an attacker. We ran the forensic analysis instead on zai-org/GLM-5.2, an open-weight model, on our own infrastructure. This had a second benefit: no attacker data, and none of the credentials it referenced, left our environment.

In pratica durante il famoso attacco a Hugging face, per analizzare l'attacco e i danni subiti non è stato possibile usare i modelli americani e hanno dovuto usare quelli cinesi. Da notare che quelli cinesi possono essere modificati in quanto open source (open weight) e resi liberi da vincoli e quindi usati per lo scopo, quelli USA no.

Questo al di la e prima dell'esecuzione locale che viene un attimo dopo il fatto che i modelli siano liberi.
__________________
Utente Linux: Mageia 7. Sito: www.kensan.it
Sandro kensan è offline   Rispondi citando il messaggio o parte di esso
Old 09-08-2026, 07:25   #13
mozzarello
Senior Member
 
L'Avatar di mozzarello
 
Iscritto dal: Oct 2025
Messaggi: 2229
Quote:
Originariamente inviato da NewEconomy Guarda i messaggi
Principalmente si.. Una volta c’era anche il vantaggio economico, ma ultimamente con i prezzi enormemente scesi (vedasi DeepSeek V4 Flash aggiornato oppure Xiaomi MiMo) non è scontato sia conveniente l’inferenza locale (a patto di avere energia gratuita quello si).

In futuro probabilmente i prezzi torneranno a salire quindi sul lungo termine sono positivo…

Altro vantaggio è che puoi farci quello che vuoi con i modelli, non hanno inutili guardrail con la scusa safety
Ah quello sicuro, però io non ho ancora incontrato gurdarail al lavoro o in qualsiasi richiesta che non "diventasse" (per colpa dell'LLM spesso) NSFW, quindi per quello mi chiedevo se il problema fosse realmente solo di privacy, perché alla fine i costi diventano alti comunque, dato che devi avere un tuo "server" sempre acceso e connesso, se vuoi poterla interrogare da remoto, e i tempi son comunque molto più lunghi.

Un'azienda ha senso, per segreto industriale e altro, un privato forse è solo un esercizio di stile.

Quote:
Originariamente inviato da Sandro kensan Guarda i messaggi
Anch'io non me ne intendo ma mi ha colpito la notizia seguente:

When we started the log analysis, we first used frontier models behind commercial APIs. This did not work: the analysis requires submitting large volumes of real attack commands, exploit payloads, and C2 artifacts, and these requests were blocked by the providers' safety guardrails, which cannot distinguish an incident responder from an attacker. We ran the forensic analysis instead on zai-org/GLM-5.2, an open-weight model, on our own infrastructure. This had a second benefit: no attacker data, and none of the credentials it referenced, left our environment.

In pratica durante il famoso attacco a Hugging face, per analizzare l'attacco e i danni subiti non è stato possibile usare i modelli americani e hanno dovuto usare quelli cinesi. Da notare che quelli cinesi possono essere modificati in quanto open source (open weight) e resi liberi da vincoli e quindi usati per lo scopo, quelli USA no.

Questo al di la e prima dell'esecuzione locale che viene un attimo dopo il fatto che i modelli siano liberi.
Sì, chiaro anche questo, se hai bisogno di fare qualcosa di particolare, meglio avere qualcosa di open e modificabile. E' poi il motivo per cui anche in Europa dovrebbero staccarsi dai modelli chiusi, ma vabbé che in Europa tutto il digitale lo abbiamo messo in mani americane. Non che cinesi siano migliori, per ora rilasciano modelli open weight perché è l'unico modo che hanno per contrastare i modello di frontiera americani, mica perché son buoni.

Ultima modifica di mozzarello : 09-08-2026 alle 07:42.
mozzarello è online   Rispondi citando il messaggio o parte di esso
 Rispondi


realme 16 Pro Harry Potter Edition: il nuovo midrange ha uno stemma di Hogwarts che cambia colore al sole! realme 16 Pro Harry Potter Edition: il nuovo mid...
Recensione REDMI Note 17 Pro: il midrange con batteria da 8.340 mAh e ricarica veloce Recensione REDMI Note 17 Pro: il midrange con ba...
Insta360 Luna Ultra: la potenza del sensore da 1 pollice incontra la portabilità estrema Insta360 Luna Ultra: la potenza del sensore da 1...
Marvel's Wolverine, la recensione: Logan torna protagonista in un'avventura brutale e intensa Marvel's Wolverine, la recensione: Logan torna p...
DJI Romo 2: tante novità lo rendono un robot completo DJI Romo 2: tante novità lo rendono un ro...
Amazon Haul, sconto del 15% su almeno 2 ...
Quasi il 90% degli sviluppatori di video...
Future Studies di Luca Locatelli in most...
ASUS ha lanciato il suo primo Mini PC co...
HillMiles MileCity1 torna disponibile a ...
Nel 2028 sarà lanciata la mission...
Un materiale rigido come pochi, ma isola...
Intel: fine delle ricompense fino a 100....
Un problema alle turbopompe potrebbe ral...
Jensen Huang, NVIDIA: 'Nel 2030 non fini...
PC rincondizionato Lenovo ThinkStation a...
Il Neural Rendering di DLSS 5 gira (male...
AMD Radeon RX 9050 4GB, ecco quanto perd...
Factorio è certificato Steam Frame: la b...
TECLAST ArtPad è attualmente il m...
Chromium
GPU-Z
OCCT
LibreOffice Portable
Opera One Portable
Opera One 106
CCleaner Portable
CCleaner Standard
Cpu-Z
Driver NVIDIA GeForce 546.65 WHQL
SmartFTP
Trillian
Google Chrome Portable
Google Chrome 120
VirtualBox
Tutti gli articoli Tutte le news Tutti i download

Strumenti

Regole
Non Puoi aprire nuove discussioni
Non Puoi rispondere ai messaggi
Non Puoi allegare file
Non Puoi modificare i tuoi messaggi

Il codice vB è On
Le Faccine sono On
Il codice [IMG] è On
Il codice HTML è Off
Vai al Forum


Tutti gli orari sono GMT +1. Ora sono le: 09:45.


Powered by vBulletin® Version 3.6.4
Copyright ©2000 - 2026, Jelsoft Enterprises Ltd.
Served by www3v
1