|
|||||||
|
|
|
![]() |
|
|
Strumenti |
|
|
#1 |
|
www.hwupgrade.it
Iscritto dal: Jul 2001
Messaggi: 75166
|
Link alla notizia: https://www.hwupgrade.it/news/scienz...re_157221.html
Per qualche giorno ho trasformato un ASUS NUC 16 Pro in un laboratorio di intelligenza artificiale casalinga: prima un modello gigantesco da 744 miliardi di parametri, poi uno più piccolo che gira sulla scheda grafica integrata, alla fine un agente vero e proprio a cui scrivo da Telegram e che mi apre le pagine, raccoglie le fonti e mi consegna un lavoro che posso controllare. Click sul link per visualizzare la notizia. |
|
|
|
|
|
#2 |
|
Senior Member
Iscritto dal: Dec 2011
Messaggi: 3352
|
Molto interessante, un lavorone e poi con questo caldo risolvere problemi è ancora più difficile.
__________________
Utente Linux: Mageia 7. Sito: www.kensan.it |
|
|
|
|
|
#3 |
|
Senior Member
Iscritto dal: Aug 2008
Città: N.P.
Messaggi: 15453
|
Bravo Luciano, stesse cose che sto sperimentando io, pari pari.
Io uso un modello da 9B che gira sulla 3080 e faccio oltre 90 token/s. Il tuo è più di un esperimento, è una prova tangibile che un modello abbastanza grande, e 27B è ottimo per usarlo con Hermes, è fattibile in casa. Col 9B mi trovo bene, non è super intelligente ma va bene. Proverò Colibrì (che conoscevo ma non ho implementato) per vedere se riesco a superare il limite molto stringente dei 10GB di vram.
__________________
Sto cercando di disintossicarmi dall'Hardware... ma non ci sono ancora riuscito battutona ci gira Cyberpunk? Ultima modifica di bonzoxxx : 08-08-2026 alle 10:30. |
|
|
|
|
|
#4 | |
|
Senior Member
Iscritto dal: May 2001
Messaggi: 13043
|
Quote:
Io uso llama-cpp su Linux. Tanto per dirti, con una 1060 6GB e 16 GB ram di sistema, riesco a far girare Gemma4 26B-A4B (QAT con quantizzazione Q4) sui 17/18 token/s (che in genere è più che sufficiente per la chat). Su un sistema più decente con 5070 Ti Mobile 12gb e 64 gb di RAM, Qwen3.6 35B-A3B con quantizzazione IQ4_XS va intorno ai 90 token/s Colibrì è al momento un po' limitato nel supporto dei modelli e nell'accelerazione CUDA. |
|
|
|
|
|
|
#5 |
|
Senior Member
Iscritto dal: Oct 2004
Messaggi: 898
|
Grazie anche per l'articolo di questa settimane e buone ferie!
Non mollarci al ritorno, però, eh! Che è stata una grande idea il tuo ritorno su HWUpgrade in veste di articolista.
|
|
|
|
|
|
#6 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: N.P.
Messaggi: 15453
|
Quote:
Interessante, anche io uso llama-cpp ma su win11 ma si vede che il modello che ho usato ora non è MoE. Approfondisco. Ti ringrazio
__________________
Sto cercando di disintossicarmi dall'Hardware... ma non ci sono ancora riuscito battutona ci gira Cyberpunk? |
|
|
|
|
|
|
#7 |
|
Senior Member
Iscritto dal: Jan 2007
Messaggi: 7001
|
Per i miei progetti casalinghi con AI locale, uso l'open source Unsloth studio: nonostante ancora in fase beta, è più comodo e completo di Ollama ma veloce come LLaMA_C++. Usa tutti i modelli in formato GGuFFnon e SafeTensors (Hugging Face), non fa solo inferenza ma anche finetuning (voce Train), tool coding e ricerche pre-integrate, varie ottimizzazioni di quantizzazione, community tecnicamente forte, documentazione molto buona.
Usando sotto unsloth anche modelli piccolini si possono ottenere già buone qualità delle risposte perché vanno oltre la risposta del modello base (che in casi di modelli piccoli e non specifici può non fornirtene alcuna) con l'apporto della web search (veramente buona la sintesi della risposta; le sue ricerche funzionano decisamente meglio di quelle di Ollama) e il tool coding. Per una cosa che gira localmente (costo zero, privacy, meno spreco risorse, ecc.) e ancora in fase beta, lo trovo già molto buono.
__________________
E come disse Peppone appena svegliatosi in Parlamento, "Fasciiisti!!!" |
|
|
|
|
|
#8 |
|
Senior Member
Iscritto dal: Dec 2018
Messaggi: 1084
|
Avete provato LFM2.5 2.6B di LiquidAI?
Io lo sto trovando spettacolare https://huggingface.co/collections/LiquidAI/lfm25 |
|
|
|
|
|
#9 |
|
Senior Member
Iscritto dal: Dec 2008
Messaggi: 18812
|
in pochi giorni hai sfornato due articoli di livello assoluto, complimenti luciano
|
|
|
|
|
|
#10 |
|
Senior Member
Iscritto dal: Oct 2025
Messaggi: 2229
|
Bell'articolo, io sono zero esperto di modelli locali, anche perché non ho bisogno di fargli fare nulla, quindi sarebbe al massimo uno sfizio, ma chiedo a chi li usa: il vantaggio rispetto al cloud è solo lato privacy o c'è altro?
|
|
|
|
|
|
#11 | |
|
Senior Member
Iscritto dal: Dec 2018
Messaggi: 1084
|
Quote:
In futuro probabilmente i prezzi torneranno a salire quindi sul lungo termine sono positivo… Altro vantaggio è che puoi farci quello che vuoi con i modelli, non hanno inutili guardrail con la scusa safety |
|
|
|
|
|
|
#12 | |
|
Senior Member
Iscritto dal: Dec 2011
Messaggi: 3352
|
Quote:
When we started the log analysis, we first used frontier models behind commercial APIs. This did not work: the analysis requires submitting large volumes of real attack commands, exploit payloads, and C2 artifacts, and these requests were blocked by the providers' safety guardrails, which cannot distinguish an incident responder from an attacker. We ran the forensic analysis instead on zai-org/GLM-5.2, an open-weight model, on our own infrastructure. This had a second benefit: no attacker data, and none of the credentials it referenced, left our environment. In pratica durante il famoso attacco a Hugging face, per analizzare l'attacco e i danni subiti non è stato possibile usare i modelli americani e hanno dovuto usare quelli cinesi. Da notare che quelli cinesi possono essere modificati in quanto open source (open weight) e resi liberi da vincoli e quindi usati per lo scopo, quelli USA no. Questo al di la e prima dell'esecuzione locale che viene un attimo dopo il fatto che i modelli siano liberi.
__________________
Utente Linux: Mageia 7. Sito: www.kensan.it |
|
|
|
|
|
|
#13 | ||
|
Senior Member
Iscritto dal: Oct 2025
Messaggi: 2229
|
Quote:
Un'azienda ha senso, per segreto industriale e altro, un privato forse è solo un esercizio di stile. Quote:
__________________
.. ma chi specula su chi è malato, su disabili, tossici e anziani è un vero criminale La ricchezza sta nel semplice, nel semplice, nel semplice sorridere in un giorno che non vale niente. Le tue gambe accavallate, con le incognite che hanno, mi hanno trattenuto qua. Ultima modifica di mozzarello : 09-08-2026 alle 07:42. |
||
|
|
|
|
| Strumenti | |
|
|
Tutti gli orari sono GMT +1. Ora sono le: 09:45.





















