|
|||||||
|
|
|
![]() |
|
|
Strumenti |
|
|
#1 |
|
www.hwupgrade.it
Iscritto dal: Jul 2001
Messaggi: 75166
|
Link alla notizia: https://www.hwupgrade.it/news/scienz...ri_155455.html
Una lettera del segretario al Commercio Lutnick riapre l'accesso al modello cybersecurity di Anthropic per le organizzazioni che difendono infrastrutture critiche, ma lascia la versione pubblica Fable 5 ancora bloccata, in attesa di nuove trattative Click sul link per visualizzare la notizia. |
|
|
|
|
|
#2 |
|
Senior Member
Iscritto dal: Dec 2011
Messaggi: 3278
|
E in questi mesi un privato programmatore, Sanfilippo, sta usando DeepSeek V4 Pro e poi GLM 5.2 per ridurre in modo molto smart il peso di questi modelli MoE in modo da farli rientrare in una RAM da 80 GB e quindi da farli eseguire in 128 GB in locale, senza perdite significative di contesto e differenze di risposte e allucinazioni.
https://www.youtube.com/watch?v=ff2iPMjPu1s Si parla di modelli da: GLM-5.2 è un modello Mixture-of-Experts: ha 753 miliardi di parametri totali, ma solo circa 40 miliardi sono attivi per ogni token. Si tratta in sostanza di ridurre la quantizzazione per gli esperti meno importanti e tenerla alta per gli esperti significativi, inoltre di spostare nell'SSD le parti poco importanti e meno usate o usate saltuariamente. Addirittura un membro del Governo di Taiwan ha donato a Sanfilippo un mac con 128 GB di Ram per il suo lavoro.
__________________
Utente Linux: Mageia 7. Sito: www.kensan.it |
|
|
|
|
| Strumenti | |
|
|
Tutti gli orari sono GMT +1. Ora sono le: 07:45.



















