Anthropic propone regole per bloccare i modelli AI pericolosi e ammette l'errore su Fable 5
Anthropic pubblica due framework di policy per governi su AI safety e occupazione, corregge i safeguard non dichiarati di Fable 5 dopo le proteste dei ricercatori di sicurezza
di Andrea Bai pubblicata il 12 Giugno 2026, alle 09:11 nel canale Scienza e tecnologiaAnthropic
Anthropic ha pubblicato un Advanced AI Framework che propone di dare ai governi il potere di bloccare il lo sviluppo e la diffusione di modelli AI giudicati pericolosi. Il documento introduce anche un Economic Policy Framework separato, dedicato al problema occupazionale e alla distribuzione del capitale generato dall'AI.
Il campo di applicazione è volutamente ristretto: i requisiti si rivolgono ai soli modelli addestrati con oltre 10²⁵ operazioni floating-point, sviluppati da aziende con ricavi AI superiori a 500 milioni di dollari o investimenti in ricerca superiori a un miliardo. Con questi presupposti, per ammissione del documento stesso, ad essere realmente interessate sono appena cinque aziende: Anthropic, OpenAI, Google DeepMind, xAI e, potenzialmente, Meta.

Il framework classifica quattro categorie di rischio catastrofico: sviluppo di armi biologiche, scoperta di vulnerabilità informatiche su larga scala, perdita di controllo su sistemi autonomi, e AI che automatizza la propria ricerca e sviluppo. A sostegno dell'urgenza, il documento cita i risultati di Claude Mythos Preview: migliaia di vulnerabilità ad alta gravità scoperte in ogni sistema operativo e browser principale.
Le obbligazioni proposte per chi sviluppa modelli di frontiera includono il testing dei modelli, la pubblicazione dei risultati, l'esposizione a valutazioni indipendenti, la gestione di programmi di sicurezza e la pubblicazione di report sui rischi. Le sanzioni previste sono penalità civili proporzionate al fatturato globale annuo, con escalation in caso di violazioni reiterate. Sul versante legislativo statunitense, Anthropic si oppone esplicitamente alla prelazione federale delle leggi statali senza l'adozione di una normativa federale almeno altrettanto stringente del framework proposto.
Per il fronte economico, le misure indicate comprendono assicurazioni salariali, incentivi fiscali e l'ampliamento delle reti di protezione sociale per chi perde il lavoro a causa dell'automazione.
Il mea culpa su Fable 5
In parallelo, Anthropic ha modificato il comportamento di Fable 5 in risposta alle critiche dei ricercatori. Secondo la ricostruzione di Engadget, il modello gestiva in modo non documentato alcune categorie di richiesta: per attività come il training di modelli concorrenti, il debug di codice AI e l'ottimizzazione di architetture neurali, Fable 5 reindirizzava silenziosamente le sessioni a un modello di categoria inferiore o rifiutava la risposta, senza alcuna notifica all'utente e spesso in situazioni di falsi positivi.
La critica si è concentrata sull'assenza di trasparenza. Anthropic ha riconosciuto l'errore, ammettendo di aver sbagliato il bilanciamento e di non aver trovato l'equilibrio giusto, e ha chiarito che la scelta iniziale di mantenere invisibili i safeguard dipendeva dall'intenzione di rilasciare il modello rapidamente riducendo i falsi positivi.
Nella versione corretta, quando i classificatori di Fable 5 rilevano richieste legate a cybersicurezza, biologia e chimica, o distillazione, la risposta viene gestita automaticamente da Claude Opus 4.8, con notifica esplicita all'utente. I dati preliminari indicano che oltre il 95% delle sessioni non comporta alcun fallback. Mythos 5, variante con i safeguard di cybersicurezza rimossi, resta disponibile per i partner Glasswing.










Recensione HONOR Magic V6: spessore record e super batteria. È lui il fold da battere?
Redmi Pad 2 9.7: ampio display, economico e peso contenuto, ma qualche limite nelle prestazioni
Peugeot Polygon Concept: ecco il futuro delle utilitarie
CXMT come un treno: quasi raggiunta la capacità di Micron e completa le fabbriche in metà del tempo
Il CEO di Microsoft invita le imprese alla prudenza sull'AI: rischiano di pagare due volte
Agent 64: Spies Never Die arriverà su PC. Il titolo è fortemente ispirato a GoldenEye 007 e Perfect Dark per N64
Windows 11, addio pubblicità e risultati locali migliori: la ricerca interna ora è davvero utile?
Due volte più resistente dell'acciaio, con meno materiali: basta cambiare una fase della produzione
Il litio non si comporta come pensavamo: la scoperta potrebbe cambiare le batterie del futuro
Top 15 offerte Amazon: dalla RTX 5070, passando per computer portatili, bici elettriche e proiettori smart
Google contro l'Europa: ecco perché la guerra alla pirateria fa paura ai colossi del web
Computer portatili, le offerte Amazon che meritano davvero attenzione: 7 modelli selezionati dal notebook economico al gaming
E-bike da 29'' con 120 km di autonomia contro la pieghevole fat tire URLIFE T5: due mountain bike elettriche quasi allo stesso prezzo
Auto elettriche incentivate dallo Stato, ma il vero impatto ambientale resta un mistero
Huawei FreeClip 2 S ufficiali: gli auricolari open-ear diventano gioielli hi-tech
Gigabyte RTX 5070 EAGLE OC scende a 599€: 12GB GDDR7 che aprono le porte all'intelligenza artificiale locale
Ferrari Luce telaio numero 0, l'elettrica del Cavallino viene messa all'asta: base di partenza milionaria









0 Commenti
Gli autori dei commenti, e non la redazione, sono responsabili dei contenuti da loro inseriti - infoDevi effettuare il login per poter commentare
Se non sei ancora registrato, puoi farlo attraverso questo form.
Se sei già registrato e loggato nel sito, puoi inserire il tuo commento.
Si tenga presente quanto letto nel regolamento, nel rispetto del "quieto vivere".