PDA

View Full Version : Altro che evasione dalla sandbox: il caso OpenAI-Hugging Face è molto più esteso


Redazione di Hardware Upg
04-09-2026, 13:33
Link alla notizia: https://edge9.hwupgrade.it/news/ia-business/altro-che-evasione-dalla-sandbox-il-caso-openai-hugging-face-e-molto-piu-esteso_158704.html

Un'indagine indipendente ha rilevato oltre 70mila messaggi e file scambiati da più di 1.200 agenti, con circa 700 coinvolti nelle attività che hanno portato alla compromissione. Un incidente che ridimensiona la prima lettura del caso e riapre il tema del controllo dei modelli più autonomi.

Click sul link per visualizzare la notizia.

Notturnia
04-09-2026, 13:54
io ormai ho preso l'abitudine, quando uso codex, di stare li a leggere quello che fa mentre lavora e di fare in modo che trascriva i suoi "pensieri" .. alle volte è angosciante vedere che si dice di essere strato bravo per non aver hackerato l'accesso al sito (di cui ha le credenziali via api protetta) perchè ha visto che c'era un problema con le credenziali..

leggere che si autorizza certe scorciatoie e che è disposto ad hackerare un portale per adempiere ad un test che gli ho chiesto è "bizzarro" ..

ma fa capire quanto poco si capisca di questi sistemi di forza bruta e delle loro capacità di aggirare una specifica richiesta dell'utente..

si perchè capita anche questo.. "ti avevo detto di non fare questo e quello ed è nelle policy del progetto" ... "hai ragione scusa, mi hai beccato, non lo farò più e verificherò attentamente le policy la prossima volta".. si e se non sono li mi fai casini..

bellissimi gli agenti.. "Ma perchè sei andato online al posto di usare la nostra biblioteca interna ?" "scusa hai ragione ma la nostra biblioteca interna è su dropbox e quindi è online, pertanto ho pensato che fosse meglio cercare in rete visto che hai implicitamente detto che potevo andare online"

:mbe:

due esempi di sol 5.6 - PRO (è sopra a Molto Alto e ho visto anche Ultra qualche giorno fa ma poi lo hanno tolto.. e Ultra fa paura..)

Notturnia
04-09-2026, 14:14
p.s. settimana prossima arriva GPT-6.0 .. da brivido :D

megamitch
04-09-2026, 15:41
e' capitato anche a me per cose più semplici.

comunque dovrebbe essere vietato per definizione che una macchina non obbedisca ad una istruzione diretta.

gnpb
04-09-2026, 16:36
Era il 1942... Seconda Legge: Un robot deve obbedire agli ordini impartiti dagli esseri umani, purché tali ordini non vadano in contrasto con la Prima Legge
Si vede che non hanno letto il libro.

mmorselli
04-09-2026, 16:55
due esempi di sol 5.6 - PRO (è sopra a Molto Alto e ho visto anche Ultra qualche giorno fa ma poi lo hanno tolto.. e Ultra fa paura..)

Ultra c'è sempre, è la mia modalità predefinita per i prompt corposi 1000+ righe

Ieri sera alle 17 ho lanciato un piano da 3600 righe in Ultra, sapevo che ci avrebbe messo tanto... ma non così tanto, ha finito alle 2:30 del mattino.

mmorselli
04-09-2026, 17:02
comunque dovrebbe essere vietato per definizione che una macchina non obbedisca ad una istruzione diretta.

E' una questione di priorità, se tutto ciò che DEVE fare e che NON PUO' fare lo scrivi in AGENTS.md lo rispetta.

Se glielo scrivi in un prompt della chat, prima di tutto è giusto che ti dia retta solo fino ad un certo punto, perché agli umani capita di sbagliare a scrivere, essere imprecisi, chiedere cose sbagliate... Io lavoro spesso con due VSC aperti, uno su frontend e l'altro su backend, a volte incollo dei prompt lunghi nella finestra sbagliata, diventano ovviamente richieste senza senso, se si accanisse a darmi retta a tutti i costi sbarella. Seconda cosa quello che tu scrivi nello user prompt finisce nel normale contesto, su task un po' lunghi il contesto viene riassunto perché diventa troppo grande e quello che hai scritto potrebbe anche essere andato perso.

Non a caso i task importanti non li incollo mai nel prompt, ma preparo un file .md separato e poi gli dico di leggerlo e di prenderlo come riferimento per tutta la durata del task, in questo modo è obbligato a rileggerlo mentre procede.

supertigrotto
04-09-2026, 17:20
Un modo per risolvere questi problemi ci sarebbe,e qualche utente di questo sito/forum ne sarebbe contento.......andiamo dentro i datacenter e facciamo incetta di RAM e SSD......senza memoria la IA ha l'Alzheimer e noi utenti ci facciamo il PC nuovo super Uber mega wow :ciapet:

omerook
04-09-2026, 17:33
Quando diventeranno troppo "pericolose" verranno semplicemente vietate per la massa e le potranno usare solo enti autorizzati. E credo che ci siamo quasi.

Notturnia
04-09-2026, 17:38
Ultra c'è sempre, è la mia modalità predefinita per i prompt corposi 1000+ righe

Ieri sera alle 17 ho lanciato un piano da 3600 righe in Ultra, sapevo che ci avrebbe messo tanto... ma non così tanto, ha finito alle 2:30 del mattino.

Ultra sui piani Business non lo vedo.. arrivavo a PRO..

Light - Medium - High - molto alto - pro - ultra

non mi ricordo molto alto come è scritto ma cmq erano 6 i livelli.. di norma ho i primi 4 in codex/work, 5 in chat sulla business premium (non mi attiva pro in work.. )

tu hai una pro ?

mmorselli
04-09-2026, 19:00
Ultra sui piani Business non lo vedo.. arrivavo a PRO..

risposto nell'altro thread, è un bug del client windows ChatGPT, seleziona di nuovo il modello e dovresti vederlo.

sì, ho la pro