Torna indietro   Hardware Upgrade Forum > Hardware Upgrade > News

Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090
Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090
Ho affidato ai due modelli lo stesso mestiere ma non lo stesso identico prompt: trasformare una storia illustrata in un video usando una RTX 3090 e modelli locali. Ne sono usciti due film, due applicazioni e due idee opposte di efficienza. Fucina, progettata con Fable 5, colpisce di più nei primi secondi. Storyboard Studio, costruito con ChatGPT/Codex, regge meglio sulla distanza e vince il confronto complessivo, ma di stretta misura
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile
Lenovo ha lanciato il ThinkTab X11 rimettendo piede nel segmento dei tablet Android con il marchio Think dopo oltre un decennio di assenza. Il risultato è un dispositivo che prende una direzione precisa: massima dotazione funzionale, costruzione resistente, autonomia fuori dagli schemi
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot
AMD Advancing AI è l'appuntamento annuale con il quale l'azienda americana mostra quelle che sono le proprie novità dal versante datacenter. Tra piattaforma Helios, GPU Instinct MI455X e processori EPYC di sesta generazione tutto quello che serve per processare l'IA sempre più complessa ed esigente
Tutti gli articoli Tutte le news

Vai al Forum
Rispondi
 
Strumenti
Old 04-06-2026, 13:01   #1
Redazione di Hardware Upg
www.hwupgrade.it
 
Iscritto dal: Jul 2001
Messaggi: 75166
Link alla notizia: https://www.hwupgrade.it/news/scienz...ra_154286.html

Tre fonti uscite tutte tra l'aprile e il maggio del 2026 raccontano tre cose che sembrano in disaccordo. Le ho messe in fila, una dopo l'altra, e secondo me il disaccordo è solo apparente. Quando le leggi nell'ordine giusto smettono di rassicurarti.

Click sul link per visualizzare la notizia.
Redazione di Hardware Upg è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 13:34   #2
Eroes78
Member
 
L'Avatar di Eroes78
 
Iscritto dal: Sep 2010
Messaggi: 143
Interessantissimo, come sempre.

(e anche un po' angosciante, come sempre )
Eroes78 è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 13:50   #3
windowistaxcaso
Senior Member
 
L'Avatar di windowistaxcaso
 
Iscritto dal: Nov 2002
Città: Milano-Venezia
Messaggi: 613
Quote:
Originariamente inviato da Eroes78 Guarda i messaggi
Interessantissimo, come sempre.

(e anche un po' angosciante, come sempre )
Grazie, purtroppo sono realista...
__________________
Ho fatto affari con: Sallivan77 / Aketaton / Raffaele / huangwei / tohni / Kaldais / McNamara / thegiox / lucaman / uc84 / MichelMauro / XP2200 / riccimar / ♂_KRONOS_♂ / ltmlmotig / Polos /six_of_nine / T3RM1N4T0R / Il Lonfo
windowistaxcaso è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 15:08   #4
Notturnia
Senior Member
 
L'Avatar di Notturnia
 
Iscritto dal: May 2008
Messaggi: 14288
Quote:
Originariamente inviato da Eroes78 Guarda i messaggi
Interessantissimo, come sempre.

(e anche un po' angosciante, come sempre )
Quote:
Originariamente inviato da windowistaxcaso Guarda i messaggi
Grazie, purtroppo sono realista...
confermo entrambi (e bello l'articolo) lo sto sperimentando in ufficio da me.. abbiamo iniziato a "giocare" con chatptg e codex da poco.. ero restio a farli entrare in ufficio.. poi una lettera di dimissione di un dipendente mi ha fatto pensare che forse alcune cose potevo automatizzarle dopo decenni di "lo faccio dopo" e ho iniziato a collaborare con la IA.. adesso anche io mi pongo le stesse domande sia esternamente: quanto è lontana la IA dall'essere utile ad un mio competitor per essere usata e fare il nostro lavoro bene al 70% ma con un costo del 10% ?), che internamente: cosa posso automatizzare e togliere ai dipendenti senza ridurre la qualità ma aumentando la disponibilità di informazioni ? come posso creare agenti che controllino l'operato di altri agenti/programmi in modo da passare dati validati il più possibile a chi poi deve prendere decisioni ? cosa posso fare ? che step farà codex 5.6 ? posso dare voce a 30 anni di documenti ed esperienza sepolta nei nostri server per valorizzare quello che oggi non ho tempo di portare ai clienti ? posso far fare questo ? posso far fare quello ?

ma poi.. posso licenziare A se faccio quello ? mi serve ancora B se poi faccio questo ? .. quali lavori è meglio che non automatizzo ? chi è meglio tenere assieme ai programmi che sto sviluppando a 6 mani con le IA ?

etc.. io ero nato programmatore quando babbo portò a casa un C16.. tornare a programmare mi sta facendo divertire di nuovo e quindi adesso passo 16 ore al giorno dietro ai monitor di nuovo..3 pc accesi.. tante sessioni IA.. debug, lavoro e programmazione e sto vedendo risultati concreti..

per ora stiamo solo giocando.. nulla di quello che ho prodotto è entrato realmente nel flusso di lavoro.. li considero ancora tutti in beta.. per cui facciamo fare il lavoro alle persone, lo facciamo fare alla cieca al computer e poi verifichiamo tramite agente IA e persona fisica le differenze e gli errori dell'uno e dell'altro per capire dove ha sbagliato l'umano e dove la IA/Python.. ma la distanza si assottiglia sempre di più e la velocità è ad un livello diverso..

l'Economist dice ?... dicono quello che la politici dice loro di dire perchè non possono spaventare le masse.. visto V for Vendetta ? non è compito nostro inventare le notizie a quello pensa il governo.. e qui mi sa che è lo stesso.. nei lavori tech, con un pò di impegno.. tagliare il 50% sarebbe possibile in meno di un anno .. con un costo ambientale importante se penso a quanti crediti mangio solo io .. ma è fattibile.. basta la volontà di farlo
Notturnia è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 16:54   #5
gparlav
Member
 
Iscritto dal: Jan 2005
Città: Roma
Messaggi: 185
Quote:
Originariamente inviato da Notturnia Guarda i messaggi
.. adesso anche io mi pongo le stesse domande sia esternamente: quanto è lontana la IA dall'essere utile ad un mio competitor per essere usata e fare il nostro lavoro bene al 70% ma con un costo del 10% ?)
Nel concordare con le tue riflessioni, quoto solo questo pezzo del tuo post, specialmente per quanto riferito al costo

Qui di seguito articolo interessante sui costi a seguito della revisione dei piani

https://www.tomshw.it/business/finis...ano-2026-06-01

Anche da noi stiamo iniziando a usare sempre più gli strumenti di AI, ma non per programmare. Ma ci stanno centellinando lo strumento. Per ora la versione free di Copilot, poi andremo forse su Gemini. Ma sempre con il contagocce.

Altrimenti mandiamo in bancarotta l'azienda, statene certi !
gparlav è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 16:59   #6
Cfranco
Senior Member
 
L'Avatar di Cfranco
 
Iscritto dal: Apr 2002
Città: PD
Messaggi: 12007
I primi lavori che l'AI potrebbe rimpiazzare e a una frazione del costo sono quelli dirigenziali
Ma chissà perché a nessuno è venuto in mente di buttare a mare il CEO e sostituirlo con una AI e risparmiare un botto
__________________
Certe persone non le digerisco
"È solo quando una zanzara si posa sui tuoi testicoli che impari che la violenza non risolve tutti i problemi"
Cfranco è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 17:06   #7
euscar
Senior Member
 
Iscritto dal: Jan 2007
Città: Un piccolo paese di montagna nel Trentino occidentale
Messaggi: 6444
Ottimo articolo ... futuro molto incerto per moltissime persone, ma visti i progressi potrebbe accadere tutto già entro un lustro.

P.S. V for Vendetta visto più volte ed ogni volta che lo riguardo mi sembra di esserci sempre più dentro
__________________
PC1:i5-9600K GTX 1660Ti WindForce OC 6GB PC2:AMDFX-8320 RogStrix GTX 1050Ti 4GB PC3:i5-8400 Dual GeForce RTX 3060 V2 OC Edition 12GB

Due cose sono infinite: l'universo e la stupidità umana, ma riguardo l'universo ho ancora dei dubbi. (cit. A.E.)
euscar è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 17:07   #8
Notturnia
Senior Member
 
L'Avatar di Notturnia
 
Iscritto dal: May 2008
Messaggi: 14288
Quote:
Originariamente inviato da gparlav Guarda i messaggi
Nel concordare con le tue riflessioni, quoto solo questo pezzo del tuo post, specialmente per quanto riferito al costo

Qui di seguito articolo interessante sui costi a seguito della revisione dei piani

https://www.tomshw.it/business/finis...ano-2026-06-01

Anche da noi stiamo iniziando a usare sempre più gli strumenti di AI, ma non per programmare. Ma ci stanno centellinando lo strumento. Per ora la versione free di Copilot, poi andremo forse su Gemini. Ma sempre con il contagocce.

Altrimenti mandiamo in bancarotta l'azienda, statene certi !
concordo.. ho visto quanto durano i token se ti metti a programmare sul serio.. 40 euro di token in 1 ora circa.. rispetto ad un programmatore vero non li valgono.. ma semplificano la vita perchè possono lavorare in autorevisione mentre tu dormi.. ma costano.. per ora è un investimento ma quando parlo con miei concorrenti sento che molti hanno implementato Claude a certi livelli e più è piccola l'azienda e più ne fanno uso mentre in aziende più grandi si tende a limitarne l'accesso.

io ho avuto copilot da oltre 1 anno.. anzi.. mi sa che sono 18 mesi buoni se non 24.. a pagamento.. una ciofeca.. ma è integrata con office.. ma credo che smetterò di pagarla solo che è a ano anticipato e quindi.. ma fa pena..

gemini e claude le ho analizzate ma alla fine, per via del gdpr migliore (a mio avviso) ho preferito chatgpt.. ma i prezzi possono scappare velocemente se hai fretta di fare e quindi meglio non lasciarla in mano a chiunque perchè una "seat" come le chiamano, finisce i crediti in poco tempo..

Quote:
Originariamente inviato da Cfranco Guarda i messaggi
I primi lavori che l'AI potrebbe rimpiazzare e a una frazione del costo sono quelli dirigenziali
Ma chissà perché a nessuno è venuto in mente di buttare a mare il CEO e sostituirlo con una AI e risparmiare un botto
si.. questa storiella l'ho sentita spesso, specie da chi non ha quelle qualifiche e non sa cosa fanno i CEO veri.. penso che molti colletti bianchi invece potrebbero essere rimpiazzati senza fatica dalle IA ad un costo irrisorio mentre una mente che decide in cima è meglio tenerla perchè da giù vedo che le cose non si vedono molto bene e si tende a fare confusione su cosa fa una IA..
Notturnia è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 17:23   #9
Notturnia
Senior Member
 
L'Avatar di Notturnia
 
Iscritto dal: May 2008
Messaggi: 14288
Quote:
Originariamente inviato da euscar Guarda i messaggi
Ottimo articolo ... futuro molto incerto per moltissime persone, ma visti i progressi potrebbe accadere tutto già entro un lustro.

P.S. V for Vendetta visto più volte ed ogni volta che lo riguardo mi sembra di esserci sempre più dentro
quello.. idiocracy.. etc.. è pieno di "vecchi" film che stanno apparendo nel mondo reale..
Notturnia è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 17:56   #10
mmorselli
Senior Member
 
L'Avatar di mmorselli
 
Iscritto dal: Jun 2007
Messaggi: 5357
Quote:
Originariamente inviato da windowistaxcaso Guarda i messaggi
Grazie, purtroppo sono realista...
La cosa che mi lascia però perplesso in tutto quel discorso è che di norma esce un modello nuovo, assieme a quello escono i benchmark, e subito tutti si affrettano a ricordare che i benchmark lasciano il tempo che trovano, e mi sono sempre trovato d'accordo sia per esperienza personale che per buonsenso, se dovessimo dar retta a Humanity's Last Exam altro che AGI, due anni fa quel benchmark stava al 2%, adesso al 45%, ma se fosse realistico vorrebbe dire che siamo già pronti a mandare a casa i professori all'università, non impiegati e stagisti.

poi però quando si vuole dire che l'AI si avvicina sempre di più a sostituire le persone si usa un benchmark.

Io uso quotidianamente gli agenti AI per attività che esulano dalla programmazione (scraping, analisi di dati incrociati, popolamento db, report, documenti, ecc...) ma tutta quella capacità di far da soli io non la vedo, nemmeno come direzione in cui stiamo andando, e sono un tecno entusiasta sempre più ottimista del dovuto. Uno strumento straordinario sicuramente, divertente, ma autonomo come un bambino genio di 4 anni.

Se un agente AI è autonomo al 90% vuol dire che non è autonomo, e no, non vuol dire che allora posso mettere una persona a controllare 10 task diversi per quel 10% che rimane, un essere umano smette di essere affidabile se gli assegno 10 task importanti tutti assieme. Ci sono cose che non si possono cambiare, se una donna fa un bambino in 9 mesi non posso mettere assieme 9 donne e farlo in un mese.

Il tempo magari mi smentirà, ma per me i lavori intellettuali, quelli che la gente crede più a rischio, non saranno facilmente rimpiazzabili con l'AI, diventerà più facile farli, saranno accessibili a più persone, l'azienda che davvero è in grado di alimentare l'AI con 10 task importanti prenderà 10 persone nuove, pagate meno perchè sono meno specializzate.

I lavori a rischio, al contrario, secondo me sono quelli che la gente crede al sicuro, cioè quelli manuali non totalmente ripetitivi (quelli sono già stati rimpiazzati), ma che non necessitano di grande creatività, per cui l'elettricista no, ma l'autista e il magazziniere hanno i giorni contati.
mmorselli è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 19:37   #11
Cfranco
Senior Member
 
L'Avatar di Cfranco
 
Iscritto dal: Apr 2002
Città: PD
Messaggi: 12007
Quote:
Originariamente inviato da Notturnia Guarda i messaggi
si.. questa storiella l'ho sentita spesso, specie da chi non ha quelle qualifiche e non sa cosa fanno i CEO veri.. penso che molti colletti bianchi invece potrebbero essere rimpiazzati senza fatica dalle IA ad un costo irrisorio mentre una mente che decide in cima è meglio tenerla perchè da giù vedo che le cose non si vedono molto bene e si tende a fare confusione su cosa fa una IA..
Hai ragione, le AI non sono molto brave a prendere per il *ulo la gente come fanno i CEO, le menzogne dette in carne ed ossa sono molto più convincenti
Per il resto l'unica qualità dei CEO bravi è quella di saper scegliere le persone più adatte, però se sostituisci pure quelle con l'AI ...
__________________
Certe persone non le digerisco
"È solo quando una zanzara si posa sui tuoi testicoli che impari che la violenza non risolve tutti i problemi"
Cfranco è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 20:09   #12
mmorselli
Senior Member
 
L'Avatar di mmorselli
 
Iscritto dal: Jun 2007
Messaggi: 5357
Quote:
Originariamente inviato da Cfranco Guarda i messaggi
Hai ragione, le AI non sono molto brave a prendere per il *ulo la gente come fanno i CEO, le menzogne dette in carne ed ossa sono molto più convincenti
Per il resto l'unica qualità dei CEO bravi è quella di saper scegliere le persone più adatte, però se sostituisci pure quelle con l'AI ...
Potresti rileggere questa frase a freddo, senza che ti sembri nemmeno un po' qualunquista?
mmorselli è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 21:45   #13
Notturnia
Senior Member
 
L'Avatar di Notturnia
 
Iscritto dal: May 2008
Messaggi: 14288
Quote:
Originariamente inviato da Cfranco Guarda i messaggi
Hai ragione, le AI non sono molto brave a prendere per il *ulo la gente come fanno i CEO, le menzogne dette in carne ed ossa sono molto più convincenti
Per il resto l'unica qualità dei CEO bravi è quella di saper scegliere le persone più adatte, però se sostituisci pure quelle con l'AI ...
brutto posto di lavoro o sei stato licenziato ?


conosco molti dipendenti la cui descrizione calza a pennello con quello che hai scritto tu.. se tu però credi che sia il lavoro dei CEO beh ... brutto lavoro o licenziato ?
Notturnia è offline   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 22:28   #14
sbaffo
Senior Member
 
L'Avatar di sbaffo
 
Iscritto dal: Feb 2005
Città: MIa
Messaggi: 8856
Quote:
Originariamente inviato da articolo;
L'Economist ha ragione: i numeri occupazionali di oggi non bastano a incolpare l'IA. Ma usare i numeri di oggi per stare tranquilli sul 2027 ha lo stesso difetto che avevo già segnalato a chi citava studi con dati fermi al 2024. La variabile che conta cresce dopo la fine della finestra in cui stiamo guardando, e leggere i dati definitivi vorrà dire leggerli quando la transizione sarà già avvenuta.
Si ma se nel 2024 si diceva la stessa cosa e oggi due anni dopo non è successa, potrebbe ripetersi oggi con il 2027, e poi ancora...
Si vedrà cosa succederà, come dice il proverbio "non fasciarsi la testa prima di..."

Quote:
Originariamente inviato da mmorselli Guarda i messaggi
La cosa che mi lascia però perplesso in tutto quel discorso è che di norma esce un modello nuovo, assieme a quello escono i benchmark, e subito tutti si affrettano a ricordare che i benchmark lasciano il tempo che trovano, e mi sono sempre trovato d'accordo sia per esperienza personale che per buonsenso, se dovessimo dar retta a Humanity's Last Exam altro che AGI, due anni fa quel benchmark stava al 2%, adesso al 45%, ma se fosse realistico vorrebbe dire che siamo già pronti a mandare a casa i professori all'università, non impiegati e stagisti.

poi però quando si vuole dire che l'AI si avvicina sempre di più a sostituire le persone si usa un benchmark.
Avevo letto anche io un articolo (mi pare su tom) che diceva cose del genere, cioè i bench sono una cosa e la realtà un'altra.
Parlavano anche dello studio McKinsey, che alla fine parla di potenzialità, e sappiamo bene che tra il dire e il fare c'è di mezzo il mare.

Ancora sui bench, non mi è chiaro come funziona METR: misura l'abilità di una Ia di completare long tasks con un'affidabilità del 50%, e questa lunghezza è espressa in ore uomo, giusto? Ma il 50% mi pare poco, a meno che non sia sottinteso che sui compiti più brevi l'affidabilità salga molto, cioè misura il limite o il "punto di rottura" dell'ia (in effetti guardando i grafici sembra così, ma non ho approfondito). Ma anche così potrebbe essere poco significativo, dipende se i task sono ripetitivi o meno, ecc.
Esempio stupido, se c'è da contare patate una calcolatrice può farlo all'infinito senza mai sbagliare, la lunghezza non è un indice di difficoltà, spero di essermi spiegato.
sbaffo è online   Rispondi citando il messaggio o parte di esso
Old 04-06-2026, 22:54   #15
windowistaxcaso
Senior Member
 
L'Avatar di windowistaxcaso
 
Iscritto dal: Nov 2002
Città: Milano-Venezia
Messaggi: 613
Quote:
Originariamente inviato da sbaffo Guarda i messaggi
Si ma se nel 2024 si diceva la stessa cosa e oggi due anni dopo non è successa, potrebbe ripetersi oggi con il 2027, e poi ancora...
Si vedrà cosa succederà, come dice il proverbio "non fasciarsi la testa prima di..."

Avevo letto anche io un articolo (mi pare su tom) che diceva cose del genere, cioè i bench sono una cosa e la realtà un'altra.
Parlavano anche dello studio McKinsey, che alla fine parla di potenzialità, e sappiamo bene che tra il dire e il fare c'è di mezzo il mare.

Ancora sui bench, non mi è chiaro come funziona METR: misura l'abilità di una Ia di completare long tasks con un'affidabilità del 50%, e questa lunghezza è espressa in ore uomo, giusto? Ma il 50% mi pare poco, a meno che non sia sottinteso che sui compiti più brevi l'affidabilità salga molto, cioè misura il limite o il "punto di rottura" dell'ia (in effetti guardando i grafici sembra così, ma non ho approfondito). Ma anche così potrebbe essere poco significativo, dipende se i task sono ripetitivi o meno, ecc.
Esempio stupido, se c'è da contare patate una calcolatrice può farlo all'infinito senza mai sbagliare, la lunghezza non è un indice di difficoltà, spero di essermi spiegato.
Sul METR: quel 50% non vuol dire che il modello azzecca una cosa su due a caso. C'è una curva: sui compiti brevi l'affidabilità è altissima, e man mano che il compito si allunga la percentuale di riuscita scende, finché passa sotto la metà. Il "time horizon" è il punto in cui quella curva tocca il 50%, cioè grosso modo il punto di rottura che avevi in mente. METR riporta anche una soglia all'80%, che cade prima. Quindi misura dove il modello comincia a piantarsi sui lavori lunghi, mentre sui corti se la cava benissimo.

Non sono "conta patate per sei ore", sono task di ingegneria del software e di ricerca dove la durata è quanto ci mette un umano competente, e dove la difficoltà sta nel non perdere il filo, recuperare quando sbaglia e capire il passo successivo. Una calcolatrice che conta patate non entrerebbe mai nel test, perché non c'è niente da tenere insieme.

Sui benchmark, e qui mmorselli ha colto una cosa giusta: Humanity's Last Exam che passa dal 2 al 45% non significa che siamo pronti a rimandare a casa i professori, e infatti quel tipo di benchmark non l'ho citato. Sono quiz, e rispondere a domande tostissime è altra cosa rispetto a fare il mestiere di qualcuno, fatto anche di giudizio, rapporti e responsabilità. Per questo mi appoggio a METR e non ai quiz: METR se ne infischia di quanto sa il modello e guarda per quanto tempo regge un lavoro da solo prima che tu debba rimetterci le mani.
__________________
Ho fatto affari con: Sallivan77 / Aketaton / Raffaele / huangwei / tohni / Kaldais / McNamara / thegiox / lucaman / uc84 / MichelMauro / XP2200 / riccimar / ♂_KRONOS_♂ / ltmlmotig / Polos /six_of_nine / T3RM1N4T0R / Il Lonfo
windowistaxcaso è offline   Rispondi citando il messaggio o parte di esso
Old 05-06-2026, 02:47   #16
mmorselli
Senior Member
 
L'Avatar di mmorselli
 
Iscritto dal: Jun 2007
Messaggi: 5357
Quote:
Originariamente inviato da windowistaxcaso Guarda i messaggi
Quindi misura dove il modello comincia a piantarsi sui lavori lunghi, mentre sui corti se la cava benissimo.
Un dipendente di solito entro la prima mezz'ora della mattinata sa già cosa dovrà fare per tutto il giorno.

Quote:
sono task di ingegneria del software e di ricerca
Il software è il campo dove gli agenti AI performano meglio perché è verificabile. Gli attualli agenti AI, che sono straordinari nel coding, risolvono quasi tutti i problemi per approssimazioni successive. Se guardi il flusso mentre lavorano vedi che in quasi tutti i prompt complessi sbagliano, rilevano l'errore, correggono, vanno avanti... solo nel riassunto finale è tutto perfetto. Però i lavoratori non sono mica tutti programmatori, i quali per ora mi sembrano abbastanza tranquilli dal momento che alimentare bene un agente di coding resta ancora piuttosto difficile.

Quando però il task è "prepara una perizia partendo da documenti e foto ricevuti via email questa settimana che riguardano la ditta Acme", come misuri automaticamente la qualità del lavoro svolto? Se correttamente istruito l'agente potrebbe fare quel lavoro in 15 minuti, l'umano poi impiega 3 ore a rileggere, controllare tutto e metterci la firma in fondo. L'agente, posto che abbia fatto un ottimo lavoro, dopo 15 minuti è pronto a farne un'altra, l'umano però sta ancora verificando la prima, per cui se vuoi sfruttare al massimo la super produttività dell'agente ti prendi un altro umano, come quando le fabbriche pagano maggiorato il turno di notte per sfruttare i macchinari 24/24.
mmorselli è offline   Rispondi citando il messaggio o parte di esso
Old 05-06-2026, 08:35   #17
WarDuck
Senior Member
 
L'Avatar di WarDuck
 
Iscritto dal: May 2001
Messaggi: 13027
Una cosa sulla produttività: per me il problema maggiore è che non si valorizza a sufficienza il mono-tasking e il deep work.

È risaputo che il cervello umano performa meglio se si concentra su un unico obiettivo, per un medio-lungo periodo.

Voler far tutto a mozzichi e bocconi senza riuscire a concentrarsi a fare una cosa e farla bene è un grosso problema, il context-switch è un grosso problema.

Infatti si vede la differenza con quelle che consideriamo "eccellenze", che fanno esattamente quello: una cosa e fatta possibilmente bene.

Stare a rincorrere clienti o a prendere nuove commesse in una totale disorganizzazione e senza alcuna visione purtroppo temo sia la realtà italiana, dove chiaramente l'IA può aiutare semplicemente per stare dietro a tutto.

Ma secondo me c'è un grosso problema a monte di disorganizzazione generale, che andrebbe risolto *prima ancora* di pensare all'IA.
WarDuck è offline   Rispondi citando il messaggio o parte di esso
Old 05-06-2026, 08:51   #18
sbaffo
Senior Member
 
L'Avatar di sbaffo
 
Iscritto dal: Feb 2005
Città: MIa
Messaggi: 8856
Quote:
Originariamente inviato da windowistaxcaso Guarda i messaggi
Sul METR: quel 50% non vuol dire che il modello azzecca una cosa su due a caso. C'è una curva: sui compiti brevi l'affidabilità è altissima, e man mano che il compito si allunga la percentuale di riuscita scende, finché passa sotto la metà. Il "time horizon" è il punto in cui quella curva tocca il 50%, cioè grosso modo il punto di rottura che avevi in mente. METR riporta anche una soglia all'80%, che cade prima. Quindi misura dove il modello comincia a piantarsi sui lavori lunghi, mentre sui corti se la cava benissimo.
ok, è come pensavo, però diciamo che una soglia dell'80-90% sarebbe più sensata, sotto quello l'affidabilità crolla, il 50% è un po pochino imho.
Inoltre SE le linee fossero rette il 50% si allontanerebbe con progressione geometrica rispetto a un 80% (ma nel grafico 5 sono curve per fortuna).

Quote:
Non sono "conta patate per sei ore", sono task di ingegneria del software e di ricerca dove la durata è quanto ci mette un umano competente, e dove la difficoltà sta nel non perdere il filo, recuperare quando sbaglia e capire il passo successivo. Una calcolatrice che conta patate non entrerebbe mai nel test, perché non c'è niente da tenere insieme.
Certo, l'esempio è appositamente banale, forse troppo, ma il punto è che dipende molto dal task: dal primo grafico mi pare che i task variano a seconda della lunghezza: si parte da "answer question", poi "count words" (non poi tanto diverso dal mio contare patate ), "Find fact on web" (ricerca, tipo google?), "Train classifier" , "Train adversarially robust image model" (programmazione?), "Optimally reduce the size of a language model" (programmazione avanzata?).
Se quelli sono i soli task presi per il modello e non solo degli esempi tra molti altri, si potrebbe pensare a cherry picking, o cumunque un campione ridotto e (forse) poco significativo. EDIT: (nelle faq ci sono altri tasks -puntini blu- ma resta il dubbio)
Nel summary parla di "software tasks that currently take humans days or weeks" quindi sembra orientato alla programmazione come dici anche tu (anche se i primi task non mi sembrano, boh), insomma un benchmark settoriale. Prenderlo come esempio per tutto mi pare azzardato.
McKinsey parlava del mondo del lavoro in generale, l'economist anche, METR invece è settoriale, sempre se ho capito bene eh.
Quote:
Originariamente inviato da mmorselli Guarda i messaggi
Il software è il campo dove gli agenti AI performano meglio...
Appunto. Non si può prendere l'esempio migliore, o comunque un campione ridotto, e applicarlo a tutto.

Ultima modifica di sbaffo : 05-06-2026 alle 09:20.
sbaffo è online   Rispondi citando il messaggio o parte di esso
Old 06-06-2026, 17:21   #19
sbaffo
Senior Member
 
L'Avatar di sbaffo
 
Iscritto dal: Feb 2005
Città: MIa
Messaggi: 8856
Oggi ho letto di un'intervista a Altman preoccupato perche i costi dell'AI per le aziende stanno esplodendo. (su tom ma non metto il link, si troverà ovunque)
Il fatto, di cui già si iniziava a parlare, è che gli agenti consumano token in maniera mostruosa, fuori controllo, e i modelli di pricing non sono più forfettari/promozionali (insostenibili per i supplier) ma stanno passando a consumo come giusto che siano.

Ricollegandomi a questo articolo, se anche i modelli progredissero raddoppiando le loro capacità ogni sei mesi, ma se anche il loro costo computazionale cresce esponenzialmente (il che è molto probabile), il problema non sarà la capacità dei modelli di sostituire l'uomo ma il loro costo di utilizzo.

Se spendi 20e al mese non ci pensi nemmeno, se ne spendi 200 ci pensi poco, se ne spendi 2.000-3.000 cioè circa quanto un junior, sei sicuro che non sia meglio prendere un junior?

Ultima modifica di sbaffo : 06-06-2026 alle 17:30.
sbaffo è online   Rispondi citando il messaggio o parte di esso
Old 06-06-2026, 17:30   #20
mmorselli
Senior Member
 
L'Avatar di mmorselli
 
Iscritto dal: Jun 2007
Messaggi: 5357
Quote:
Originariamente inviato da sbaffo Guarda i messaggi
Ricollegandomi a questo articolo, se anche i modelli progrediscono raddoppiando le loro capacità ogni sei mesi, se anche il loro costo computazionale cresce esponenzialmente (il che è molto probabile), il problema non sarà la capacità dei modelli di sostituire l'uomo ma il loro costo di utilizzo.
Non per forza, molte innovazioni recenti vanno proprio in direzione di una maggiore efficienza nell'inferenza, e poi c'è l'hardware che fa la corsa opposta per la legge di Moore che, a quanto pare, un modo per essere valida continua a trovarlo.

Una cosa su cui si sta puntando molto è l'inferenza locale, quando tu interroghi un modello OpenAI un router decide se indirizzare la tua domanda verso un modello più o meno intelligente e quindi costoso, ma ha tutti i limiti di un sistema automatico. Un essere umano invece che conosce perfettamente le sue esigenze sceglie già il modello che le risolve. Se il mio problema è "cataloga le email" e un modello quantizzato a 2 bit che gira in 128GB o anche meno lo risolve perfettamente, perché dovrei usare un servizio esterno?
mmorselli è offline   Rispondi citando il messaggio o parte di esso
 Rispondi


Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090 Fable e Sol a confronto: due cartoni animati cre...
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile Il tablet rugged leggero e sottile: Lenovo Think...
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot AMD Advancing AI 2026: l'hardware AMD per le ela...
Tascabile e con Android: BOOX Go 6 Gen II è diverso da tutti gli altri e-reader Tascabile e con Android: BOOX Go 6 Gen II &egrav...
Recensione Lenovo Idea Tab Plus: il tablet da 12 pollici che costa meno di 300 euro Recensione Lenovo Idea Tab Plus: il tablet da 12...
SpaceX Starship: dopo il successo di Fli...
Gli incendi in Spagna minacciano la staz...
Intel punta sul vetro: partnership con L...
L'acquisizione di ATI compie 20 anni: AM...
iPhone 18 Pro, Apple le prova tutte per ...
NVIDIA, Samsung, SK hynix e Broadcom: a ...
Sony rompe il silenzio: God of War Laufe...
iPhone Ultra, lancio ritardato per il pi...
Microsoft rafforza l'attivazione di Wind...
Galaxy S27 e S27+: Samsung starebbe test...
macOS più sicuro di Windows? Il n...
L'UE punta il dito contro TikTok: ecco c...
Qualcomm aumenterà i prezzi dei c...
TOP 12 Amazon weekend: al top una stampa...
Come sfruttare le offerte di Amazon per ...
Chromium
GPU-Z
OCCT
LibreOffice Portable
Opera One Portable
Opera One 106
CCleaner Portable
CCleaner Standard
Cpu-Z
Driver NVIDIA GeForce 546.65 WHQL
SmartFTP
Trillian
Google Chrome Portable
Google Chrome 120
VirtualBox
Tutti gli articoli Tutte le news Tutti i download

Strumenti

Regole
Non Puoi aprire nuove discussioni
Non Puoi rispondere ai messaggi
Non Puoi allegare file
Non Puoi modificare i tuoi messaggi

Il codice vB è On
Le Faccine sono On
Il codice [IMG] è On
Il codice HTML è Off
Vai al Forum


Tutti gli orari sono GMT +1. Ora sono le: 23:26.


Powered by vBulletin® Version 3.6.4
Copyright ©2000 - 2026, Jelsoft Enterprises Ltd.
Served by www3v
1