|
|||||||
|
|
|
![]() |
|
|
Strumenti |
|
|
#21 | |
|
Senior Member
Iscritto dal: Aug 2004
Città: Firenze (P.zza Libertà)
Messaggi: 9135
|
Quote:
Cosa doveva dire il CEO di un'azienda che sta presentando un'IPO da non so quanto miliardi per quotarsi in borsa...? "Oste com'è il suo vino?" dai, facciamo un po' di tara sui discorsi di questi personaggi. Sicuramente l'AI cambierà il mondo e il modo di pensare il fatto che loro vogliano accelerare al 1000% per rientrare nei loro fanta-investimenti
__________________
_______________________ Quando la "tossicità dell'azoto" diviene dipendenza!... "Bolle! Ancora bolle!" |
|
|
|
|
|
|
#22 |
|
Senior Member
Iscritto dal: Aug 2004
Città: Firenze (P.zza Libertà)
Messaggi: 9135
|
altra cosa...
leggo commenti in cui siete tutti ad usare 'sta c@zzo di intelligenza artificiale. Ma siete tutti a lavoro alla scrivania? ma qualcuno che si sporca ancora le mani , no? Bho... mi sento un Neanderthal IMHO
__________________
_______________________ Quando la "tossicità dell'azoto" diviene dipendenza!... "Bolle! Ancora bolle!" |
|
|
|
|
|
#23 | |
|
Senior Member
Iscritto dal: Jul 2015
Messaggi: 5904
|
Quote:
A spanne per un 72b 2x per il coding ti servono circa 300 gb di vram ed almeno 128 gb di ecc ( e ci lavori in due con contesti relativamente lunghi). Solo di hardware ( server finito) vai sopra gli 80k, aggiungici linea dedicata da 5/6 kwh. Un sistema con 4 ia Agent ( non tutti attivi contemporaneamente) e Ai di verifica per uso office ( non il pacchetto office ) e coon 2/3 utenti connessi vai sopra i 45k €, non proprio una bazzeccola. Se poi credi che l'AI che ti gira sullo smartphone sia appena utilizzabile in ufficio dai troppa enfasi ai proclami dei produttori. |
|
|
|
|
|
|
#24 | |
|
Senior Member
Iscritto dal: May 2008
Messaggi: 14417
|
Quote:
codex lo saturo facendo programmazione e facendogli fare i debug.. la versione business di codex flat si brucia solo a guardarla.. tanto che creo i moduli generici sul pro e poi li testo sul business per non consumare troppi token.. spero che lascino le cose così anche con la 5.6 e che non mettano paletti o aumenti di prezzo
__________________
https://www.ansa.it/sito/notizie/cro...46d9c33ec.html |
|
|
|
|
|
|
#25 |
|
Senior Member
Iscritto dal: Jun 2007
Messaggi: 5751
|
Se con PC intendi un Mac, potremmo ragionare sui 64, ma è durissima, con 128 si inizia a mettere un piede nel "non è perfetto, ma si usa". Però poi scrivi RTX, per cui penso che intendevi un PC Intel/AMD e con 32-64GB di RAM intendevi DDR5... Qui entri invece nel mondo del "non ci provare nemmeno", è troppo lenta (ma pure troppo poca) per un modello che abbia qualche funzionalità un po' avanzata, puoi solo caricare dei modelli (comunque limitati) per funzioni specifiche come la generazione di immagini per esempio, ma anni luce come qualità da quelli a cui la gente è abituata in cloud. Modelli molto piccoli e leggeri per sperimentare ne trovi, ma per lavorare no.
|
|
|
|
|
|
#26 | |
|
Senior Member
Iscritto dal: Jul 2015
Messaggi: 5904
|
Quote:
|
|
|
|
|
|
|
#27 | ||
|
Senior Member
Iscritto dal: May 2008
Messaggi: 14417
|
Quote:
Quote:
__________________
https://www.ansa.it/sito/notizie/cro...46d9c33ec.html |
||
|
|
|
|
|
#28 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: Firenze
Messaggi: 13975
|
Quote:
Vedremo quanto sangue qualcuno lascerà a terra tra qualche tempo...
__________________
Mac Mini M2 Pro; Apple Studio Display; Logitech MX Keys for Mac; MBA 13" M3; iPod Touch 1st Gen. 8 Gb; iPhone 14 Pro; iPad Air 2020 WiFi 64 Gb, Apple Watch 8... |
|
|
|
|
|
|
#29 | |
|
Senior Member
Iscritto dal: Jun 2007
Messaggi: 5751
|
Quote:
Una volta che il tuo brand è diventato sinonimo di quel servizio dopo i soldi arrivano da soli. Nel frattempo se tirano anche su qualche soldo rivendendo il servizio non fa schifo, ma non è la cosa più importante. |
|
|
|
|
|
|
#30 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: Firenze
Messaggi: 13975
|
Quote:
__________________
Mac Mini M2 Pro; Apple Studio Display; Logitech MX Keys for Mac; MBA 13" M3; iPod Touch 1st Gen. 8 Gb; iPhone 14 Pro; iPad Air 2020 WiFi 64 Gb, Apple Watch 8... |
|
|
|
|
|
|
#31 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: N.P.
Messaggi: 15410
|
Quote:
Però se devi fare roba seria seria i costi salgono esponenzialmente. Per dire, un DGX spark va bene per sperimentare/laboratorio ma se ti serve roba che fa 200-300 token/s con una finestra di contesto grande (512K / 1M) e magari far girare un modello full allora no, i costi sono proibitivi. Certo, puoi fare offload sulla RAM, posso far tranquillamente girare un modello 30B sul mio pc ma la velocità passa da 95token/s a 5token/s, praticamente si passa dalla fibra al telegrafo, letteralmente.
__________________
Sto cercando di disintossicarmi dall'Hardware... ma non ci sono ancora riuscito battutona ci gira Cyberpunk? Ultima modifica di bonzoxxx : 03-07-2026 alle 19:22. |
|
|
|
|
|
|
#32 | |
|
Senior Member
Iscritto dal: Jul 2015
Messaggi: 5904
|
Quote:
Ma quella non è Ai, e un giocattolo costoso. Per lavoro se vuoi davvero usare l'Ai come minimo ti devi munire di Ai agentic ( magari nvidia) e di un llm un pochino più serio, con un server proxmox ( e ddr ecc ed almeno una rx 6000 da 48 gb ), ma 1 max 2 utenti ed una sola Ai la volta. Come passi ad usare qualcosa sopra 20b 24 gb di ram si esauriscono e ti tocca fare switching con la ram di sistema in Hibrid mode, Stando attento anche a non riempire il buffer del content text con prestazioni per singolo utente di 4/5 token al secondo. Non stiamo parlando dell'Ai che provi a casa su una vga da 16 gb, ma di un server che deve sostituire una AI di frontiera per i flusssi di lavoro di più pertsone ( e per il coding devi partire da almeno 280gb vram perchè sarai costretto ad usare modelli da oltre 70b ( che da solo occuperanno in ram tra i 180 ed i 240 gb di spazio lasciando davvero poco alla content cache. |
|
|
|
|
|
|
#33 |
|
Senior Member
Iscritto dal: Jun 2007
Messaggi: 5751
|
Eppure, se fosse solo business tradizionale non avrebbe senso, esattamente come stanno dicendo molti, anche qui, non ha senso... Ma questa gente non fa cose che non hanno senso, possono andare bene o male, ma non sono a caso. E' una guerra per il posizionamento, e le due o tre aziende che saranno in grado di farsi un nome nel settore prenderanno la maggioranza dei guadagni, anche se ci saranno altri che faranno la stessa cosa.
|
|
|
|
|
|
#34 | |
|
Senior Member
Iscritto dal: Dec 2004
Messaggi: 1891
|
Quote:
Tim, Vodafone, Wind, ecc possono far pagare poco la connessione (realtà solo italiana) perché guadagnano con finanziamenti per smartphone e vendita di abbonamenti di DAZN, Netflix, ecc abbinati alla vendita di connessione. Ne ho comprati io? No, ma se è la modalità di vendita, vuol dire che funziona, quindi c'è chi li acquista! Ma non credo che venderanno i crediti AI a meno per rifilarti l'Iphone a rate... E allora? La concorrenza può indurre a far pagare il meno possibile, ma un costo c'è. E a quanto pare è un costo elevato. I modelli di vendita sono in "prova". Da una parte loro che sono ancora in perdita, dall'altra gli utilizzatori che non sono propensi a spendere. |
|
|
|
|
|
|
#35 | |||
|
Senior Member
Iscritto dal: Jun 2007
Messaggi: 5751
|
Quote:
Si stava parlando dei costi di telefonia che non sono esplosi dopo averti invogliato, giusto? Bene, per me il costo di telefonia è quanto pago io che compro solo la telefonia, non quanto paga chi assieme ci compra anche Netflix. Quote:
Quote:
|
|||
|
|
|
|
|
#36 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: Firenze
Messaggi: 13975
|
Quote:
L'AI, al di là della rivoluzione tecnologica che porta con se, si sta dimostrando una enorme polo di attrazione e movimentazione di ingenti capitali che sta alimentando un vero e proprio mercato finanziario derivato. In sostanza si ragiona sul fatto che se ti presto 100 da investire in infrastruttura ( hardware e software ), posso sempre rivendere il rischio del capitale prestato ed assicurarmi guadagnandoci sopra anche un 20%, in attesa che il core business inizi a produrre utili e profitti dimostrandosi autosufficiente. Fino ad oggi, in preda ad una sbornia colossale da AI, nessuno a badato tanto ai veri costi per usare l'intelligenza artificiale in azienda nella speranza che rimanessero " bassi " e che gli strumenti siano un vero rimpiazzo di impiegati. Si sono " sottovalutati " i veri TCO dell'infrastruttura da parte degli hyperscaler che vengono scaricati direttamente sugli utenti finali, così come quelli sociali che stanno iniziando ad alimentare il dibattito politico. E la politica è una bella variabile di difficile valutazione vista la portata rivoluzionaria dell'AI nel mondo del lavoro, ovvero nell'abbassamento o distruzione di reddito da lavoro. Quindi il senso che ha ora l'AI come industria, in un momento dove c'è un eccesso di offerta rispetto ad una domanda ancora " disorientata " e con costi folli, è quella di tentare di creare delle prospettive e prodotti futuri abbastanza convincenti per stabilizzare la domanda in un quadro lavorativo possibilmente normato, il tutto con il sostegno dell'industria finanziaria. Questo è quello che personalmente leggo nei vari report trimestrali e dalle notizie del settore; i numeri contabili, mio caro, sono tutti nero su bianco e tutti noi, professionisti e/o appassionati in ambito IT, stiamo vivendo e vedendo come è stato ridotto il mercato dell'hardware e dei dispositivi elettronici. Un mercato stravolto, stuprato, in tempi brevissimi con aumenti che sono arrivati a tripla cifra su memorie e SSD. Vedremo come andrà a finire ( economicamente ragionando ), visto che gli ingredienti di una crisi ben peggiore a quella del 2008 ci sono tutti.
__________________
Mac Mini M2 Pro; Apple Studio Display; Logitech MX Keys for Mac; MBA 13" M3; iPod Touch 1st Gen. 8 Gb; iPhone 14 Pro; iPad Air 2020 WiFi 64 Gb, Apple Watch 8... |
|
|
|
|
|
|
#37 | |
|
Senior Member
Iscritto dal: Aug 2008
Città: Firenze
Messaggi: 13975
|
Quote:
Nel resto, dalla parte dei fornitori di servizi AI, c'è anche il ritorno e la remunerazione del capitale investito che sono una bella voce di costo. Altro fattore è il tempo: quanto tempo ci metteranno i fornitori di servizi AI a diventare profittevoli e/o a ripagare il capitale preso a prestito? Perchè le banche hanno scadenze temporali precise sulle cedole e su determinati prodotti di copertura... La " macchina " AI sotto il lato economico è più complessa di come te la stai prefiggendo.
__________________
Mac Mini M2 Pro; Apple Studio Display; Logitech MX Keys for Mac; MBA 13" M3; iPod Touch 1st Gen. 8 Gb; iPhone 14 Pro; iPad Air 2020 WiFi 64 Gb, Apple Watch 8... |
|
|
|
|
|
|
#38 | |
|
Senior Member
Iscritto dal: Jul 2015
Messaggi: 5904
|
Quote:
Ps ti consiglio ( se proprio volessi mettere les pelotas in mezo a due mattoni) di aggiungere una r9700 ai pro da 32 gb e far girare gli Ai agent ( magari nemotron 3 di nvidia) su rtx pro 6000 coon supervisor ed agent multipli gestiti dal supervisor, ma fa far validare i risultati ( magari anche qualche intermedio) sulla vm Ai da far girare su r9700 ( una 27b moe tra gemma4 o qwen 3.6) |
|
|
|
|
|
|
#39 |
|
Senior Member
Iscritto dal: Oct 2025
Messaggi: 1993
|
Io al lavoro uso diverse IA:
Copilot (la versione base inclusa in MS365) per richieste spot, tipo come si fa questo o quello, che è più veloce che una ricerca, anche se potrei sostituirlo con un AI Assist di Google o DuckDuckGo. In Outlook lo uso per avere fare il sunto di email che mi arrivano in reply a 12123 messaggi, con cui posso posso pi chattare per capire meglio cosa c'è da fare e come farlo, ancora non gli ho fatto creare email di risposta però. Rovo di Atlassian, più che altro per migliorare i testi dei task, ticket (kira) e doc (comfluence) che scrivo, e anche questo per ora è compreso nel prezzo va da se che lo uso poco perché fa tutto Kiro per ticket e doc. Kiro-CLI questa comprende i 1000 crediti mensili (20€ per ora) e la uso per fare operazioni su file, inizializzare un progetto Laravel, integrare con code-commit, qualsiasi cosa che avrei fatto in bash a mano, uso kiro-cli in WSL Kiro IDE, che è un fork di VS Code, questo è il grosso dei miei 1000 crediti mensili. Oltre a praticamente scrivere tutto il codice, collegando Kiro a Jira/Confluence di Atlassian via MCP, gli faccio creare task e soprattutto la documentazione direttamente a lui (esso?). Non ho ancora approfondito l'uso agentico perché essendo installato in Windows, ma lavorando su progetti WSL, gli agenti usano cmd di partenza e fa sempre giri pindarici assurdi per arrivare all'effettivo file, che alla fine faccio prima io per molte cose, se no vado di kiro-cli direttamente. In pratica il mio lavoro ora è: Apro Jira, vedo che ho da fare Prendo un lavoro e su carta e penna metto giù che va fatto, lo suddivido in più parti se necessario, raccolgo tutte le info che possono servire qua e là (db, codice esterno, ecc) e poi monto un prompt abbastanza lungo, ma completo. Lo rileggo, magari lo faggio migliorare a copilot, lo aggiusto, ecc Quando ho fatto apro Kiro e, se il task su jira nomn esiste, glielo faccio creare, poi metto modalità pianificazione e incollo il suddetto prompt. Quando ha finito di pianificare, chiedendomi cose nel mentre, leggo il piano, lo aggiusto eventualmente, poi lo faccio eseguire. Crea di solito anche test per verificare il codice, fa il controllo sintassi, ecc, ma meglio non fidarsi, così quando ha finito guardo il codice, e testo io direttamente. Se va tutto, gli chiedo di creare la doc su Confluence di quello che ha appena fatto. Se è gittato, faccio merge del branch e push Fine. Se mi chiedono di tornare a lavorare come prima, mi licenzio e apro una gelateria. Son disposto a essere pagato in token invece che buoni pasto se necessario. Sullo stuipendio è da discutere perché se devo stare al lavoro comunque 8 ore, mi paghi per 8 ore in denaro. Se mi paghi in parte con i token le ore lavorative devono essere basate sullo stipendio reale, che è poi il motivo per cui venire pagati in token. |
|
|
|
|
|
#40 | |
|
Senior Member
Iscritto dal: Jul 2015
Messaggi: 5904
|
Quote:
Sembra che si perda più tempo, ma la creazione a 4 mani degli schizzi del progetto ti può portare a rivalutare alcuni assunti. |
|
|
|
|
|
| Strumenti | |
|
|
Tutti gli orari sono GMT +1. Ora sono le: 21:01.





















