PDA

View Full Version : NVIDIA Blackwell B200: due chip in uno per rivoluzionare l'intelligenza artificiale


Redazione di Hardware Upg
18-03-2024, 22:35
Link all'Articolo: https://www.hwupgrade.it/articoli/skvideo/6749/nvidia-blackwell-b200-due-chip-in-uno-per-rivoluzionare-l-intelligenza-artificiale_index.html

Due GPU (die) su un unico package per un totale di 208 miliardi di transistor: la nuova GPU Blackwell di NVIDIA nasce per accelerare l'innovazione nel campo dell'intelligenza artificiale come mai prima d'ora. La nuova proposta è accompagnata da 192 GB di memoria HBM3E per una bandwidth di 8 TB/s. A comporre la nuova offerta di NVIDIA troviamo tre soluzioni: B100, B200 e GB200.

Click sul link per visualizzare l'articolo.

silvanotrevi
18-03-2024, 23:21
Wow che bomba potentissima! Questo è il futuro ragazzi. Grandissima Nvidia :cool:

xxxyyy
19-03-2024, 01:15
Con GX200 supereremo tranquillamente gli zettaflops... paura.

io78bis
19-03-2024, 06:34
Caspita a guardare le tabelle il confronto delle specifiche con AMD è piuttosto imbarazzante.

Non capisco come sia riuscita a mantenere un consumo di 700W con lo stesso processo produttivo (ok evoluto) e numero transistor più che raddoppiati e RAM e altre specifiche molto migliorate

Dracula1975
19-03-2024, 06:37
Link all'Articolo: https://www.hwupgrade.it/articoli/skvideo/6749/nvidia-blackwell-b200-due-chip-in-uno-per-rivoluzionare-l-intelligenza-artificiale_index.html

Due GPU (die) su un unico package per un totale di 208 miliardi di transistor: la nuova GPU Blackwell di NVIDIA nasce per accelerare l'innovazione nel campo dell'intelligenza artificiale come mai prima d'ora. La nuova proposta è accompagnata da 192 GB di memoria HBM3E per una bandwidth di 8 TB/s. A comporre la nuova offerta di NVIDIA troviamo tre soluzioni: B100, B200 e GB200.

Click sul link per visualizzare l'articolo.

La vera "stranezza" è l'utilizzo del 4nm invece che del 3nm....mi aspettavo decisamente il 3nm (quindi mi fa pensare anche per le future soluzioni gaming che tutti davano sui 3nm ma a sto punto..bhooo)

frankie
19-03-2024, 08:04
la vera stranezza è utilizzare FP4 invece di FP8.
Ma io di questo non ci capisco e mi astengo.
Quanto siano meglio i calcoli FP4 invece che 8 su IA?

carloUba
19-03-2024, 08:25
la vera stranezza è utilizzare FP4 invece di FP8.
Ma io di questo non ci capisco e mi astengo.
Quanto siano meglio i calcoli FP4 invece che 8 su IA?

Non mi dilungo troppo ma è stato l'argomento principale di un corso che ho seguito proprio in sede nvidia e ti assicuro che i vantaggi in inferenza di FP4 su FP8 sono ENORMI.

ninja750
19-03-2024, 09:19
tutto questo per "disegnami un gatto azzurro con il cappello da pirata"

io78bis
19-03-2024, 09:27
Non mi dilungo troppo ma è stato l'argomento principale di un corso che ho seguito proprio in sede nvidia e ti assicuro che i vantaggi in inferenza di FP4 su FP8 sono ENORMI.

Immagino la risposta sia negativa ma puoi girare documentazione in merito?

io78bis
19-03-2024, 09:28
tutto questo per "disegnami un gatto azzurro con il cappello da pirata"

Si ma con una velocità che non hai mai visto prima

hackaro75
19-03-2024, 09:57
Eh niente l'AI farà bruciare letteralmente tutto il pianeta visto il consumo folle di queste architetture !!!! Addio mondo !!!

pengfei
19-03-2024, 10:08
Rimango sempre allibito dalla miopia e reazionarismo di buona parte degli utenti, sembra di essere in un bar frequentato da umarell

!fazz
19-03-2024, 10:17
la vera stranezza è utilizzare FP4 invece di FP8.
Ma io di questo non ci capisco e mi astengo.
Quanto siano meglio i calcoli FP4 invece che 8 su IA?

non è che siano meglio ma spesso per i calcoli di inferenza avere una tale precisione in virgola mobile è esagerato (a meno di modelli di calcolo specifici per limitatissime applicazioni)

il fatto è che abbassare la risoluzione del float permette di usare molti meno transistor nell'alu e quindi di poter mettere molte più unità di calcolo nel chip ma se hai unità a 64bit utilizzarle per calcoli più semplici è nettamente meno efficente (come è meno efficente aggregare unità più semplici per risolvere iterativamente calcoli complessi

per fare un esempio da gaming fps / tiro pensa alle unità a 64 bit come dei .50 tipo barrett e alle fp4 come ad un piccolissimo .22 da tiro olimpionico

ovviamente il .50 ha molta più birra ma se il tuo obiettivo è sterminare una legione di topi molto meglio avere 100 fucili in .22 che uno in .50 :D :D

Mars95
19-03-2024, 10:47
Caspita a guardare le tabelle il confronto delle specifiche con AMD è piuttosto imbarazzante.

Non capisco come sia riuscita a mantenere un consumo di 700W con lo stesso processo produttivo (ok evoluto) e numero transistor più che raddoppiati e RAM e altre specifiche molto migliorate

È imbarazante tanto quanto il confronto con H100, perchè bisogna sempre aizzare le tifoserie di una o l'altra parte?

Eh niente l'AI farà bruciare letteralmente tutto il pianeta visto il consumo folle di queste architetture !!!! Addio mondo !!!

Rimango sempre allibito dalla miopia e reazionarismo di buona parte degli utenti, sembra di essere in un bar frequentato da umarell

https://www.hdblog.it/tecnologia/articoli/n579494/ai-diagnosi-previsione-alzheimer-7-anni-anticipo/

brutta e cattiva l'IA...

Si forse alcuni commenti sembrano da bar frequentato da umarell però un pizzico di verità la contengono.

Sicuramente la AI è utilissima e rivoluzionaria in molti campi, ma è anche vero che migliaia di kW/h vengono bruciati per disegnari gatti azzurri col cappello da pirata come ha scritto Ninja.
È molto più l'energia buttata per cagate che l'energia usata per diagnosticare l'Alzheimer o i tumori della pelle per citare un altro utilizzo medico.

La AI non è ne buona ne cattiva è uno strumento, un ottimo strumento, ma come tutti gli strumenti può essere usato male.

dr-omega
19-03-2024, 10:55
...cut...

Sicuramente la AI è utilissima e rivoluzionaria in molti campi, ma è anche vero che migliaia di kW/h vengono bruciati per disegnari gatti azzurri col cappello da pirata come ha scritto Ninja.
È molto più l'energia buttata per cagate che l'energia usata per diagnosticare l'Alzheimer o i tumori della pelle per citare un altro utilizzo medico.

La AI non è ne buona ne cattiva è uno strumento, un ottimo strumento, ma come tutti gli strumenti può essere usato male.

A proposito di kW/h consumati, sempre meglio per l'IA che per le criptovalute :) . Comunque credo che far generare gatti azzurri con cappelli da pirata serva per alimentare il mercato, perché più richiesta genera più investimenti, più prestazioni e di conseguenza, come il famoso volano, più ricadute positive nei campi che servono davvero, teorici e pratici di fisica, medicina, meteo, geologia, e tutta la scienza buona.

CtrlAltSdeng!
19-03-2024, 11:03
Wow che bomba potentissima! Questo è il futuro ragazzi. Grandissima Nvidia :cool:

Ma ti pagano?

supertigrotto
19-03-2024, 11:35
Lavoro eccellente ma aspetto le risposte di Intel, AMD, IBM,MIT,Keller e altri ancora che non sono gli ultimi arrivati.
Sono contento che consumino meno energia questa serie 200 ma altre soluzioni promettono ancora meglio,staremo a vedere.
L'unica cosa è che spero non facciano il giochino che sembra stiano facendo con i clienti,se osano solo guardare la concorrenza,ritardano di proposito le consegne anche di molto,un giochino alla Intel di tanti anni fa.

Mars95
19-03-2024, 11:39
L'angolo del rompipalle.

Perchè scrivere sempre IA e non AI?
"Perchè in italiano di si dice intelligenza artificiale"
Certo e allora perchè scrivere CPU e GPU e non UEC e UEG (Unità di Elaborazione Centrale/Grafica)? :Prrr:

baruk
19-03-2024, 11:46
Un po' come è successo all'epoca con le CPU classiche, assisteremo ad una crescita sempre maggiore di prestazioni di questi "mostri". L'unica paura è l'uso che si può fare di questi strumenti, che varia dalla medicina avanzata, alla ricerca scientifica ma anche ai peggiori scenari tra armi sempre più efficaci e impatto sui posti di lavoro in molti campi.

Vul
19-03-2024, 13:01
la vera stranezza è utilizzare FP4 invece di FP8.
Ma io di questo non ci capisco e mi astengo.
Quanto siano meglio i calcoli FP4 invece che 8 su IA?

Dipende.

Fondamentalmente tutto cio' che riguarda il machine learning e' semplicemente fare moltiplicazioni tra matrici per trovare dei pesi da 0 ad 1.

fp4 significa che hai semplicemente la meta' dei bit disponibili per rappresentare questi pesi, quindi rinunci a numerosi ordini di accuratezza ma rimanendo in un range di precisione accettabile (in maniera grossolana possiamo dire che e' preciso alla quarta/quinta cifra dopo la virgola, e' un numero intermedio tra la quarta e la quinta in quanto un fp4 puo' rappresentare esattamente 45000 numeri circa).

Ora, anche se rinunci in accuratezza raddoppi la capacita' di calcolo e questo puo' essere desiderabile, in quanto se vuoi sperimentare sul tirare su un modello con diversi dati ci metti la meta' del tempo e poi eventualmente usare gli fp8 per quando generi il modello finale.

Ci sono diversi scenari dove questo e' preferibile e altri dove non lo e', ma l'avere la possibilita' ovviamente permette maggiore sperimentazione a maggior velocita'.

boboviz
19-03-2024, 14:54
Caspita a guardare le tabelle il confronto delle specifiche con AMD è piuttosto imbarazzante.

Ah, dici che confrontare una scheda uscita mesi fa con una che uscirà tra molti mesi è imbarazzante?

boboviz
19-03-2024, 14:55
Wow che bomba potentissima! Questo è il futuro ragazzi. Grandissima Nvidia :cool:

Ne hai già prenotata una per il tuo pc di casa?

Vul
19-03-2024, 16:24
Ne hai già prenotata una per il tuo pc di casa?

No ma avra' comprato azioni Nvidia a 800 euro quindi deve accaparrare piu' membri possibile per il culto.

giovanni69
19-03-2024, 16:58
$10 Bln.. per lo sviluppo attorno alla piattaforma Blackwell.

dominator84
19-03-2024, 20:54
giacchetta ha sofferto

e ora xxxxxxaaaa fiamme!!! grande giacchè!

io ho già i piccioli pronti per blackwell, ma già che c'erano potevano chiamarla blackwhealty!

i miei patek philippe, e forse a breve un richard mille, ti aspettano!

nebuk
19-03-2024, 21:24
Ma tralasciando per un attimo le specifiche di Blackwell, quello che Jensen ieri ha fatto è stato un'enorme flexata davanti al mondo di tutto l'ecosistema NVIDIA che va dall'hardware ma soprattutto al software. Ha dimostrato di avere una piattaforma pronta e performante per poter impiegare immediatamente i propri prodotti in qualsiasi ambito, dal gattino sul browser al contenimento del plasma nei reattori a fusione.
É qui che sta la differenza fra NVIDIA e tutti gli altri competitor.

nosio
20-03-2024, 02:04
É qui che sta la differenza fra NVIDIA e tutti gli altri competitor.

in realtà lo ha solo fatto intendere, ma non ha presentato ne HW ne tantomeno software a disponibilità immediata.
parliamo di "farò, avrò, sarò"....

solo marketing per far star alte le azioni.
probabilmente gli assets li ha, ma la tecnologia non lo assiste, perchè quello che ha dichiarato senza un salto di nodo non è per nulla facile da ottenere...

nosio
20-03-2024, 02:10
Caspita a guardare le tabelle il confronto delle specifiche con AMD è piuttosto imbarazzante.


imbarazzante gli sbagli che hanno scritto...
3/4 delle specifiche di AMD sono sbagliate.
anche AMD ha Matrix, ma quelli sono, in parte, solo le prestazioni degli shaders.

anche nella tabella di comparazione tra Hopper e Blackwell sulla colonna di hopper le unità di misura sono tutte sbagliate.

k0nt3
20-03-2024, 06:25
In effetti i dati in tabella non tornano, mi sembra di capire che per Nvidia sono stati usati i valori "w/Sparsity", ma non l'equivalente AMD.
https://substackcdn.com/image/fetch/w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F9553eb31-bf4c-4fa5-a6f9-5de1191af2f1_2018x1134.png

boboviz
20-03-2024, 07:10
Ha dimostrato di avere una piattaforma pronta e performante per poter impiegare immediatamente i propri prodotti in qualsiasi ambito, dal gattino sul browser al contenimento del plasma nei reattori a fusione.
É qui che sta la differenza fra NVIDIA e tutti gli altri competitor.

Ah, dici che le migliaia di MI300X che AMD sta vendendo ai vari clienti non sono pronte per funzionare?


P.S
Finchè non saranno provati sul campo, questi prodotti (e non si sa nemmeno quando di preciso), rimarranno solo benchmark che, per quanto entusiasmanti, sempre benchmark sono.

RaZoR93
20-03-2024, 07:36
Ah, dici che le migliaia di MI300X che AMD sta vendendo ai vari clienti non sono pronte per funzionare?


P.S
Finchè non saranno provati sul campo, questi prodotti (e non si sa nemmeno quando di preciso), rimarranno solo benchmark che, per quanto entusiasmanti, sempre benchmark sono.Provate sul campo dici? Gli hyperscaler avranno già fatto ordini per miliardi di dollari per Blackwell. Credi non abbiano tastato con mano le capacità reali?
Solo il progetto Ceiba di Amazon Web Services annunciato ieri equivale a circa un 1 miliardo di dollari per 20.000 B200.

Mars95
20-03-2024, 07:55
Provate sul campo dici? Gli hyperscaler avranno già fatto ordini per miliardi di dollari per Blackwell. Credi non abbiano tastato con mano le capacità reali?
Solo il progetto Ceiba di Amazon Web Services annunciato ieri equivale a circa un 1 miliardo di dollari per 20.000 B200.

Tutte le volte che presentano cose di questo genere lo fanno sventolando parnership con questo o quello per dimostrare che ci sono progetti in corso.

Nello specifico il progetto Ceiba fino a ieiri avrabbe dovuto impiegare 16000 e rotti GH200, hanno annunciato l'upgrade a 20 mila B200.
Ottima cosa, ma sono anche 16 mila B200 in meno che venderanno.
Tra l'altro colloca il tutto più in la nel tempo perché B200 cominceranno a spedirle a fine 24.

Grazie al piffero che paragonando Blackwell alla generazione di Hopper e CDNA3 di AMD Blackwell ne esce vincitore a mani basse, ma oggi ci sono Hopper e CDNA3, Blackwell sarà architettura del 2025 insieme a CDNA4.

nebuk
20-03-2024, 08:49
Ah, dici che le migliaia di MI300X che AMD sta vendendo ai vari clienti non sono pronte per funzionare?


Non dico non siano pronte per funzionare, ma l'ambiente ROCm è indietro anni luce rispetto a quello nVIDIA.

Alekx
20-03-2024, 08:51
https://www.hdblog.it/tecnologia/articoli/n579494/ai-diagnosi-previsione-alzheimer-7-anni-anticipo/

brutta e cattiva l'IA...


Che l' IA stia rivoluzionando un po' tutto e' sotto gli occhi di tutti, ma quello che hanno scritto in precedenza non e' una paura futura perche' si sta gia' verificando.

Basti guardare quello che sta succedendo negli USA dove proprio a causa delle IA il consumo di energia e' balzato ai limiti con molta preoccupazione.

A questo punto al di la di come verra' utilizzata, sicuramente sia in ambito lecito che illecito, il consumo rimarra' altissimo e forse non ci sara' energia per tutti.

AceGranger
20-03-2024, 09:19
in realtà lo ha solo fatto intendere, ma non ha presentato ne HW ne tantomeno software a disponibilità immediata.
parliamo di "farò, avrò, sarò"....

solo marketing per far star alte le azioni.
probabilmente gli assets li ha, ma la tecnologia non lo assiste, perchè quello che ha dichiarato senza un salto di nodo non è per nulla facile da ottenere...

è la prassi.

HOPPER

presentazione Marzo 2022
commercializzazione Ottobre 2022

MI300

Presentazione Gennaio 2023
Commercializzazione Dicembre 2023

BW

Presentazione Marzo 2024
Commercializzazione prevista Settembre/ottobre 2024

Tutte le volte che presentano cose di questo genere lo fanno sventolando parnership con questo o quello per dimostrare che ci sono progetti in corso.

Nello specifico il progetto Ceiba fino a ieiri avrabbe dovuto impiegare 16000 e rotti GH200, hanno annunciato l'upgrade a 20 mila B200.
Ottima cosa, ma sono anche 16 mila B200 in meno che venderanno.
Tra l'altro colloca il tutto più in la nel tempo perché B200 cominceranno a spedirle a fine 24.

Grazie al piffero che paragonando Blackwell alla generazione di Hopper e CDNA3 di AMD Blackwell ne esce vincitore a mani basse, ma oggi ci sono Hopper e CDNA3, Blackwell sarà architettura del 2025 insieme a CDNA4.

il calendario con lo storico delle presentazione/vendita è segnato qui sopra

CDNA 4 alla fine sara l'architettura del 2026, come BW alla fine, lo sara del 2025, e via dicendo, perchè hanno sempre presentato a inizio anno e commercializzato a fine anno...;
attualmente AMD ha annunciato un refresh di MI300 con le nuove HBM3e, segno che CDN4 è molto lontano come nomale che sia, visto che la MI300 hanno iniziato a commercializzarla 3 mesi fa... se poi l'intenzione di AMD è bruciare la MI300 e abbreviare la commercializzazione di CDNA4 lo vedremo l'anno prossimo.


Ah, dici che le migliaia di MI300X che AMD sta vendendo ai vari clienti non sono pronte per funzionare?



Funzionano sicuramente bene entrambe, ma una funziona meglio e copre nettamente meglio le esigenze del mercato.

https://www.economist.com/the-economist-explains/2024/02/27/why-do-nvidias-chips-dominate-the-ai-market
"Most analysts expect that Nvidia, which controls more than 95% of the market for specialist ai chips, will continue to grow at a blistering pace for the foreseeable future."



P.S
Finchè non saranno provati sul campo, questi prodotti (e non si sa nemmeno quando di preciso), rimarranno solo benchmark che, per quanto entusiasmanti, sempre benchmark sono.

Prove sul campo su stessi software hanno sempre avuto poco senso e dubito le vedrai mai perchè nVidia ha nel 99% dei casi i suoi tool proprietari e i risultati li vedi dai dati di diffusione; AMD ha sempre sbandierato i suoi dati i targa superiori alle nVidia in ogni sua slide, poi sul campo alla fine il sistema nVidia + "CUDA" ( inteso come software in ogni sua declinazione ) si è sempre rivelato quasi sempre migliore, da li il suo market share; nVidia nemmeno spreca pixel nelle slide a fare i confronti con le GPU AMD che detengono il 5% del marcato...

tempo fa spopolavano i bench dei motori di render OpenCL dove le AMD andavano un pelo meglio delle nVidia, senza poi contare che il grosso dei motori di render veri commerciali erano CUDA + RTX e nella realta nVidia va il triplo delle AMD...

RaZoR93
20-03-2024, 09:32
Tutte le volte che presentano cose di questo genere lo fanno sventolando parnership con questo o quello per dimostrare che ci sono progetti in corso.

Nello specifico il progetto Ceiba fino a ieiri avrabbe dovuto impiegare 16000 e rotti GH200, hanno annunciato l'upgrade a 20 mila B200.
Ottima cosa, ma sono anche 16 mila B200 in meno che venderanno.
Tra l'altro colloca il tutto più in la nel tempo perché B200 cominceranno a spedirle a fine 24.

Grazie al piffero che paragonando Blackwell alla generazione di Hopper e CDNA3 di AMD Blackwell ne esce vincitore a mani basse, ma oggi ci sono Hopper e CDNA3, Blackwell sarà architettura del 2025 insieme a CDNA4.Considerando che AMD, stando alla trimestrale del Q4 2023, deve ancora mettere in commercio volumi decenti di MI300X direi che CDNA4 è come minimo a 2 anni di distanza.
Stando alla stessa guidance di AMD il volume di vendite per la serie di acceleratori CDNA3 è di appena 3,5 miliardi di dollari per l'intero anno (anche se probabilmente è una stima conservativa), una goccia rispetto al volume previsto per Nvidia che sarà di circa 80-100 miliardi quest'anno (per l'intero settore data center).

mbk
20-03-2024, 09:47
Tutto molto impressionante...chissà tra 10 anni di sviluppo dove saremo arrivati. Gli scenari ipotizzabili sono sia incredibilmente affascinanti che terribilmente preoccupanti. In un era dove la disinformazione la fa da padrone questi strumenti potrebbero cambiare molti equilibri. Staremo a vedere...

PS: QUalcuno ha già chiesto se riesce a far girare Crysis? :D

Phantom II
21-03-2024, 13:03
A proposito di kW/h consumati, sempre meglio per l'IA che per le criptovalute :) . Comunque credo che far generare gatti azzurri con cappelli da pirata serva per alimentare il mercato, perché più richiesta genera più investimenti, più prestazioni e di conseguenza, come il famoso volano, più ricadute positive nei campi che servono davvero, teorici e pratici di fisica, medicina, meteo, geologia, e tutta la scienza buona.
Il problema infatti è che l'allocazione delle risorse (di ogni genere, da quelle energetiche per far funzionare l'ambaradan a quelle economiche essenziali per svilupparlo) è completamente in mano al mercato che del valore d'uso (che a me pare evidente sia zero tanto per le criptovalute, quanto per i gatti azzurri) se ne frega altamente perchè il fine è il valore di scambio che da decenni fa rima con speculazione.

zappy
21-03-2024, 20:41
L'angolo del rompipalle.

Perchè scrivere sempre IA e non AI?
"Perchè in italiano di si dice intelligenza artificiale"
Certo e allora perchè scrivere CPU e GPU e non UEC e UEG (Unità di Elaborazione Centrale/Grafica)? :Prrr:
perchè se la parola italiana e/o l'acronimo sono lunghi uguali o più brevi, si dovrebbe usare quelli inglesi?

cmq cpu si può anche chiamare proc, procio o processore :p

IA :p

alexsky8
22-03-2024, 09:50
tutta l'infrastruttura web consuma valangate di energia per gli usi piu' disparati, dai tiktoker alle video conferenze di medicina. Non è lo sturmento, è l'uso come sempre...

basterebbe limitarne l'utilizzo in settori che non siano le stron zate o in alternativa fare pagare almeno limiti i servizi inutili

quando alzi i prezzi ci pensi a cosa fai