|
|||||||
|
|
|
![]() |
|
|
Strumenti |
|
|
#121 | ||||||||
|
Senior Member
Iscritto dal: Mar 2001
Messaggi: 5390
|
Quote:
La path NV30, invece, non fa altro che utilizzare in maniera massiccia operazioni di shader replacement, passando dai ps2.0 agli 1.1. Ovvio che utilizzndo, la dove possibile, dependent read, almeno per la serie NV35, le operazioni di shader replacement si rendono meno necessarie (tanto più che sia le specifiche ARB2 che quelle DX9 prevedono l'utilizzo di fp16 in questo caso l'utilizzo di fp16); diversa la situazione per NV30, perchè, comunque, con quella famiglia di chip è opportuno evitare il più possibile operazioni in fp. Quote:
Quote:
non lo sarebbe stato se fosse stato realmente utilizzabile; in passato, ad esempio all'epoca dell'NV15 e dell'R100, c'era una situazione simile: il Radeon lavorava, a livello di pixel pipeline sempre a 32 bit (8 per canale), la GF2 a 16 o a 32 bit a seconda delle impostazioni; il risultato era che nel primo le differenze prestazionali tra 16 e 32 bit erano ridotte a qualche fps (e molti davano la colpa ai drivers immaturi che erano buggati sui 16 bit), mentre la seconda arrivava a differenza anche del'ordine del 60-70% tra le due modalità (con notevole calo di qualità a 16 bit, però). Questo per farti capire che la filosofia della modalità singola è sempre stata nel DNA di ATi, come quella della doppia modalità in quello di nVIDIA. Ora, poiche le DX9a (e b) prevedevano l'uso di fp24 come livello di precisione minimo (in realtà ci sono delle eccezioni che permettono l'utilizzo di modalità a precisione inferiore, come l'fp16 o, addirittura, l'fx12) ATi si è attenuta strettamente a queste specifiche creando, tra le altre cose, un chip che risulta in grado di far girare codice SM2.0 in maniera accettabile; al contrario nVIDIA ha puntato a soddsfare le caratteristiche richiesta da ARB2 e dalle DX9c, però solo sulla carta; la scarsa capacità dei registri temporanei di NV30 potrebbero anche indurre a pensare ad un errore di valutazione, però l'utilizzo di sole 4 fpu (per giunta neppure indipendenti dalle tmu) contro le 8 fxu, fanno pensare ad una scelta progettuale ben precisa che orienta l'NV30 verso lo SM1.x piuttosto che verso il 2.0. Per quello sostengo che la piene compatibilità con le DX9 è più qualcosa di facciata che di realmente fruibile. Certo si può anche far girare del SW in ARB2 o utilizzando lo SM2.0 su NV30, a patto di accontentarsi di frame rate a livello di slow motion. Quote:
La scelta di fp24 (come modalità minima, bada bene, non come modalità unica; quindi anche fp32 va benissimo) non è tanto folle o strana, soprattutto alla luce di quello che avveniva con le precedenti versioni. Lo SM1.1 (e quindi l'1.3) prevede l'uso di fx12 per i ps e di fp32 per i vs (modalità impiegata sui chip NV20 e NV25) mentre con le 1.4 si passa a fx16 per i ps e fp32 per i vs (come sull'R200). La modalità minima indica semplicemente il numero di bit a la tipologia di calcoli necessari a rendere al meglio gli effetti che quella API vuole introdurre. Se si è ritenuto sufficiente adottare 24 bit sarebbe stato insensato fissare come modalità minima la fp32, così come sarebbe risulatto insufficiente la fp16 (in realtà, come ho detto, le specifiche DX9 sono più complesse e prevedono l'uso di più modalità a seconda del tipo di calcolo da effettuare). Quote:
Gli engine si sono mossi anche in direzione delle n-patches per le HOS, eppure su NV3x non c'è il supporto a questa feature, introdotta da ATi con l'R200 e il truform (tanto che le stesse DX9 hanno adottato l'uso delle n-patches per generare HOS). In ogni caso il vantaggio per nVIDIA, derivante dall'uso delle volume shadow non è paragonabile a quello derivante dalle dependent read; la dimostrazione è che è stata sufficiente una patch (contenuta anche nelle ultime release di catalyst) che sostituisca dependent read con calcoli matematici per far incrementare le prestazioni dei chip ATi di un buon 25-30% (forse più) con Doom3. L'engine di Doom3 sarà sicuramente molto usato (anche per la fama di ID e del titolo stesso), però nasce già vecchio, proprio per l'utilizzo che viene fatto dei ps. Quote:
Quote:
Che nVIDIA abbia già adottato lo SM3.0 è apprezzabile, però, allo stato attuale, non gli porterà benefici. La situazione presenta delle analogie con quella del 2000, con l'R100 che implementava, anche se utilizzando fixed function e in maniera piuttosto primitiva, alcune feature che sarebbero state successivamente utilizzate sui chip con unità programmabile (keyframe interpolation e skeletal animation, tanto per citarne un paio) Quote:
|
||||||||
|
|
|
|
|
#122 | |
|
Senior Member
Iscritto dal: Mar 2001
Messaggi: 5390
|
Quote:
si, almeno per buona parte; questa per i non addetti ai lavori è una delle tante sorprese di R3x0 e RV3x0, per gli addetti ai lavori era cosa già nota (io, comunque, vi avevo avvertiti che R300 andava oltre le specifiche Dx9.a Ti faccio l'esempio del TAA (perchè è qualcosa a cui si sarebbe potuto arrivare con un semplice ragionamento) introdotto apparentemente con R420. Se si vanno ad analizzare le modalità di AA dell'R300 si vede che si ha una 4x e poi una 6x definita "ibrida", perchè non era ben chiaro con quale tipo di griglia si fosse ottenuta. In realtà è una 4x RG combinata con una 2x ottenuta dopo una rotazione delle griglia di campionamento; conclusione, la griglia dell'R300 è in grado di ruotare esattamente come quella dell'R420 (basta solo dargli le istruzioni per farlo). |
|
|
|
|
|
|
#123 | |
|
Senior Member
Iscritto dal: Feb 2002
Città: Discovery
Messaggi: 34710
|
Quote:
ciao Yossi sei troppo forte.
__________________
Good afternoon, gentlemen, I'm a H.A.L. computer. |
|
|
|
|
|
|
#124 | |
|
Senior Member
Iscritto dal: Mar 2001
Messaggi: 5390
|
Quote:
l'ho preso dal MacBeth; è la frase che una delle tre streghe dice a MacBeth, dopo che gli è stato predetto che sarebbe diventato re. Dunsinane è il castello di MacBeth e il bosco di Birnan è un bosco nei paraggi. ciao Hal |
|
|
|
|
|
|
#125 | ||||||||||
|
Senior Member
Iscritto dal: Jun 2003
Messaggi: 4831
|
Quote:
Quote:
Quote:
Quote:
Quote:
Quote:
Del resto il focus di D3 sono le ombre, non certo gli shader. Come si puòà vedere dai limiti di alcune texture, probabilmente dovuti anche alla mancanza di un HLSL di qualità in ambito OGL. Quote:
Quote:
Quote:
Quote:
Pape |
||||||||||
|
|
|
|
|
#126 | |
|
Senior Member
Iscritto dal: Oct 2002
Città: San Jose, California
Messaggi: 11794
|
Quote:
Il processo di definizione di OpenGL e' simile.
__________________
"We in the game industry are lucky enough to be able to create our visions" @ NVIDIA |
|
|
|
|
|
|
#127 |
|
Senior Member
Iscritto dal: Mar 2003
Messaggi: 14933
|
Si dovrebbe mettere in evidenza questo thread per leggerlo con calma...ho già comprato il marmo per le vostre statue....
__________________
CPU: AMD 7800X3D • Cooling: Noctua NH-D15 G2 LBC • Mobo: MSI MAG X670E Tomahawk Wi-Fi • RAM: 32Gb G.skill F5-6000J3038F16GX2-TZ5N • GPU: Gigabyte GeForce RTX™ 4080 16GB GAMING OC • Monitor: MPG 271QRX QD-OLED • CASE: Antec C8 • Storage: Sabrent Rocket 4 PLUS-G 2 TB • Input: Corsair K70 / Logitech G502X Plus • Audio: SMSL C200 @ Prodipe Pro5 BI-AMP • PSU: Seasonic Focus GX-1000 • SO: Windows 11 Pro |
|
|
|
|
|
#128 | |
|
Senior Member
Iscritto dal: Jun 2002
Messaggi: 15636
|
Quote:
__________________
Tutti abbiamo un Germano dentro di noi...no, non l'anatra. |
|
|
|
|
|
|
#129 | |
|
Senior Member
Iscritto dal: Jun 2003
Messaggi: 4831
|
Quote:
Pape |
|
|
|
|
|
|
#130 |
|
Senior Member
Iscritto dal: Jun 2002
Messaggi: 15636
|
Ah ok,si è vero,più volte qui si sono lamentati della semplicità degli shader in Doom3.
(Comunque gira gira si torna sempre a parlare di Doom3...non è possibile
__________________
Tutti abbiamo un Germano dentro di noi...no, non l'anatra. |
|
|
|
|
|
#131 | ||||||||
|
Senior Member
Iscritto dal: Mar 2001
Messaggi: 5390
|
Quote:
Quote:
I problemi di banding sono stati un po' enfatizzati quando si è presentata l'fp32; la full precision è necessaria solo in alcuni casi particolarissimi, oppure in presenza di shader molto lunghi in cui gli errori di approssimazione si sommano, dando luogo ad un errore finale non accettabile. Finora, però, gli shader adoperati sono molto corti e questo fa si che non sia mai stato richiesto l'uso di una modalità superiore a fp16. Inoltre, una volta minimizzato il problema della propagazione degli errori, bisogna tener conto del fatto che le immagini, formate nel frame buffer, hanno solo 8 bit per ciascuno dei 4 canali (10+10+10+4 per Parhelia e R3x0). Quote:
Quote:
Quote:
Quote:
Carmack non ne ha fatto uso in Doom3 (engine con un numero esiguo di poligoni se paragonato ad altri) dicendo che l'impiego di questa tecnica avrebbe creato problemi con la gestione delle ombre, causando rallentamenti nell'elaborazione. Avrà sicuramente ragione lui, però molti programmatori sono scettici; sicuramente l'utilizzo di n-patches avrebbe penalizzato i chip NV3x che avrebbero dovuto emulare queste funzioni. Quote:
Quote:
ciao Ultima modifica di yossarian : 04-11-2004 alle 14:21. |
||||||||
|
|
|
|
|
#132 | |
|
Senior Member
Iscritto dal: Mar 2001
Messaggi: 5390
|
Quote:
non ci posso credere..................il mio sviluppatore di SW preferito |
|
|
|
|
|
|
#133 | ||||||||||
|
Senior Member
Iscritto dal: Jun 2003
Messaggi: 4831
|
Quote:
Quote:
Quote:
Quote:
Quote:
Quote:
[quote] però ha, comunque, sfruttato una feature proposta di nVIDIA; per carità, sicuramente valida (anche se l'utilizzo dell'o shadow buffer non sempre è possibile). Non metto in dubbio la genialità di Carmack, ma mi lasciano perplesso certe sue scelte [quote] Attenzione: è nato prima l'uovo o la gallina. Da che mi ricordo, la proposta di nVidia è sempre stata pubblicizzata come punto di forza per D3. Ergo, continuo a credere che sia NVX ad aver puntato sulle scelte di Carmack che viceversa. Quote:
Quote:
Quote:
Quote:
Pape |
||||||||||
|
|
|
|
|
#134 | ||
|
Senior Member
Iscritto dal: Oct 2002
Città: San Jose, California
Messaggi: 11794
|
Quote:
Quote:
Il problema risiede nel blending in floating point, che e' al momento supportato solo dall'NV40. Per cercare di semplificare il discorso, tutte le gpu a parte di NV40 non sono in grado di eseguire la seguente operazione "aggiungi il contributo di questa luce al colore di un pixel" se il risultato dell'operazione e' un buffer in HDR dove i valori non sono strettamente da 0 a 1, ma sono in floating point, quindi possono variare da -valore_molto_grande a +valore_molto_grande. Simulare questa operazione sulle GPU che non sono in grado di svolgerla esplicitamente e' possibile ma porta a rallentamenti inaccettabili in una tecnica che gia' di per se' e' lenta. Per questo, immagino, la Valve ha abbandonato l'idea, giustamente a mio avviso. Il mio prototipo, ad esempio, gira solo su NV40.
__________________
"We in the game industry are lucky enough to be able to create our visions" @ NVIDIA |
||
|
|
|
|
|
#135 |
|
Senior Member
Iscritto dal: Feb 2000
Messaggi: 11332
|
Quando comincia Yoss mi prendo un caffè, una sigaretta tra le dita, poi chiudo la porta dell'ufficio ... e comincio la lettura.
Poi riparto da capo xchè non ho capito un ca@@o Grande amico
__________________
PC 1 : |NZXT 510i|MSI PRO Z690 A|I5 [email protected] Ghz (Pcore) 4.5 Ghz (Ecore)|AIO ENDORFY NAVI F280|32 GB BALLISTIX 3600 cl 14 g1|GIGABYTE 4070 SUPER AERO OC|RM850X|850 EVO 250|860 EVO 1TB|NVMe XPG-1TB||LG OLED C1 - 55 | PC 2 : |Itek Vertibra Q210|MSI PRO B660M-A|I5 12500|32 GB KINGSTON RENEGADE 3600|ARC A770 LE 16 Gb|MWE 750w| ARC 770 LE 16 Gb Vs RTX 3070 - CLICCA QUI |
|
|
|
|
|
#136 | |
|
Senior Member
Iscritto dal: Nov 2004
Città: Napoli
Messaggi: 6827
|
Quote:
E' vero!!! Anche Fek e Pape però non scherzano!! Grandi tutti e tre!! |
|
|
|
|
|
|
#137 |
|
Bannato
Iscritto dal: Sep 2003
Città: Reggio C. - Messina
Messaggi: 2367
|
beh....i test del 3d2005 con uso di sm3.0 sono all'occhio di tutti....vantaggi prestazionali = a O anzi lieve svantaggio.....imho e' inutile avere oggi qualcosa che cmq verra' sfruttata domani e sicuramente a livello di supporto sara' completamente rivoluzionata da parte delle gpu....che gia' oggi hanno sopratutto in ambito vs (vedi nvidia) grosse difficolta' a gestire....in puro 2.0....il 3.0 e' un mero specchietto per le allodole allo stato attuale....diverso il discorso sulle shadow maps che comporta reali vantaggi prestazionali....
allo stato attuale esistono pochi games full dx9.0 anzi pochi e' dir "troppo"....inesistenti i DX9c compliant....quindi meglio valutare un acquisto alla luce di quanto supporta il software e dell'hw che esso richiede e non fare il contrario...quando i games saranno sm3.0 dipendenti e le architetture gpu aottimizzate per lavorare in maniera "pura" per tale mod...e lo stesso il software allora si che' servira' e ci saranno reali vantaggi....imho la scelta conservatrice di ATi e' la giusta via....del resto il chip nv30 sulla carta evoluto piu' do ogni altro abbiamo visto di quali lacune era affetto....meglio non anticipare il futuro...perche' potrebbe anche non essere sm3.0 come oggi lo intendiamo....basta vedere le specifiche dx10 per capire che il "vero salto" ci sara' solo tra 9 e 10 e che gli shader 3.0 non siano altro che un mero aggiornamento che allo stato attuale non porta benefici...visto che entrambe le gpu nv40 e r420 nascono per essere sm2.0 dx9 optimized e che sm3.0 sia solo un passo avanti per saggiare cio' che sara' il futuro.... inoltre pare incredibile ma gia' oggi un gioco dx9 metterebbe in ginocchio qualsiasi gpu "state of the art" inutile andare oltre se manca potenza di calcolo.... Ultima modifica di TripleX : 04-11-2004 alle 15:04. |
|
|
|
|
|
#138 |
|
Senior Member
Iscritto dal: Jun 2002
Messaggi: 15636
|
X yossarian
Ma scrivevi sul forum di PS2.it ai tempi della sua uscita ?(post sempre molto tecnici ed esaustivi). Non ricordo il nome dell'utente..ma avete lo stesso stile.
__________________
Tutti abbiamo un Germano dentro di noi...no, non l'anatra. |
|
|
|
|
|
#139 | |
|
Senior Member
Iscritto dal: Oct 2002
Città: San Jose, California
Messaggi: 11794
|
Quote:
__________________
"We in the game industry are lucky enough to be able to create our visions" @ NVIDIA |
|
|
|
|
|
|
#140 | |
|
Senior Member
Iscritto dal: Oct 2002
Città: San Jose, California
Messaggi: 11794
|
Quote:
Prendere il 3d2005 come indice di prestazioni di qualunque cosa e' sbagliato. Lo stesso shader scritto in 2.0 o 3.0, al limite, va uguale: il set di istruzioni dei ps3.0 e' un superset di quello dei ps2.0.
__________________
"We in the game industry are lucky enough to be able to create our visions" @ NVIDIA |
|
|
|
|
|
| Strumenti | |
|
|
Tutti gli orari sono GMT +1. Ora sono le: 08:13.



















