Quote:
Originariamente inviato da cdimauro
Bisogna vedere come vengono conteggiate le operazioni di tipo "ALU", visto che Broadwell e Skylake ne hanno 4. Dal manuale delle ottimizzazione di Intel (per Broadwell; Skylake ne copre di più):
"Execution Unit | # of Unit | Instructions
ALU | 4 | add, and, cmp, or, test, xor, movzx, movsx, mov, (v)movdqu, (v)movdqa"

|
Non so se sti tizi di instlat hanno letto i documenti o fanno test come agner fog, ma il secondo numero, quello dopo la barra "|" (la avevo messa tra parentesi, ma non vorrei essere preso per scurrile...

) è l'inverso del throughput, e per ALU r64, segna 0.25 per Zen (quindi 4/ciclo) e 0.33 per INTEL, quindi 3... Se è vero, allora necessariamente una delle 4 ALU è "semplice"...