Torna indietro   Hardware Upgrade Forum > Software > Linux, Unix, OS alternativi

Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090
Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090
Ho affidato ai due modelli lo stesso mestiere ma non lo stesso identico prompt: trasformare una storia illustrata in un video usando una RTX 3090 e modelli locali. Ne sono usciti due film, due applicazioni e due idee opposte di efficienza. Fucina, progettata con Fable 5, colpisce di più nei primi secondi. Storyboard Studio, costruito con ChatGPT/Codex, regge meglio sulla distanza e vince il confronto complessivo, ma di stretta misura
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile
Lenovo ha lanciato il ThinkTab X11 rimettendo piede nel segmento dei tablet Android con il marchio Think dopo oltre un decennio di assenza. Il risultato è un dispositivo che prende una direzione precisa: massima dotazione funzionale, costruzione resistente, autonomia fuori dagli schemi
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot
AMD Advancing AI è l'appuntamento annuale con il quale l'azienda americana mostra quelle che sono le proprie novità dal versante datacenter. Tra piattaforma Helios, GPU Instinct MI455X e processori EPYC di sesta generazione tutto quello che serve per processare l'IA sempre più complessa ed esigente
Tutti gli articoli Tutte le news

Vai al Forum
Rispondi
 
Strumenti
Old 04-03-2003, 19:31   #1
taiger
Member
 
Iscritto dal: Aug 1999
Messaggi: 112
modifica Makefile del kerne...

In un documento molto interessante Securing and optimizing linux ho trovato delle configurazioni ad-hoc per aumentare le prestazioni del kernel
per esempio modificare la linea del Makefile nell'albero dei sorgenti da

HOSTCFLAGS = -Wall -Wstrict-prototypes -O2 -fomit-frame-pointer

a

HOSTCFLAGS = -Wall -Wstrict-prototypes -O3 -funrool-loops -fomit-frame-pointer

(c'è anche una modifica simile più avanti nello script ma la tralascio...)

ma nel make bzImage mi dice che non riconosce come opzione -funroll-loops, il testo fa riferimento al kern 2.4.5, io ho il 2.4.20
qualcuno ne sa qualcosa?
sa dove potrei approfondire?
__________________
TaiGeR

http://www.il-cinematografo.it
Gentoo -- Cely800@1000
taiger è offline   Rispondi citando il messaggio o parte di esso
Old 04-03-2003, 19:41   #2
ilsensine
Senior Member
 
L'Avatar di ilsensine
 
Iscritto dal: Apr 2000
Città: Roma
Messaggi: 15625
Re: modifica Makefile del kerne...

Quote:
Originally posted by "taiger"


HOSTCFLAGS = -Wall -Wstrict-prototypes -O3 -funrool-loops -fomit-frame-pointer
-funroll-loops esiste, -funrool-loops no.

Cmq tieni conto che -O3 e -funroll-loops generalmente tendono a ingrandire il codice e a farlo più lento. Le ottimizzazioni attualmente usate sono state studiate accuratamente per la velocità.

Per me per migliorare ulteriormente le prestazioni occorrerebbe testare -fforce-mem e -fforce-addr (le ho usate con interessanti risultati nei programmi in user space); -funroll-loops potrebbe in alcuni casi migliorare le prestazioni, ma non sempre. -funroll-all-loops non migliora le prestazioni (anzi le peggiora), come ho riscontrato peggioramenti (stranamente) anche con -fschedule-insns, -fschedule-insns2 e -fthread-jumps. Anche -fexpensive-optimizations non mi ha mai fatto guadagnare un microsecondo.
__________________
0: or %edi, %ecx; adc %eax, (%edx); popf; je 0b-22; pop %ebx; fadds 0x56(%ecx); lds 0x56(%ebx), %esp; mov %al, %al
andeqs pc, r1, #147456; blpl 0xff8dd280; ldrgtb r4, [r6, #-472]; addgt r5, r8, r3, ror #12
ilsensine è offline   Rispondi citando il messaggio o parte di esso
Old 04-03-2003, 20:13   #3
mcardini
Senior Member
 
L'Avatar di mcardini
 
Iscritto dal: Apr 2000
Città: Prato
Messaggi: 1061
Re: modifica Makefile del kerne...

Quote:
Originally posted by "ilsensine"


-funroll-loops esiste, -funrool-loops no.

Cmq tieni conto che -O3 e -funroll-loops generalmente tendono a ingrandire il codice e a farlo più lento. Le ottimizzazioni attualmente usate sono state studiate accuratamente per la velocità.

Per me per migliorare ulteriormente le prestazioni occorrerebbe testare -fforce-mem e -fforce-addr (le ho usate con interessanti risultati nei programmi in user space); -funroll-loops potrebbe in alcuni casi migliorare le prestazioni, ma non sempre. -funroll-all-loops non migliora le prestazioni (anzi le peggiora), come ho riscontrato peggioramenti (stranamente) anche con -fschedule-insns, -fschedule-insns2 e -fthread-jumps. Anche -fexpensive-optimizations non mi ha mai fatto guadagnare un microsecondo.
Cosa consigli per una compilazione veramente ottimizzata sia in velocità che in dimensioni del kernel?
Sono interessato anche io all'argomento, propio oggi ho provato a ricompilare un kernel su un k6III con varie stringhe lette su un sito, ma mi è venuto fuori un kernel enorme e che non andava un tubo
Quale è a tuo avviso la "stringa perfetta" per la compilazione del kernel?
__________________
Il mio colore preferito era il blu...
Fino a quando non ho installato Windows...
mcardini è offline   Rispondi citando il messaggio o parte di esso
Old 04-03-2003, 20:20   #4
ilsensine
Senior Member
 
L'Avatar di ilsensine
 
Iscritto dal: Apr 2000
Città: Roma
Messaggi: 15625
La mia "stringa perfetta" è quella di default per il mio Athlon. Non ho ancora trovato il tempo di studiare a fondo -fforce-mem e -fforce-addr nel kernel.

Per il resto, diffido di qualsiasi cosa cerchi di aumentare la velocità aumentando troppo le dimensioni. Questo vale anche per il gcc 3.x: maggiore ottimizzazione del codice, maggiore dimensione dei binari ("migliore allineamento dei dati", dicono loro) ==> minore velocità. Per un motivo molto semplice: maggiori dimensioni == maggiore spreco della preziosa cache L1.
__________________
0: or %edi, %ecx; adc %eax, (%edx); popf; je 0b-22; pop %ebx; fadds 0x56(%ecx); lds 0x56(%ebx), %esp; mov %al, %al
andeqs pc, r1, #147456; blpl 0xff8dd280; ldrgtb r4, [r6, #-472]; addgt r5, r8, r3, ror #12
ilsensine è offline   Rispondi citando il messaggio o parte di esso
Old 04-03-2003, 20:31   #5
mcardini
Senior Member
 
L'Avatar di mcardini
 
Iscritto dal: Apr 2000
Città: Prato
Messaggi: 1061
Quote:
Originally posted by "ilsensine"

La mia "stringa perfetta" è quella di default per il mio Athlon. Non ho ancora trovato il tempo di studiare a fondo -fforce-mem e -fforce-addr nel kernel.

Per il resto, diffido di qualsiasi cosa cerchi di aumentare la velocità aumentando troppo le dimensioni. Questo vale anche per il gcc 3.x: maggiore ottimizzazione del codice, maggiore dimensione dei binari ("migliore allineamento dei dati", dicono loro) ==> minore velocità. Per un motivo molto semplice: maggiori dimensioni == maggiore spreco della preziosa cache L1.
-Wall -Wstrict-prototypes -O2 -mcpu=athonxp -march=athonxp -fomit-frame-pointer

Che dici, queta va bene per il mio athlonxp?
__________________
Il mio colore preferito era il blu...
Fino a quando non ho installato Windows...
mcardini è offline   Rispondi citando il messaggio o parte di esso
Old 05-03-2003, 07:27   #6
ilsensine
Senior Member
 
L'Avatar di ilsensine
 
Iscritto dal: Apr 2000
Città: Roma
Messaggi: 15625
A naso direi di no. Mancano le direttive di allineamento, che dovrebbero essere presenti nei Makefile del kernel.
__________________
0: or %edi, %ecx; adc %eax, (%edx); popf; je 0b-22; pop %ebx; fadds 0x56(%ecx); lds 0x56(%ebx), %esp; mov %al, %al
andeqs pc, r1, #147456; blpl 0xff8dd280; ldrgtb r4, [r6, #-472]; addgt r5, r8, r3, ror #12
ilsensine è offline   Rispondi citando il messaggio o parte di esso
Old 05-03-2003, 19:46   #7
mcardini
Senior Member
 
L'Avatar di mcardini
 
Iscritto dal: Apr 2000
Città: Prato
Messaggi: 1061
Quote:
Originally posted by "ilsensine"

A naso direi di no. Mancano le direttive di allineamento, che dovrebbero essere presenti nei Makefile del kernel.
Scusa la mia ignoranza ma cosa sono le direttive di allineamento?
Mi puoi postare la riga precisa, in c/c++ sono un pò ignorante
__________________
Il mio colore preferito era il blu...
Fino a quando non ho installato Windows...
mcardini è offline   Rispondi citando il messaggio o parte di esso
Old 06-03-2003, 07:48   #8
ilsensine
Senior Member
 
L'Avatar di ilsensine
 
Iscritto dal: Apr 2000
Città: Roma
Messaggi: 15625
-mpreferred-stack-boundary=2 (e su alcuni processori -malign-functions)

Cmq per "personalizzare" le opzioni del proprio processore la cosa migliore è agire su arch/i386/Makefile, non sul makefile principale.
__________________
0: or %edi, %ecx; adc %eax, (%edx); popf; je 0b-22; pop %ebx; fadds 0x56(%ecx); lds 0x56(%ebx), %esp; mov %al, %al
andeqs pc, r1, #147456; blpl 0xff8dd280; ldrgtb r4, [r6, #-472]; addgt r5, r8, r3, ror #12
ilsensine è offline   Rispondi citando il messaggio o parte di esso
 Rispondi


Fable e Sol a confronto: due cartoni animati creati su un PC con RTX 3090 Fable e Sol a confronto: due cartoni animati cre...
Il tablet rugged leggero e sottile: Lenovo ThinkTab X11 offre resistenza, doppia USB-C e batteria rimovibile Il tablet rugged leggero e sottile: Lenovo Think...
AMD Advancing AI 2026: l'hardware AMD per le elaborazioni IA del futuro, tra GPU, CPU e robot AMD Advancing AI 2026: l'hardware AMD per le ela...
Tascabile e con Android: BOOX Go 6 Gen II è diverso da tutti gli altri e-reader Tascabile e con Android: BOOX Go 6 Gen II &egrav...
Recensione Lenovo Idea Tab Plus: il tablet da 12 pollici che costa meno di 300 euro Recensione Lenovo Idea Tab Plus: il tablet da 12...
Smartphone troppo cari: Qualcomm ripensa...
Age of Empires III: Definitive Edition t...
GitHub contro i report fatti dall'IA: ri...
Google spinge sugli schermi ultra-wide: ...
Occhiali smart, Instagram bannerà chi re...
L'UE approva PRIMA: il chip fotovoltaico...
Nothing smentisce l'uscita da alcuni mer...
Tassa sui pacchi extra-UE, Giorgetti: da...
Jensen Huang esordisce su X: 'non mettet...
Ha reso lo smartphone e Amazon lo ha 'pe...
TOP 10 offerte del weekend Amazon: ai pr...
TV LG C6 e B5 da 55 pollici: due OLED da...
Tomb Raider: Catalyst rinviato al 2028, ...
Lefant M210 Omni a 265,99€: il robot sli...
Paramount sospende la fusione con Warner...
Chromium
GPU-Z
OCCT
LibreOffice Portable
Opera One Portable
Opera One 106
CCleaner Portable
CCleaner Standard
Cpu-Z
Driver NVIDIA GeForce 546.65 WHQL
SmartFTP
Trillian
Google Chrome Portable
Google Chrome 120
VirtualBox
Tutti gli articoli Tutte le news Tutti i download

Strumenti

Regole
Non Puoi aprire nuove discussioni
Non Puoi rispondere ai messaggi
Non Puoi allegare file
Non Puoi modificare i tuoi messaggi

Il codice vB è On
Le Faccine sono On
Il codice [IMG] è On
Il codice HTML è Off
Vai al Forum


Tutti gli orari sono GMT +1. Ora sono le: 15:20.


Powered by vBulletin® Version 3.6.4
Copyright ©2000 - 2026, Jelsoft Enterprises Ltd.
Served by www3v