Scraping e IA, Google e Reddit fermati dai giudici: 'Non possiedono internet'

Scraping e IA, Google e Reddit fermati dai giudici: 'Non possiedono internet'

Sconfitta in tribunale per Google nella causa contro SerpApi: il tentativo di usare il DMCA per frenare lo scraping dei dati per l'IA fallisce, ma Big G e Reddit continuano la battaglia legale per tutelare i propri risultati di ricerca

di pubblicata il , alle 09:51 nel canale Web
GoogleReddit
 

Google ha incassato una pesante sconfitta giudiziaria nella sua crociata per impedire ai robot dell'intelligenza artificiale di raccogliere i dati dai propri risultati di ricerca. Nonostante il pronunciamento contrario, il colosso di Mountain View ha confermato che non intende tirarsi indietro dalla battaglia legale contro le attività di web scraping, una posizione in cui si trova ad avanzare a braccetto con Reddit.

La vertenza ha preso il via lo scorso dicembre, quando la società di Mountain View ha citato in giudizio SerpApi. L'accusa mossa contro l'azienda specializzata nell'estrazione di dati è quella di aver aggirato i sistemi di protezione anti-scraping per commercializzare un servizio software non autorizzato denominato "Google Search API". Nelle intenzioni di Big G, le barriere tecnologiche servivano a tutelare i contenuti protetti da diritto d'autore presenti nei risultati di ricerca, tra cui le informazioni dei pannelli di conoscenza (i cosiddetti "knowledge panel") concesse in licenza da terzi e a rischio di essere compromesse nelle trattative commerciali.

La strategia legale di Google ha fatto leva in modo insolito sul Digital Millennium Copyright Act (DMCA). Trattandosi di semplici indicizzazioni e schede riassuntive, i risultati di ricerca in sé non sono tutelabili dal diritto d'autore. Big G si è comunque risolta a percorrere questa strada sulla scia di una causa del tutto analoga depositata a ottobre da Reddit, che aveva trascinato in tribunale la stessa SerpApi e la piattaforma Perplexity con l'accusa di sottrarre contenuti di Reddit visibili tra le pagine di ricerca di Google.

Google perde contro SerpApi, puntando sul DMCA come difesa

Nei documenti ufficiali dell'azione legale, presentata come extrema ratio, Google ha sostenuto che l'aggiramento delle protezioni da parte di SerpApi ha reso impossibile monetizzare o recuperare i costi generati da miliardi di scansioni effettuate da bot automatizzati. Dal canto suo, Reddit ha contestato l'elusione di un doppio livello di sicurezza: le barriere interne della propria piattaforma e i filtri predisposti da Google per impedire l'estrazione di dati dai risultati di ricerca.

Come evidenziato da Meredith Rose, legale esperta di copyright presso l'associazione no-profit Public Knowledge citata da ArsTechnica, le mosse di Google e Reddit evidenziano un vero e proprio arroccamento difensivo. Le aziende stanno cercando di sfruttare qualsiasi strumento giuridico a disposizione pur di contenere l'esplosione dello scraping legato all'addestramento dei modelli di intelligenza artificiale, un fenomeno cresciuto in modo massiccio negli ultimi tre anni.

La posizione di SerpApi rimane ovviamente durissima:

"Certo, il contenzioso è stato incredibilmente costoso e dirompente. Ma riteniamo fermamente che piattaforme come Google e Reddit non possiedano Internet e che i loro tentativi di trasformare il DMCA in armi minaccino tutti gli utenti del web aperto."

L'impiego del DMCA per impedire la scansione dei dati digitali appare infatti una forzatura rispetto agli scopi originali della normativa. Storicamente, la legge sul copyright statunitense è servita per bloccare rapidamente usi non autorizzati dei contenuti e costringere le controparti a sedersi al tavolo delle licenze commerciali. Come emerge dall'esito della vicenda giudiziaria, estendere questa norma all'indicizzazione dei dati web rimane una scommessa giuridica rischiosa e difficile da sostenere in sede processuale.

1 Commenti
Gli autori dei commenti, e non la redazione, sono responsabili dei contenuti da loro inseriti - info
mail9000it30 Luglio 2026, 14:40 #1

Comodo

Senza contare il fatto che il riepilogo effettuato dal motore di ricerca (es.google) mostrando il riassunto della pagina originale disincentiva gli utenti a navigare sul sito della notizia. Questo di fatto sottrae al sito gli ingressi pubblicitari generati dalla navigazione degli utenti.
Quindi Google può guadagnare con i contenuti degli altri ma un terzo non puó ridurre le entrate generate agli indici di google.

Devi effettuare il login per poter commentare
Se non sei ancora registrato, puoi farlo attraverso questo form.
Se sei già registrato e loggato nel sito, puoi inserire il tuo commento.
Si tenga presente quanto letto nel regolamento, nel rispetto del "quieto vivere".

La discussione è consultabile anche qui, sul forum.
 
^