Lo scraping web è legale nel 2026? I casi, le linee, la checklist
Lo scraping di dati pubblici è ampiamente legale. Lo scraping di dati personali, opere protette da copyright o qualsiasi cosa dietro un login è dove si sbaglia. Ecco i casi che hanno tracciato le linee e una checklist per rimanere dalla parte giusta.
"Lo scraping web è legale?" è la domanda sbagliata, ed è il motivo per cui le risposte online si contraddicono. Lo scraping non è un unico atto — è uno strumento, e la sua legalità dipende interamente da cosa raccogli, come vi accedi e cosa ne fai dopo. La versione chiara: lo scraping di dati pubblicamente disponibili è ampiamente legale negli Stati Uniti, nell'UE e nel Regno Unito, ma i dati personali, le opere protette da copyright, i contenuti protetti da login e l'aggiramento dei blocchi sono dove i casi si perdono. Questa guida percorre le sentenze che hanno tracciato quelle linee e termina con una checklist che puoi effettivamente applicare. È informativa, non consulenza legale — per una decisione reale, parla con un avvocato nella tua giurisdizione.
La risposta breve
Non esiste una legge che vieti lo scraping web. Uno scraper richiede dati pubblici nello stesso modo in cui lo fa un browser; entrambi ricevono i dati che il server sceglie di servire e ne fanno qualcosa da parte loro. Finché i dati sono pubblicamente disponibili — puoi vederli senza effettuare il login — raccoglierli è generalmente legale. Il rischio non deriva dallo scraping in sé; deriva da quattro cose sovrapposte: dati personali, copyright, termini di servizio e come accedi al sito. Se li gestisci correttamente, sei su un terreno solido.
I casi che hanno tracciato le linee
Un pugno di sentenze plasma il panorama odierno, ed è utile conoscerle perché sono quelle che i tribunali effettivamente citano:
- hiQ Labs v. LinkedIn (US). Il 9° Circuito ha stabilito che lo scraping di dati pubblicamente disponibili non viola il Computer Fraud and Abuse Act — non puoi "eccedere l'accesso autorizzato" a una pagina aperta a tutti. Questo è il punto di riferimento per la posizione che i dati pubblici sono legittimi da raccogliere negli Stati Uniti.
- Ryanair v. PR Aviation (EU). La corte più alta d'Europa ha stabilito che un sito può limitare lo scraping attraverso i suoi termini d'uso, anche per dati pubblicamente disponibili. Lo scraping dei dati può essere legale, ma farlo in violazione di termini applicabili può essere un problema contrattuale — la giurisdizione conta.
- Meta v. Social Data Trading (US). Meta ha citato in giudizio un'azienda che ha utilizzato migliaia di account automatizzati falsi per fare scraping su Instagram e Facebook dopo essere stata bloccata. La lezione non è "lo scraping sui social media è illegale" — è che aggirare i blocchi tecnici e utilizzare account falsi ti sposta dalla raccolta di dati pubblici in un territorio vicino all'hacking.
Il filo conduttore: i dati visibili pubblicamente e accessibili apertamente sono difendibili; aggirare un blocco, un login o un contratto applicabile per raggiungerli non lo è.

I dati personali sono la vera linea
Se c'è una cosa da interiorizzare, è questa: pubblicamente disponibile non significa non regolamentato quando i dati riguardano persone. Secondo il GDPR, tutti i dati personali sono protetti indipendentemente da dove provengano — un'azienda è stata multata per aver fatto scraping di dati personali pubblicamente disponibili da un registro pubblico delle imprese (la multa è stata successivamente annullata, ma il principio che i dati personali pubblici sono comunque protetti è stato confermato). I dati personali sono definiti in modo ampio: nomi, indirizzi, email, numeri di telefono, persino indirizzi IP e handle social. Il GDPR si applica a chiunque elabori i dati dei residenti dell'EEA, ovunque si trovi.
Gli Stati Uniti sono più permissivi ma si stanno muovendo nella stessa direzione. Il CCPA della California, ampliato dal CPRA nel 2023, ha ampliato ciò che conta come informazioni personali protette, sebbene tratti i dati che una persona ha reso pubblici in modo più indulgente rispetto al GDPR. Colorado e Virginia hanno approvato leggi simili. La regola pratica ovunque: raccogliere il meno possibile di dati personali, evitare del tutto le categorie speciali e non costruire un database di persone identificabili senza una base legale. Il nostro approfondimento su GDPR e scraping di dati personali copre in dettaglio la questione della base legale.
Copyright e termini di servizio
Altri due strati si sovrappongono alla privacy. Copyright: i fatti non sono protetti — prezzi, specifiche, livelli di stock, valutazioni a stelle sono legittimi da raccogliere — ma le opere creative lo sono. Immagini, articoli, canzoni, database e testi lunghi possono essere protetti da copyright, e ripubblicarli può violare anche se lo scraping non lo ha fatto. Termini di servizio: come stabilito da Ryanair, i termini di un sito possono proibire la raccolta automatizzata, e un accordo "clickwrap" che hai accettato attivamente è molto più applicabile di un avviso "browsewrap" nascosto in un piè di pagina. Violare termini applicabili è un rischio contrattuale, non penale, ma è un rischio. La mossa sicura è controllare i termini del target prima di costruire una pipeline attorno ad esso.

Una checklist di conformità
Prima di uno scraping, passa attraverso questo. Si mappa direttamente sui rischi sopra e sui principi dello scraper etico proposti dagli studiosi legali — raccogli dati pubblici e fattuali; sii un buon cittadino del web; e costruisci qualcosa di trasformativo piuttosto che un clone:
- È pubblico? Nessun login, nessun paywall, nessun blocco da aggirare. Se avresti bisogno di credenziali, fermati.
- È un dato personale? Se identifica persone, minimizza, ottieni una base legale e evita le categorie speciali. In caso di dubbio, non raccoglierlo.
- È protetto da copyright? Raccogli liberamente i fatti; fai attenzione a ripubblicare immagini, articoli o media.
- Cosa dicono i termini? Leggili. Violare termini applicabili è un rischio contrattuale.
- Sei educato? Limita il ritmo, fai scraping fuori orario di punta e non degradare il servizio del sito per gli utenti reali.
- Il tuo scopo è trasformativo? Costruire analisi o un nuovo prodotto è difendibile; clonare la fonte per rubare i suoi utenti non lo è.
Essere educati è anche un segnale di conformità, non solo cortesia — sovraccaricare un server rafforza qualsiasi pretesa contro di te. La nostra guida su robots.txt e etica dello scraping e la nostra guida alla scelta di fornitori di proxy etici approfondiscono entrambi su come farlo in modo responsabile.
Raccogli dati web pubblici in modo conforme con Scraper API
Come l'infrastruttura ti mantiene conforme
Buoni strumenti rendono la cosa giusta la cosa facile. Limitare il ritmo e ruotare i proxy residenziali ti permette di distribuire le richieste in modo da non sovraccaricare mai un singolo server — la cortesia che la checklist richiede. Un Scraper API che recupera solo pagine pubbliche e restituisce dati strutturati puliti ti tiene fuori dalla trappola dell'aggiramento del login per design. Nulla di questo sostituisce il giudizio legale su cosa raccogli e perché, ma rimuove le scorciatoie tecniche che trasformano uno scraping difendibile in uno indifendibile.
Domande frequenti
Lo scraping web è legale negli Stati Uniti?
Lo scraping di dati pubblicamente disponibili è ampiamente legale negli Stati Uniti, e i tribunali hanno stabilito che non viola il CFAA. I rischi sono il copyright (non ripubblicare opere protette), le leggi sulla privacy come il CCPA/CPRA (fai attenzione con i dati personali) e i termini di servizio (violazione di termini applicabili è un rischio contrattuale). Aggirare blocchi o login cambia l'analisi.
Lo scraping web è legale in Europa?
Sì per dati pubblicamente disponibili e non personali — ma il GDPR protegge tutti i dati personali indipendentemente dalla fonte, quindi lo scraping di informazioni identificabili su persone necessita di una base legale. La Direttiva Database dell'UE e i termini del sito possono anche limitare la raccolta. In pratica, evita i dati personali, rispetta i termini e tratta l'UE come la giurisdizione più severa in cui operi.
Lo scraping web è legale per uso personale?
L'uso personale e accademico generalmente affronta un rischio inferiore rispetto all'uso commerciale, ma le stesse linee si applicano: attieniti ai dati pubblici, evita le informazioni personali e il materiale protetto da copyright, rispetta i termini del sito e non sovraccaricare il server. "Per uso personale" non è un'esenzione generale — tende solo a ridurre le poste in gioco e la probabilità di una disputa.
È legale fare scraping su LinkedIn?
Il caso hiQ ha supportato lo scraping dei dati visibili pubblicamente di LinkedIn senza effettuare il login, ma i termini di LinkedIn proibiscono la raccolta automatizzata e molti dei dati utili si trovano dietro un login. Fare scraping di profili pubblici che puoi vedere senza un account è il limite difendibile; utilizzare account falsi o bypassare l'autenticazione è dove i casi sono stati persi, come ha mostrato il contenzioso di Meta.
Lo scraping web è uno strumento legale con confini chiari: pubblico e fattuale è difendibile, personale e protetto da copyright e protetto da login è dove vive il rischio. Conosci i casi, segui la checklist, minimizza i dati personali, rispetta i termini e fai scraping educatamente. Fai così, e spenderai la tua energia sui dati invece che sulle dispute — queste sono informazioni generali, quindi conferma i dettagli per il tuo progetto con un avvocato.