Meta: documenti rivelano l’uso di opere protette da copyright per l’IA

by | 22 Feb 2025 | IA, Legal

Mark Zuckerberg | Foto: xAI
Tempo di lettura: 3 minuti

Meta avrebbe utilizzato opere protette da copyright per addestrare i propri modelli di intelligenza artificiale, ricorrendo a strategie legalmente discutibili e discutendone apertamente nei suoi canali interni.

È quanto emerge da una serie di documenti giudiziari desecretati giovedì, nell’ambito della causa Kadrey v. Meta, una delle numerose battaglie legali in corso negli Stati Uniti sul tema del copyright nell’IA.

Le nuove rivelazioni mostrano conversazioni interne tra i dipendenti dell’azienda, i quali sembrano aver discusso apertamente l’uso di libri protetti senza autorizzazione, talvolta adottando un approccio spregiudicato.

“Meglio chiedere perdono che permesso”

In una chat risalente al febbraio 2023, Xavier Martinet, ingegnere di ricerca di Meta, scriveva: “Il mio parere sarebbe (seguendo la logica del ‘meglio chiedere perdono che permesso’): proviamo a ottenere i libri e poi lasciamo la decisione ai dirigenti”.

Illuminanti anche i commenti di Melanie Kambadur, senior manager del team di ricerca sui modelli Llama, che ha discusso dell’addestramento dei modelli su opere di dubbia legalità.

A Martinet che scriveva “Voglio dire, nel peggiore dei casi scopriamo che alla fine va bene, mentre un’infinità di startup ha già piratato tonnellate di libri su BitTorrent”, la Kambadur rispondeva: “[Il] mio parere: cercare di fare accordi direttamente con gli editori richiede troppo tempo…”

“Dobbiamo sicuramente ottenere licenze o approvazioni per i dati pubblicamente disponibili”, poi però aggiungeva che “ora abbiamo più soldi, più avvocati, più supporto per il business development, la possibilità di accelerare i processi per guadagnare tempo, e gli avvocati sono un po’ meno conservatori nelle approvazioni”,

L’ombra di Libgen e la competizione nell’IA

Uno degli aspetti più controversi riguarda il possibile utilizzo di Libgen, un noto archivio di libri piratati, già oggetto di diverse cause legali e sanzioni per decine di milioni di dollari.

Dai documenti emerge che alcuni dirigenti di Meta ritenevano l’accesso a queste risorse “essenziale per raggiungere numeri SOTA (state-of-the-art) in tutte le categorie”.

Sony Theakanath, direttore della gestione prodotti di Meta, avrebbe suggerito delle strategie per ridurre il rischio legale, tra cui l’eliminazione dei file contrassegnati come “rubati” o “piratati”, oltre alla mancata citazione pubblica dell’uso di dataset provenienti da Libgen.

L’idea era chiara: attingere a fonti non autorizzate senza esporsi troppo.

Non solo: dalle chat emergono riferimenti a Reddit come possibile fonte di dati per l’addestramento, forse tramite l’uso di strumenti di terze parti. Questo nonostante Reddit abbia dichiarato, nell’aprile 2023, di voler far pagare le aziende di IA per l’accesso ai suoi contenuti.

Meta alza la posta e si prepara alla battaglia legale

Di fronte alle accuse, Meta ha rafforzato la propria squadra legale, assumendo due avvocati esperti di contenziosi presso la Corte Suprema dallo studio Paul Weiss.

L’azienda ha sempre sostenuto che l’uso di opere protette da copyright per addestrare i suoi modelli rientri nel concetto di fair use, ma la posizione dei querelanti – tra cui gli scrittori Sarah Silverman e Ta-Nehisi Coates – è diametralmente opposta.

Nel frattempo, emergono dettagli su come Meta abbia valutato l’opportunità di siglare accordi con gli editori. Secondo i documenti, l’azienda avrebbe confrontato i libri piratati con quelli disponibili per la licenza, per decidere se valesse la pena investire in un accordo ufficiale.

Quanto raccontato finora è l’ulteriore tassello che bene illustra come le grandi aziende \tecnologiche stiano affrontando la sfida dell’addestramento delle IA, spesso muovendosi in una zona grigia tra etica, business e regolamentazione.

E scalfisce, una volta di più, l’immagine di Zuckerberg, che tra Cambridge Analytica, lo scandalo di Snapchat e ora questo, è ormai coinvolto in troppe situazioni torbide perché si tratti di sfortunate circostanze.

POTREBBE INTERESSARTI

Zuckerberg Meta Connect

Meta sconta l’IA del 95% se può addestrarla sui vostri dati

Con Muse Spark, prompt e risposte diventano una moneta di scambio: chi accetta di condividerli con Meta, paga molto meno per usare il modello.

cani guida robot (1)

La Cina prova a sostituire i cani guida con i robot

Oltre 17 milioni di persone hanno disabilità visive, ma nel Paese sono disponibili appena circa 400 cani guida. Xiaoyuan prova a colmare quel vuoto.

Greg Brockman OpenAI

OpenAI dice che l’AGI è arrivata. Ma ne ha cambiato il significato

Per anni l’intelligenza artificiale generale è stata una soglia tecnica ed economica molto concreta. Ora Brockman la definisce qualcosa di “grigio” e persino...
Google Alphabet

Google evita ancora lo smembramento. È una giornata d’oro per le Big Tech

Nello stesso giorno in cui il governo Trump si schiera con OpenAI contro il New York Times, un giudice respinge la richiesta di smembrare il business pubblicitario di...
New York Times HQ

Il governo USA si schiera con OpenAI contro il New York Times

Il Dipartimento di Giustizia fa dell’IA una questione di sicurezza nazionale. Il New York Times invece accusa Trump di favorire i miliardari dell’IA.

Chris Lehane OpenAI

Chi decise di non chiamare la polizia? OpenAI affronta altre 30 cause

Dopo la strage di Tumbler Ridge, le nuove denunce puntano sulla catena di comando interna e chiamano in causa Chris Lehane e Sam Altman. OpenAI respinge le...
John Kushner

Infantino, FIFA, Josh Kushner e l’avvocato di Elon Musk

Josh Kushner, fratello del più noto Jared e fondatore di Thrive Capital, era pronto a partecipare a un investimento da 4,2 miliardi di dollari. Ora l’UEFA chiede...
Apple

Apple dice di avere nuove prove contro OpenAI

L’analisi del MacBook di Chang Liu rafforza le accuse di Apple. OpenAI replica che Cupertino gestisce male gli accessi degli ex dipendenti e vuole frenare un futuro...
Andrew Ferguson FTC Amazon

La FTC accusa Amazon di aver gonfiato di nascosto i prezzi della pubblicità

Gli inserzionisti pensavano di partecipare a un’asta ma, secondo la FTC, Amazon poteva aumentare il prezzo dopo le offerte. L’azienda respinge le accuse.

musk altman openai cursor

OpenAI taglia fuori Cursor dopo l’acquisizione di Elon Musk

I modelli OpenAI valgono solo il 5% del traffico di Cursor, ma il caso mostra quanto chi sviluppa servizi basati sull’IA dipenda dalle guerre tra i fornitori dei...
Share This