Caso di copyright sull'IA: i dirigenti sapevano che i dati di addestramento erano 'piratati', secondo le accuse
AI News

Caso di copyright sull'IA: i dirigenti sapevano che i dati di addestramento erano 'piratati', secondo le accuse

5 min
27/09/2026
AI copyrightOpenAI lawsuitMicrosoft lawsuitAuthors Guild

Documenti desecretati espongono le tattiche di addestramento 'illegali' dei giganti dell'IA

Documenti giudiziari recentemente desecretati nel caso storico sul copyright Authors Guild contro OpenAI hanno messo sotto i riflettori la conoscenza interna e la presunta condotta intenzionale illecita dei dirigenti di Microsoft e OpenAI. I documenti, resi pubblici il 17 settembre 2026, dipingono un quadro accusatorio del processo decisionale ai massimi livelli, suggerendo che i principali attori erano pienamente consapevoli di utilizzare libri piratati per addestrare i loro modelli di IA—e hanno comunque proceduto.

I documenti, depositati come parte di una mozione per giudizio sommario parziale, citano comunicazioni interne in cui i dirigenti avrebbero descritto la pratica come l'utilizzo di libri provenienti da un 'sito web russo losco' e avrebbero riconosciuto che la tecnologia avrebbe 'reso le persone disoccupate'. Le rivelazioni aggiungono un nuovo livello di esposizione legale per i giganti della tecnologia, spostando la narrazione da una violazione accidentale a una condotta deliberata e consapevole.

Le parole dei dirigenti: 'Roba piratata' e 'Minaccia esistenziale'

Tra le accuse più esplosive c'è una citazione attribuita a un alto dirigente dell'IA: 'Abbiamo addestrato GPT-3 con roba piratata!' Questa dichiarazione, insieme a un memo del 2023 del Direttore di Scienze Applicate di Microsoft Brent Hecht, costituisce il fulcro dell'argomentazione degli attori. Hecht avrebbe descritto la raccolta massiccia di contenuti online come un 'furto sbalorditivo' e potenzialmente 'il più grande furto di lavoro nella storia umana', una caratterizzazione che da allora ha avuto eco in tutto il settore tecnologico.

I documenti evidenziano anche un avvertimento proveniente dall'interno di OpenAI stesso. Nick Turley, capo di ChatGPT di OpenAI, avrebbe descritto i prodotti dell'azienda come 'in gran parte sostitutivi' delle opere originali, con quella sostituibilità destinata a crescere con il miglioramento della tecnologia. Gli attori sostengono che questa è una prova diretta che le aziende capivano che i loro prodotti avrebbero cannibalizzato il mercato dei libri scritti da umani, rappresentando quella che chiamano una 'minaccia esistenziale per coloro che scrivono e pubblicano libri'.

Il 'Ciclo di rovina' e una cultura di incoscienza

Forse la cosa più sorprendente è il riconoscimento interno di un 'ciclo di rovina' della strategia dei contenuti dell'IA, un termine che sarebbe stato usato dalla stessa Microsoft nei documenti desecretati. Questo concetto descrive un circolo vizioso in cui i sistemi di IA consumano contenuti generati dall'uomo, degradano la qualità dell'ecosistema informativo e poi richiedono ancora più contenuti umani freschi per riaddestrarsi—portando a un'ulteriore degradazione. Nonostante questa consapevolezza, secondo le accuse, le aziende hanno proseguito con ciò che sapevano essere un'attività illegale.

Mary Rasenberger, CEO della Authors Guild, non ha usato mezzi termini in risposta ai documenti. 'Questi documenti rivelano un disprezzo scioccante per gli scrittori e il loro lavoro attraverso decisioni ripetute e intenzionali di rubare libri invece di pagarli', ha detto. 'OpenAI ha portato avanti il suo schema di pirateria di massa anche di fronte a prove evidenti che ciò avrebbe degradato la cultura americana sostituendo le opere umane con robaccia dell'IA e avrebbe messo fuori dal lavoro migliaia di scrittori.'

continua a leggere sotto...

Contesto legale: Fair use vs. Violazione deliberata

OpenAI e Microsoft hanno costantemente difeso le loro pratiche con la dottrina del 'fair use', sostenendo che l'addestramento su testo disponibile pubblicamente è trasformativo e non costituisce un sostituto di mercato illecito. Tuttavia, le nuove prove di una presunta condotta consapevole potrebbero minare gravemente tale difesa. I tribunali spesso considerano la 'buona fede' dell'utente nelle analisi del fair use, e le comunicazioni interne che suggeriscono una consapevolezza dell'illegalità potrebbero essere decisive.

Il caso, che fa parte di un contenzioso multidistrettuale nel Distretto Sud di New York, include attori come John Grisham, George R.R. Martin, Jodi Picoult e Jonathan Franzen. È guidato da Justin A. Nelson di Susman Godfrey. Un'udienza è prevista per l'inizio del 2027, con ulteriori memorie attese nei prossimi mesi.

Implicazioni più ampie per l'industria dell'IA

Oltre alla battaglia legale immediata, questi documenti hanno profonde implicazioni per l'intero ecosistema dell'IA. Espongono una dipendenza sistemica da materiale protetto da copyright che molti creatori hanno a lungo sospettato ma non hanno potuto provare. I documenti sollevano anche domande critiche sulla sostenibilità del modello economico di Internet, poiché i sistemi di IA forniscono sempre più risposte senza indirizzare traffico verso le fonti originali.

Per l'industria tecnologica, il caso rappresenta un potenziale punto di svolta. Se il tribunale si pronuncia contro Microsoft e OpenAI, potrebbe forzare un cambiamento fondamentale nel modo in cui vengono reperiti i dati di addestramento, richiedendo potenzialmente accordi di licenza e un compenso equo per i creatori. Ciò avrebbe un effetto a catena su ogni azienda di IA che ha costruito prodotti sulle spalle del lavoro umano.

I documenti desecretati arrivano anche sulla scia di rivelazioni simili in un caso parallelo intentato da organizzazioni di media, suggerendo un assalto legale coordinato alle pratiche di contenuti della Grande IA. Con il progredire del contenzioso, le decisioni del tribunale potrebbero stabilire precedenti che definiranno i confini dell'addestramento dell'IA per decenni a venire.

Cosa succederà dopo?

I prossimi passi immediati prevedono ulteriori memorie e una potenziale udienza all'inizio del 2027. Il tribunale dovrà valutare le voluminose prove della presunta condotta illecita rispetto alle argomentazioni legali formali delle aziende. Indipendentemente dall'esito, i documenti desecretati hanno già ottenuto una vittoria significativa per gli attori: hanno spostato la percezione pubblica e messo i giganti della tecnologia sulla difensiva.

Per autori ed editori, il caso è più di una battaglia legale—è una lotta per il futuro della loro professione. Come avrebbe detto un memo interno di Microsoft, l'azienda era consapevole di essere coinvolta in un 'ciclo di rovina' che avrebbe distrutto l'ecosistema stesso di cui si nutriva. La domanda ora è se i tribunali li riterranno responsabili per quella conoscenza.