Microsoft: l’addestramento AI, “il più grande furto di lavoro nella storia umana”

L’esecutivo di OpenAI Greg Brockman ha ammesso che ChatGPT può completare frasi di articoli del NYT parola per parola

In breve: Oltre alle preoccupazioni relative all’estinzione umana o a una bolla finanziaria di vasta portata, una delle maggiori controversie dell’IA generativa riguarda il modo in cui i colossi tecnologici addestrano i loro modelli. Sebbene OpenAI e Microsoft sostengano che l’addestramento dell’IA su materiale protetto da diritto d’autore rientri nell’uso legittimo, commenti interni delle aziende potrebbero suggerire il contrario.

Brent Hecht, direttore della scienza applicata di Microsoft, ha previsto che, secondo documenti giudiziari rilasciati giovedì, persone in tutto il mondo potrebbero considerare i modelli di linguaggio avanzati come un furto su scala senza precedenti. Questi commenti sembrano contraddire la difesa pubblica di Microsoft e OpenAI contro una causa in corso intentata da alcune testate giornalistiche.

Nell’ultimo documento presentato nel caso, Hecht ha descritto l’IA generativa come il più grande furto di lavoro nella storia dell’umanità, spiegando come Microsoft, OpenAI e altre aziende di IA addestrino i loro modelli su enormi quantità di materiale proveniente da internet. Questa pratica è al centro della causa per violazione dei diritti d’autore intentata dal The New York Times alla fine del 2023.

Documenti giudiziari e martelletto che rappresentano la causa sul copyright
I documenti giudiziari citati nel caso sul copyright contro Microsoft e OpenAI.

Microsoft e OpenAI sostengono che l’addestramento dei modelli di IA su articoli del NYT e altre pubblicazioni sia ammissibile come uso legittimo, analogamente a uno studente che legge libri. Gli imputati affermano inoltre che i risultati generati dall’IA, basati su tali articoli, trasformano sufficientemente il materiale originale.

Tuttavia, il documento presentato giovedì contiene commenti interni di OpenAI che evidenziano la capacità dell’IA di riprodurre articoli di giornale. Ad esempio, l’esecutivo di OpenAI Greg Brockman ha ammesso che ChatGPT può prevedere e completare frasi degli articoli del NYT quando lavora con il materiale del giornale. Hecht ha anche sostenuto che vincere la causa potrebbe richiedere agli imputati di “ridere della nozione di uso legittimo”.

LEGGI  App FordPass aggiornata con controlli del Centro di controllo e nuovo widget della schermata iniziale

OpenAI ha inoltre precedentemente ammesso che è impossibile addestrare l’IA senza accedere a materiale protetto da diritto d’autore. L’ex esecutivo di Meta, Nick Clegg, ha fatto eco a questa visione l’anno scorso, sostenendo che l’IA morirebbe quasi immediatamente se le leggi sul diritto d’autore fossero applicate contro di essa.

Nel frattempo, le aziende di IA hanno continuato ad addestrare i loro modelli su enormi quantità di dati degli utenti, articoli e altro materiale. Meta ha suscitato polemiche addestrando la sua IA sul comportamento dei dipendenti, il GitHub Copilot di Microsoft si addestra sui dati degli utenti a meno che questi non scelgano di non partecipare, e Twitch ha solo recentemente permesso agli streamer di scegliere di non partecipare dopo anni di addestramento sui loro materiali. Gli sviluppatori di IA stanno anche acquistando, scannerizzando e distruggendo silenziosamente milioni di libri per raccogliere più materiale di addestramento.

Rack di server in un data center usati per l'addestramento dell'IA
Grandi data center dove i modelli di IA vengono addestrati su enormi quantità di dati.

L’impatto dell’IA generativa sul modello di business delle notizie è un altro pilastro della causa del NYT. Google e altri motori di ricerca ora forniscono riassunti generati dall’IA delle informazioni degli articoli in risposta alle query degli utenti, scoraggiando potenzialmente i lettori dal visitare i siti di notizie. In un documento giudiziario di questa settimana, un esecutivo di OpenAI coinvolto nello sviluppo di ChatGPT ha dichiarato che gli editori si trovano di fronte a una minaccia esistenziale da parte dell’IA.

Messaggi simili:

LEGGI  Scandalo OpenAI: proposta bipartitana per un "kill switch" AI del governo!