LLM (Law Learning Managers) “Miljoenen mensen over de hele wereld zullen het feit dat grote modellen al hun werk ‘opslokken’ binnenkort beschouwen als een verbazingwekkende diefstal van ongekende proporties.”
LLM Leidinggevenden die bij Microsoft en OpenAI aan AI werken, hebben toegegeven wat critici al die tijd al zeiden: grote taalmodellen zijn roofzuchtige technologieën die gebouwd zijn op wat een Microsoft-topman “een verbazingwekkende diefstal van ongekende proporties” noemde, en “de grootste diefstal van arbeid in de menselijke geschiedenis”. Een intern Microsoft-document stelde dat generatieve AI-producten een “vicieuze cirkel” hebben gecreëerd die “het hele web” om zeep helpt.
Die verklaringen en een reeks andere momenten waarop de ware aard van de betrokkenen aan het licht komt, spelen een belangrijke rol in een niet-geanonimiseerd gerechtelijk document dat donderdag openbaar is gemaakt in de gigantische auteursrechtzaak tussen de New York Times en OpenAI, die al jaren door het rechtssysteem sleept.
In een verzoek om een samenvattend vonnis (in feite een verzoek aan de rechtbank om een uitspraak te doen) presenteerden de advocaten van de New York Times een reeks bekentenissen van leidinggevenden van Microsoft en OpenAI in documenten en getuigenverklaringen die tot nu toe geheim of geanonimiseerd waren gebleven op verzoek van Microsoft en OpenAI.

Het is gemakkelijk te begrijpen waarom de AI-bedrijven dit voor het publiek verborgen wilden houden. De verklaringen vormen samen een van de meest vernietigende beschuldigingen over de manier waarop LLM’s (Law Learning Managers) werden opgeleid, hoe ze werkten en de directe bedreiging die ze vormen voor de menselijke arbeidsmarkt.
Het is een herinnering dat, zelfs nu AI steeds krachtiger wordt en bedrijven proberen het verhaal te verschuiven naar het vermeende existentiële risico van ‘superintelligente’ AI, de tools die ze al hebben ontwikkeld, zijn gecreëerd door te stelen van menselijke creativiteit en arbeid en per definitie een existentiële bedreiging vormen voor de menselijke arbeidsmarkt.
“Miljoenen mensen over de hele wereld zullen het feit dat grote modellen al hun werk ‘opslokken’ binnenkort beschouwen als een verbazingwekkende diefstal van ongekende omvang”, zo luidde een intern Microsoft-document dat in de rechtszaak werd aangehaald. “Vrijwel niemand was van plan dat de door hen gecreëerde inhoud op deze manier gebruikt zou worden, noch worden ze gecompenseerd voor het gebruik ervan.”
Het document is opgesteld door advocaten van de New York Times, maar bestaat grotendeels uit verklaringen en interviews met topmanagers van grote technologiebedrijven. Zij geven toe dat LLM’s (Legal Life Managers) voornamelijk zijn opgeleid met gestolen content, dat ze een existentieel risico vormen voor de menselijke schrijvers, kunstenaars en mediabedrijven waarvan ze hebben gestolen, en dat hun producten een “vicieuze cirkel” hebben veroorzaakt die het internet opvreet en de bedrijven vernietigt waarvan deze bedrijven hebben gestolen.
Het onbewerkte document werd gevonden door Jason Kint, de CEO van Digital Content Next, een brancheorganisatie die digitale mediabedrijven vertegenwoordigt. Kint volgt de omvangrijke rechtszaken over auteursrecht op AI op de voet en publiceert er regelmatig over .
In de gerechtelijke stukken wordt verwezen naar een intern Microsoft-document waaruit blijkt dat AI-producten content stelen van menselijke contentmakers en vervolgens clicks afsnoepen van de mensen en websites waarvan ze die content hebben gestolen, waardoor hun bedrijfsmodellen worden vernietigd.
“Onze AI-contentstrategie heeft een vicieuze cirkel in gang gezet die de prestaties van onze modellen en het hele internet tegelijkertijd zal schaden: het is zeer ongebruikelijk dat een eindproduct de economische basis van zijn essentiële leveranciers bedreigt, maar dat is de situatie die we voor onze LLM-activiteiten hebben gecreëerd met betrekking tot de ‘contenttoeleveringsketen’,” aldus het document.
Microsoft-topfunctionarissen, waaronder CEO Satya Nadella, verklaarden onder ede dat na het verwijderen van content van de New York Times en andere nieuwssites, het aantal klikken naar die nieuwssites volledig instortte, met een daling van meer dan 90 procent op Bing.
Uit documenten die tijdens de rechtszaak zijn verkregen, bleek dat OpenAI een “hack had bedacht om de betaalmuur van de New York Times te omzeilen”, waarop OpenAI-medeoprichter Greg Brockman reageerde met “ah, mooi zo”. Microsoft-topman Brent Hecht schreef dat LLM’s content stelen “zonder manieren om de economische waarde ervan door de hele toeleveringsketen te verdelen, wat noodzakelijkerwijs de economische stabiliteit bedreigt van degenen die de content creëren.”
Jack Clark, beleidsdirecteur van OpenAI, schreef dat het bedrijf “systemen creëert die de arbeid vervangen van de mensen die de ‘cultuur’ van de samenleving bepalen”. Microsoft schreef in een beleidsdocument dat generatieve AI “de werkgelegenheid van de mensen die de data genereerden waarop het basismodel is getraind, aanzienlijk zou kunnen verstoren […] LLM’s zijn een product dat de toeleveringsketen vernietigt.”
OpenAI noemde zichzelf een “existentiële bedreiging” voor nieuwsuitgevers, en een software-engineer van OpenAI getuigde dat “hoe prominent we de links ook weergeven, gebruikers er niet op zullen klikken.”
Dit alles zal niemand verbazen die de ontwikkeling van generatieve kunstmatige intelligentie heeft gevolgd, maar het document als geheel laat zien dat ze het gewoon toegeven. De advocaten van OpenAI en Microsoft proberen te beargumenteren dat hun modeltraining onder het auteursrecht valt en transformatief is, en dat ze iets bouwen dat fundamenteel verschilt van de menselijke arbeid waarop het is getraind.
Maar intern weten deze managers dat wat ze hebben gebouwd gebaseerd is op gestolen content en dat de producten die ze hebben gemaakt de bronnen die ze hebben gestolen ondermijnen en het internet zoals we dat kennen vernietigen.
