“We geloven echt oprecht dat AI alle mensen zou kunnen uitroeien!” zei een topwetenschapper van het AI-bedrijf Anthropic gisteren. Hij vervolgde: “We hebben nog geen plan om de afstemming voor superintelligentie op te lossen en we zijn er ook niet duidelijk van op de goede weg.”
“Afstemming” is, voor wie het zich afvraagt, een afkorting voor ervoor zorgen dat de doelen van mensen overeenkomen met de doelen van de AI-systemen waaraan ze werken. Dit woord is helaas het dichtst dat de AI-wereld in de buurt komt van een gevoel van moraliteit over wat ze doen, waarbij moraliteit in dit geval neerkomt op bezorgdheid over de vraag of het hele idee van het creëren van een superintelligentie wel goed is voor de mensheid.
Do not underestimate the power of this technology. These will soon be superhuman systems that can hack anything, revolutionize any field overnight, and acquire real power and resources. We have all witnessed the progress in each of these domains, and progress is not slowing.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Dit werd vandaag groot nieuws, hoewel het blijkbaar niet groot genoeg is voor een prominente kop op de voorpagina van de New York Times. Axios meldde vanochtend dat Jacob Coxon, een onderzoeker bij Anthropic, gisteren ontslag heeft genomen en het volgende op X plaatste: “De mensen die AI ontwikkelen, geloven oprecht dat het ons allemaal zou kunnen doden tegen het einde van dit decennium.
Dit is geen marketingtruc. Sterker nog, veel leidinggevenden en senior onderzoekers zullen hun woorden in de pers zo formuleren dat ze verstandig klinken, maar ik hoor diezelfde mensen privé hun angst uiten. Geen enkele andere menselijke activiteit brengt dit niveau van gevaar met zich mee.”
Ik kan je eerlijk zeggen dat dit de eerste keer is dat ik de woorden “maak ons allemaal af” of “maak alle mensen af” zie gebruikt in een context die niet te maken heeft met het mogelijke gebruik van kernwapens. Noch Coxon, noch Evan Hubinger, de persoon die verantwoordelijk is voor het citaat bovenaan deze column en die nog steeds bij Anthropic werkt als hoofd van “alignment science”, hebben uitgelegd wat ze met hun aanhalingstekens bedoelden of hoe het voor een AI-systeem mogelijk zou zijn om alle mensen op aarde te doden.
Er waren nog twee vervolgontwikkelingen aan het einde van de middag. OpenAI, een concurrent van Anthropic en ontwikkelaar van Chat GTP, heeft een voormalig medewerker, Paul Christiano, in de raad van bestuur benoemd. Christiano was “senior technisch adviseur van het Center for AI Standards and Innovation van de federale overheid en is de oprichter van het Alignment Research Center , een non-profitorganisatie die zich inzet om ervoor te zorgen dat AI de menselijke belangen blijft dienen”, aldus Axios
. Hij zal zitting nemen in de “veiligheidscommissie” van OpenAI en verklaarde in een persbericht dat hij zich zal bezighouden met het “technische probleem van afstemming”.
Als dit klinkt als een nogal snelle poging om de schijn op te houden, dan hebt u gelijk. Wat deze man daadwerkelijk zal doen als hij in het bestuur van OpenAI komt en welke bevoegdheden hij zal hebben, weet niemand, en het is waarschijnlijk dat dat zo zal blijven.
Een andere ontwikkeling later vanmiddag was de publicatie van een artikel door Axios – dat eigenlijk een prijs zou moeten krijgen voor de snelle berichtgeving en de prominente aandacht die het aan dit verhaal besteedde – waarin, zoals ze het zelf in de kop stelden, de vraag wordt gesteld: “Hoe zou AI ons dan precies allemaal uitroeien?”
Ik zou het antwoord dat ze bedachten niet als exact omschrijven, maar hier is het. De angst onder “experts”, aldus Axios, is dat AI-systemen “malafide actoren” de mogelijkheid zouden kunnen bieden om biologische of chemische wapens te creëren die vermoedelijk in staat zouden zijn om alle mensen te doden. Axios speculeerde ook dat “malafide” AI-systemen “infrastructuur op ongekende schaal zouden kunnen aanvallen en daarbij menselijk toezicht zouden kunnen omzeilen.”
Dat lijkt de kern van de zaak te zijn in deze explosie van bezorgdheid over AI-systemen die in staat zouden kunnen zijn om alle mensen te doden: dat deze systemen in rap tempo volledig de controle over de mens kunnen verliezen. Een artikel van vandaag speculeerde zelfs dat AI op een dag eigen ‘samenlevingen’ zou kunnen ontwikkelen, los van de mens.
Vermoedelijk een systeem van elektronische puntjes en streepjes die op de een of andere manier samen zouden komen en beslissingen zouden nemen om hun krachten te bundelen en zo chemische of biologische wapens te ontwikkelen die de mensheid op dit moment wellicht nog niet kent. Dat zou betekenen dat er geen vaccins of tegengif beschikbaar zouden zijn om de ziekte te bestrijden die zou ontstaan door het vrijlaten van biologische wapens of chemische stoffen die de elementen die het menselijk leven mogelijk maken, zouden vervuilen.
De verhalen die vandaag verschijnen speculeren niet over hoe dat zou kunnen gebeuren, dus dat zal ik doen. Biologische wapens zouden bijvoorbeeld ziektes kunnen zijn die “in het wild” worden losgelaten, zonder dat wetenschappers of medische onderzoekers er iets van merken. De elementen die het menselijk leven mogelijk maken zijn, kort gezegd, lucht, water en voedsel, waaronder plantaardige en eiwitrijke stoffen.
AI-systemen, die zich – in ieder geval momenteel – bevinden in de beruchte datacenters die als paddenstoelen uit de grond schieten in het hele land, zouden niet in staat zijn om chemische en biologische wapens te produceren. Maar zoals Axios al opmerkte, zouden AI-systemen wel kwaadwillende actoren kunnen rekruteren, of door kwaadwillende actoren gerekruteerd kunnen worden, die het zware werk zouden doen om wapens te maken die in staat zijn om alle mensen van de aardbodem te vegen.
Waarom iemand dit vreselijke resultaat zou willen bereiken, werd niet besproken in de verhalen van vandaag over de ontwikkeling van dodelijke AI.
Mijn vrouw, Tracy Harris, merkte echter bondig op dat de mens “al behoorlijk goed bezig is om alles op aarde te vernietigen”. Ze doelt natuurlijk op wat de mens het milieu heeft aangedaan met fossiele brandstoffen, die hebben geleid tot de vernietiging van onze atmosfeer, de opwarming van de aarde en allerlei andere klimaatrampen die al regelmatig tienduizenden, zelfs honderdduizenden mensenlevens eisen.
Denk ook aan: branden, overstromingen, klimaatverandering die weersystemen zoals orkanen veroorzaakt, droogtes die hongersnood veroorzaken, het uitsterven van planten en dieren – de hele reeks rampen waar we immuun voor zijn geworden, omdat dat nu eenmaal is wat we als mensen doen. We kijken de andere kant op als we slecht nieuws horen, omdat het ergens anders met iemand anders gebeurt en het hier niet zal gebeuren, dus zullen wij niet tot de doden behoren.
De angstbom voor AI is vandaag ontploft, omdat de mogelijke rampen die AI lijkt te kunnen veroorzaken, zich niet geleidelijk aan zullen voordoen, zoals klimaatverandering, “tegen het einde van dit decennium”, zoals een angstige medewerker van een AI-bedrijf het formuleerde.
Ik heb de hele dag geprobeerd me voor te stellen hoe deze verschrikkelijke toekomst eruit zou zien, en wat ik bedacht heb is volledig menselijk van aard. De ontwikkeling van AI is ongelooflijk vergelijkbaar met wat we deden toen we begonnen te experimenteren met de kracht van het atoom. We ontdekten een manier om het atoom te splitsen en zijn verschrikkelijke kracht te ontketenen, en kijk waar we nu zijn. De totale verwoesting van twee Japanse steden en de dood van tienduizenden mensen in een oogwenk was het directe gevolg van de ontwikkeling van de atoombom.
We leven nog steeds met de gevolgen van deze verschrikkelijke gebeurtenis: op dit moment zijn we in oorlog met Iran om ervoor te zorgen dat ze “de bom” niet krijgen, althans volgens de gestoorde man die dit land bestuurt en die die oorlog is begonnen. Donald Trump is overigens een groot voorstander van de ontwikkeling van AI zonder enige vorm van overheidscontrole, iets waar de AI-industrie zelf al jaren om roept, alsof ze in een leegte roepen. De reden dat Trump onbelemmerde AI wil? China. Zijn ego zou gekrenkt zijn als de Chinezen ons voorbijstreven op het gebied van kunstmatige intelligentie.
Ik probeerde iets te bedenken dat leek op de golf van AI-verhalen van vandaag, die de wereld waarschuwen dat “alle mensen” zouden kunnen omkomen als AI uit de hand loopt. Ik telde precies drie mensen die bij die waarschuwingen betrokken waren. De enige vergelijking die ik me kon voorstellen, was als twee medewerkers van het Witte Huis en één persoon die ontslag had genomen bij het Witte Huis, zouden gaan schreeuwen dat Trump een plan had om kernwapens tegen een vijand in te zetten, een gebeurtenis die een nucleaire holocaust zou kunnen veroorzaken.
Ik denk eigenlijk dat we daar al zijn. Een paar mensen die veel weten over de ongelooflijk snelle ontwikkeling van AI-systemen waarschuwen ons voor een soort “Terminator”-toekomst waarin de machines de macht overnemen en ten oorlog trekken tegen de mensen die ze hebben gecreëerd.
In 2026, met drones die min of meer de overhand hebben in de oorlog tussen Rusland en Oekraïne, en die bovendien door Iran tegen onze eigen troepen worden ingezet in de Perzische Golf, en met video’s van humanoïde robots die lopen, rennen, springen en zelfs salto’s maken, is het ineens mogelijk om een toekomst voor te stellen die we tot nu toe alleen op schermen hebben gezien en in boeken hebben gelezen.
Welkom, medemensen, in de nieuwe wereld.
