De nieuwsstroom rond “AI gaat ons allemaal uitroeien” laaide op toen Sam Altman van OpenAI en Elon Musk van xAI zich aansloten bij de oproep van Dario Amodei, CEO van Anthropic , om onafhankelijke beoordelaars uit te nodigen in AI-laboratoria. Dit om ervoor te zorgen dat ’s werelds slimste computerwetenschappers niet per ongeluk de uitroeiing van de mensheid veroorzaken.
artificial intelligence Een rustige lezing van Amodei’s voorstel kan je bloeddruk verlagen. Hij stelt dingen voor die elk AI-lab sowieso al moet doen, vooral om commerciële redenen: operationele excellentie, afstemming, interpreteerbaarheid, testen en evaluatie.
Stel je voor dat de CEO van een autofabrikant een blogpost schrijft waarin hij suggereert dat de industrie betrouwbare auto’s moet ontwikkelen die voorspelbaar reageren wanneer je aan het stuur draait en het gaspedaal en de rem indrukt. Oh, en misschien ook nog eens uitzoeken hoe die zuigertjes de wielen laten draaien. Natuurlijk moeten AI-bedrijven dit soort dingen doen. Wie zou AI de leiding geven over iets belangrijks als ze niet weten wat de technologie gaat doen, of waarom?
Waarom zouden AI-bedrijven geen onafhankelijke beoordelaars inschakelen? Als filantropen gratis arbeid willen leveren, waarom zouden ze daar dan bezwaar tegen maken? Wat Amodei niet heeft besproken, is wat er gebeurt als onafhankelijke beoordelaars besluiten dat een grensverleggend laboratorium dat ze monitoren, simpelweg de activiteiten moet stopzetten, waardoor investeerders met de gebakken peren blijven zitten. Er bestaat een risico dat Anthropic, of elk ander AI-bedrijf dat deze feedback krijgt, gewoon een andere onafhankelijke beoordelaar inschakelt.
Amodei stelt voor om het risiconiveau van een model te beoordelen aan de hand van controlepunten. “Als modellen over capaciteit X beschikken, moeten ze vergezeld gaan van certificeringen van uitlijningseigenschappen Y en Z”, schrijft hij.
Maar de capaciteiten van modellen zijn niet de meest sprekende maatstaf om te bepalen of ze een gevaar vormen voor de mensheid. Als dat wel zo was, zou de huidige paniek 29 jaar geleden al begonnen zijn, toen Deep Blue Garry Kasparov versloeg met schaken. Stel je een miljard AI-agenten voor, zo slim als een schaakmeester, die samenzweren om de wereld over te nemen. De mensheid zou geen schijn van kans hebben.
Gelukkig werkt kunstmatige intelligentie niet zoals menselijke intelligentie. Dat een model een extreem complex wiskundig probleem kan oplossen, betekent niet dat het een plan kan smeden om de mensheid schaakmat te zetten.
Zelfs het vermogen van een AI-model om de creatie van nieuwe AI-modellen te verbeteren (ook wel recursieve zelfverbetering genoemd) is niet wat de mensheid in gevaar brengt. Om dat te kunnen doen, zouden AI-modellen een niveau van verfijning moeten bereiken dat hen in staat stelt om zelfstandig op kleine computers te werken en vervolgens in het geheim continu te leren. Zonder dat vermogen kunnen mensen ze simpelweg uitschakelen.
Frontier Labs bouwt zeker niet voor dat scenario: ze investeren honderden miljarden dollars in AI-datacenters in de veronderstelling dat artificial intelligence nog jarenlang enorme, krachtige computers nodig zal hebben. Als ze een superintelligent AI-model bouwen dat op elke computer kan draaien en continu kan leren, zullen ze zichzelf overbodig maken.
Er zijn tal van reële, zelfs directe, risico’s verbonden aan artificial intelligence, maar de uitsterving van de mensheid kan niet echt plaatsvinden zolang er een uitschakelknop is.
In Amodei’s blog, en ook niet door mensen zoals voormalig Anthropic-onderzoeker Jacob Coxon, wordt er melding gemaakt van de meest rampzalige scenario’s, omdat zelfs de meest bezorgde mensen binnen deze bedrijven het niet als een directe bedreiging zien.
Het onderwerp AI-veiligheid lijkt echter te zijn ontsnapt aan de beperkingen van het laboratorium dat San Francisco heet, en is aangewakkerd door een opgewonden media voor wie massale uitsterving – laten we eerlijk zijn – een ongelooflijk leuk verhaal is. Nu het de netwerken van Washington en Brussel heeft besmet, is het grootste risico dat hysterie de plaats inneemt van een doordacht debat.
Ruimte voor meningsverschillen: een nieuwe lijst op de rationalistische website LessWrong, al lange tijd een broeinest van zorgen over AI, biedt “enkele manieren waarop artificial intelligence ons zou kunnen doden”, waaronder dodelijke virussen, moorddrones en het blokkeren van de zon.
De paniek rondom artificial intelligence heeft een omslagpunt bereikt, aldus de Wall Street Journal .
Altman vertelde Fortune dat het bedrijf de beursgang had uitgesteld om veiligheidsproblemen op te lossen.
De vaart kwam er vrijdag in Washington niet in een wetsvoorstel over de veiligheid van kunstmatige intelligentie, dat door beide partijen gesteund zou worden. Sommige Democraten vonden het wetsvoorstel namelijk niet streng genoeg, zo meldde Ashley Gold van Semafor .
De politieke opvattingen over artificial intelligence veranderen snel, en een conservatieve leider beschreef de technologie vorige week als het loslaten van een horde ongewenste “algoritmische immigranten”.
