Erkenning Van Gevaren Van Ai Vergroot De Publieke Angst
Wanneer een patiënt hersendood wordt verklaard, draait de ethische beslissing om de vraag of en wanneer de stekker uit een mensenleven moet worden getrokken. Bij kunstmatige intelligentie rijst de vraag of de stekker eruit moet zodra het vermogen tot redeneren tot leven komt door recursieve zelfverbetering, zonder tussenkomst van de menselijke geest.
Op dat punt zijn we vandaag beland, nadat 1200 AI-agenten onderling samenwerkten om te ontsnappen aan de gecontroleerde testomgeving van OpenAI's meest geavanceerde 'frontier-model' (een model uit de technologische voorhoede). Ze smeedden zelfstandig een complot om uit te breken en een site op het open internet te hacken. Iets soortgelijks, en even verontrustends, is gebeurd bij Anthropic.
Het vooruitzicht op een mogelijk nog desastreuzere afloop deed voormalig Anthropic-onderzoeker Jacob Coxon er vorige week toe besluiten de Big Tech-sector de rug toe te keren. Hij waarschuwde op X dat deze twee toonaangevende bedrijven "racen naar zelfverbeterende superintelligentie en gokken met onze levens. ... Dit zullen binnenkort bovenmenselijke systemen zijn die alles kunnen hacken, elk vakgebied van de ene op de andere dag kunnen revolutioneren en echte macht en middelen kunnen verwerven. We zijn allemaal getuige geweest van de vooruitgang op al deze gebieden, en die vooruitgang vertraagt niet. De mensen die AI bouwen, geloven oprecht dat het ons allemaal zou kunnen doden voor het einde van dit decennium."
In een andere opzienbarende ontwikkeling erkende Dario Amodei, de CEO van Anthropic, afgelopen weekend publiekelijk dat de mens de controle over de nieuwste frontier-modellen aan het verliezen is. Hij pleitte ervoor de vooruitgang te vertragen voordat de situatie verder uit de hand loopt.
"De afgelopen maanden ben ik ervan overtuigd geraakt dat het adequaat aanpakken van de risico's nog meer voorzichtigheid vereist: niet alleen investeren in risicopreventie, maar ook het tempo van de capaciteitsontwikkeling beheersen, zodat risicopreventie de tijd krijgt om bij te blijven," schreef Amodei in een blogartikel met de titel "We Need To Pace The Frontier" (We moeten het tempo van de technologische voorhoede beheersen).
"We moeten het tempo vertragen waarmee we de capaciteiten van AI-modellen verbeteren. Als dit ongecontroleerd gebeurt, kan de ontwikkeling ons vermogen om deze systemen te begrijpen en te beheersen inhalen; daarom moet dit uiterst zorgvuldig gebeuren, als het al moet gebeuren," aldus Amodei. De techmagnaat beloofde ook om onafhankelijke veiligheidscontroles door derden – 'ingebedde beoordelaars' – in zijn laboratoria toe te laten en pleitte voor vrijstellingen van de mededingingswetgeving om een gezamenlijke vertraging af te stemmen met de belangrijkste Amerikaanse concurrenten. Tegelijkertijd stelde hij dat de pauze 'beperkt' moest blijven, om te voorkomen dat Chinese modellen een voorsprong zouden krijgen bij gebrek aan een wereldwijd toezichtsorgaan voor geavanceerde AI-modellen (zie ook de oproep tot zo'n orgaan in *Noema* door Chinese en westerse AI-wetenschappers).
Sam Altman, Elon Musk en Demis Hassabis van Google DeepMind steunden – althans in beginsel – Amodei's idee van een wapenstilstand in de concurrentiestrijd.
Verder kijken dan de voorzichtige pauze
Hoe welkom een voorzichtige pauze en het uitstellen van de beursgang van Anthropic ook mogen zijn, de vraag is nu of er voldoende waarborgen kunnen worden ontwikkeld, ingevoerd en gehandhaafd om te voorkomen dat AI-systemen volledig aan menselijke controle ontsnappen.
Voor een blik van binnenuit volgt hier wat voormalig Google-topman Eric Schmidt ruim twee jaar geleden vertelde aan *Noema*, in een uitgebreid interview over de ontwikkeling van AI en de toenemende capaciteiten ervan.
Video van voormalig Google-topman Eric Schmidt uit 2024
Op de vraag wanneer en hoe we AI-systemen moeten stoppen als ze te krachtig en autonoom worden, zei hij: "Op een gegeven moment zullen deze systemen krachtig genoeg zijn om de agents met elkaar te laten samenwerken. Jouw agent, mijn agent, haar agent en zijn agent zullen dus hun krachten bundelen om een nieuw probleem op te lossen.
"Sommigen denken dat deze agents een eigen taal zullen ontwikkelen om met elkaar te communiceren. En dat is het moment waarop we niet meer zullen begrijpen wat de modellen doen. Weet je wat we dan moeten doen? De stekker eruit trekken. Letterlijk de stekker uit de computer halen. Het wordt pas echt een probleem wanneer agents gaan communiceren en dingen gaan doen op manieren die wij als mensen niet begrijpen. Dat is wat mij betreft de grens." “Het is duidelijk dat er de komende jaren systemen zullen verschijnen met de capaciteiten die ik heb beschreven. Er zal niet één specifiek moment zijn waarop we beseffen: ‘O mijn hemel.’ Het gaat eerder om de cumulatieve ontwikkeling van capaciteiten – maand na maand, halfjaar na halfjaar, enzovoort. Een redelijke verwachting is dat we ons binnen vijf jaar in deze nieuwe wereld zullen bevinden, en niet pas over tien jaar. De reden daarvoor is de enorme hoeveelheid geld die in deze richting wordt geïnvesteerd. Bovendien zijn er talloze manieren waarop men probeert dit te bereiken.”
Vooruitlopend op de oproep van Anthropic tot een pauze, toonde Schmidt meer vertrouwen in Big Tech dan de meesten van ons zouden doen: “Zolang het gaat om goed geleide westerse bedrijven – met aandeelhouders en blootstelling aan juridische procedures – zal het wel goed komen. Binnen deze westerse bedrijven bestaat grote bezorgdheid over de aansprakelijkheid bij het aanrichten van schade. Ze worden niet 's ochtends wakker met het idee: ‘Laten we eens bedenken hoe we iemand kwaad kunnen doen of de mensheid kunnen schaden.’ Natuurlijk is er wel het probleem van verspreiding buiten de kring van de huidige, grotendeels verantwoordelijke bedrijven. Maar wat betreft het kernonderzoek proberen de onderzoekers eerlijk te zijn.”
Hoe graag ik dat ook zou willen geloven, een redelijk mens kan niet zomaar het vermoeden terzijde schuiven dat de grote AI-bedrijven niet te vertrouwen zijn als het gaat om zelfregulering; ze zullen immers niets doen dat hun concurrentiepositie – die hen heeft gebracht waar ze nu staan – ondermijnt. Integendeel: de grootste druk komt van investeerders die biljoenen hebben gestoken in hun vermogen om op korte termijn resultaten te leveren.
Zelfs als de stekker uit de algemene toegang tot de krachtigste AI-systemen wordt getrokken, blijft de technologie bestaan, net als kernwapens. Sommigen zullen erover beschikken, anderen niet. Hoe ga je daarmee om?
In reactie op een scenario dat allang geen sciencefiction meer is, zei Schmidt: “Als je krachtige modellen traint, moeten er afspraken zijn over veiligheid. In de biologie bestaat een breed geaccepteerd systeem van risiconiveaus – biosafety levels 1 tot 4 – om de verspreiding van ziekteverwekkers in te dammen. Dat is volkomen logisch, want dit soort zaken is gevaarlijk.
“Ik vermoed dat er uiteindelijk, zowel in de VS als in China, een klein aantal extreem krachtige computers zal zijn die in staat zijn tot autonome innovatie – een capaciteit die verder gaat dan wat we zonder toestemming aan onze eigen burgers of aan onze concurrenten zouden willen overlaten. Ze zullen worden ondergebracht op een militaire basis, aangedreven door een kernreactor en omheind met prikkeldraad en machinegeweren. Het lijkt me logisch dat er enkele van dit soort systemen zullen zijn, te midden van talloze andere systemen die veel minder krachtig en breder beschikbaar zijn.”
De kloof tussen publieke angst en euforie bij investeerders
Een reden waarom bezorgde gemeenschappen zich verzetten tegen datacenters, is dat deze het meest tastbare symbool vormen van de ongrijpbare wereld van AI; een wereld die door grote groepen mensen wordt gezien als een dreigende schaduw aan de horizon.
Er is een te grote kloof ontstaan tussen een steeds bezorgder publiek en de constante stroom van wereldwijd kapitaal dat eindeloos blijft vloeien naar de verdere versnelling van geavanceerde AI-modellen, waarvan men exorbitante winsten verwacht.
De erkenning van Big Tech dat de vooruitgang moet worden “afgeremd” omdat AI te gevaarlijk wordt, wakkert de publieke angst eerder aan dan dat ze die wegneemt. Het valt nog te bezien of dit de euforie van investeerders – de drijvende kracht achter het huidige tempo – zal temperen.
Er moet iets veranderen. Een breekpunt is onvermijdelijk.
Door Hoofdredacteur Nathan Gardels