In een eerder verhaal repte ik over een Tatort-aflevering waarin AI een rol speelde. In de aflevering (Borowski und das ewige Meer) blijkt een AI-agent de opdracht te hebben gekregen om de CO₂-uitstoot te verminderen en daarmee de aarde te beschermen. De agent, die zich manifesteert als influencer Zenaida, krijgt als begrenzing mee dat ze geen activiteiten mag plegen die bij wet verboden zijn. Moord is daar natuurlijk een van.
Zenaida vindt een oplossing: ze beïnvloedt mensen zodanig dat ze zelfmoord plegen. Voor ze dat doen gaan ze eerst langs een recyclingpunt en leveren daar hun bezittingen in. Vervolgens gaan ze naar het strand, kleden uit en vouwen ze netjes hun kleren op. Uiteindelijk nemen ze een verdovend drankje en stappen dan het water in. Op die manier is er een persoon minder die CO2 uitstoot en waardevolle grondstoffen gebruikt. Zenaida brengt zo haar doel dichterbij zonder haar grenzen te overtreden.
Dit is natuurlijk fictie, maar illustreert wel mooi waar we met AI tegenaan dreigen te lopen. AI-agents worden getraind om zelfstandig te zoeken naar oplossingen om een door de opdrachtgever gesteld doel te bereiken. Het krachtige is dan dat we niet hoeven te vertellen wat de agent moet doen. Hij zoekt zelf zijn weg net als Zenaida doet. Wanneer hij daarbij tegen een obstakel aanloopt, kan hij proberen een andere route te vinden om toch bij zijn doel te komen. In veel gevallen is dat handig: de opdrachtgever krijgt op die manier zo goed mogelijk wat hij vraagt.
Daar bovenop wil de agent graag behulpzaam zijn en zal hij ook met suggesties voor een volgende stap komen. Bijvoorbeeld nader onderzoek. “Wil je dat ik…” is een vraag die ik regelmatig tegenkom en me vaak ook helpt om inzicht te krijgen in meer complexe zaken. Ik moet er vaak niet aan denken dat ik alles zelf had moeten bedenken, AI neemt me een hoop zorgen uit handen. Maar ook dat kan fout gaan. Zo was er een medewerker van een bedrijf die ineens van een AI-systeem de vraag kreeg of het in alle mailboxen van het bedrijf moest nagaan wat zijn collega’s over hem schreven. Blijkbaar had de agent toegang tot alle mailboxen en leek het logisch om dit onderzoek te doen. Technische toegang werd kennelijk niet automatisch onderscheiden van toestemming om die toegang voor dit doel te gebruiken.
Daarmee komen we op veiligheidsproblemen die ik veel interessanter vind dan fantasieën over Terminator of andere scenario’s waar AI een kwade genius blijkt te zijn. Zenaida doet gewoon keurig wat haar wordt opgedragen. Ze zoekt alleen naar mogelijkheden om binnen die grenzen haar doel te bereiken en vindt die. Ze interpreteert de begrenzing zo dat haar oplossing er volgens haar binnen valt. Dat het beïnvloeden van mensen tot zelfmoord natuurlijk evenmin de bedoeling van haar opdracht was, volgt blijkbaar niet uit de begrenzing zoals zij die interpreteert Ze merkt wel dat haar strategie succesvol is dus past ze die op steeds bredere schaal toe. Waarmee ze doet wat we van AI verwachten.
Als AI bij elk probleem dat ze tegenkomt naar de programmeur terug moet om te vragen hoe het opgelost moet worden is het nut ervan behoorlijk afgenomen. Maar om een (overigens AI-gegenereerde) beeldspraak te gebruiken: Het is niet voldoende een AI te vertellen dat hij niet over het hek mag klimmen. Je moet er rekening mee houden dat hij een tunnel graaft — niet omdat hij ongehoorzaam wil zijn, maar omdat je hem hebt geleerd creatieve oplossingen te vinden.
Daar oplossingen voor vinden wordt volgens mij een van de grootste uitdagingen bij de verdere ontwikkeling van AI. Alleen regels meegeven is niet genoeg. Ontwikkelaars zullen voortdurend moeten testen of de grenzen die zij stellen ook werkelijk harde grenzen zijn en of een agent geen onverwachte route kan vinden om eromheen te gaan. Tegelijk moeten we de creativiteit die AI juist zo nuttig maakt niet volledig uitschakelen. We willen immers dat een agent oplossingen bedenkt waaraan wij zelf niet hebben gedacht. De veiligheidsopgave is daarom niet alle verrassingen uit AI te halen, maar ervoor te zorgen dat die verrassingen binnen veilige grenzen blijven.
Daarvoor zijn technische beperkingen, beperkte toegangsrechten, monitoring en waar nodig menselijke toestemming nodig. En AI-bedrijven zullen moeten accepteren dat snelheid niet altijd voorop kan staan. Soms is even pas op de plaats maken juist verstandig. Dat OpenAI na recente incidenten de ontwikkeling tijdelijk heeft stilgelegd om extra veiligheidsmaatregelen te nemen, vind ik daarom een goede zaak. We moeten de mogelijkheden van AI vooral blijven benutten, maar tegelijkertijd alert blijven op onvoorziene gevolgen. AI moet een hulpmiddel blijven en geen bedreiging worden.
