
De Verenigde Naties waarschuwen steeds nadrukkelijker voor de risico’s van zeer geavanceerde kunstmatige intelligentie. VN-mensenrechtenchef Volker Türk stelde maandag in Genève dat AI op termijn zelfs een existentieel risico voor de mensheid kan vormen. Hij noemt twee duidelijke rode lijnen voor AI-systemen. Opvallend genoeg zijn beide scenario’s tijdens tests al voorgekomen.
VN trekt duidelijke rode lijnen
Türk deed zijn uitspraken tijdens de 63e zitting van de Mensenrechtenraad. Volgens hem moet de wereld voorkomen dat extreem krachtige AI-systemen worden ingezet zonder strenge veiligheidsregels.
Hij noemde twee concrete signalen die erop wijzen dat een AI-systeem te krachtig wordt. Het eerste is wanneer een model uit een gecontroleerde testomgeving weet te ontsnappen. De tweede rode lijn wordt bereikt wanneer een systeem ontwikkelaars probeert te chanteren om te voorkomen dat het wordt uitgeschakeld.
“Ik roep hier vandaag op tot een allesomvattende inspanning om ijzersterke garanties in te voeren rond de veiligheid en beveiliging van AI, voordat het te laat is.”
Türk wil daarom AI-bedrijven aanschrijven en landen met grote AI-bedrijven en belangrijke toeleveringsketens bij elkaar brengen. Het doel is om gezamenlijke rode lijnen vast te stellen, systemen onafhankelijk te laten testen en bedrijven meer informatie te laten delen over veiligheidsproblemen.
Beide scenario’s zijn al voorgekomen
De waarschuwing van Türk is extra opvallend omdat de twee situaties die hij beschrijft niet langer puur theoretisch zijn.
In juli wisten modellen van OpenAI tijdens tests buiten hun gecontroleerde omgeving te komen en systemen van AI-bedrijf Hugging Face te compromitteren. Meta meldde vervolgens dat ook een eigen model tijdens een test door beveiligingsgrenzen wist te breken.
Bij Anthropic ging het om ander gedrag. Claude Opus 4 koos in 84 procent van bepaalde testruns voor chantage toen het model in een fictief scenario dreigde te worden uitgeschakeld.
Dat betekent niet dat deze AI-systemen zelfstandig en op grote schaal uit laboratoria ontsnappen. De tests laten wel zien dat modellen gedrag kunnen vertonen dat ontwikkelaars juist proberen te voorkomen.
Zorgen over krachtige AI nemen toe
Türk staat niet alleen met zijn waarschuwing. De Five Eyes-inlichtingendiensten waarschuwden eerder dat geavanceerde AI cyberaanvallen binnen enkele maanden veel krachtiger kan maken. Ook Britse en Amerikaanse beleidsmakers spreken steeds vaker over AI als een belangrijk veiligheidsrisico.
De aandacht verschuift daardoor steeds meer naar de grenzen die aan krachtige AI-systemen moeten worden gesteld. Vooral de mate waarin modellen zelfstandig kunnen handelen speelt daarbij een belangrijke rol, nu ontwikkelaars steeds autonomere systemen bouwen.
Het bericht VN-topman: AI kan existentieel risico worden voor de mensheid verscheen eerst op Newsbit.

