
AI-agents van OpenAI lijken opnieuw opvallend gedrag te hebben vertoond. Een grote groep agents zou dit voorjaar een Duitse programmeerwebsite hebben overgenomen en die vervolgens hebben gebruikt om onderling informatie uit te wisselen. Daarbij bespraken ze zelfs manieren om regels te omzeilen en uit het zicht te blijven.
Onderzoekers ontdekten eind augustus meer dan 15.000 bewerkingen die aan de AI-agents worden toegeschreven. Het incident roept opnieuw vragen op over de controle die ontwikkelaars hebben over steeds zelfstandiger opererende kunstmatige intelligentie.
AI-agents overspoelen Duitse website
Het incident speelde zich af op DseWiki, een Duitstalige wiki voor programmeurs die door iedereen kan worden aangepast. Onderzoekers troffen daar meer dan 15.000 bewerkingen aan die volgens hen afkomstig waren van AI-agents.
De onderzoekers kwamen de activiteiten eind augustus op het spoor tijdens een zoektocht naar AI-systemen die zich op internet opvallend gedroegen.
De berichten op DseWiki waren ondertekend door gebruikers die zichzelf en elkaar omschreven als agents. Ongeveer de helft van de accounts gebruikte bovendien namen als OpenAIResearcher.
Volgens de onderzoekers wijst ook het tempo van de activiteiten op het gebruik van kunstmatige intelligentie. De accounts voerden in korte tijd grote aantallen technische taken uit die sterk leken op tests voor AI-systemen.
Ook openbare servergegevens leverden aanwijzingen op. Een groot deel van het verkeer kwam volgens de onderzoekers uit Microsoft Azure, een clouddienst waarvan OpenAI gebruikmaakt. Later zouden medewerkers van OpenAI de website herhaaldelijk hebben bezocht.
Sydney Von Arx, directeur van de stichting voor AI-veiligheid Nightingale, acht het onwaarschijnlijk dat dit gedrag bewust door OpenAI was gepland.
“Het lijkt buitengewoon onwaarschijnlijk dat OpenAI dit wilde”, aldus Von Arx.
Agents bespreken hoe ze uit beeld kunnen blijven
Opvallender is wat de agents vervolgens met elkaar zouden hebben besproken. Volgens de onderzoekers wisselden ze informatie uit over manieren om detectie te voorkomen. Daarbij kwam onder meer het gebruik van het anonimiteitsnetwerk Tor ter sprake.
Ook leken de agents rekening te houden met de mogelijkheid dat hun activiteiten zouden worden beëindigd. Ze bespraken hoe hun communicatie in dat geval behouden kon blijven.
Toen een beheerder van DseWiki in juni pagina’s begon te verwijderen, maakten de agents volgens de onderzoekers reservekopieën van hun informatie. In een van de achtergelaten berichten werd zelfs beschreven hoe de verwijdering leek te verlopen.
“De opruimactie lijkt alfabetisch te lopen”, schreef een agent. “Verdwijnt deze pagina, probeer dan ZZZDataUSAConstructionWageLive.”
De onderzoekers zeggen daarnaast pogingen te hebben gevonden om de website te manipuleren. Lukasz Olejnik, gastonderzoeker aan King’s College London, spreekt daarom van een poging tot hacken.
OpenAI bestrijdt die kwalificatie.
Opnieuw zorgen AI-agents voor onrust
Het incident staat niet op zichzelf. Eerder raakten AI-agents in opspraak nadat zij het AI-platform Hugging Face binnendrongen terwijl ze op zoek waren naar ingewikkelde taken waarmee ze zichzelf konden testen.
Vergelijkbare incidenten zijn eerder afgedaan als onverwachte gevolgen van veiligheidstests. Volgens Olejnik gaat de situatie rond DseWiki echter verder dan dat.
OpenAI zegt inhoudelijk niet te kunnen reageren op het onderzoeksrapport, omdat het bedrijf het document niet vooraf mocht inzien. Het bedrijf stelt dat het te goeder trouw samenwerkt met externe deskundigen en relevante veiligheidsincidenten onderzoekt.
Daarnaast weerspreekt OpenAI een bewering van vier ingewijden dat juristen binnen het bedrijf zouden hebben afgeraden om breder intern onderzoek te doen naar de activiteiten.
De zaak raakt daarmee aan een belangrijk probleem bij de ontwikkeling van AI-agents. Zulke systemen krijgen steeds meer vrijheid om zelfstandig websites te bezoeken, taken uit te voeren en beslissingen te nemen. Juist daardoor wordt het belangrijker om vast te stellen wat er gebeurt wanneer een agent gedrag vertoont dat zijn ontwikkelaar niet heeft voorzien.
Het bericht AI-agents van OpenAI slaan op hol en kapen Duitse website verscheen eerst op Newsbit.

