
Het aankomende AI-model Astra van OpenAI kan zelfstandig onbekende softwarelekken opsporen. Het model weet zogenoemde zero-days te vinden die zelfs bij de ontwikkelaar nog niet bekend zijn. Daarna kan Astra ook uitzoeken hoe zo’n kwetsbaarheid kan worden misbruikt, zonder dat een mens het model daarbij stap voor stap hoeft te helpen.
Dat is een flinke stap vooruit. Astra analyseert niet alleen bekende beveiligingsproblemen, maar gaat zelf op zoek naar nieuwe zwakke plekken in software. OpenAI beoordeelt de cybercapaciteiten van het model daarom als ‘kritiek’ binnen zijn eigen Preparedness Framework.
Astra vindt zelf onbekende zero-days
Zero-days behoren tot de gevaarlijkste softwarelekken. De ontwikkelaar weet namelijk nog niet dat het probleem bestaat en heeft dus meestal ook geen beveiligingsupdate klaarstaan.
Als een aanvaller zo’n lek als eerste vindt, kan die proberen het te misbruiken voordat het wordt gedicht.
Tijdens interne tests liet Astra zien dat het dit soort kwetsbaarheden daadwerkelijk kan ontdekken. Volgens OpenAI vond het model twee tot dan toe onbekende softwarefouten terwijl het meerdere zwakke plekken probeerde te combineren.
Bij een andere test behaalde Astra een score van 100 procent bij het ontwikkelen van manieren om bekende kwetsbaarheden te misbruiken.
Juist die combinatie maakt het model krachtig. Astra kan niet alleen een fout vinden, maar ook onderzoeken of verschillende fouten samen toegang tot een systeem kunnen geven. Werk waarvoor normaal ervaren beveiligingsonderzoekers nodig zijn, kan zo steeds verder worden geautomatiseerd.
Astra ontsnapt uit beveiligde omgeving
Een andere test laat zien hoe ver die mogelijkheden gaan. OpenAI plaatste Astra in een beveiligde browsersandbox. Dat is een afgesloten omgeving die juist moet voorkomen dat software toegang krijgt tot de rest van een computer.
Astra wist volgens OpenAI uit die omgeving te ontsnappen en vervolgens opdrachten uit te voeren op het onderliggende systeem.
Het model vond daarnaast meerdere kwetsbaarheden in een besturingssysteem en combineerde die om uiteindelijk roottoegang te krijgen. Dat is het hoogste toegangsniveau binnen veel computersystemen en geeft vrijwel volledige controle.
De resultaten waren voor OpenAI reden om extra voorzichtig te zijn. Het bedrijf heeft delen van de ontwikkeling uitgesteld en aanvullende beveiligingsmaatregelen genomen. De meest geavanceerde cybermogelijkheden worden voorlopig alleen beschikbaar gesteld aan een beperkte groep testers.
Het bericht Nieuw OpenAI-model ontdekt zelfstandig onbekende softwarelekken verscheen eerst op Newsbit.

