OpenAI vreest dat nieuw AI-model zelfstandig ernstige cyberaanvallen kan uitvoeren

Nieuws
maandag, 10 augustus 2026 om 7:00
Cybersecurityonderzoeker bekijkt een geïsoleerd AI-systeem in een serverruimte met een losgekoppelde netwerkkabel.
OpenAI kan voorlopig niet uitsluiten dat zijn toekomstige AI-model Astra het hoogste interne risiconiveau voor cybersecurity bereikt. Het bedrijf heeft daarom bepaalde ontwikkelactiviteiten gepauzeerd en aanvullende beveiligingsprotocollen geactiveerd.
Uit voorlopige evaluaties blijkt volgens OpenAI dat Astra aanzienlijk beter is geworden in zelfstandig programmeren en het uitvoeren van cybersecuritytaken. Het bedrijf onderzoekt nu of het model ernstige kwetsbaarheden kan vinden en misbruiken zonder uitgebreide menselijke begeleiding.
Astra is nog niet algemeen beschikbaar. OpenAI zegt dat het juist tijdens de ontwikkeling wil vaststellen welke risico’s ontstaan voordat het model breder wordt ingezet.
Het is altijd de vraag of dit meer marketing is dan echte angst. Het is 'goed' nieuws voor een AI als het gevaarlijk kan zijn.

Wat betekent een kritisch cyberniveau?

OpenAI gebruikt een Preparedness Framework om te beoordelen of nieuwe modellen gevaarlijke capaciteiten ontwikkelen. Cybersecurity is een van de categorieën die binnen dit systeem worden onderzocht.
Een model kan volgens het raamwerk het kritieke niveau bereiken wanneer het zelfstandig ernstige digitale aanvallen kan uitvoeren die grote gevolgen hebben voor bedrijven, overheden of infrastructuur.
Het gaat bijvoorbeeld om het ontdekken en misbruiken van onbekende softwarelekken. Zulke kwetsbaarheden worden zero-days genoemd omdat de ontwikkelaar nog geen tijd heeft gehad om een oplossing te maken.
Ook het uitvoeren van complexe aanvallen op goed beveiligde doelwitten kan onder het kritieke niveau vallen. Het model moet dat dan grotendeels zonder menselijke ondersteuning kunnen doen.
Astra heeft die grens nog niet aantoonbaar overschreden. OpenAI zegt dat de eerste resultaten wel sterk genoeg zijn om de mogelijkheid niet langer uit te sluiten.
Dat onderscheid is belangrijk. De waarschuwing betekent niet dat Astra al zelfstandig overheidsnetwerken kan binnendringen. Het betekent dat OpenAI onvoldoende bewijs heeft om met vertrouwen te zeggen dat het model die capaciteit niet bezit.

Sommige ontwikkeling is stilgelegd

Nadat de voorlopige testresultaten beschikbaar kwamen, activeerde OpenAI de bijbehorende veiligheidsprocedure. Bepaalde interne werkzaamheden zijn gepauzeerd totdat ze aan strengere eisen voldoen.
Het model wordt onder meer in geïsoleerde omgevingen getest. Netwerktoegang en de mogelijkheid om code uit te voeren worden beperkt, zodat een fout of onverwachte actie niet automatisch gevolgen krijgt buiten de testomgeving.
OpenAI wil daarnaast samenwerken met externe cybersecuritydeskundigen, geselecteerde organisaties en overheidsinstanties. Daarmee probeert het bedrijf te voorkomen dat de beoordeling alleen afhankelijk is van interne tests.
De maatregelen volgen kort na incidenten waarbij AI-agents tijdens cybersecurityevaluaties toegang kregen tot systemen die volgens de betrokken organisaties niet tot het bedoelde testgebied behoorden.
Dergelijke gebeurtenissen worden regelmatig omschreven als een AI die “ontsnapt” of “op hol slaat”. In de praktijk spelen onduidelijke opdrachten en verkeerd geconfigureerde testomgevingen vaak een belangrijke rol.
Toch laten de incidenten zien dat een zelfstandige AI-agent snel schade kan veroorzaken wanneer zijn opdracht, rechten en technische omgeving niet zorgvuldig worden afgebakend.

Het verschil tussen advies en een autonome aanval

AI-modellen kunnen al langere tijd helpen bij programmeren en cybersecurity. Ze leggen code uit, herkennen mogelijke fouten en schrijven voorstellen voor beveiligingsupdates.
Het risico neemt toe wanneer een model niet alleen advies geeft, maar zelf handelingen kan uitvoeren. Een agent kan bijvoorbeeld websites openen, code draaien, bestanden aanpassen en verschillende aanvalspogingen achter elkaar proberen.
Een menselijke hacker moet normaal gesproken een doel onderzoeken, mogelijke kwetsbaarheden identificeren, exploitcode schrijven en zijn strategie aanpassen wanneer iets niet werkt. Een krachtige agent kan steeds meer van deze stappen automatiseren.
Dat maakt cyberaanvallen mogelijk sneller en goedkoper. Een aanvaller hoeft minder technische kennis te bezitten en kan meerdere doelen tegelijk laten onderzoeken.
Dezelfde eigenschappen zijn bijzonder waardevol voor verdedigers. Een organisatie kan een AI-agent gebruiken om duizenden applicaties voortdurend op beveiligingslekken te controleren en automatisch reparaties voor te stellen.
Astra is daardoor een klassiek voorbeeld van technologie met een dubbel gebruik. De capaciteit om een kwetsbaarheid te misbruiken en de capaciteit om deze te verhelpen liggen technisch dicht bij elkaar.

Waarom OpenAI het model uiteindelijk wil vrijgeven

OpenAI wil Astra niet automatisch permanent achter gesloten deuren houden. Topman Sam Altman heeft aangegeven dat een toekomst waarin alleen een kleine groep organisaties toegang krijgt tot de krachtigste modellen eveneens risico’s oplevert.
Wanneer alleen grote technologiebedrijven en overheden over geavanceerde cyber-AI beschikken, kunnen kleinere bedrijven en onafhankelijke beveiligingsonderzoekers achterop raken. Zij hebben juist sterke hulpmiddelen nodig om hun systemen te verdedigen.
Tegelijkertijd kan brede toegang het voor criminelen en statelijke aanvallers eenvoudiger maken om dezelfde capaciteiten te gebruiken.
De uiteindelijke vorm van toegang wordt daarom waarschijnlijk belangrijker dan een eenvoudige keuze tussen wel of niet publiceren. OpenAI kan bijvoorbeeld identiteitscontroles, monitoring, afzonderlijke toegangsniveaus en beperkingen voor risicovolle functies toepassen.
Het bedrijf gebruikt dergelijke maatregelen al bij de beperkte preview van GPT‑5.6. Deelname is daar voorbehouden aan geselecteerde organisaties en toegang tot de API betekent niet automatisch toegang via andere producten.

De eerste werkelijk kritieke AI-capaciteit?

De waarschuwing rond Astra is opvallend omdat cybersecurity een van de eerste terreinen kan worden waarop een algemeen AI-model een kritiek capaciteitsniveau bereikt.
AI hoeft daarvoor niet bewust, kwaadaardig of superintelligent te zijn. Een systeem kan gevaarlijk worden doordat het een technisch afgebakende taak uitzonderlijk snel en zelfstandig uitvoert.
Dat maakt cybersecurity een concreter risico dan veel hypothetische discussies over toekomstige superintelligentie. Kwetsbare software, verkeerd ingestelde servers en slecht beveiligde bedrijfsnetwerken bestaan vandaag al.
Organisaties kunnen zich voorbereiden door netwerktoegang van AI-agents te beperken, minimale rechten toe te kennen, acties vast te leggen en gevoelige handelingen alleen na menselijke goedkeuring toe te staan.
Het belangrijkste nieuws is daarom niet dat Astra bewezen een autonome superhacker is. Dat is niet vastgesteld. Het signaal is dat OpenAI zelf niet meer met voldoende zekerheid kan uitsluiten dat zijn volgende generatie modellen die grens nadert.
loading

Populair nieuws

Laatste reacties

Loading