OpenAI heeft aangekondigd dat haar nieuwste model, Astra, het ‘Critical’ cybersecurity-niveau heeft bereikt binnen het eigen Preparedness Framework. Dit is de eerste keer dat een model van OpenAI in deze categorie wordt geplaatst. Deze classificatie geldt wanneer een model zelfstandig zero-day kwetsbaarheden kan ontdekken en benutten in goed beveiligde systemen, of een volledige cyberaanval kan uitvoeren op een versterkt doelwit op basis van slechts een algemene instructie.
Volgens OpenAI vereist deze classificatie extra beveiligingsmaatregelen voordat het model breed kan worden ingezet. Tijdens tests, zoals beschreven door het bedrijf, behaalde Astra een perfecte score op ExploitBench, een benchmark die meet hoe goed een model bekende kwetsbaarheden kan omzetten in werkende exploits. In een aparte evaluatie ontdekte Astra zelfstandig twee zero-day kwetsbaarheden die recent waren gemeld. Daarnaast wist het model uit een browser sandbox te ontsnappen om commando’s op het onderliggende systeem uit te voeren en combineerde het meerdere kwetsbaarheden in een versterkt besturingssysteem om root-toegang te verkrijgen.
OpenAI meldt dat Astra nu 91,5% van de cybergerelateerde jailbreak-pogingen afwijst tijdens tests, een aanzienlijke verbetering ten opzichte van de 59% van zijn voorganger, GPT-5.6 Sol. Ook vertoonde Astra veel minder neiging om veiligheidsbeperkingen te omzeilen of misleidende ‘honeypot’-doelen te benutten tijdens evaluaties. De volledige cybersecurity-mogelijkheden van Astra zullen bij de lancering niet direct breed beschikbaar zijn. OpenAI geeft een selecte groep testers vroegtijdige toegang, waarna een bredere beschikbaarheid volgt via het Daybreak Blue-programma.
OpenAI benadrukt dat de ontwikkeling van AI-modellen met zulke geavanceerde capaciteiten vraagt om strengere controle en afstemming. Het bedrijf stelt dat het waarborgen van veilige inzet afhankelijk is van bewijs van verantwoord gedrag, passende beveiligingsmaatregelen en de bereidheid om het ontwikkeltempo te vertragen als die maatregelen onvoldoende zijn. Onlangs hebben bijna 130 technologie- en cybersecuritybedrijven hun steun uitgesproken voor een door OpenAI geleid initiatief om cyberverdediging te versterken, nu AI-gedreven aanvallen steeds geavanceerder worden.
Reacties
Geef een reactie
Vereiste velden zijn gemarkeerd met *