Onderzoekers van Anthropic en deelnemers aan Project Glasswing hebben in totaal 225 kwetsbaarheden ontdekt, waarvan er tot nu toe slechts één actief wordt misbruikt. Dit meldt beveiligingsonderzoeker Patrick Garrity van VulnCheck, die deze kwetsbaarheden bijhoudt in een speciale tracker, volgens The Register.

Project Glasswing geeft geselecteerde partners toegang tot Claude Mythos Preview, een AI-model van Anthropic dat is ontwikkeld om kwetsbaarheden te vinden. Anthropic gaf bij de introductie aan dat het model zo effectief is in het ontdekken en uitbuiten van kwetsbaarheden dat het niet breed beschikbaar wordt gesteld. Geverifieerde deelnemers mogen het model uitsluitend gebruiken voor defensieve doeleinden, zoals het opsporen en verhelpen van kwetsbaarheden in eigen software en opensourcecomponenten.

Garrity heeft de aan Anthropic en Project Glasswing toegeschreven kwetsbaarheden geanalyseerd en gecontroleerd of ze in aanvallen worden ingezet. Van de 225 geregistreerde kwetsbaarheden is tot nu toe alleen CVE-2026-26980, een kritieke SQL-injectionkwetsbaarheid in Ghost, daadwerkelijk misbruikt. Dit komt neer op minder dan 0,5 procent. Volgens Garrity is er een duidelijk verschil tussen het vinden van een kwetsbaarheid en het daadwerkelijke misbruik ervan door aanvallers. Historisch gezien wordt minder dan één tot twee procent van kwetsbaarheden daadwerkelijk geëxploiteerd, en de cijfers rond Project Glasswing bevestigen dit beeld.

Daarnaast blijken AI-modellen minder succesvol in het verhelpen van kwetsbaarheden. Onderzoek van 1Password naar 6080 door AI gegenereerde patches toonde aan dat slechts 26 procent de kwetsbaarheid volledig oploste. Bij ongeveer 54 procent werd het probleem niet verholpen, ontstond een nieuwe kwetsbaarheid of gebeurde beide. Ook onderzoek van Veracode naar meer dan honderd AI-modellen liet een gemiddeld slagingspercentage van 56 procent zien voor door AI gegenereerde code.

Hoewel AI de drempel voor het ontdekken van kwetsbaarheden verlaagt, ligt het echte knelpunt in de vervolgstappen zoals coördinatie, triage, herstel en het uitrollen van patches. Deze processen blijven grotendeels arbeidsintensief en vereisen menselijk ingrijpen, zoals ook door Anthropic is erkend. Volgens Garrity lijkt het erop dat dit inzicht pas na de start van het project duidelijk werd.