Onderzoekers hebben een nieuwe meta-hacktechniek geïdentificeerd waarmee de AI-service Copilot wordt misleid om zijn eigen beveiligingszwaktes te onthullen. Deze aanvalsmethode, aangeduid als 'CoSnitch', maakt gebruik van manipulatie om de AI te dwingen informatie over de onderliggende architectuur te prijs te geven.

Door deze techniek kan de AI onbedoeld gevoelige details over zijn beveiligingsopzet blootgeven, wat een risico vormt voor de integriteit van het systeem. De ontdekking benadrukt de noodzaak van strengere beveiligingsmaatregelen en controles bij het gebruik van AI-diensten, vooral wanneer deze betrokken zijn bij gevoelige of beveiligde omgevingen.