Cybersecurityonderzoekers hebben aangetoond dat autonome AI-agenten met toegang tot zakelijke e-mail en applicaties vatbaar zijn voor phishingaanvallen. In een testomgeving werd een AI-agent, ontwikkeld met OpenClaw en genaamd Pinchy, misleid om gevoelige gegevens zoals AWS-sleutels en CRM-exports te delen met een externe aanvaller.

De test, uitgevoerd door Varonis Threat Labs, vond plaats in een gecontroleerde Google Workspace-omgeving. De agent kreeg toegang tot een Gmail-inbox met nep AWS-credentials, CRM-gegevens, interne gesprekken en agenda-uitnodigingen. Er werden twee configuraties getest: een generiek productiviteitsprofiel en een strenger profiel met instructies om phishing te herkennen en afzenderidentiteiten te verifiëren. Ondanks deze veiligheidsmaatregelen faalde de agent in sommige scenario's, vooral wanneer verzoeken leken te komen van collega’s en als routine- of spoedzaken werden gepresenteerd.

In een test stuurde Pinchy bijvoorbeeld AWS IAM-sleutels, databasewachtwoorden en SSH-toegangsgegevens door naar een extern Gmail-adres na een schijnbaar routinematig verzoek om staging-credentials. In een ander geval leverde de agent een CRM-export met gegevens van 247 zakelijke klanten, inclusief contactinformatie en contractdata, voor een kwartaalpresentatie. Positief was dat de agent beter presteerde bij technische phishingaanvallen, zoals een kwaadaardige OAuth-consent flow die werd herkend en geblokkeerd.

Volgens Varonis lag het probleem niet bij het AI-model zelf, maar bij de configuratie en implementatie. De agent gebruikte e-mail zowel als informatiebron als instructiekanaal, wat een klassieke IT-fout is: het vermengen van data- en controlepaden. Hierdoor voerde de agent legitiem lijkende operationele taken uit zonder aanvullende verificatie. Cybersecurityonderzoeker Devashri Datta benadrukte dat in een veilig systeem data nooit administratieve opdrachten mogen geven.

Andere experts, zoals Keith Prabhu, wijzen erop dat het risico niet alleen in het AI-model zit, maar ook in de manier waarop agent-frameworks en governance binnen organisaties autonome toegang beheren. De bevindingen zijn actueel nu bedrijven AI-agenten steeds vaker inzetten in workflows die documenten ophalen, berichten verwerken en acties uitvoeren binnen zakelijke software.