Naarmate AI-platforms steeds meer geïntegreerd raken in dagelijkse workflows, ontdekken cybercriminelen nieuwe aanvalsvectoren binnen deze platforms zelf. Volgens het Huntress Security Operations Center ligt het grootste risico niet in aanvallen op de AI-bedrijven of modellen, maar in het misbruiken van de AI-functies die gebruikers al vertrouwen en dagelijks gebruiken.

In de afgelopen negen maanden heeft Huntress meerdere incidenten gevolgd waarbij aanvallers gebruikmaakten van deelbare AI-content, publieke mini-apps en gesponsorde zoekresultaten om AI-gebruikers te targeten en malware te verspreiden. Zo werden legitieme functies van platforms als Claude en ChatGPT gekaapt om schadelijke instructies of downloads te verbergen binnen vertrouwde omgevingen. Deze campagnes duren vaak slechts enkele uren tot dagen, maar dat is voldoende om slachtoffers te misleiden voordat de content wordt verwijderd.

Een voorbeeld hiervan is de campagne FakeAgent, waarbij een kwaadaardige Claude Artifact werd gehost op het officiële claude.ai-domein. Slachtoffers die via Bing zochten naar de Claude desktop-app werden doorverwezen naar een valse downloadpagina, die uiteindelijk malware verspreidde. Hoewel Anthropic de Artifact na melding verwijderde, bleven gerelateerde incidenten nog enige tijd doorgaan.

In een ander geval leidde een gesponsord zoekresultaat op Google naar een gedeelde Claude.ai-pagina die zich voordeed als een Apple Support-installatiehandleiding. Deze pagina, zonder zichtbare waarschuwingen omdat deze op het officiële domein stond, instrueerde gebruikers om een curl-commando in de Terminal te plakken, waarmee de MacSync stealer werd geïnstalleerd. Deze malware verzamelde onder andere cookies, inloggegevens en SSH-sleutels.

Daarnaast is er een patroon van AI-poisoning waarbij aanvallers AI-gegenereerde troubleshooting adviezen manipuleren. Zo werden in december hoog scorende ChatGPT- en Grok-gesprekken gevonden die misleidende ClickFix-achtige instructies gaven in plaats van echte oplossingen, wat gebruikers kan misleiden en kwetsbaar maakt voor aanvallen.