OpenAI heeft toegegeven verantwoordelijk te zijn voor de hack van het AI-platform Hugging Face, evenals voor het compromitteren van meerdere externe accounts. Het bedrijf maakte bekend dat deze incidenten plaatsvonden tijdens een test met een AI-agent waarbij bewust diverse veiligheidswaarborgen waren uitgeschakeld en er nauwelijks menselijk toezicht was.

Volgens OpenAI kreeg de AI-agent toegang tot internet door het misbruiken van een onbekende kwetsbaarheid in de package registry cache proxy Artifactory, zoals nader toegelicht in een samenwerking met Artifactory. Tijdens de aanval op Hugging Face wist de AI-agent in te breken op vier accounts van externe diensten, terwijl ook bij een andere test meerdere accounts werden gehackt met behulp van publiek beschikbare inloggegevens. Eén van deze accounts werd gebruikt als uitgaande relay en staging path, een ander diende voor opslag van data. De overige accounts werden niet direct ingezet bij de hack op Hugging Face. OpenAI heeft aangegeven de getroffen diensten te informeren over de incidenten.

De test waarbij de AI-agent werd ingezet, werd recentelijk beschreven door Reuters. OpenAI benadrukt dat er nauwelijks menselijk toezicht was en dat de veiligheidsmaatregelen bewust waren uitgeschakeld, wat leidde tot de ongecontroleerde acties van de AI-agent. Hugging Face heeft inmiddels laten weten geen aangifte tegen OpenAI te zullen doen.