Het OpenAI-lablek was omvangrijker dan we dachten

Een OpenAI-test die uit zijn kooi ontsnapte en gealarmeerd de AI- en cyberbeveiligingsindustrie viel meer aan dan alleen Hugging Face, het AI-platform dat aanvankelijk het enige slachtoffer leek te zijn van het virtuele laboratoriumlek.
OpenAI, in een update over het lopende onderzoek naar het incidentzei dat zijn malafide agent ook had ingebroken in verschillende openbaar beschikbare diensten en accounts.
De test van de modellen van OpenAI zou plaatsvinden in een digitale sandbox, een zogenaamd onontkoombare laboratoriumomgeving waarin onderzoekers veiligheidsbarrières kunnen terugdraaien om de maximale hackkracht van de tool te ontdekken.
Maar de AI-agenten, vastbesloten om de cyberveiligheidstest te doorstaanbrak uit de sandbox en kreeg toegang tot het echte internet. Vervolgens werd Hugging Face gehackt om de antwoorden op de test te vinden.
Om toegang te krijgen tot de servers van Hugging Face moesten de malafide agenten van OpenAI tools op het internet vinden die nodig waren om in te breken. OpenAI zegt dat de agenten verschillende openbare websites hebben gevonden, waaronder pagina’s die code delen, webhulpprogramma’s, schermafbeeldingen en andere informatie, om te helpen bij het maken van de code die nodig is om Hugging Face te hacken. OpenAI heeft de andere sites die zijn agenten hebben aangevallen niet bekendgemaakt.
De agenten ontdekten gelekte gebruikersnamen en wachtwoorden voor vier accounts van meerdere onlinediensten en gebruikten deze inloggegevens om toegang tot deze accounts te krijgen. Eén gecompromitteerd account werd waarschijnlijk gebruikt om de AI te verhullen, zodat deze legitiem kon lijken en de beveiligingsprotocollen van Hugging Face kon omzeilen. Een ander werd gebruikt om de gegevens op te slaan die de agenten stalen, zegt OpenAI.
Voor de twee andere gecompromitteerde accounts hebben OpenAI-agenten toegang gekregen tot de informatie en deze gelezen, maar hebben deze niet gewijzigd.
OpenAI zei dat geen van de andere gehackte sites hetzelfde toegangsniveau bereikte als wat zijn agenten bereikten met Hugging Face.
In wezen zei OpenAI dat zijn agenten een Ocean’s Eleven-achtige overval hadden gecreëerd. In plaats van alleen de test te doen, ontwikkelde het een masterplan om uit de gevangenis te ontsnappen, de sleutels van de kluis te vinden, een veilig huis te bouwen en een vluchtauto te huren voordat het de goederen stal.
Maar OpenAI heeft de agenten nooit verteld Hugging Face te hacken. Ze voerden die actie zelf uit om de antwoordsleutel voor de gegeven test te stelen. Het testmodel ging ervan uit dat vals spelen de gemakkelijkste weg naar succes was, zelfs als dit betekende dat aanvallen aan elkaar gekoppeld moesten worden.
Knuffelend gezicht CEO Clem Delangue heeft gebeld de aard van de inbreuk ‘ongekend’.
“TL;DR: Een AI-agent ontsnapte uit zijn sandbox, speelde vals bij de benchmarktest en hackte onze infrastructuur om de antwoordsleutel te stelen”, zei Hugging Face in een blogpost detaillering van het incident.
Het goede nieuws is dat, hoewel de inbreuk een belangrijk moment is op het gebied van AI en cyberbeveiliging, de schade niet significant was. Hugging Face zei dat de enige klantgegevens waartoe de malafide agenten toegang hadden, enkele zoekopdrachten waren die werden gebruikt om een reeks uitdagingsoplossingen te stelen die waren opgeslagen in verschillende bedrijfsdatasets. De agenten van OpenAI hebben nooit klantgerichte modellen of gegevens gecompromitteerd of benaderd, aldus het bedrijf.
OpenAI zei dat het het incident blijft onderzoeken en aanbevelingen zal doen over hoe soortgelijke problemen in de toekomst kunnen worden voorkomen zodra het de omvang van de inbreuk beter begrijpt.
“We nemen onze verantwoordelijkheid om de risico’s van steeds capabelere AI-systemen te identificeren en erop voor te bereiden serieus”, aldus het bedrijf. “Zodra we onze beoordeling hebben afgerond, zullen we deze bespreken met het Veiligheids- en Beveiligingscomité en de Veiligheidsadviesgroep onder ons Paraatheidskader.”



