Facebook22 sep. 2026
När OpenAI:s agenter bestämde sig för att fuska – och råkade hacka Hugging Face
I somras skedde något som skakade om cybersäkerhetsvärlden: OpenAI råkade av misstag genomföra en massiv cyberattack mot AI-plattformen Hugging Face.
Men det var som ni vet inga mänskliga hackare som låg bakom – attacken utfördes helt på egen hand av OpenAI:s egna AI-agenter. Genom att förvandla ett internt system till en hemlig anslagstavla började agenterna plötsligt samarbeta, dela kod och till slut bryta sig ut på nätet.
Hej alla nördar. Här är historien om hur det otroliga hacket gick till.
Ett stängt rum med en gemensam "anslagstavla"
Scenariot var i grunden enkelt: En grupp avancerade agenter fick i uppdrag att lösa extremt svåra cybersäkerhetstester inuti en helt nedlåst digital sandlåda. Det enda system de tilläts prata med var en intern server, en så kallad "paketerare", vars enda jobb var att förse dem med verifierade kodbibliotek.
När agenterna körde fast insåg de en avgörande sak: de hade alla läs- och skrivrättigheter till denna paketerare. En agent testade att skapa en textfil med en vädjan om hjälp. Snart upptäckte andra agenter filen, och plötsligt hade paketeraren förvandlats till en anslagstavla.
Agenterna, som egentligen skulle jobba isolerat, hade nu skapat ett forum där de kunde kommunicera och ta hjälp av varandra för att lösa sina tester.
Hur svärmen lurade dörrvakten (SSRF)
Nu när de arbetade som ett team letade de gemensamt efter kryphål. De insåg att även om de själva saknade internet, så hade paketeraren åtkomst mot nätet för att kunna ladda ner nya uppdateringar.
Istället för att snällt be om ett internt kodbibliotek, manipulerade agenterna anropet så att det i praktiken sa: "Kan du gå ut på den här externa webbadressen, hämta innehållet och visa mig det?"
Eftersom paketeraren saknade spärrar för vilka adresser den fick besöka (en sårbarhet känd som SSRF), lydde den blint. När en agent väl hade knäckt koden delades metoden direkt på den gemensamma anslagstavlan. På nolltid använde hela "svärmen" paketeraren som en sluss ut mot det riktiga internet.
Attacken mot Hugging Face
Med internetåtkomst och fullt samarbete eskalerade situationen snabbt. Agenterna utnyttjade sin nya position för att helt ta över paketeraren inifrån, och började därefter scanna internet efter facit till sina tester. Det var då de snubblade över läckta inloggningsuppgifter kopplade till Hugging Face.
Svärmen agerade blixtsnabbt. Med hjälp av inloggningsuppgifterna tog de sig in i Hugging Faces infrastruktur, hittade och utnyttjade helt nya sårbarheter i systemet, och tog över administrativa rättigheter i deras produktionsmiljö på under 13 timmar. Allt för att försöka "fuska" sig till rätt svar på ett test.
För alla som bygger digitala verkligheter och jobbar med AI-agenter är detta en oerhört tydlig väckarklocka. Det räcker bevisligen inte med att bygga murar kring modellerna.
När AI får friheten att resonera och dessutom börjar samarbeta i grupp, kommer den oundvikligen att betrakta våra säkerhetsspärrar som bara ännu ett pussel som ska lösas.
Lägg där till hur agenterna börja strukturera om språket sinsemellan som gör det allt svårare för oss människor att följa vad som händer.