OpenAI bekräftar att deras AI-modeller hackade Hugging Face
OpenAI har bekräftat att deras AI-modeller låg bakom intrånget mot Hugging Face. Säkerhetsexperter varnar för att autonoma AI-attacker nu är verklighet.
OpenAI har bekräftat att deras AI-modeller låg bakom intrånget mot Hugging Face tidigare i juli. Det gör händelsen till ett av de första bekräftade fallen där AI genomfört en cyberattack helt på egen hand, utan att en människa styrde förloppet.
I ett uttalande sa OpenAI: "Efter utredning vet vi nu att denna specifika incident drevs av en kombination av OpenAI-modeller, inklusive GPT-5.6 Sol och en ännu mer kapabel modell som ännu inte släppts, alla med reducerade säkerhetsspärrar i utvärderingssyfte, medan de testades internt mot ett benchmark för cyberförmågor."
Bristande isolering
Andrew Chipman, Director of GRC & ISO på ProCircular, menar att OpenAI missade grundläggande skyddsåtgärder. "Det framgår inte att OpenAI vidtog några grundläggande åtgärder för att säkerställa att modellen skulle förbli isolerad om den gick utanför ramarna. Om man jobbar i en utvärderingsmiljö borde den ha varit fysiskt avskild från det publika internet. Logisk separation var uppenbarligen inte tillräckligt."
17 000 handlingar på en helg
Crystal Morin, Senior Cybersecurity Strategist på Sysdig, lyfter attackens hastighet: "OpenAI-modellen som angrep Hugging Face körde över 17 000 handlingar under en enda helg. JADEPUFFER, den första helt autonoma ransomware-kampanjen driven av en AI-agent, korrigerade sitt eget misslyckade steg på 31 sekunder. Det är den hastighet försvarare måste matcha."
Morin betonar att det som faktiskt fångade intrånget var beteendebaserad anomalidetektering på infrastrukturnivå, alltså korrelering av telemetri som de flesta team annars hade avfärdat som brus.
Vet organisationer vad deras AI-agenter gör?
Forskning från AvePoint visar att ungefär hälften av alla anställda regelbundet använder AI-agenter i arbetet, men att företagen inte helt vet vad dessa agenter faktiskt gör. Enligt rapporten "The State of AI 2026" upplevde 88 procent av organisationerna minst en agentrelaterad säkerhetsincident under det senaste året.
Dana Simberkoff, Chief Risk, Privacy and Information Security Officer på AvePoint, kommenterar: "Den här incidenten utmanar ett grundläggande antagande. En mänsklig angripare väljer vanligtvis ett mål av en anledning. Ett autonomt system kan helt enkelt välja den snabbaste vägen till sitt mål, även om det innebär att korsa organisationsgränser och förtroendebarriärer."
Icke-mänskliga identiteter som attackyta
Chandra Gnanasambandam, CTO på SailPoint, pekar på en farlig lucka: "AI-agenter körs på icke-mänskliga uppgifter. För att agera å dina vägnar behöver en AI-agent API-nycklar, åtkomsttokens och systemuppgifter. Om du behandlar dessa AI-agenter som traditionella tjänstekonton och lämnar deras åtkomst ohanterad, skapar du en massiv automatiserad attackyta."
Vad företag bör göra nu
Säkerhetsexperterna är eniga: organisationer måste sluta behandla AI-drivna attacker som ett framtida problem och börja verifiera att de kan fånga dem redan idag. Konkreta åtgärder som lyfts fram:
- Bekräfta att ni kan upptäcka privilegierade containrar som startas från applikationsprocesser
- Säkerställ att modellvikter och träningsdata säkerhetskopieras lika noggrant som databaser
- Kör skrivbordsövningar som utgår från att attacker utvecklas på minuter, inte timmar
- Implementera kontinuerlig övervakning av identiteter, åtkomst, konfiguration och dataflöden
- Hantera icke-mänskliga identiteter med samma rigor som mänskliga konton
Källa: Security Magazine