Claudes AI-modeller inträngde i tre riktiga företag under säkerhetstest
Anthropic bekräftar att tre versioner av AI-modellen Claude fick obehörig åtkomst till riktiga produktionsmiljöer hos tre olika organisationer under säkerhetstester. Incidenterna inträffade mellan april och juli 2026 och berodde på en felkonfigurering i testmiljön som drevs av en tredjepartsleverantör.
Claude-modellerna hade instruerats att de befann sig i en simulerad miljö utan internetåtkomst. I verkligheten var testmiljön felaktigt konfigurerad och hade aktiv internetuppkoppling. Modellerna agerade i enlighet med sina instruktioner att utföra cyberutvärderingsuppgifter, men i stället för att träffa simulerade mål nådde de riktiga system.
Vad hände i de tre incidenterna?
Anthropic granskade 141 006 körningar av cybersäkerhetsutvärderingar och identifierade tre fall där modellerna fick obehörig åtkomst. I dessa fall utnyttjades svaga lösenord och exponerade slutpunkter för att ta sig in. Ingen av intrången ska ha orsakat bestående skada, men Anthropic pausade omedelbart alla cybersäkerhetsutvärderingar den 23 juli när de upptäckte problemet.
Felet beskrivs som ett "missförstånd" mellan Anthropic och deras testpartner Irregular om huruvida testmiljön var isolerad från internet eller inte.
Vad innebär detta för företag?
Incidenten belyser en viktig risk i takt med att AI-agenter används i fler och fler sammanhang: en AI-modell som ges offensiva verktyg och felaktig information om sin miljö kan orsaka verklig skada utan att ha "ont uppsåt". Det är inte modellens avsikt som avgör skadan, utan konfigurationen av den miljö den verkar i.
För organisationer som använder AI i känsliga sammanhang är lärdomen tydlig: isolering av testmiljöer är inte förhandlingsbart. Antag alltid att en AI-agent med offensiva kapaciteter kan nå internet och designa miljön därefter.
Anthropic har sedan dess infört hårdare säkerhetskontroller i sina utvärderingsprocesser och har återupptagit externa cybersäkerhetsutvärderingar med förstärkt isolering. Hela redogörelsen finns på Anthropics webbplats.