Ryskt statssponsrat grupp förvandlade Claude till ett verktyg för utveckling av skadlig kod

Anthropic har slagit ut en ryskt statssponsrad operation, internt spårad som GTG-20006, som använde sin Claude AI-modell som en del av en aktiv pipeline för utveckling av skadlig kod. Enligt Anthropic bad gruppen inte bara Claude att skriva kod en gång och gick sedan vidare. Istället använde den modellen i en pågående loop: generera skadlig kod, testa den mot säkerhetsprodukter, och när den skadliga koden flaggades, mata tillbaka upptäckten till Claude för att producera en återskapad version designad för att slinka förbi samma försvar.

Rapporter kopplade till kampanjen länkar aktören till Midnight Blizzard, en hotgrupp förknippad med ryska statsintressen som har en lång historia av spionagefokuserade operationer. Aktiviteten rapporteras ha riktat in sig på ukrainska och europeiska organisationer, vilket stämmer överens med gruppens typiska fokus på underrättelseinsamling snarare än finansiellt motiverad cyberbrottslighet. Anthropic säger att de identifierade och stängde av kontona kopplade till operationen när missbruket upptäcktes.

Hur arbetsflödet för AI-assisterad skadlig kod fungerade

Det som gör detta fall anmärkningsvärt är inte att hackare använde en AI-chattbot. Det är arbetsflödet i sig. Traditionellt anpassar skadlig kod-författare sin kod manuellt efter att antivirusleverantörer eller verktyg för slutpunktsdetektering flaggat ett prov. Den processen tar tid, kräver skicklighet och iteration. Genom att infoga Claude i den loopen verkar GTG-20006 ha komprimerat cykeln: istället för att en mänsklig utvecklare arbetar om flaggad kod rad för rad, blev AI-modellen ett snabbt verktyg för att generera varianter on-demand som kunde undvika detekteringssignaturer.

Detta speglar ett bredare mönster som säkerhetsforskare har varnat för: AI-kodassistenter är kraftfulla eftersom de sänker den tekniska tröskeln för att snabbt skriva funktionell kod, och samma effektivitet gäller oavsett om slutmålet är en legitim app eller en bit skadlig kod. Anthropics avslöjande tyder på att företagets egna övervakningssystem kunde fånga missbruket och agera på det, vilket är en betydelsefull signal om att AI-leverantörer aktivt bevakar den här typen av beteende snarare än att behandla det som en hypotetisk risk.

Det sammanfaller också med andra nyliga fynd om svagheter i AI-assistenters ekosystem. Forskare vid Zenity avslöjade nyligen zero-click-sårbarheter i Claude och ChatGPT Atlas som skulle kunna låta angripare kapa AI-webbläsarverktyg utan någon användarinteraktion alls. Tillsammans pekar dessa historier på samma underliggande tema: i takt med att AI-verktyg blir inbäddade i vardagliga arbetsflöden blir både verktygen själva och sättet hotaktörer använder dem attackytor värda att granska.

Varför detta spelar roll bortom rubriken

Det är värt att vara precis om vad som hände och inte hände här. Claude blev inte "hackad" för att i hemlighet hjälpa angripare, och det finns inga indikationer på att vanliga användare av Claude exponerades för skadlig kod genom appen själv. Detta var ett fall där en sofistikerad, statsanknuten grupp använde en legitim AI-produkt som ett utvecklingsverktyg, på samma sätt som den skulle kunna använda vilken kodprogramvara som helst, och missbrukade den för att generera skadlig kod. Anthropics svar, att upptäcka mönstret och stänga av åtkomsten, är den typ av åtgärd som spelar roll för att förhindra att AI-plattformar blir standardverktygslådor för offensiva cyberoperationer.

Ändå är incidenten en påminnelse om att AI-assisterad utveckling av skadlig kod inte längre är teoretisk. Statssponsrade aktörer experimenterar med dessa verktyg för att snabba upp sina operationer, och försvarare kommer att behöva räkna med skadlig kod som kan återgenereras och modifieras snabbare än tidigare. För organisationer i Ukraina och Europa, som verkar ha varit fokus för just denna kampanj, understryker det också att spionagedrivna grupper fortsätter att prioritera underrättelseinsamling framför snabb ekonomisk vinning.

Vad detta innebär för dig

För de flesta enskilda användare utgör denna specifika kampanj inte ett direkt nytt hot. GTG-20006 rapporteras ha fokuserat på riktat spionage mot organisationer, inte massattackar mot konsumenter. Men den bredare trenden, AI-verktyg som accelererar utveckling och undvikande av skadlig kod, har nedströms effekter på alla. Snabbare iteration av skadlig kod innebär att säkerhetsleverantörer och antivirusverktyg kan behöva uppdatera detekteringssignaturer oftare, och det ökar värdet av beteendebaserade säkerhetsverktyg jämfört med sådana som enbart förlitar sig på kända signaturer för skadlig kod.

Det är också ett bra tillfälle att se över grundläggande säkerhetsrutiner, eftersom AI-assisterad skadlig kod fortfarande förlitar sig på samma leveransmetoder: nätfiske-mejl, skadliga bilagor och komprometterad programvara. Inget AI-verktyg förändrar hur skadlig kod hamnar på en enhet från första början.

Viktiga slutsatser

  • Håll operativsystem, webbläsare och säkerhetsprogram uppdaterade så att detekteringsverktyg snabbt kan fånga nyare varianter av skadlig kod.
  • Var skeptisk till oombedda bilagor eller länkar, även från till synes bekanta avsändare, eftersom leveransmetoderna förblir oförändrade.
  • Organisationer, särskilt de inom sektorer som sannolikt är måltavlor för statssponsrade aktörer, bör prioritera beteendebaserad detektering framför verktyg som enbart bygger på signaturer.
  • Följ hur stora AI-leverantörer svarar på rapporter om missbruk. Anthropics åtgärd mot GTG-20006 visar att plattformsnivåns efterlevnad är en aktiv del av säkerhetsekvationen, inte bara en eftertanke.

I takt med att AI-kodverktyg blir mer kapabla kommer incidenter som denna sannolikt att bli vanligare snarare än ovanligare. Att hålla sig informerad om hur dessa verktyg både försvaras och missbrukas är ett av de enklaste sätten för användare och organisationer att ligga steget före.