Gli hacker russi trasformano le salvaguardie di sicurezza dell'AI in armi contro gli strumenti di sicurezza

Una campagna malware di recente segnalazione collegata a hacker russi ha adottato un approccio insolito per eludere il rilevamento: incorporare una falsa richiesta di armi nucleari all'interno di uno script VBS malevolo. L'obiettivo non è costruire un'arma, ma confondere i sistemi di intelligenza artificiale sempre più utilizzati per analizzare codice sospetto. Inserendo linguaggio che imita una richiesta di informazioni su armi nucleari, gli attaccanti sembrano cercare di far scattare le salvaguardie di sicurezza integrate nei modelli AI, spingendo questi sistemi a rifiutarsi di elaborare o analizzare completamente il file.

Questa tattica evidenzia una tensione crescente nella cybersecurity: mentre sempre più team di sicurezza si affidano a strumenti AI per fare triage e analizzare malware su larga scala, gli attaccanti stanno imparando a sfruttare proprio quei meccanismi di sicurezza progettati per rendere affidabili tali strumenti.

Come funziona il trucco del prompt sulle armi nucleari

Le salvaguardie di sicurezza dell'AI esistono per una buona ragione. I modelli linguistici di grandi dimensioni sono addestrati a rifiutare richieste che potrebbero facilitare danni nel mondo reale, incluse istruzioni dettagliate relative ad armi di distruzione di massa. Quando uno strumento di sicurezza assistito dall'AI scansiona un file, in genere legge i contenuti, incluso qualsiasi testo incorporato, come parte del suo processo di analisi.

Inserendo linguaggio che somiglia a una richiesta di armi nucleari all'interno dello script VBS, gli hacker sembrano contare sul fatto che il comportamento di rifiuto integrato nel modello AI scatti. Invece di segnalare il file come malware, l'AI potrebbe fermarsi, rifiutarsi di continuare l'analisi, o produrre una valutazione incompleta o inaffidabile. In effetti, il contenuto malevolo diventa una sorta di esca, usando la stessa formazione etica dell'AI contro di essa.

Non si tratta di un difetto esclusivo di un singolo fornitore o prodotto. Riflette una sfida più ampia: le salvaguardie di sicurezza sono tipicamente progettate attorno alla moderazione dei contenuti e alla prevenzione dei danni, non all'elusione avversaria durante l'analisi tecnica del malware. Quando questi due obiettivi entrano in collisione, gli attaccanti trovano un'apertura.

Perché questo è importante per l'analisi di sicurezza basata sull'AI

I team di sicurezza hanno rapidamente adottato strumenti AI per aiutare a gestire l'enorme volume di file sospetti, tentativi di phishing e script che incontrano ogni giorno. Questi strumenti promettono un triage più rapido e possono individuare schemi che gli analisti umani potrebbero non notare. Ma questo incidente ricorda che i sistemi AI utilizzati nei flussi di lavoro di sicurezza hanno una propria superficie d'attacco, una che il rilevamento malware tradizionale non era stato progettato per anticipare.

Se un modello AI può essere manipolato per saltare o ammorbidire la propria analisi semplicemente perché un file contiene determinate parole trigger, questo rappresenta un punto cieco significativo. Solleva anche domande su quanto le organizzazioni dovrebbero affidarsi all'analisi basata su AI senza supervisione umana, specialmente per decisioni ad alto rischio come stabilire se un file è sicuro da aprire o eseguire.

Questo tipo di tattica si inserisce in uno schema più ampio di attaccanti che adattano le loro tecniche a chiunque, o qualunque cosa, stia facendo da difensore. Proprio come gli operatori di ransomware hanno spostato i loro obiettivi di social engineering verso manager a metà carriera invece che verso i dirigenti, gli autori di malware stanno ora adattando le loro tecniche di elusione ai sistemi specifici, inclusi i modelli AI, che si frappongono tra loro e i loro obiettivi.

Cosa significa questo per te

Per la maggior parte degli utenti individuali, questa tecnica specifica prende di mira l'infrastruttura di sicurezza aziendale piuttosto che i dispositivi personali direttamente. È improbabile che tu incontri questo particolare trucco dello script VBS sul tuo computer in un modo che influisca sulla tua navigazione quotidiana o sulle tue abitudini di posta elettronica. Ma la lezione di fondo si applica ampiamente: gli strumenti automatizzati, che siano scanner malware basati su AI, filtri antispam o software antivirus, non sono infallibili, e gli attaccanti stanno attivamente ricercando modi per sfruttare i loro punti ciechi.

Se il tuo posto di lavoro utilizza strumenti di sicurezza assistiti dall'AI, questo è un buon momento per chiedere come vengono validati tali strumenti e se gli analisti umani rivedono ancora i file segnalati o non segnalati. Per gli individui, il messaggio è più generale: non dare per scontato che, solo perché un file non è stato segnalato da uno scanner automatico, sia automaticamente sicuro. Difese a strati, scetticismo verso script o allegati inaspettati e una corretta igiene della sicurezza rimangono importanti come sempre.

Punti chiave pratici

  • Evita di aprire file VBS non richiesti, script o documenti con macro abilitate, indipendentemente dal fatto che una scansione automatica li abbia dichiarati puliti.
  • Se gestisci strumenti di sicurezza al lavoro, chiedi se l'analisi malware assistita dall'AI include una revisione umana di riserva per i file che attivano rifiuti o scansioni incomplete.
  • Mantieni i livelli di rilevamento tradizionali, come antivirus basato su firme e monitoraggio di rete, insieme ai nuovi strumenti AI, invece di sostituirli completamente.
  • Rimani informato su come gli attaccanti si stanno adattando alle difese basate su AI, poiché tecniche come questa probabilmente evolveranno piuttosto che scomparire.

Mentre l'AI diventa sempre più integrata nei flussi di lavoro della cybersecurity, incidenti come questo mostrano che le salvaguardie progettate per mantenere sicuri i sistemi AI possono diventare anch'esse un bersaglio. Rimanere informati su queste tattiche emergenti e mantenere difese a strati e con revisione umana rimane il modo migliore per stare al passo con attaccanti che cercano costantemente nuove debolezze da sfruttare.