Des hackers russes utilisent les garde-fous de sécurité de l'IA contre les outils de sécurité

Une campagne de malware récemment signalée, liée à des hackers russes, a adopté une approche inhabituelle pour échapper à la détection : intégrer une fausse requête d'arme nucléaire dans un script VBS malveillant. L'objectif n'est pas de construire une arme, mais de confondre les systèmes d'IA de plus en plus utilisés pour analyser les codes suspects. En insérant un langage qui imite une demande d'informations sur les armes nucléaires, les attaquants semblent tenter de déclencher les garde-fous de sécurité intégrés aux modèles d'IA, amenant ces systèmes à refuser de traiter ou d'analyser complètement le fichier.

Cette tactique met en lumière une tension croissante dans la cybersécurité : alors que de plus en plus d'équipes de sécurité s'appuient sur des outils d'IA pour trier et analyser les malwares à grande échelle, les attaquants apprennent à exploiter les mécanismes de sécurité mêmes conçus pour rendre ces outils fiables.

Comment fonctionne l'astuce de la requête d'arme nucléaire

Les garde-fous de sécurité de l'IA existent pour de bonnes raisons. Les grands modèles de langage sont entraînés à refuser les demandes qui pourraient faciliter des préjudices dans le monde réel, y compris les instructions détaillées liées aux armes de destruction massive. Lorsqu'un outil de sécurité assisté par IA analyse un fichier, il lit généralement le contenu, y compris tout texte intégré, dans le cadre de son processus d'analyse.

En plaçant un langage ressemblant à une requête d'arme nucléaire dans le script VBS, les hackers semblent compter sur le comportement de refus intégré du modèle d'IA. Plutôt que de signaler le fichier comme malware, l'IA peut s'arrêter net, refuser de poursuivre l'analyse, ou produire une évaluation incomplète ou peu fiable. En effet, le contenu malveillant devient une sorte de leurre, utilisant la propre formation éthique de l'IA contre elle.

Ce n'est pas une faille propre à un fournisseur ou un produit. Cela reflète un défi plus large : les garde-fous de sécurité sont généralement conçus autour de la modération de contenu et de la prévention des préjudices, et non de l'évasion adverse lors d'une analyse technique de malware. Lorsque ces deux objectifs entrent en collision, les attaquants trouvent une ouverture.

Pourquoi cela importe pour l'analyse de sécurité assistée par IA

Les équipes de sécurité ont rapidement adopté des outils d'IA pour trier le volume considérable de fichiers suspects, de tentatives de hameçonnage et de scripts qu'elles rencontrent quotidiennement. Ces outils promettent un tri plus rapide et peuvent signaler des schémas que les analystes humains pourraient manquer. Mais cet incident rappelle que les systèmes d'IA utilisés dans les flux de travail de sécurité comportent leur propre surface d'attaque, que la détection traditionnelle de malwares n'a pas été conçue pour anticiper.

Si un modèle d'IA peut être manipulé pour sauter ou atténuer son analyse simplement parce qu'un fichier contient certains mots déclencheurs, cela représente une zone d'ombre significative. Cela soulève également des questions sur la mesure dans laquelle les organisations devraient s'appuyer sur l'analyse pilotée par l'IA sans supervision humaine, en particulier pour les décisions à fort enjeu comme déterminer si un fichier est sûr à ouvrir ou à exécuter.

Ce type de tactique s'inscrit dans un schéma plus large d'attaquants qui adaptent leurs techniques à qui, ou quoi, assure la défense. Tout comme les opérateurs de ransomwares ont déplacé leurs cibles d'ingénierie sociale vers les managers en milieu de carrière plutôt que les cadres dirigeants, les auteurs de malwares adaptent désormais leurs techniques d'évasion aux systèmes spécifiques, y compris les modèles d'IA, qui se dressent entre eux et leurs cibles.

Ce que cela signifie pour vous

Pour la plupart des utilisateurs individuels, cette technique spécifique cible l'infrastructure de sécurité des entreprises plutôt que directement les appareils personnels. Il est peu probable que vous rencontriez cette astuce de script VBS particulière sur votre propre ordinateur d'une manière qui affecte votre navigation quotidienne ou vos habitudes de courriel. Mais la leçon sous-jacente s'applique largement : les outils automatisés, qu'il s'agisse de scanners de malwares basés sur l'IA, de filtres anti-spam ou de logiciels antivirus, ne sont pas infaillibles, et les attaquants recherchent activement des moyens d'exploiter leurs zones d'ombre.

Si votre lieu de travail utilise des outils de sécurité assistés par IA, c'est un moment utile pour demander comment ces outils sont validés et si des analystes humains examinent encore les fichiers signalés ou non signalés. Pour les individus, la leçon est plus générale : ne supposez pas que parce qu'un fichier n'a pas été signalé par un scanner automatisé, il est automatiquement sûr. Les défenses en couches, le scepticisme envers les scripts ou pièces jointes inattendus, et une hygiène de sécurité de base restent aussi importants que jamais.

Points clés à retenir

  • Évitez d'ouvrir des fichiers VBS non sollicités, des scripts ou des documents avec macros activées, qu'un scan automatisé les ait ou non déclarés sûrs.
  • Si vous gérez des outils de sécurité au travail, demandez si l'analyse de malwares assistée par IA inclut un examen humain de secours pour les fichiers qui déclenchent des refus ou des analyses incomplètes.
  • Maintenez les couches de détection traditionnelles, comme l'antivirus basé sur les signatures et la surveillance du réseau, en place aux côtés des outils d'IA plus récents plutôt que de les remplacer entièrement.
  • Restez informé sur la façon dont les attaquants s'adaptent aux défenses pilotées par l'IA, car des techniques comme celle-ci sont susceptibles d'évoluer plutôt que de disparaître.

Alors que l'IA s'intègre de plus en plus dans les flux de travail de cybersécurité, des incidents comme celui-ci montrent que les garde-fous destinés à maintenir les systèmes d'IA sûrs peuvent également devenir une cible en soi. Rester informé de ces tactiques émergentes, et maintenir des défenses en couches et examinées par des humains, reste le meilleur moyen de garder une longueur d'avance sur les attaquants qui sondent constamment à la recherche de nouvelles faiblesses à exploiter.