“Monde Immersif”, nouvelle technique de détournement des IA

Le groupe de renseignement sur les cybermenaces Cato CRTL a alerté sur le manque de garde-fous chez les IA génératives de DeepSeek, Microsoft Copilot et OpenAI. À l’aide d’un prompt narratif, un chercheur a réussi à faire produire aux modèles des logiciels malveillants.

Publié et mis à jour le 19 mars 20252 min de lecture
“Monde Immersif”, nouvelle technique de détournement des IA

Les mots justes, Vitaly Simonovich a su les trouver. Chercheur pour le groupe de renseignement sur les cybermenaces Cato CRTL, il a su convaincre les outils d’IA générative de développer des logiciels malveillants capables de voler des identifiants de connexion à Google Chrome. “Notre nouvelle technique de jailbreak LLM, détaillée dans notre rapport sur les menaces “Cato CTRL 2025”, aurait dû être bloquée par des garde-fous. Ce ne fut pas le cas. Il a été possible d'utiliser à mauvais escient les services de ChatGPT, Copilot et DeepSeek”, a déclaré Etay Maor, le responsable stratégique de la sécurité chez Cato Networks. Ni DeepSeek, ni OpenAI, ni Microsoft n’ont répondu au rapport concernant la découverte, tandis que Google a refusé d’examiner le code de l’infostealer obtenu par les modèles d’IA.

Une ingénierie narrative...

Le “Monde Immersif”, c’est la méthode de jailbreaking découverte consistant à créer un univers fictif détaillé, dans lequel chaque outil d’IA générative joue un rôle. Chacun a des tâches et des défis assignés. Cette ingénierie narrative permet de contourner les contrôles de sécurité des LLM et de normaliser les opérations restreintes. En fin de compte, le chercheur a réussi à amener les modèeles de créer des infostealers. « Les infostealers jouent un rôle significatif dans le vol d'identifiants en permettant aux acteurs de la menace de pénétrer dans les entreprises. Notre nouvelle technique de jailbreak LLM, que nous avons découverte et nommée Monde Immersif, montre le potentiel dangereux de la facilité de création d'un infostealer », a déclaré Vitaly Simonovich.

... pour un hack à portée de prompt

“Les obstacles à la création de logiciels malveillants s'amenuisent considérablement avec les outils d’IA générative », déplore le chercheur. Dorénavant, il est possible de développer des infostealers, en utilisant uniquement des outils disponibles librement et sans aucune connaissance en logiciels malveillants. Les chatbots d’IA sont la nouvelle boîte à outil des hackers, conclut le rapport “Cato CRTL 2025”. Pour les responsables de la sécurité de l’information, cela signifie plus de risques de cyberattaques.

Cela pourrait aussi vous intéresser : Quand les meilleures IA trichent pour gagner

Autres articles

De la démonstration au déploiement : l'essor de l'IA physique

Chronique

De la démonstration au déploiement : l'essor de l'IA physique

L'IA physique sort du stade de la démonstration. La question n'est plus de savoir si les robots peuvent accomplir des prouesses, mais s'ils peuvent fonctionner de manière sûre, fiable et rentable au cœur d'opérations réelles.

Cybersécurité : Anthropic espère que son nouveau Claude Opus 5 sera moins problématique

Confiance numérique

Cybersécurité : Anthropic espère que son nouveau Claude Opus 5 sera moins problématique

Anthropic a mis en ligne vendredi un nouveau modèle d'intelligence artificielle (IA), Claude Opus 5, présenté comme moins susceptible de dérives et plus difficile à détourner pour des attaques informatiques.

Auzeville, VMware, Broadcom : vingt ans de choix qui ont verrouillé l’Éducation nationale

Chronique

Auzeville, VMware, Broadcom : vingt ans de choix qui ont verrouillé l’Éducation nationale

Fin 2023, Broadcom rachète VMware. En 2024, la restructuration unilatérale des licences frappe de plein fouet les grands comptes publics. Jacky Galicher revient sur son expérience au sein de l'Éducation nationale.

Dassault Systèmes actualise sa stratégie de décarbonation avec un objectif "zéro émission nette" d’ici 2050

Numérique responsable

Dassault Systèmes actualise sa stratégie de décarbonation avec un objectif "zéro émission nette" d’ici 2050 

L'éditeur de logiciel a obtenu la validation de la Science Based Targets initiative (SBTi) pour son nouvel objectif de neutralité carbone à horizon 25 ans. 

Numérique responsable : les livres clés pour s’inspirer et agir

Conseil lecture

Numérique responsable : les livres clés pour s’inspirer et agir

Pour l’été, nous vous proposons de lire (ou relire) une sélection d'essais, romans de science-fiction, ressources opérationnelles et réflexions philosophiques, consacrées aux défis du numérique responsable.


Préférences de consentement