Le téléphone sonne, l'interlocuteur affirme appeler de la part d'une agence de cybersécurité. La voix est calme, compétente et pressante : votre ordinateur serait peut-être touché par un logiciel malveillant connu, vous devez installer immédiatement un outil de diagnostic. Ce qui était autrefois un appel frauduleux soigneusement préparé peut aujourd'hui être mené par un agent IA - de manière autonome, convaincante et des centaines de fois en parallèle.
Les voix deepfake ne sont pas un sujet nouveau. Ce qui est nouveau, c'est que l'IA ne fournit plus seulement une voix : elle mène toute la conversation. Elle répond aux questions, repère l'hésitation, rassure, met la pression et adapte ses arguments. Le social engineering s'en trouve profondément transformé - en entreprise comme sur le téléphone privé.
Le Cyber Snack d'août rend précisément cela concret : il montre comment une attaque menée par des agents IA peut se dérouler, pourquoi elle se démultiplie si facilement et quelles règles simples protègent les collaborateurs et les familles.
Vraie voix ou IA ? Au téléphone, presque impossible à distinguer
Dans le Cyber Snack, vous écoutez quatre voix et devez deviner laquelle est générée par l'IA. La réponse : les quatre. C'est précisément le problème. Les modèles vocaux actuels produisent des voix avec une intonation naturelle, de petites pauses et l'émotion adaptée. Au téléphone, avec la légère distorsion de la ligne, la différence se remarque encore moins.
Nous avons déjà montré dans notre Impuls Réunions en ligne à quel point de fausses voix et de faux visages peuvent être efficaces - notamment avec le cas Arup, où un employé à Hong Kong a viré environ 25 millions de dollars américains après une visioconférence avec de faux collègues. À l'époque, l'attaque reposait encore sur beaucoup de préparation humaine. Avec les agents IA, cet effort disparaît.
Comment une telle attaque peut se dérouler
Un appel d'apparence officielle, une demande urgente, un téléchargement - l'attaque n'a besoin de rien de plus.
Le contexte est bien réel : en septembre 2025, Mandiant et le Google Threat Intelligence Group ont révélé BRICKSTORM, une porte dérobée utilisée par des attaquants présumés liés à la Chine pour espionner notamment des cabinets d'avocats, des fournisseurs SaaS et des entreprises technologiques. Elle se logeait surtout sur des équipements réseau et des serveurs VMware, là où la sécurité classique des postes de travail ne voit presque rien, et restait en moyenne indétectée plus d'un an. En décembre 2025, l'agence américaine CISA, la NSA et le Centre canadien pour la cybersécurité ont publié une analyse commune.
Ce type de gros titres est un prétexte idéal pour les fraudeurs. Le Cyber Snack le met en scène dans un scénario réaliste : un employé d'un bureau new-yorkais commence sa journée normalement. Puis le téléphone sonne. Un prétendu agent de la CISA se présente, calme et crédible : « Nous avons des indices que votre ordinateur pourrait être touché par BRICKSTORM. Restez en ligne, nous devons empêcher le logiciel malveillant de se propager. »
L'employé connaît les articles de presse. L'appel ressemble à de l'aide, pas à une attaque - et c'est précisément ainsi que commence la manipulation. On lui demande de télécharger un « outil de diagnostic ». Il s'exécute. Ce qu'il installe n'est pas l'aide d'une autorité, mais un logiciel malveillant. Le détail décisif : au bout du fil, il n'y avait pas d'humain, mais un agent IA.
La question décisive n'est plus : « Cette voix paraît-elle réelle ? » Mais : « Est-ce que je respecte le processus - aussi réelle qu'elle paraisse ? »
Ce qui est vraiment nouveau avec les agents IA
Un agent IA peut mener de nombreuses conversations en même temps. La cible, c'est celui qui décroche.
Autrefois, les appels deepfake reposaient surtout sur des extraits audio préparés ou sur des voix pilotées en direct par un humain. C'était laborieux. Ces attaques visaient donc surtout des personnes choisies : celles qui gèrent un budget, accèdent à des données confidentielles ou peuvent influer sur des paiements.
Un agent IA fonctionne autrement. L'attaquant se contente de fixer un objectif, par exemple : « Amène la personne à télécharger un outil de diagnostic. » L'IA trouve elle-même le chemin. Elle repère le scepticisme, explique patiemment, met la pression au bon moment, flatte ou menace - selon ce qui fonctionne avec son interlocuteur. C'est l'IA agentique : elle poursuit un objectif et agit de manière autonome pour l'atteindre.
La différence décisive, c'est l'échelle. Autrefois, un social engineer passait chaque appel lui-même, l'un après l'autre. Aujourd'hui, un agent IA peut mener des centaines de conversations en parallèle. La cible n'est alors plus une personne précise, mais n'importe qui décroche, est stressé et clique. Le social engineering devient plus rapide, moins cher et industrialisable.
Ce n'est pas de la science-fiction. Dès octobre 2024, des chercheurs de l'University of Illinois ont montré que des agents IA dotés de la parole peuvent mener seuls des escroqueries téléphoniques courantes - pour un coût moyen inférieur à un dollar américain par tentative. En avril 2026, Abnormal Security a décrit ATHR, une plateforme vendue dans l'univers cybercriminel, sur laquelle un agent vocal IA mène automatiquement des appels de vishing et un seul opérateur pilote de nombreuses conversations à la fois. Et en mai 2025, le FBI a mis en garde contre une campagne dans laquelle des criminels imitaient de hauts responsables du gouvernement américain à l'aide de messages vocaux générés par IA.
La vraie CISA met elle aussi en garde contre les faux appels de la CISA
Le scénario du Cyber Snack est fictif, mais la méthode qui le sous-tend ne l'est pas. Dès juin 2024, l'agence américaine CISA a publiquement mis en garde contre des escrocs se faisant passer pour ses employés au téléphone. Son conseil : les vrais employés de la CISA ne demandent jamais de virement, d'espèces, de cryptomonnaies ou de cartes cadeaux - et ne demandent jamais de garder la conversation secrète.
Pas seulement les entreprises : familles et enfants dans le viseur
Vous pensez peut-être : cela concerne les entreprises, pas moi en tant que particulier. Malheureusement si. Les agents IA peuvent imiter des autorités, des écoles, des clubs ou des personnes connues - aussi sur le téléphone privé. Et ils n'appellent pas seulement des adultes.
Imaginez que votre enfant reçoive un appel, prétendument de la police : « Tes parents ont eu un accident. Il y a quelqu'un à la maison ? Comment pouvons-nous joindre ta famille ? » Ou bien l'agent se fait passer pour un enseignant, une entraîneuse ou un ami de la famille et demande l'adresse, l'emploi du temps, des noms, les projets de vacances ou si l'enfant est seul. Les enfants et les adolescents sont particulièrement vulnérables lorsqu'une voix paraît adulte, officielle et pressante.
Plus un appel paraît authentique et urgent, plus il est difficile de garder son calme. C'est exactement ce qu'exploitent les fraudeurs. Un agent IA ne s'impatiente jamais. Il répète, rassure, menace ou flatte aussi longtemps qu'il le faut, jusqu'à ce que quelque chose fonctionne.
Cinq règles face aux appels suspects
La bonne nouvelle : la meilleure protection n'est pas technique, elle est humaine et informée. Celui qui connaît les règles suivantes n'a pas besoin de deviner si une voix est réelle. Il lui suffit de suivre le processus.
1. Les autorités n'appellent pas par surprise en mettant la pression
Les véritables autorités utilisent des canaux officiels et des moyens de contact connus. Un appel inattendu et pressant exigeant une action immédiate est un signal d'alerte.
2. Pas d'accès à distance, pas de logiciel, pas d'identifiants
Les organismes sérieux ne demandent jamais par téléphone un accès à distance, l'installation d'un logiciel ou des identifiants confidentiels. Ne rien cliquer, ne rien installer, ne donner aucun accès.
3. Ne pas discuter, raccrocher
Un agent IA a une réponse à chaque objection. Ne vous laissez pas entraîner dans une discussion. Mettez fin à l'appel poliment mais fermement.
4. Rappeler soi-même via un numéro officiel
Cherchez le numéro vous-même, par exemple sur le site officiel ou sur l'intranet. Ne composez jamais le numéro donné par l'appelant - il peut être aussi faux que son histoire.
5. Signaler, même s'il ne s'est rien passé
En entreprise, chaque appel de ce type doit être signalé à la sécurité informatique - même si vous n'avez rien cliqué. Ainsi, vos collègues peuvent être avertis à temps.
Code familial et jeux de rôle : comment protéger vos enfants
Un code familial convenu protège là où la voix seule n'est plus fiable.
Les familles disposent d'un outil simple mais très efficace : un code familial. Il s'agit d'un mot secret ou d'une courte phrase connus uniquement de la famille et de quelques personnes de confiance - par exemple « Panda bleu » ou « Opération Kiwi ». Toute personne qui appelle au nom de la famille et réclame quelque chose en urgence doit pouvoir donner le code. Sinon, l'appel est terminé.
Il est important que les enfants sachent comment réagir lorsque quelqu'un demande leur adresse, leur école, des mots de passe ou veut savoir s'ils sont seuls :
Dire stop et ne pas paniquer.
Demander le code familial.
Mettre fin à l'appel.
Appeler soi-même ses parents ou une personne de confiance connue.
Ne jamais agir dans la précipitation - même si la voix paraît officielle.
Le meilleur moyen de s'entraîner, ce sont de petits jeux de rôle. Un parent joue l'escroc, l'enfant s'exerce : rester calme, demander le code, raccrocher et appeler lui-même ses parents. Il ne s'agit pas d'être parfait, mais de marquer une pause au lieu de répondre automatiquement.
Ce que les équipes awareness devraient en retenir
Pour les CISOs et les responsables awareness, la leçon principale est la suivante : au téléphone, on ne peut plus répondre de manière fiable à la question « Cette voix est-elle réelle ? ». Les formations qui misent sur la détection des deepfakes ne suffisent donc plus. Des procédures claires et simples, efficaces quel que soit le degré de conviction de l'appelant, sont plus utiles.
Cela implique : les collaborateurs ont besoin d'un numéro officiel facile à trouver pour vérifier, de l'autorisation explicite d'éconduire même des appelants prétendument haut placés, et d'un canal de signalement simple - y compris pour les appels où rien ne s'est passé. Chaque signalement aide à repérer tôt une vague en cours et à avertir les collègues.
Notre Impuls Ransomware montre à quel point un seul « outil » installé peut rapidement devenir un incident de sécurité grave. Et la question centrale de Services en ligne et outils d'IA s'applique aussi ici : quelles informations est-ce que je transmets - et à qui, au juste ?
Conclusion
Les agents IA ne sont pas dangereux en soi. Mais entre les mains de fraudeurs, ils rendent le social engineering plus rapide, plus crédible et plus industrialisable. Une voix, une autorité, un téléchargement urgent - il n'en faut pas plus si personne ne marque de pause.
Ne faites pas aveuglément confiance à la voix. Faites confiance au processus : ne pas discuter, ne rien cliquer, raccrocher, rappeler via un canal officiel et signaler l'incident dans l'entreprise.
Sources
Google Threat Intelligence Group / Mandiant, 24 septembre 2025 : « Another BRICKSTORM: Stealthy Backdoor Enabling Espionage into Tech and Legal Sectors » ; CISA, NSA et Centre canadien pour la cybersécurité, 4 décembre 2025 : Malware Analysis Report « BRICKSTORM Backdoor » (AR25-338A).
CISA, 12 juin 2024 : alerte concernant des escrocs se faisant passer par téléphone pour des employés de la CISA.
FBI / IC3, 15 mai 2025 : Public Service Announcement « Senior US Officials Impersonated in Malicious Messaging Campaign » (I-051525-PSA).
Fang, Bowman, Kang et al. (University of Illinois Urbana-Champaign), octobre 2024 : « Voice-Enabled AI Agents can Perform Common Scams », arXiv:2410.15650 ; Abnormal Security, 16 avril 2026 : « AI Meets Voice Phishing: How ATHR Automates the Full TOAD Attack Chain ».