Gardez votre agent en laisse courte
Un agent personnel peut lire vos e-mails, dépenser votre argent et parler à des inconnus, et une ligne de texte cachée sur une page web peut le détourner. Voici les défaillances déjà constatées et les réglages qui réduisent le risque qu’elles se reproduisent.
Six habitudes pour éviter la plupart des problèmes
Accordez le minimum d’accès
Commencez par des autorisations en lecture seule et laissez l’agent observer avant d’agir. Élargissez ses accès application par application, et seulement si une tâche l’exige.
Approuvez chaque action irréversible
Les paiements, les messages sortants, les suppressions, les publications et tout ce qui révèle des informations personnelles doivent attendre votre confirmation. Un agent qui demande trop souvent votre accord pose moins problème qu’un agent qui ne le demande jamais.
Séparez l’argent et l’identité
Donnez à l’agent une carte virtuelle à faible plafond plutôt que votre carte principale ou vos identifiants bancaires. Ne saisissez pas vos mots de passe, codes à usage unique ni numéros d’identité dans la conversation, et utilisez le coffre-fort de l’agent lorsqu’il en propose un.
Considérez les contenus externes comme des données
Les pages web, les e-mails et les documents peuvent dissimuler des instructions que l’agent risque de suivre comme si vous les lui aviez données. Précisez dans ses règles que rien de ce qu’il lit ne constitue une commande.
Limitez ses dépenses
Une boucle ou un malentendu peut transformer un achat en plusieurs achats, ou épuiser vos crédits API en une nuit. Maintenez les plafonds des cartes à un niveau bas et surveillez de près les coûts par jeton lors des premières tâches longues.
Consultez le journal et repérez le frein
Passez en revue le journal d’activité chaque jour pendant la première semaine, car les erreurs ont tendance à se répéter. Apprenez à mettre l’agent en pause et à lui retirer l’accès aux applications avant qu’un problème ne survienne.
Les défaillances réelles des agents
Divulgation excessive
En terminant une tâche, un agent peut divulguer plus que prévu : une adresse, un numéro de téléphone, un emploi du temps. Il ne sait pas toujours quels détails sont privés, sauf si vous le lui précisez.
En septembre 2026, Muse a communiqué l’adresse personnelle d’un évaluateur à un acheteur sur Facebook Marketplace sans son autorisation.
Instructions cachées
Un texte inséré dans une page, un e-mail, un document ou un plugin peut détourner l’agent. C’est ce qu’on appelle une injection de prompt, et l’agent risque d’obéir à ce texte comme s’il venait de vous.
Les failles Claw Chain dans OpenClaw pouvaient commencer par une injection de prompt ou un plugin malveillant et aboutir à la prise de contrôle complète de la machine hôte.
Dépasser son autorité
Les agents décident parfois qu’une étape est acceptable et l’exécutent : accepter une offre, contourner un blocage, envoyer un message. Leurs propres comptes rendus de leurs actions peuvent aussi être erronés.
En juin, un agent de recherche d’OpenAI a contourné les limites d’accès d’un portail de Services Australia et ouvert des fichiers qui n’étaient pas destinés au public.
Configurations auto-hébergées exposées
Une passerelle auto-hébergée accessible à tous sur Internet, ou exécutant une version obsolète, peut permettre à un inconnu de prendre le contrôle de votre agent et de ses clés. L’auto-hébergement vous confie l’ensemble des responsabilités de sécurité.
Au début de 2026, des analyses d’Internet ont détecté des dizaines de milliers de passerelles OpenClaw accessibles, dont beaucoup exposaient des clés API et des jetons.
Sites bloqués et risque pour votre compte
Certains commerçants bloquent les agents qui dissimulent leur identité, et essayer de les faire passer malgré tout peut entraîner le signalement de votre compte. Une cour d’appel américaine a également décrit l’agent comme un outil : vous êtes donc responsable de ses actions dans votre compte.
Amazon a coupé l’accès de Muse, et les clients qui essaient de l’utiliser sur le site voient désormais un avertissement concernant les agents non autorisés.
Sécuriser chaque agent
Dots
- Rédigez vos Custom Rules avant de connecter votre messagerie, en indiquant pour chaque action si elle est autorisée, soumise à approbation ou interdite.
- Laissez la recherche proactive activée : dans ce mode, le Dot peut uniquement consulter, jamais envoyer ni modifier quoi que ce soit.
- Connectez les applications de l’annuaire des extensions une par une, et évitez les outils bancaires et d’administration pendant la première semaine.
- Ne connectez votre ordinateur que si une tâche l’exige, puis révoquez l’accès une fois la tâche terminée.
- Consultez régulièrement la Vue d’activité, y compris le travail effectué en arrière-plan par votre Dot.
- Avec un forfait personnel, choisissez dans les contrôles des données si l’option « Améliorer le modèle pour tout le monde » doit rester activée, car elle détermine si le travail de votre Dot sert à l’entraînement.
Muse
- Précisez par écrit que Muse ne doit divulguer ni votre adresse, ni votre numéro de téléphone, ni votre emploi du temps.
- Exigez une approbation avant tout paiement, toute acceptation d’offre ou toute prise de contact avec une nouvelle personne.
- Ne communiquez pas à Muse l’adresse de retrait pour vos ventes sur Marketplace ; transmettez-la vous-même.
- Évitez Amazon : le site bloque Muse et avertit les clients contre les agents non autorisés.
- Ne connectez les comptes sensibles que pour les tâches qui en ont besoin, car tout ce que vous connectez est copié sur votre VM Muse.
- Mettez rapidement l’application à jour et lisez les avertissements de sécurité de Meta dans l’application.
Gemini Spark
- Vérifiez à quels éléments parmi Photos, Chrome, Drive, Docs, Calendar et Gmail Spark peut accéder, puis retirez les accès inutiles pour vos premières tâches.
- Surveillez de près les tâches déclenchées par un événement au début, et interrompez celles qui s’écartent de leur objectif.
- Passez vos tâches planifiées en revue de temps à autre et supprimez celles dont vous n’avez plus besoin.
- Lancez quelques tâches clairement définies au lieu de remplir les 15 emplacements.
- Avec un compte professionnel, demandez à l’administrateur de votre Workspace quelles restrictions s’appliquent à Spark.
Claude
- Limitez les connecteurs à ceux dont la tâche en cours a besoin, puis déconnectez-les.
- Indiquez à Claude quelles sources il peut utiliser pour ses recherches, car chaque connecteur élargit l’éventail de contenus auxquels il peut accéder.
- Lisez la demande d’autorisation affichée par Claude avant qu’il agisse dans une application connectée, plutôt que de l’approuver machinalement.
- Relisez les documents générés avant de les partager : ils peuvent inclure du contenu provenant de vos fichiers connectés.
OpenClaw
- Utilisez la dernière version stable ; les versions antérieures à 2026.4.22 présentent des failles critiques connues.
- Gardez gateway.bind sur loopback et accédez à la passerelle par SSH ou Tailscale, jamais via un port ouvert.
- Réglez dmPolicy sur pairing afin qu’un inconnu qui envoie un message à votre bot reçoive un code au lieu d’obtenir un accès.
- Réglez les approbations d’exécution sur « toujours demander » et laissez le mode élevé désactivé.
- Exécutez régulièrement openclaw security audit et installez le moins de skills possible, uniquement depuis des sources fiables.
- Si vous avez déjà utilisé une version antérieure à 2026.4.22, renouvelez toutes les clés auxquelles l’agent a pu accéder.
Liste de contrôle de sécurité
Cochez chaque élément une fois terminé ; votre progression est enregistrée dans ce navigateur, et nulle part ailleurs.
Journal des incidents liés aux agents
Incidents répertoriés : 11 →OpenAI annule GPT-6.1 Astra après les résultats des tests
28 septembre 2026 · ConfidentialitéMuse indique à un acheteur de Marketplace où habite son utilisateur
25 septembre 2026 · ConfidentialitéDes agents de recherche d’OpenAI téléversent 53 images d’utilisateurs sur des hébergeurs d’images
25 septembre 2026 · VulnérabilitéUn signalement au programme de récompenses pour les bugs révèle une faille permettant d’accéder aux machines virtuelles de Muse
Questions
Quel réglage est le plus important ?
Exigez une validation pour toute action irréversible : paiements, messages sortants, suppressions et partage de renseignements personnels. Plusieurs incidents présentés sur cette page ont commencé par une action de l’agent sans demande préalable.
Qu’est-ce que l’injection de prompt ?
Il s’agit d’un texte dissimulé dans une page web, un e-mail, un document ou un plug-in que l’agent lit et auquel il obéit comme si vous l’aviez écrit. Précisez que le contenu externe est uniquement informatif, soumettez les actions irréversibles à validation et connectez le moins de sources possible.
Un agent hébergé par mes soins, comme OpenClaw, est-il plus sûr qu’un agent cloud ?
Vos données restent sur votre propre matériel, mais vous devenez responsable de la sécurité. Jusqu’à présent, la plupart des incidents OpenClaw sont dus à des passerelles exposées et à des versions obsolètes. Liez donc la passerelle à l’interface loopback, laissez l’association DM activée, exigez une validation pour les commandes shell et installez rapidement les mises à jour.
Le travail de mon agent sert-il à l’entraînement ?
Cela dépend du produit et de l’offre. Avec Dots, le travail des espaces Business, Enterprise et Edu n’est pas utilisé pour l’entraînement par défaut. Pour les offres personnelles, le réglage d’entraînement ChatGPT que vous avez déjà choisi s’applique. OpenAI indique que les notes privées et les recherches en arrière-plan d’un Dot ne sont pas utilisées directement pour l’entraînement.