Action sensible sans validation humaine
Le piège n° 1. Paiement, envoi email, modification de fichier critique : sans validation humaine, vous signez en aveugle.
Quatre agents asynchrones 2026, cinq garde-fous non négociables. L'agent autorisé n'est pas l'agent en roue libre.
En 2026, les 4 IA grand public ont leur agent asynchrone. Le défi technique de 2024 est résolu. Le défi 2026 est juridique et financier.
Promesse
Vous saurez choisir un agent IA autonome pour 4 cas pro et appliquer 5 garde-fous non négociables avant tout déploiement.
Pourquoi maintenant
Les 4 IA grand public ont leur agent asynchrone disponible : ChatGPT mode agent (17 juillet 2025), Claude Computer Use (bêta publique depuis le 22 octobre 2024), Gemini Agent (3.1 Pro, héritier de Project Mariner fermé le 4 mai 2026, avec Gemini Live pour le temps réel), Vibe Work Mode (Mistral, 28 mai 2026 avec agents asynchrones de codage).
Le défi technique de 2024 (« est-ce qu'un agent peut vraiment naviguer le web et cliquer ») est résolu. Le défi 2026 est ailleurs : cadrer un agent qui exécute des actions réelles, avec quels garde-fous, et comment réagir au cumul des sanctions RGPD (jusqu'à 4 % du CA mondial) et AI Act (jusqu'à 7 % du CA pour les pratiques interdites, 3 % pour les manquements aux obligations) en cas d'exfiltration de données par un agent mal configuré.
Le concept central
Agent IA = LLM + outils + boucle d'exécution + garde-fous.
Ce n'est pas un chatbot. Un chatbot reçoit une question, génère une réponse, s'arrête. C'est une transaction.
Ce n'est pas un workflow Zapier qui exécute des étapes pré-définies. Un workflow déclenche les mêmes 5 étapes dans le même ordre à chaque exécution. Il est déterministe.
Un agent décompose un objectif en sous-tâches, choisit ses outils (navigation web, appel API, lecture fichier, écriture commande), exécute, observe, ajuste, recommence si nécessaire. Il est non déterministe par construction. C'est précisément ce qui le rend puissant pour les tâches non spécifiables a priori. Et précisément ce qui le rend dangereux sans garde-fous explicites.
Panorama 2026
Chaque agent a sa zone de force. Choisir hors de cette zone, c'est compliquer un cas qui irait sur un autre outil.
OpenAI · GPT-5.6 · USA
Anthropic · Opus 5 · USA
Google · 3.1 Pro · USA
Mistral · Medium 3.5 · France
Vibe mode Work est le seul agent souverain en 2026 (juridiction FR, hébergement européen conservé). Pour les contenus sensibles ou les organisations soumises à RGPD strict, c'est le défaut à considérer.
Atelier
Pour chaque cas pro, sélectionnez l'agent IA le mieux placé en 2026.
| Usage | ChatGPT mode agent (GPT-5.6) | Claude Computer Use (Opus 5) | Gemini Agent (3.1 Pro) | Vibe mode Work (Mistral 3.5) |
|---|---|---|---|---|
| Planification déjeuner pro avec recherche restaurants et réservation web | ||||
| Code review automatique sur un dépôt Git avec exécution de tests | ||||
| Reporting hebdomadaire avec collecte multi-fichiers locaux et capture écran apps métier | ||||
| Recherche web complexe en temps réel avec analyse caméra ou écran partagé |
Méthode
Avant tout déploiement, ces cinq points doivent être écrits noir sur blanc. Si une case est vide, vous n'êtes pas prêt à déployer.
Ce que l'agent peut faire ET ne peut pas faire. Kill-switch documenté. Validation humaine hors périmètre.
Paiement, envoi email, modification fichier, action irréversible : humain dans la boucle, non négociable.
Chaque action tracée et auditable : requête, URL, outil, réponse, décision. Sans logs, pas de contrôle CNIL.
Budget tokens et appels API mensuel défini. Circuit breaker automatique. Une boucle = 50 € en 30 min.
Avant déploiement : 4 questions du module Lucidité opérationnelle. L'agent durcit ces questions, ne les supprime pas.
Exemple de périmètre explicite : « tu peux rechercher des restaurants, comparer les avis, proposer 3 options. Tu ne peux PAS confirmer une réservation, payer un acompte, ou contacter le restaurant directement. » Sans ce double cadre, vous avez un agent qui peut tout, donc qui peut tout casser.
Risques documentés
Fraude au deepfake : autour de 900 millions d'euros de pertes dans le monde en 2025, un montant qui a triplé en un an. En France, les mesures disponibles portent sur la progression, pas sur un montant national : les tentatives ont bondi d'environ 700 % entre le premier trimestre 2024 et le premier trimestre 2025. Méfiez-vous des chiffres mondiaux présentés comme français, l'écart est d'un ordre de grandeur. Une attaque vocale par deepfake coûte moins de 50 € à produire, et un agent IA qui déclenche un virement sur la base d'un appel entrant est le cas d'école de 2026.
Cumul RGPD + AI Act : sanctions RGPD jusqu'à 4 % du CA mondial, AI Act jusqu'à 7 % du CA pour les pratiques interdites et 3 % pour les manquements aux obligations (règlement UE 2024/1689, art. 99), exécutoires depuis le 2 août 2026. Un agent qui exfiltre des données personnelles engage toute la chaîne : éditeur du LLM, intégrateur, organisation utilisatrice. La CNIL a fixé ses priorités 2026 le 3 avril : recrutement et IA en tête. Un agent RH mal cadré est une cible directe.
À éviter
Le piège n° 1. Paiement, envoi email, modification de fichier critique : sans validation humaine, vous signez en aveugle.
Sans traces, impossible d'auditer après incident. La CNIL ou votre DPO ne peuvent pas répondre à un contrôle.
Sans circuit breaker, un agent en boucle peut générer 50 € de tokens en 30 minutes. À l'échelle d'une équipe, le risque est mensuel.
Faux. Un agent est plus flexible mais moins prévisible. Pour une tâche stable, un workflow Zapier ou n8n reste supérieur.
Une extension agentique hérite de vos cookies. Une instruction cachée dans un mail ou une page atteint alors votre messagerie et votre stockage, sans un seul clic de votre part.
Exemple complet
Le besoin. Une responsable marketing veut un dossier hebdomadaire sur cinq concurrents : annonces produit, levées de fonds, changements de prix, recrutements notables.
Ce que fait l'agent. Il part d'un objectif, pas d'une liste d'étapes. Il cherche, ouvre les pages, recoupe, et rend un document sourcé. C'est exactement le cas où un agent bat un workflow déterministe : la liste des sources n'est pas connue à l'avance.
Les cinq garde-fous, appliqués :
Plafond de coût. 8 € par exécution, coupure automatique au-delà. Sans plafond, une boucle de recherche mal cadrée consomme un budget mensuel en une nuit.
Périmètre d'action. Lecture web seule. Aucun accès en écriture, aucun envoi d'e-mail, aucun accès aux outils internes.
Traçabilité. Chaque affirmation du dossier porte son URL source. Sans cela, l'agent produit un texte plausible et invérifiable.
Point de contrôle humain. Le dossier part en brouillon, jamais en diffusion directe à la direction.
Critère d'arrêt. Vingt minutes maximum, puis l'agent rend ce qu'il a, même incomplet.
Le garde-fou le plus souvent oublié est le critère d'arrêt. Un agent sans limite de temps ni de profondeur continue à chercher tant qu'il trouve des liens. Ce n'est pas une hypothèse d'école, c'est le mode d'échec le plus fréquent en production.
8 questions. 60 % de bonnes réponses pour valider la leçon.
Synthèse
Mise en pratique
Identifiez 1 cas pro où vous envisagez de déployer un agent IA dans les 3 mois. Pour ce cas, écrivez : (1) le périmètre explicite (peut faire / ne peut pas faire), (2) les actions qui exigent validation humaine, (3) le format de log à conserver, (4) le plafond de coût mensuel, (5) la réponse aux 4 questions de la boussole de décision.
Critère de réussite : votre note d'1 page tient sur 5 sections claires. Si une section est vide ou floue, vous n'êtes pas prêt à déployer.
Un modèle de langage doté d'outils, d'une boucle d'exécution et de garde-fous. C'est ce qui le distingue d'un chatbot, transactionnel, et d'un workflow, déterministe.
Pas sur les tâches stables : un workflow déterministe sous Zapier ou n8n reste supérieur. L'agent complète, il ne remplace pas. Cinq garde-fous s'imposent : périmètre, validation humaine, journalisation, plafond de coût, boussole de décision.
Non, il est plus flexible et moins prévisible. Sur une tâche stable et répétitive, un workflow déterministe gagne à tous les coups : il fait la même chose à chaque exécution. L'agent sert quand le chemin ne peut pas être écrit à l'avance.
Trois au minimum : un périmètre d'actions autorisées, un budget d'étapes et de dépense qui l'arrête tout seul, et un point de validation humaine avant tout effet irréversible. Un agent sans limite de boucle finit toujours par en trouver une, à vos frais.
Votre organisation, comme pour tout contenu qu'elle diffuse. Le fournisseur du modèle n'a aucune obligation envers vos clients. C'est la raison pour laquelle un agent qui écrit à l'extérieur demande une validation humaine, pas une simple journalisation.
Plus qu'un agent distant, oui. Elle agit dans vos sessions déjà ouvertes et hérite de vos cookies : messagerie, stockage, banque. En août 2026, Zenity Labs a montré qu'un simple courriel suffisait à détourner cinq navigateurs agentiques sans le moindre clic de la victime. La parade tient en une règle : un profil de navigateur dédié à l'agent, déconnecté de tout ce qui compte.