Aller au contenu
Integration

Kimi WebBridge permet aux agents de piloter votre navigateur : 3 garde-fous pour les agents de navigation locaux

| 7 min read

Moonshot AI a livré une extension Chrome/Edge qui confie le volant à un agent IA sans envoyer de sessions vers le cloud. Une couche de stratégie de 50 lignes qui vérifie chaque URL par phishing, développe les raccourcisseurs et analyse les formulaires PII soumis avant leur déclenchement.

Laptop browser representing a local AI agent driving Chrome via Kimi WebBridge
Photo by Sigmund on Unsplash

Moonshot AI a livré Kimi WebBridge en mai 2026 : une extension Chrome et Edge qui permet à une IA agent pilote votre navigateur. Il clique, fait défiler, remplit des formulaires et parcourt des flux en plusieurs étapes. Contrairement à Agents de navigateur rendus dans le cloud, WebBridge s'exécute dans votre propre session de navigateur. Vos cookies, votre sessions, votre stockage local ; le cloud voit le raisonnement de l'agent mais pas votre état d'authentification.

Ce modèle supprime une véritable classe de risque (aucun jeton de session ne quitte jamais votre machine) et crée une nouvelle (l'agent hérite de chaque session authentifiée que vous avez). S'il fait suite à une redirection chaîne à un récolteur d'informations d'identification, le récolteur ne voit pas l'adresse IP de Moonshot ; il voit le vôtre, avec vos cookies ci-joints.

Le correctif n'est pas "ne pas utiliser d'agents de navigation". Le correctif est une fine couche de politique qui enveloppe le les primitives de navigation, de clic et de soumission de l'agent, exécute trois vérifications au bon moment et renvoie des verdicts structurés d'autorisation ou de refus. Voici les 50 lignes et les trois appels API qui importe.

Où les agents de navigation se trompent

Mode de défaillance Déclenchement Point de capture
Domaine similaire L'agent lit un lien de phishing à partir du contenu de la page Vérification du phishing lors de la navigation
L'URL raccourcie masque la destination L'agent suit bit.ly à partir d'un chat ou d'un document URL développée avant de naviguer
Formulaire de soumission des fuites d'informations personnelles L'agent remplit un formulaire avec des valeurs suggérées automatiquement Analyse PII lors de la soumission de la charge utile
Remplissage automatique du presse-papiers Le gestionnaire de mots de passe remplit le mauvais champ Analyser les informations personnelles dans le presse-papiers avant de les coller
Clic sur l'écran de consentement L'agent clique sur « Autoriser » sur un flux de consentement malveillant Liste verte des hôtes du fournisseur OAuth

Chaque ligne se résout en un appel d'API à un moment donné dans la boucle de l'agent. Le modèle est le même à chaque fois : ne laissez pas l'agent entreprendre une action dont vous ne pouvez pas vous permettre de perdre le rayon d'action.

Garde-corps 1 : développez les raccourcisseurs et vérifiez l'URL finale

Une URL raccourcie n'est pas sûre par définition ; vous ne savez pas à quoi cela aboutit. Devant l'agent navigue, développez l'URL et vérifiez la destination finale. Les deux correspondent chacun à un appel :

La réponse inclut la chaîne de redirection complète. Introduisez l'URL finale dans la vérification de phishing :

Un verdict de phishing sur un sous-domaine similaire signifie que l'agent ne navigue jamais. Renvoie le motif du verdict afin que l'agent puisse suggérer le domaine légitime au lieu d'échouer. de manière opaque.

Garde-corps 2 : analyse des informations personnelles sur chaque formulaire soumis

Les agents de navigation remplissent rapidement les formulaires. Ils les remplissent également mal. Un agent qui colle un presse-papier valeur dans le champ "Nom de l'entreprise" lorsque votre gestionnaire de mots de passe vient de suggérer automatiquement un crédit la carte est à une frappe de la soumettre à un commerçant aléatoire.

Analysez la charge utile du formulaire sérialisé via la détection des informations personnelles avant le déclenchement de la soumission. Autoriser attendu champs (e-mails, téléphones, adresses pour un formulaire d'expédition) ; bloquer ceux qui sont restreints (SSN, crédit cartes, numéros de passeport, clés AWS) et affichez le nom du champ afin que l'agent puisse se corriger.

Guardrail 3 : une liste blanche fixe pour les surfaces sensibles

Les écrans de consentement OAuth, les confirmations de paiement et les panneaux d'administration n'ont jamais besoin de vivre derrière un lien court ou un hôte sosie. Conservez une petite liste autorisée de fournisseurs (votre IdP, votre paiement processeur, votre CMS) et exigent une confirmation explicite de l'utilisateur avant que l'agent n'agisse sur quoi que ce soit qui correspond à un sélecteur sensible en dehors de la liste verte.

Ennuyeux, fini, efficace. L'agent reste rapide sur la longue traîne des tâches à faible risque (recherche, résumé, comparateur) et fait une pause pour un humain sur les quelques éléments qui comptent.

La couche de stratégie de 50 lignes

Câblez les trois chèques en une seule fonction sur laquelle l'agent navigue, clique et soumet les primitifs appellent avant d'agir. Il s'exécute dans le contexte de la page, il a donc un accès complet au formulaire données et l'URL proposée :

L'ensemble d'hôtes de confiance constitue votre filet de sécurité pour les destinations à fort trafic. L'appel de métadonnées d'URL gère les raccourcisseurs et les chaînes de redirection. L'analyse PII gère les soumissions de formulaires. Ajouter un presse-papier intercepter qui exécute le même détecteur PII avant le collage, et vous avez fermé les quatre plus hauts modes de défaillance des risques dans moins d’une centaine de lignes.

Exécutez la couche de stratégie dans fail-closed mode pour les sessions sensibles (banque, administration, paie) et fail-open mode pour une navigation à faibles enjeux. L'utilisateur choisit le profil de session lorsqu'ils appellent l'agent ; la couche politique applique le reste.

Où les agents de navigateur locaux s'intègrent aux agents cloud

Agents de navigateur locaux (Kimi WebBridge, la prochaine version de Claude in Chrome Enterprise) commodité du cloud pour la localité de la session. Agents de navigateur cloud (OpenAI Operator, Anthropic Utilisation d'un ordinateur) échangez une localité pour une observabilité centralisée. Utilisez-les différemment :

  • Agent local : tâches qui touchent vos sessions authentifiées (triage des emails, tableaux de bord internes, services bancaires personnels) où la session ne peut pas quitter l'appareil.
  • Agent cloud : tâches sur des sites publics ou des comptes sandbox (recherche, lead gen, archives publiques) où la journalisation et la relecture centralisées valent l'exportation de la session.

Les garde-corps de cet article s’appliquent aux deux. La différence réside dans l'emplacement de la couche politique : dans le extension pour les agents locaux, au proxy pour ceux cloud. Les appels API et l'autorisation ou le refus la logique est identique.

Points clés à retenir

  • Les agents de navigateur locaux héritent de vos sessions. Les cookies restent sur l'appareil ; explosion le rayon s'agrandit. L'agent agit en votre nom sur chaque site auquel vous êtes connecté.
  • Développez les raccourcisseurs avant la navigation. Bit.ly et ses amis cachent la destination. Un appel API renvoie la chaîne de redirection et l'URL finale.
  • Phishing : vérifiez chaque destination non fiable. Sous-domaines similaires et les certificats trompeurs obtiennent des résultats élevés ; traiter tout ce qui précède clean comme un bloc.
  • PII-scannez chaque formulaire soumis. Les erreurs de remplissage automatique sont le moyen le plus courant les agents de navigateur divulguent les informations d'identification et les cartes. Bloquez les champs restreints au niveau de la couche politique.
  • Liste autorisée fixe pour les surfaces sensibles. OAuth, paiements et panneaux d'administration vivent sur des hôtes connus. Exiger une confirmation explicite pour tout ce qui se trouve en dehors de la liste autorisée.

Botoi exposes /v1/phishing/check, /v1/url-metadata, /v1/redirect/trace, et /v1/pii/detect derrière une clé API avec 5 demande/min gratuite. Connectez-les à la couche de stratégie de votre agent de navigateur ou montez le serveur MCP botoi afin qu'un agent compatible MCP puisse les appeler directement. Commencez par le documents interactifs.

FAQ

Qu’est-ce que Kimi WebBridge ?
Kimi WebBridge est une extension de navigateur de Moonshot AI qui permet à un agent IA de piloter Chrome ou Edge : cliquer, faire défiler, remplir des formulaires et naviguer dans des flux en plusieurs étapes au nom de l'utilisateur. Contrairement aux agents de navigateur rendus dans le cloud, WebBridge s'exécute dans la propre session de navigateur de l'utilisateur, de sorte que les cookies, les sessions et le stockage local restent sur l'appareil.
Un agent de navigateur local est-il plus sûr qu'un agent cloud ?
Plus sûr à certains égards, plus risqué à d’autres. L'exécution locale signifie que les cookies de session ne quittent jamais l'appareil, ce qui supprime une classe de fuite côté cloud. Cela signifie également que l'agent hérite de chaque session authentifiée dans votre navigateur. S'il visite la mauvaise URL, il le fait comme vous. Le commerce consiste en moins de surfaces nuageuses et en un plus grand rayon d’explosion dans le navigateur.
Qu'est-ce qui peut mal se passer lorsqu'un agent pilote mon navigateur ?
Cinq échecs courants : naviguer vers un domaine de phishing similaire, cliquer sur un écran de consentement malveillant, coller le contenu du presse-papiers (souvent un remplissage automatique du gestionnaire de mots de passe) dans le mauvais champ, soumettre un formulaire sur une origine contrôlée par un attaquant et suivre une chaîne de redirection qui dépose l'agent sur un collecteur d'informations d'identification. Chacun se termine par des informations d’identification ou de l’argent qui échappent à votre contrôle.
Comment ajouter des garde-corps sans rompre la boucle des agents ?
Enveloppez les actions de navigation, de clic et d’envoi de formulaire dans une fine couche de stratégie. Avant la navigation, exécutez une vérification de phishing sur l'URL de destination. Avant de soumettre le formulaire, analysez la charge utile pour les informations personnelles que vous n'aviez pas l'intention d'envoyer. Avant de coller, vérifiez le contenu du presse-papiers par rapport à un détecteur de fuite. Renvoie des verdicts d'autorisation/refus structurés dont l'agent peut récupérer au lieu d'échecs opaques.
Que fait Botoi spécifiquement pour les agents de navigation ?
Trois points de terminaison sont directement mappés à la boucle de garde-corps navigateur-agent. /v1/phishing/check valide chaque URL proposée par l'agent. /v1/url-metadata développe les raccourcisseurs et suit les redirections avant l'agent. /v1/pii/detect analyse les charges utiles des formulaires et le contenu du presse-papiers pour détecter les champs restreints. Tous les trois sont apatrides, inférieurs à 200 ms et gratuits à 5 req/min.

Commencez a construire avec botoi

150+ endpoints API pour la recherche, le traitement de texte, la generation d'images et les utilitaires pour developpeurs. Offre gratuite, sans carte bancaire.