Mit Kimi WebBridge können Agenten Ihren Browser steuern: 3 Leitplanken für lokale Browser-Agenten
Moonshot AI hat eine Chrome/Edge-Erweiterung ausgeliefert, die einem KI-Agenten das Steuer übergibt, ohne Sitzungen an die Cloud zu senden. Eine 50-Zeilen-Richtlinienschicht, die jede URL einer Phishing-Prüfung unterzieht, Shortener erweitert und PII-Scans von übermittelten Formularen durchführt, bevor sie ausgelöst werden.
Moonshot AI hat Kimi WebBridge im Mai 2026 ausgeliefert: eine Chrome- und Edge-Erweiterung, die eine KI ermöglicht Agenten steuern Ihren Browser. Es klickt, scrollt, füllt Formulare aus und führt mehrstufige Abläufe durch. Anders als WebBridge ist ein in der Cloud gerenderter Browser-Agent und wird in Ihrer eigenen Browsersitzung ausgeführt. Deine Kekse, deine Sitzungen, Ihr lokaler Speicher; Die Cloud sieht die Argumentation des Agenten, nicht jedoch Ihren Authentifizierungsstatus.
Dieses Modell entfernt eine echte Risikoklasse (kein Sitzungstoken verlässt jemals Ihren Computer) und erstellt eine neue (der Agent erbt jede authentifizierte Sitzung, die Sie haben). Wenn es zu einer Weiterleitung kommt Kette zu einem Credential-Harvester, der Harvester sieht die IP von Moonshot nicht; es sieht deins, mit Ihre Cookies beigefügt.
Die Lösung lautet nicht „Keine Browser-Agenten verwenden“. Der Fix ist eine dünne Richtlinienschicht, die das umschließt Der Agent navigiert, klickt und sendet Grundelemente, führt drei Prüfungen im richtigen Moment durch und gibt strukturierte Zulassungs- oder Ablehnungsurteile zurück. Hier sind die 50 Zeilen und die drei API-Aufrufe Angelegenheit.
Wo Browser-Agenten schief gehen
| Fehlermodus | Auslösen | Fangpunkt |
|---|---|---|
| Lookalike-Domäne | Der Agent liest einen Phishing-Link aus dem Seiteninhalt | Phishing-Check beim Navigieren |
| Die verkürzte URL verbirgt das Ziel | Agent folgt bit.ly aus einem Chat oder Dokument |
URL vor dem Navigieren erweitern |
| Formular senden verliert personenbezogene Daten | Der Agent füllt ein Formular mit automatisch vorgeschlagenen Werten aus | PII-Scan bei der Übermittlung der Nutzlast |
| Automatisches Ausfüllen der Zwischenablage | Der Passwort-Manager füllt das falsche Feld aus | PII vor dem Einfügen in der Zwischenablage scannen |
| Durchklicken des Einwilligungsbildschirms | Der Agent klickt bei einem böswilligen Einwilligungsfluss auf „Zulassen“. | Zulassungsliste der OAuth-Anbieter-Hosts |
Jede Zeile wird zu einem Zeitpunkt in der Agentenschleife in einen API-Aufruf aufgelöst. Das Muster ist das gleiche Jedes Mal: Lassen Sie den Agenten nicht eine Aktion ausführen, deren Explosionsradius Sie nicht verlieren dürfen.
Leitplanke 1: Erweitern Sie die Shortener und überprüfen Sie die endgültige URL
Eine verkürzte URL ist per Definition unsicher; Sie wissen nicht, worauf es hinausläuft. Vor dem Agenten navigiert, erweitert die URL und überprüft das endgültige Ziel. Beides passt in jeweils einen Aufruf:
Die Antwort umfasst die vollständige Weiterleitungskette. Geben Sie die finale URL in die Phishing-Prüfung ein:
Ein Urteil von phishing auf einer Lookalike-Subdomain bedeutet, dass der Agent nie navigiert.
Geben Sie den Urteilsgrund zurück, damit der Agent die legitime Domäne vorschlagen kann, anstatt fehlzuschlagen
undurchsichtig.
Leitplanke 2: PII-Scan bei jeder Formularübermittlung
Browser-Agenten füllen Formulare schnell aus. Sie füllen sie auch falsch aus. Ein Agent, der eine Zwischenablage einfügt Geben Sie den Wert in das Feld „Firmenname“ ein, wenn Ihr Passwort-Manager gerade automatisch eine Gutschrift vorgeschlagen hat Die Karte ist nur einen Tastendruck von der Übermittlung der Karte an einen beliebigen Händler entfernt.
Scannen Sie die Nutzlast des serialisierten Formulars durch PII-Erkennung, bevor die Übermittlung ausgelöst wird. Erlauben erwartet Felder (E-Mails, Telefonnummern, Adressen für ein Versandformular); Blockieren Sie eingeschränkte (SSNs, Kredit). Karten, Passnummern, AWS-Schlüssel) und zeigen Sie den Feldnamen an, damit der Agent sich selbst korrigieren kann.
Leitplanke 3: eine feste Zulassungsliste für empfindliche Oberflächen
OAuth-Zustimmungsbildschirme, Zahlungsbestätigungen und Admin-Panels müssen niemals hinter einem stehen Kurzlink oder ein Lookalike-Host. Führen Sie eine kleine Zulassungsliste der Anbieter (Ihr IdP, Ihre Zahlung). Prozessor, Ihr CMS) und erfordern eine ausdrückliche Bestätigung des Benutzers, bevor der Agent etwas tut das mit einem sensiblen Selektor außerhalb der Zulassungsliste übereinstimmt.
Langweilig, endlich, effektiv. Der Agent bleibt bei Aufgaben mit geringem Risiko (Suche, Zusammenfassen, Vergleichsshop) und macht für einen Menschen eine Pause bei den wenigen, die wichtig sind.
Die 50-Zeilen-Richtlinienebene
Verknüpfen Sie die drei Prüfungen in einer einzigen Funktion, mit der der Agent navigieren, klicken und senden kann Primitive rufen auf, bevor sie handeln. Es wird im Seitenkontext ausgeführt und hat daher vollen Zugriff auf das Formular Daten und die vorgeschlagene URL:
Das Trusted Host Set ist Ihr Sicherheitsnetz für Ziele mit hohem Verkehrsaufkommen. Der URL-Metadatenaufruf Behandelt Verkürzer und Umleitungsketten. Der PII-Scan verarbeitet Formularübermittlungen. Fügen Sie eine Zwischenablage hinzu Intercept, das denselben PII-Detektor vor dem Einfügen ausführt, und Sie haben die vier höchsten Werte geschlossen. Risikoausfallmodi in weniger als hundert Zeilen.
Führen Sie die Richtlinienschicht aus fail-closed Modus für sensible Sitzungen (Banking,
Verwaltung, Gehaltsabrechnung) und fail-open Modus für Low-Stakes-Browsing. Der Benutzer wählt die aus
Sitzungsprofil, wenn sie den Agenten aufrufen; Die Richtlinienschicht erzwingt den Rest.
Wo lokale Browser-Agenten neben Cloud-Agenten passen
Lokale Browser-Agenten (Kimi WebBridge, die kommende Claude-in-Chrome-Enterprise-Version) werden gehandelt Cloud-Komfort für Sitzungslokalität. Cloud-Browser-Agenten (OpenAI Operator, Anthropic Computernutzung) Lokalität gegen zentralisierte Beobachtbarkeit eintauschen. Verwenden Sie sie anders:
- Lokaler Vertreter: Aufgaben, die Ihre authentifizierten Sitzungen betreffen (E-Mail-Triage, interne Dashboards, persönliches Banking), bei denen die Sitzung das Gerät nicht verlassen kann.
- Cloud-Agent: Aufgaben auf öffentlichen Websites oder Sandbox-Konten (Recherche, Lead). gen, öffentliche Aufzeichnungen), bei denen eine zentrale Protokollierung und Wiedergabe den Sitzungsexport wert sind.
Die Leitplanken in diesem Beitrag gelten für beide. Der Unterschied besteht im Standort der Richtlinienebene: im Erweiterung für lokale Agenten, am Proxy für Cloud-Agenten. Die API-Aufrufe und das Zulassen oder Verweigern Logik sind identisch.
Wichtige Erkenntnisse
- Lokale Browser-Agenten erben Ihre Sitzungen. Cookies bleiben auf dem Gerät; Explosion Radius erweitert sich. Der Agent fungiert auf jeder Website, auf der Sie angemeldet sind, als Sie.
- Erweitern Sie Shortener vor der Navigation. Bit.ly und Freunde verbergen das Ziel. Ein API-Aufruf gibt die Weiterleitungskette und die endgültige URL zurück.
-
Überprüfen Sie jedes nicht vertrauenswürdige Ziel auf Phishing. Lookalike-Subdomains und
betrügerische Zertifikate erzielen einen hohen Stellenwert; Behandle alles oben Genannte
cleanals Block. - PII-Scan jedes Formulars senden. Fehler beim automatischen Ausfüllen sind die häufigste Ursache Browser-Agenten geben Anmeldeinformationen und Karten preis. Blockieren Sie eingeschränkte Felder auf der Richtlinienebene.
- Die Zulassungsliste für empfindliche Oberflächen wurde korrigiert. OAuth, Zahlungen und Admin-Panels leben auf bekannten Hosts. Fordern Sie eine ausdrückliche Bestätigung für alles außerhalb der Zulassungsliste an.
Botoi-Ausstellungen /v1/phishing/check, /v1/url-metadata,
/v1/redirect/trace, Und /v1/pii/detect behind one API key with 5
Anforderung/Minute frei. Verknüpfen Sie sie mit der Richtlinienschicht Ihres Browser-Agenten oder mounten Sie sie
botoi MCP-Server
sodass ein MCP-fähiger Agent sie direkt anrufen kann. Beginnen Sie am
interaktive Dokumente.
FAQ
- Was ist Kimi WebBridge?
- Kimi WebBridge ist eine Browsererweiterung von Moonshot AI, mit der ein KI-Agent Chrome oder Edge steuern kann: Klicken, Scrollen, Ausfüllen von Formularen und Navigieren durch mehrstufige Abläufe im Namen des Benutzers. Im Gegensatz zu in der Cloud gerenderten Browser-Agenten wird WebBridge in der eigenen Browsersitzung des Benutzers ausgeführt, sodass Cookies, Sitzungen und lokaler Speicher auf dem Gerät verbleiben.
- Ist ein lokaler Browser-Agent sicherer als ein Cloud-Agent?
- In mancher Hinsicht sicherer, in anderer Hinsicht riskanter. Durch die lokale Ausführung verlassen Sitzungscookies niemals das Gerät, wodurch eine Art Cloud-seitiges Leck beseitigt wird. Dies bedeutet auch, dass der Agent jede authentifizierte Sitzung in Ihrem Browser erbt. Wenn die falsche URL aufgerufen wird, geschieht dies wie Sie. Der Nachteil besteht darin, dass es weniger Wolkenoberflächen gibt und der Explosionsradius im Browser größer ist.
- Was kann schiefgehen, wenn ein Agent meinen Browser steuert?
- Fünf häufige Fehler: Navigieren zu einer ähnlichen Phishing-Domäne, Klicken durch einen böswilligen Einwilligungsbildschirm, Einfügen von Inhalten der Zwischenablage (oft ein automatisch ausgefüllter Passwort-Manager) in das falsche Feld, Senden eines Formulars über einen vom Angreifer kontrollierten Ursprung und Befolgen einer Weiterleitungskette, die den Agenten auf einen Credential Harvester leitet. Jedes endet damit, dass Anmeldeinformationen oder Geld Ihre Kontrolle verlieren.
- Wie füge ich Leitplanken hinzu, ohne die Agentenschleife zu unterbrechen?
- Wickeln Sie Navigations-, Klick- und Formular-Sendeaktionen in eine dünne Richtlinienebene ein. Führen Sie vor der Navigation eine Phishing-Prüfung der Ziel-URL durch. Scannen Sie vor dem Absenden des Formulars die Nutzlast auf personenbezogene Daten, die Sie nicht senden wollten. Überprüfen Sie vor dem Einfügen den Inhalt der Zwischenablage mit einem Lecksuchgerät. Geben Sie statt undurchsichtiger Fehler strukturierte Zulassungs-/Verweigerungsurteile zurück, die der Agent wiederherstellen kann.
- Was macht Botoi konkret für Browser-Agenten?
- Drei Endpunkte sind direkt der Browser-Agent-Leitplankenschleife zugeordnet. /v1/phishing/check validiert jede vom Agent vorgeschlagene URL. /v1/url-metadata erweitert Shortener und folgt Weiterleitungen, bevor der Agent dies tut. /v1/pii/detect durchsucht Formularnutzlasten und Inhalte der Zwischenablage nach eingeschränkten Feldern. Alle drei sind zustandslos, unter 200 ms und mit 5 Anforderungen/Minute kostenlos.
Starte mit botoi zu entwickeln
150+ API-Endpunkte für Abfragen, Textverarbeitung, Bildgenerierung und Entwickler-Tools. Kostenloser Tarif, keine Kreditkarte nötig.