Live KI-gestütztes Referenz-Listening: System Diptych vorgestellt
↘

Browser Use veröffentlicht Jev Ultrafast: Open-Source-Browser-Agent mit Entscheidungsmodell

Statt eines generativen LLM-Screenshot-Loops nutzt der Agent TypeSafe Jev, das Operation und Ziel in einem einzigen API-Aufruf wählt. Eine Google-Flights-Suche Zürich–London ist in 7,1 Sekunden erledigt.

· Veröffentlicht: 05.10.2026 ·1 Min Lesezeit
Browser Use veröffentlicht Jev Ultrafast: Open-Source-Browser-Agent mit EntscheidungsmodellMit KI erstellt
◆ Fakten auf einen Blick
  • Jev Ultrafast ist ein Open-Source-Browser-Agent von Browser Use unter MIT-Lizenz.
  • Es nutzt TypeSafe Jev als Entscheidungsmodell, das aus einer nummerierten Elementtabelle eine Operation (CLICK, TYPE_TEXT, SELECT, SCROLL_UP, SCROLL_DOWN, WAIT, DONE, BLOCKED) und ein Ziel-Element auswählt.
  • Nur bei TYPE_TEXT wird ein separates kleines Sprachmodell (standardmäßig inception/mercury-2.5 via OpenRouter) aufgerufen, um Text zu generieren.
  • Der Agent verwendet Browser Harness 0.1.13 und steuert vorhandenes Chrome über Remote Debugging; benötigt Python ≥3.12, uv, einen TypeSafe API key (cloud only, early access) und einen OpenAI-kompatiblen Key für den Text-Helfer.
  • Die gemessene Google-Flights-Suche Zürich→London dauerte 7,073 Sekunden bei 1x Geschwindigkeit und wurde unabhängig verifiziert.
  • Im Vergleich zum ursprünglichen Loop sank die mediane Task-Zeit von 9,450 s auf 7,092 s (25% schneller) und die Browser-Protokollaufrufe von 1.092 auf 101 (ca. 91% weniger) über drei alternierende Paare.

Browser Use veröffentlicht Jev Ultrafast

Browser Use hat Jev Ultrafast als Open-Source-Browser-Agenten unter MIT-Lizenz veröffentlicht. Statt eines generativen LLM-Screenshot-Loops nutzt er TypeSafe Jev als Entscheidungsmodell: Aus einer nummerierten Elementtabelle wählt es Operation und Ziel in einem einzigen API-Aufruf. Eine Google-Flights-Suche Zürich–London ist in 7,1 Sekunden erledigt. Durch das Weglassen von Bild-Token reduziert sich das Datenvolumen pro Schritt von mehreren Megabytes auf wenige Kilobytes, wodurch die Round-Trip-Zeit zum TypeSafe-Server stark sinkt und damit sowohl Latenz als auch Token-Kosten reduziert werden. Die Token-Kosten sinken drastisch: 17 Jev-Anfragen benötigten 90.558 Input-Tokens; nur bei TYPE_TEXT wird ein separates kleines Textmodell aufgerufen.

Einschränkungen und Cloud-Abhängigkeit

Bekannte Einschränkungen: keine Unterstützung für Shadow Roots, iframes, canvas, Datei-Uploads, Pop-up-Tabs, verschachteltes Scrollen oder beliebige Tastatur-Widgets. Zudem wird ein TypeSafe API key benötigt, der nur über die Cloud verfügbar ist (Early Access). Das steht im Widerspruch zu einer an anderer Stelle behaupteten lokalen Ausführung des Agenten, da die Entscheidungsfindung nicht lokal erfolgt, sondern eine Cloud-Verbindung erfordert.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Quellen

  1. github.com ↗

Ähnliche Artikel