agentbrowse: De terminal interface die je AI coding agent verdient

agentbrowse: De terminal interface die je AI coding agent verdient

Jun 19, 2026 ai tools developer productivity browser automation npm packages claude code playwright terminal tools ai coding agents workflow automation

Waarom AI agents moeite hebben met het web — en hoe agentbrowse dat oplost

Laten we eerlijk zijn: AI coding agents zijn fantastisch als ze met code en command lines werken. Maar vraag ze om door een webinterface te klikken en het wordt een rommeltje.

Dat is precies het probleem dat agentbrowse oplost. Dit CLI-tool wrappt Playwright in een eenvoudige, agent-vriendelijke interface. Eentje die de taal spreekt van AI assistants zoals Claude Code, Cursor en Codex.

Het probleem met webinterfaces en AI agents

Traditionele browser automatisering gaat ervan uit dat een mens achter het stuur zit. Mensen kunnen CAPTCHAs oplossen, visuele layouts intuitief begrijpen, en precies op de juiste pixel klikken. AI agents? Die hebben daar moeite mee. Ze excelleren in het uitvoeren van exacte commando's, maar struikelen over de ambiguiteit van grafische interfaces.

agentbrowse draait deze relatie om. In plaats van een agent die worstelt met een browser, krijgt hij een schone API: open een URL, lees de pagina als markdown, klik op tekst of nummer, vul formulieren in — allemaal via terminal commando's die gestructureerde data teruggeven.

Binnen minuten aan de slag

Installeren is kinderlijk eenvoudig:

npm install -g agentbrowse
npx playwright install chromium

Klaar. Bij de eerste run wordt Chromium automatisch gedownload en kun je beginnen.

De basis workflow is simpel:

  • agentbrowse open <url> — navigeer naar een pagina
  • agentbrowse read — haal de huidige pagina op als markdown
  • agentbrowse links — zie genummerde, klikbare links
  • agentbrowse click "Aanmelden" — klik op zichtbare tekst of linknummer
  • agentbrowse read --json — gestructureerde output voor programmatische verwerking

Persistentie: Het geheime ingrediënt

Wat agentbrowse echt handig maakt is het persistente sessie model. Een achtergrond browser daemon draait continu en houdt je paginastatus levend tussen commando's. Dit betekent dat je een site kunt openen, kunt authenticeren, naar een specifieke pagina kunt navigeren, en dat vervolgens aan je agent kunt overhandigen — allemaal zonder telkens opnieuw de staat te hoeven opbouwen.

Sessies zijn geïsoleerd per ID, met eigen cookies en authenticatie. De login commando opent zelfs een echt browser window voor MFA en CAPTCHAs, waarna die geauthenticeerde sessie wordt opgeslagen voor headless hergebruik.

Je agent automatisch laten omvatten

Hier wordt het slim. Je kunt agentbrowse installeren als een "skill" die je coding agent automatisch herkent:

npx agentbrowse skill --global

Dit schrijft de juiste configuratiebestanden voor welke agent je ook gebruikt — SKILL.md voor Claude Code, .cursor/rules voor Cursor, AGENTS.md voor Codex. Je AI assistant weet nu dat hij browser automatisering moet gebruiken wanneer webinteracties nodig zijn.

Geen ingewikkelde prompts meer die uitleggen hoe een browser te gebruiken. De mogelijkheid is er gewoon.

Gestructureerde output voor machine-consumptie

Elk commando accepteert --json voor machine-leesbare output, en fouten volgen een consistent formaat met specifieke exit codes:

  • 2 voor usage errors
  • 3 voor navigatie failures
  • 4 voor target-not-found
  • 5 voor daemon issues

Dit maakt agentbrowse scriptbaar en betrouwbaar voor CI/CD pipelines en geautomatiseerde workflows.

Site manifests: Domein-specifieke superkrachten

Voor complexe of veelgebruikte sites kun je een site manifest bestand definiëren dat named, high-level commando's blootstelt:

agentbrowse agentbrowse --site ./github.agent.json create-issue "Bug in login flow"

Manifests declareren pagina's, selectors en commando-sequenties met variabele interpolatie — essentially creating custom "skills" voor specifieke websites.

Het grotere plaatje

agentbrowse vertegenwoordigt een verschuiving in hoe we denken over AI agent mogelijkheden. In plaats van te hopen dat AI vision modellen menselijke browser interactie kunnen benaderen, geven we agents tools die passen bij hun sterke punten: gestructureerde commando's, parseerbare output en persistente staat.

Voor developers die agent-powered workflows bouwen is dit een praktische tool die een echte lacune opvult. Voor degenen die AI-assisted development verkennen is het een glimps van hoe agent-tool interacties zich kunnen ontwikkelen — weg van visuele interfaces ontworpen voor mensen, naar programmatische interfaces ontworpen voor machines.

Of je nu web testing automatiseert, AI workflows bouwt, of gewoon nieuwsgierig bent naar de toekomst van agent-tool interactie: agentbrowse is het verkennen waard. Het is MIT-gelicenseerd, actief onderhouden, en draait volledig lokaal — geen cloud dependencies of externe services nodig.

De terminal is terug, en nu kan zelfs je AI hem gebruiken.

Read in other languages:

RU BG EL CS UZ TR SV FI RO PT PL NB HU IT FR ES DE DA ZH-HANS EN