agentbrowse: De terminal interface die je AI coding agent verdient
Waarom AI agents moeite hebben met het web — en hoe agentbrowse dat oplost
Laten we eerlijk zijn: AI coding agents zijn fantastisch als ze met code en command lines werken. Maar vraag ze om door een webinterface te klikken en het wordt een rommeltje.
Dat is precies het probleem dat agentbrowse oplost. Dit CLI-tool wrappt Playwright in een eenvoudige, agent-vriendelijke interface. Eentje die de taal spreekt van AI assistants zoals Claude Code, Cursor en Codex.
Het probleem met webinterfaces en AI agents
Traditionele browser automatisering gaat ervan uit dat een mens achter het stuur zit. Mensen kunnen CAPTCHAs oplossen, visuele layouts intuitief begrijpen, en precies op de juiste pixel klikken. AI agents? Die hebben daar moeite mee. Ze excelleren in het uitvoeren van exacte commando's, maar struikelen over de ambiguiteit van grafische interfaces.
agentbrowse draait deze relatie om. In plaats van een agent die worstelt met een browser, krijgt hij een schone API: open een URL, lees de pagina als markdown, klik op tekst of nummer, vul formulieren in — allemaal via terminal commando's die gestructureerde data teruggeven.
Binnen minuten aan de slag
Installeren is kinderlijk eenvoudig:
npm install -g agentbrowse
npx playwright install chromium
Klaar. Bij de eerste run wordt Chromium automatisch gedownload en kun je beginnen.
De basis workflow is simpel:
agentbrowse open <url>— navigeer naar een paginaagentbrowse read— haal de huidige pagina op als markdownagentbrowse links— zie genummerde, klikbare linksagentbrowse click "Aanmelden"— klik op zichtbare tekst of linknummeragentbrowse read --json— gestructureerde output voor programmatische verwerking
Persistentie: Het geheime ingrediënt
Wat agentbrowse echt handig maakt is het persistente sessie model. Een achtergrond browser daemon draait continu en houdt je paginastatus levend tussen commando's. Dit betekent dat je een site kunt openen, kunt authenticeren, naar een specifieke pagina kunt navigeren, en dat vervolgens aan je agent kunt overhandigen — allemaal zonder telkens opnieuw de staat te hoeven opbouwen.
Sessies zijn geïsoleerd per ID, met eigen cookies en authenticatie. De login commando opent zelfs een echt browser window voor MFA en CAPTCHAs, waarna die geauthenticeerde sessie wordt opgeslagen voor headless hergebruik.
Je agent automatisch laten omvatten
Hier wordt het slim. Je kunt agentbrowse installeren als een "skill" die je coding agent automatisch herkent:
npx agentbrowse skill --global
Dit schrijft de juiste configuratiebestanden voor welke agent je ook gebruikt — SKILL.md voor Claude Code, .cursor/rules voor Cursor, AGENTS.md voor Codex. Je AI assistant weet nu dat hij browser automatisering moet gebruiken wanneer webinteracties nodig zijn.
Geen ingewikkelde prompts meer die uitleggen hoe een browser te gebruiken. De mogelijkheid is er gewoon.
Gestructureerde output voor machine-consumptie
Elk commando accepteert --json voor machine-leesbare output, en fouten volgen een consistent formaat met specifieke exit codes:
- 2 voor usage errors
- 3 voor navigatie failures
- 4 voor target-not-found
- 5 voor daemon issues
Dit maakt agentbrowse scriptbaar en betrouwbaar voor CI/CD pipelines en geautomatiseerde workflows.
Site manifests: Domein-specifieke superkrachten
Voor complexe of veelgebruikte sites kun je een site manifest bestand definiëren dat named, high-level commando's blootstelt:
agentbrowse agentbrowse --site ./github.agent.json create-issue "Bug in login flow"
Manifests declareren pagina's, selectors en commando-sequenties met variabele interpolatie — essentially creating custom "skills" voor specifieke websites.
Het grotere plaatje
agentbrowse vertegenwoordigt een verschuiving in hoe we denken over AI agent mogelijkheden. In plaats van te hopen dat AI vision modellen menselijke browser interactie kunnen benaderen, geven we agents tools die passen bij hun sterke punten: gestructureerde commando's, parseerbare output en persistente staat.
Voor developers die agent-powered workflows bouwen is dit een praktische tool die een echte lacune opvult. Voor degenen die AI-assisted development verkennen is het een glimps van hoe agent-tool interacties zich kunnen ontwikkelen — weg van visuele interfaces ontworpen voor mensen, naar programmatische interfaces ontworpen voor machines.
Of je nu web testing automatiseert, AI workflows bouwt, of gewoon nieuwsgierig bent naar de toekomst van agent-tool interactie: agentbrowse is het verkennen waard. Het is MIT-gelicenseerd, actief onderhouden, en draait volledig lokaal — geen cloud dependencies of externe services nodig.
De terminal is terug, en nu kan zelfs je AI hem gebruiken.