IntermedioMCPs

MCP Browser-Use — agents de IA que controlan browsers reales

MCP server con 1,636 installs que enchufa browser-use a Claude Code. Browser-use es el framework open-source que deja a agents AI controlar Chrome/Chromium de forma robusta con DOM simplificado para LLMs.

29 de mayo de 20263 min de lecturaclaude-codebrowser-use

Qué es#

browser-use es uno de los frameworks más populares para que LLMs controlen browsers. Su diferencial: en vez de pasarle al modelo el HTML crudo (caro en tokens y confuso), procesa el DOM y le pasa una representación simplificada y accionable. El modelo decide la acción (click, type, scroll), browser-use la ejecuta, y vuelve.

Este MCP empaqueta browser-use como un servidor MCP. Cuando Claude lo activa, te da capacidades de browser real: navegar, llenar forms, scrapear, hacer login con tu sesión, testear flows.

1,636 installs lo hacen el segundo MCP más adoptado de browser_automation, después de Chrome DevTools. Indica madurez.

Tabla resumen#

CampoValor
Categoría aitmplbrowser_automation
Installs1,636
Servidor MCPbrowser-server
Frameworkbrowser-use
BrowserChrome / Chromium
CostoOpen source (browser-use es MIT)

Cómo se instala#

bash
npx claude-code-templates@latest --mcp browser_automation/browser-use-mcp-server

Pre-requisitos: Python + Chromium o Chrome instalado. browser-use baja sus deps.

Para Claude:

bash
Instalá el MCP browser_automation/browser-use-mcp-server. Verificá que
tengo Chrome instalado y abrí una sesión de prueba: navegá a
example.com, sacá un screenshot y devolveme el título de la página.

Qué podés hacer con esto#

Automatización de tareas web#

"Andá a Amazon, buscá noise cancelling headphones, ordená por reviews, y traeme los top 5 con precio, rating y review count". browser-use orquesta el flow paso a paso.

Testing E2E asistido#

"Andá a localhost:3000/signup, probá el formulario con email inválido + password corto, validá que muestre errores correctos y screen-shot". Más conversacional que Cypress.

Scraping con sesión propia#

A diferencia de BrightData o Apify, acá usás TU sesión: tu LinkedIn, tu Twitter, tu dashboard de cualquier SaaS. Útil para tareas que requieren login.

Onboarding a sitios complejos#

"Andá al panel admin de [SaaS], navegá hasta Settings > Integrations > API Keys y mostrame qué keys hay creadas". Sin tener que recordar la ruta vos.

Comparado con Playwright Skill#

Playwright Skill es model-invoked y escribe scripts custom de Playwright por cada tarea. Browser-use es más interactivo: el agente navega paso a paso decidiendo qué hacer.

Diferencia clave: browser-use es más conversacional y robusto a sitios que cambian. Playwright Skill es mejor cuando querés un script reproducible.

Pre-requisitos#

  • Chrome / Chromium instalado
  • Python 3.x (browser-use es Python)
  • Memoria razonable (Chrome consume RAM)

Cuándo NO conviene#

⚠️ Antes de instalar
  • Sitios con TOS estrictos: scrapear LinkedIn, Instagram, etc. con tu sesión puede llevar a baneo de cuenta. Usá cuenta dedicada o leé sus TOS.
  • Costo de tokens: cada acción pide al modelo decidir qué hacer. Workflows largos consumen tokens.
  • Para automatizaciones estables productivas: Playwright tradicional (sin LLM) es más confiable. browser-use brilla en exploración y tareas one-off.
  • Conflictos con tu Chrome cotidiano: correr browser-use sobre tu perfil principal puede ser raro (cookies, tabs). Usá perfil dedicado o headless.
  • Latencia: cada acción es modelo + ejecución. Más lento que un script directo.

Bajalo de la fuente#

Recursos relacionados#

  • Browser Harness — patrón similar pero como skill, con catálogo comunitario de sitios pre-escritos.
  • Playwright Skill — alternativa más scripted; mejor para tests reproducibles.
  • Agent Browser — la versión de Vercel del mismo problema. Comparalos antes de adoptar uno.