Stagehand v4 es el SDK de Browserbase para construir agentes de navegador, lanzado en 2026 como una reescritura completa que mueve la ejecución core a una extensión nativa del navegador, prometiendo el doble de velocidad que Playwright y un ahorro del 80% en tokens. A diferencia de los navegadores headless tradicionales como Puppeteer o Playwright, diseñados para testing automatizado, Stagehand está construido específicamente para que agentes de IA interactúen con la web de manera semántica, usando comandos en lenguaje natural en lugar de selectores CSS frágiles. En su versión 4, el proyecto eliminó el orquestador integrado para devolver el control al programador, duplicó el rendimiento y redujo drásticamente el coste de LLM por operación. El cambio de arquitectura es profundo: en lugar de controlar el navegador desde un proceso externo mediante CDP (Chrome DevTools Protocol), Stagehand v4 ejecuta su lógica de gestión de estado, tracking de frames y despacho de comandos dentro de una extensión del propio navegador. Esto elimina la latencia de red entre el SDK y el browser, permite acceso asíncrono a páginas y contextos, y abre la puerta a un modelo de seguridad más robusto donde el enforcement corre en el mismo proceso del navegador. ¿Cómo funciona Stagehand v4? Stagehand v4 opera sobre tres primitivas de lenguaje natural que forman su API core: , y . Cada una resuelve un problema distinto de la interacción agente web. ejecuta una acción descrita en texto libre sobre la página. En lugar de escribir y cruzar los dedos para que el selector no haya cambiado, describes lo que quieres: . Stagehand usa un modelo de lenguaje para interpretar la intención, localizar el elemento relevante en el DOM (o en el árbol de accesibilidad de Chrome), y ejecutar la acción. Si la página cambia mañana y el botón ahora tiene clase en lugar de , tu script sigue funcionando. inspecciona la página y devuelve una lista de elementos interactivos detectados, con metadatos sobre su tipo, posición y contexto. Es útil para depurar qué ve el agente antes de actuar, o para construir pipelines donde el agente primero \"mira\" y luego decide. extrae datos estructurados de la página validándolos contra un esquema que defines. Si necesitas precios, nombres de producto y disponibilidad de una tienda online, describes la estructura esperada y Stagehand devuelve JSON tipado, no HTML crudo que tengas que parsear con cheerio. La versión 4 introduce cambios importantes en el ciclo de vida del SDK. En v3, creabas una instancia de Stagehand y esta lanzaba el navegador. En v4, el orden se invierte: primero lanzas o conectas el navegador, luego creas Stagehand pasándole esa instancia. Este cambio refleja la nueva arquitectura: Stagehand ya no \"posee\" el navegador, sino que se ejecuta \"junto a él\" como una extensión con la que el SDK se comunica. Otro cambio significativo: ha sido eliminado . En versiones anteriores, Stagehand incluía un orquestador autónomo que podía ejecutar secuencias de acciones sin intervención del programador. La versión 4 abandona esa idea. El flujo de control vuelve a ser responsabilidad del desarrollador; Stagehand proporciona las herramientas primitivas, pero tú decides cuándo actuar, cuándo observar y cuándo extraer. Es una apuesta explícita por la transparencia y el control sobre la magia opaca. ¿En qué se diferencia Stagehand v4 de Playwright y Puppeteer? La comparación más honesta la hace el propio Browserbase en su documentación: \"Playwright fue construido para testing; Stagehand fue construido para agentes\". Esta distinción no es marketing, se traduce en decisiones técnicas concretas. | Característica | Stagehand v4 | Playwright | Puppeteer | | | | | | | Propósito primario | Agentes de IA autónomos | Testing end to end | Automatización de Chrome | | API de control | Lenguaje natural ( , ) + código | Selectores deterministas | Selectores deterministas | | Resiliencia a cambios UI | Alta (self healing) | Baja (selectores frágiles) | Baja (selectores frágiles) | | Rendimiento (claim v4) | 2x vs Playwright | Línea base | Similar a Playwright | | Eficiencia de tokens | 80% más eficiente | N/A (no usa LLM) | N/A (no usa LLM) | | Arquitectura v4 | Extensión nativa del navegador | Proceso externo CDP | Proceso externo CDP | | Orquestación | Manual (eliminado ) | Manual | Manual | | Soporte iframes/Shadow DOM | Sí (nested, out of process) | Sí | Parcial | Playwright y Puppeteer brillan cuando conoces la estructura de la página y necesitas repetir la misma secuencia mil veces de forma determinista. Son herramientas de testing: rápidas, predecibles, pero frágiles ante el cambio. Cuando el CSS cambia, los tests rotos se acumulan en la bandeja de entrada del equipo de QA. Stagehand apuesta por el caso opuesto: páginas que cambian constantemente, flujos donde la estructura no es conocida de antemano, o tareas donde el coste de mantener selectores actualizados supera el coste de usar un modelo de lenguaje. La pregunta de diseño no