Corre muchas pruebas de navegador en paralelo, en automático, con tu agente de IA
Playwright MCP mueve el navegador una llamada de herramienta a la vez: lento y caro en tokens. Ahora Claude Code o Codex corren toda la prueba en ego (lite) con unas pocas líneas de código: 2.4x más rápido, y corre muchas pruebas en paralelo, cada una en su propio Space.
Corre pruebas de navegador con solo pedirlo
Por ejemplo, le pido a Codex que revise si esta tienda en línea tiene bugs. Codex corre toda la prueba, arregla los bugs y me dice el resultado. Lo único que hago yo es ver TikTok mientras trabaja.
La misma página pasa de rota a correcta, en pantalla
Las páginas de producto se renderizan rotas. El agente las revisa en ego (lite), arregla el CSS en el código fuente, y la página abierta se vuelve a renderizar correcta en pantalla.
Corre pruebas de navegador a toda velocidad con ego (lite)
La forma antigua de correr pruebas de navegador es usar Playwright MCP o Chrome DevTools MCP, que ejecutan una llamada de herramienta a la vez: cada paso siguiente espera a que el modelo lea el resultado anterior, lento y caro. Ahora los agentes pueden correr muchos pasos en una sola pasada de código JS con ego (lite), así que termina más rápido y gasta menos tokens.
| ego (lite) | Playwright MCP | Chrome DevTools MCP | |
|---|---|---|---|
| Cómo lo maneja el agente | A través del skill /ego-browser | Servidor MCP externo. Una llamada de herramienta por acción. | Servidor MCP externo. Una llamada de herramienta por acción. |
| Configuración | Sin configuración, funciona con cualquier agente. | Instalación con npx, modos de lanzamiento que configurar, errores frecuentes de arranque y de detección de Chrome. | Depuración remota, user-data-dir, configuración entre hosts. |
| Uso de tokens | Bajo. Sin esquemas de herramientas MCP, y solo entra al contexto lo que el agente registra: un snapshot por pasada, no uno después de cada acción. | Alto. Los usuarios reportan un crecimiento de 6x en tokens y desbordes de contexto de 200K tokens. | Alto. Las capturas de pantalla son caras en tokens. |
| Estado de sesión | Tu propio navegador con sesión iniciada. El mismo estado de sesión que tu Chrome | Navegador aislado por defecto; mantener sesiones iniciadas implica modo extensión o configurar storage-state. | Se puede conectar, pero toma control de las pestañas que estás usando. |
| iframe / shadow DOM / widgets de SDK | Su snapshot de página está integrado al motor de renderizado, así que lee dentro de todos ellos. | El snapshot de accesibilidad tiene un punto ciego con los iframes. | DOM sin procesar, tú te encargas. |
| Consola / red / trace | Consola, red y traces, leídos directo de los datos de Chrome DevTools. | Consola, red, capturas de pantalla. | Lo más profundo: Lighthouse, rendimiento, memoria. |
| Estabilidad de los localizadores | Se ancla a etiquetas semánticas, sobrevive cambios de clase. | Refs / accesibilidad, bastante estable. | Selectores de DOM sin procesar. |
| CAPTCHA / detección de bots | Sesión humana real, la menos propensa a activarla. | Navegador aparte / headless, marcado con frecuencia. | Mejor cuando se conecta, pero toma control de tus pestañas. |
| Tareas en paralelo | Diseñado para correr muchas tareas a la vez con Spaces. | Una sesión por servidor; correr en paralelo implica administrar instancias aisladas adicionales. | Una sola instancia, muchas pestañas la hacen fallar. |
La fricción nunca fue el navegador. Era la capa de en medio.
En foros de desarrolladores y en los issue trackers, la mayoría de las quejas son sobre el MCP: es la capa entre tu agente y el navegador, y ahí se cae la conexión, se acumulan las aprobaciones, se rompe la sesión, se disparan los tokens. ego (lite) ya viene configurado, así que se acaban los errores raros.
El navegador funciona. La conexión con él, no.
- Conexión: las herramientas aparecen pero el agente no las llama, las corridas se atascan en “esperando aprobación”, y el mismo servidor se comporta distinto en cada cliente
- Aprobaciones: un popup por cada llamada de herramienta, a menudo entre 10 y 30 por tarea, incluso con “ejecutar todo” activado
- Confiabilidad: una tarea que termina a medias, o una navegación que ya tuvo éxito pero igual da timeout
Nada en medio: ego (lite) es el navegador mismo
- Estable por diseño: el agente le habla directo a un navegador local que controla, sin transporte MCP de por medio que se caiga o se atasque
- Menos aprobaciones: una sola pasada corre muchos pasos en vez de una llamada de herramienta por acción
- Predecible: funciona igual con cualquier agente de IA, la misma forma cada vez
Sin scripts de prueba. Sin selectores que mantener. Solo di qué revisar.
Playwright, Cypress, Selenium: tú escribes la prueba, tú eres responsable de los selectores, y con que renombren una clase o reordenen el layout se rompen. ego (lite) toma un check en lenguaje natural y ubica los elementos por lo que significan, así que un cambio de UI no rompe la prueba.
Tú escribes el spec, tú mantienes los selectores
- Escribir a mano y versionar un
.specpara cada flujo que quieras cubrir - Fijar selectores como
page.click(".btn-x7f3")que se rompen la próxima vez que cambia la UI - Agregar waits y reintentos tú mismo para pelear contra los tests inestables
- Construir automatización de login o archivos storage-state para probar detrás de un inicio de sesión
- Volver a correr y reparar la suite después de cada rediseño
Solo di qué revisar
- Sin spec que escribir: dile a tu agente el check en una sola frase
- Ubica los elementos por su significado, no por una clase CSS, así que un renombre o reordenamiento no lo rompe
- Waits inteligentes manejan el contenido asíncrono, sin sleeps hechos a mano
- Prueba detrás de tu inicio de sesión sin automatizar el login
- ¿Necesitas pruebas de regresión visual? El agente compara las capturas de pantalla
Para una suite versionada y headless que corra sin supervisión en CI, o para probar en Firefox y WebKit, conserva Playwright. ego (lite) es el ciclo rápido, sin scripts, mientras construyes.
Cómo los agentes de IA manejan ego (lite)
El agente maneja el navegador escribiendo un solo programa completo de JavaScript. Una única llamada agrupa cada paso (abrir la tienda, agregar un producto, esperar el checkout) y los corre en secuencia dentro del navegador, así que el agente nunca espera a que una acción termine para mandar la siguiente.
Maneja justo lo que suele hacer inestables las pruebas de navegador
Corrimos los escenarios que los desarrolladores dicen que son los más difíciles de automatizar. Con ego (lite), los agentes los resolvieron todos. Su snapshot semántico se genera dentro del propio motor de renderizado de Chromium, así que ve dentro de shadow roots e iframes de otro documento donde los scripts inyectados quedan ciegos.
Shadow DOM
Acts inside web-component shadow roots, where injected scripts go blind.
Payment iframes
Fills card fields inside cross-document iframes, like a Stripe checkout.
Custom date pickers
Picks a date range in a custom calendar with no test ids.
Drag and drop
Real HTML5 drag: moves a kanban card, the board follows.
Infinite scroll
Scrolls a lazy feed until every item is loaded, no hand-tuned waits.
Paginated tables
Walks every page of an admin table and pulls each row.
Conditional modals
Cookie banners and dialogs that pop up mid-flow get handled, not tripped over.
Autocomplete
Types an address, waits for the suggestions, picks the right one.
Y un clic que cae en un botón cubierto o deshabilitado se reporta como fallo, no como un falso positivo, igual que lo trataría un framework de pruebas real.
Tu navegador con sesión iniciada, siempre bajo tu control
Dejar suelto a un agente en el navegador donde tienes tu sesión iniciada es algo válido para detenerse a pensar. Aquí están los límites.
Trabaja en su propio Space
El agente corre en un espacio de trabajo separado dentro del navegador. Comparte tus sesiones iniciadas, pero tus pestañas y ventanas quedan intactas.
Cada paso es visible
Un navegador real y visible en tu Mac, no un proceso headless oculto. Ve la corrida en vivo, e interrúmpela desde el CLI de tu agente en cualquier momento.
Nada sale de tu Mac
El historial, las cookies y las sesiones se quedan en tu computadora. ego (lite) no las sube a ningún lado.
Y cuando un flujo tiene efectos reales, un checkout que cobra de verdad o un borrado que borra de verdad, apunta al agente a localhost o a staging, de la misma forma en que lo probarías tú a mano.
Cómo usarlo, paso a paso
Pruebas de tu web en tres pasos: apunta tu agente a localhost o a cualquier URL, dile qué revisar, y recibe de vuelta qué falló.
Un navegador Chromium que usas a diario. Un clic importa tus sesiones de Chrome, así que el agente prueba como si fueras tú.
¿Qué debería probar?
/ego-browser Abre localhost:3000, recorre el checkout, y dime qué está roto
Escribe /ego-browser y solo di qué revisar, en cualquier idioma que tu agente entienda.
| Página | Resultado |
|---|---|
| /checkout | OK |
| /product/gift-card | error de consola |
| /product/camera | imagen 404 |
Cada página rota vuelve con el error de consola o la solicitud fallida que la explica, no solo un pasa o falla.
Dónde encaja ego (lite), y dónde no
Hecho para el ciclo rápido de desarrollo: reproducir, depurar y verificar mientras construyes.
En qué es muy bueno ego (lite)
El ciclo de desarrollo, en un navegador real.
- Reproduce y depura un bug en un navegador real, con sesión iniciada
- Prueba flujos detrás de un inicio de sesión sin automatizar el login
- Lee errores de consola, solicitudes fallidas y el estado de la página
- Corre checks exploratorios en muchas páginas en paralelo
- Verifica un arreglo en la misma sesión donde encontraste el bug
Cuándo recurrir a Playwright
Honestos sobre el límite.
- Suites de regresión headless que corren sin supervisión en CI (ego (lite) es un navegador de Mac con interfaz visible)
- Pruebas en Firefox y WebKit (ego (lite) es Chromium)
- Una suite de pruebas versionada y determinista que commiteas y es tuya
Dale a tu agente un navegador real donde probar
Descargar ego (lite) para MacFAQ
No. Usas el agente de IA que ya tienes, como Claude Code, OpenAI Codex o Cursor, y le dices en lenguaje natural qué revisar. El agente escribe y ejecuta los pasos en el navegador por ti. No hay archivos .spec que mantener ni selectores CSS que escribir a mano, porque ego (lite) ubica los elementos a partir de un snapshot semántico de la página.
Playwright MCP es un servidor MCP que tu agente maneja con una llamada de herramienta por acción, así que una tarea de quince pasos significa quince idas y vueltas al modelo, lento y caro en tokens. ego (lite) es el navegador mismo: el agente escribe una sola pasada corta de JavaScript que corre muchos pasos a la vez, en tu navegador real con tu sesión iniciada. En nuestra prueba con la misma tarea en Claude Code con Opus 4.8, ego (lite) terminó en unos 18 segundos con 2 idas y vueltas al modelo, contra unos 43 segundos y 9 idas y vueltas de Playwright MCP. Además corre muchas tareas de prueba en paralelo, cada una en su propio Space, algo que un solo navegador MCP no puede hacer.
Sí, y aquí es donde brilla de verdad. ego (lite) es tu propio navegador de todos los días, ya con la sesión iniciada, así que el agente prueba dashboards, paneles de admin internos y flujos de cuenta sin que tengas que construir antes una automatización de login. Como se comporta como una sesión humana real, también es mucho menos probable que active CAPTCHAs o detección de bots que un navegador headless o recién abierto.
Cada tarea corre en su propio Space, un espacio de trabajo separado dentro del mismo navegador, como ventanas extra del mismo perfil. Los Spaces comparten tus sesiones iniciadas pero mantienen sus propias páginas, así que las corridas en paralelo no chocan entre sí ni con las pestañas en las que estás trabajando. Para una web se ve como un solo usuario con sesión iniciada y varias pestañas abiertas. Si tu app permite solo una sesión activa por cuenta, corre esos flujos uno a la vez o usa una cuenta de prueba.
Sí, en el sentido de que el agente captura una captura de pantalla de referencia y una nueva, las compara pixel por pixel, y te dice qué cambió y dónde. Es el agente haciendo el diff en tu navegador, no un producto aparte de pruebas visuales que haya que configurar, así que no hay que conectar Percy ni Chromatic. Para un servicio administrado de baselines con flujos de revisión y control de acceso en CI, una herramienta dedicada de pruebas visuales sigue siendo la mejor opción.
Por ahora no. ego (lite) es un navegador real y visible en tu Mac, hecho para probar mientras desarrollas: reproducir un bug, depurarlo, verificar el arreglo, correr checks en tus páginas. Para una suite headless que corra sin supervisión en CI, o para probar en Firefox y WebKit, conserva tu suite de Playwright. ego (lite) es el ciclo rápido de desarrollo, no el runner de CI.
Problemas funcionales y de runtime con los que se toparía un usuario real: un flujo que se rompe, un botón que no hace nada, un error de JavaScript no capturado, una solicitud de red fallida, un error de consola, un valor que sale mal. El agente lee el estado de la página junto con la consola y la red, así que reporta qué falló y dónde, no solo un verde o un rojo.
El agente trabaja en su propio Space, así que tus pestañas y ventanas quedan intactas, y todo pasa en una ventana de navegador real y visible que puedes ver e interrumpir desde el CLI de tu agente en cualquier momento. Tus datos de navegación se quedan en tu propia computadora: ego (lite) no sube tu historial, cookies ni sesiones a ningún lado. Para flujos con efectos reales, como un checkout que de verdad cobra, apunta al agente a localhost o a staging, igual que lo probarías tú a mano. Si conectas un agente o proveedor de modelo externo, ese proveedor tiene su propia política de datos.