Ejecuta muchos tests del navegador en paralelo con tu agente de IA, de forma automática
Playwright MCP maneja el navegador una llamada a herramienta cada vez: lento y caro en tokens. Ahora Claude Code o Codex ejecutan todo el test en ego (lite) con unas pocas líneas de código: 2,4 veces más rápido, y corren muchos tests en paralelo, cada uno en su propio Space.
Testea tu web con solo pedirlo
Por ejemplo, le pido a Codex que revise si esta tienda online tiene algún bug. Codex ejecuta todo el test, corrige los bugs y me cuenta el resultado. Lo único que tengo que hacer es mirar TikTok mientras trabaja.
La misma página pasa de rota a correcta, en pantalla
Las páginas de producto se renderizan rotas. El agente las revisa en ego (lite), corrige el CSS en el código fuente, y la página abierta se vuelve a renderizar correctamente en pantalla.
Testea tu web a toda velocidad con ego (lite)
La forma habitual de testear un navegador es usar Playwright MCP o Chrome DevTools MCP, que ejecutan una llamada a herramienta cada vez: cada paso siguiente espera a que el modelo lea el último resultado, lento y caro. Ahora los agentes pueden ejecutar muchos pasos en una sola pasada de código JS con ego (lite), así que termina antes y cuesta menos tokens.
| ego (lite) | Playwright MCP | Chrome DevTools MCP | |
|---|---|---|---|
| Cómo lo maneja el agente | A través del skill /ego-browser | Servidor MCP externo. Una llamada a herramienta por acción. | Servidor MCP externo. Una llamada a herramienta por acción. |
| Configuración | Sin configuración, funciona con cualquier agente. | instalación con npx, modos de lanzamiento que configurar, errores frecuentes al arrancar y al detectar Chrome. | Depuración remota, user-data-dir, configuración entre hosts. |
| Consumo de tokens | Bajo. Sin esquemas de herramientas MCP, y solo entra en el contexto lo que el agente registra: un Snapshot por pasada, no uno después de cada acción. | Alto. Hay usuarios que reportan un consumo de tokens 6 veces mayor y desbordamientos de contexto de 200 000 tokens. | Alto. Las capturas de pantalla consumen muchos tokens. |
| Estado de la sesión | Tu propio navegador con sesión iniciada. El mismo estado de sesión que tu Chrome | Navegador aislado por defecto; para heredar sesiones hace falta modo extensión o configurar storage-state. | Puede conectarse a tu sesión, pero se apodera de las pestañas que estás usando. |
| iframe / shadow DOM / widgets de SDK | Su Snapshot de página está integrado en el motor de renderizado, así que lee dentro de todos ellos. | El snapshot de accesibilidad tiene un punto ciego con los iframes. | DOM en bruto, lo gestionas tú mismo. |
| Consola / red / traza | Consola, red y trazas, leídas directamente de los datos de Chrome DevTools. | Consola, red, capturas de pantalla. | El más profundo: Lighthouse, rendimiento, memoria. |
| Estabilidad de los localizadores | Se ancla a etiquetas semánticas, sobrevive a cambios de clase. | Referencias / accesibilidad, bastante estable. | Selectores de DOM en bruto. |
| Captcha / detección de bots | Sesión humana real, la menos propensa a activar detecciones. | Navegador aparte / headless, a menudo detectado. | Mejor cuando se conecta a tu sesión, pero se apodera de tus pestañas. |
| Tareas en paralelo | Pensado desde el principio para ejecutar muchas tareas a la vez mediante Space. | Una sesión por servidor; ejecutar en paralelo implica gestionar instancias aisladas adicionales. | Instancia única, un número alto de pestañas la hace fallar. |
La fricción nunca fue el navegador. Era la capa intermedia.
En foros de desarrolladores y en los issues, la mayoría de quejas son sobre el MCP: es la capa entre tu agente y el navegador, y ahí es donde se cae la conexión, se acumulan las aprobaciones, se rompe la sesión y se disparan los tokens. ego (lite) ya lo tiene todo configurado, así que se acabaron los errores raros.
El navegador funciona. La conexión con él, no.
- Conexión: las herramientas aparecen pero el agente no las llama, las ejecuciones se atascan en "esperando aprobación", y el mismo servidor se comporta de forma distinta en cada cliente
- Aprobaciones: una ventana emergente por cada llamada a herramienta, a menudo entre 10 y 30 en una sola tarea, incluso con "ejecutar todo" activado
- Fiabilidad: una tarea que se queda a medias, o una navegación que ya tuvo éxito pero aun así agota el tiempo de espera
Sin nada intermedio: ego (lite) es el navegador en sí
- Estable por diseño: el agente habla directamente con un navegador local propio, sin ningún transporte MCP intermedio que se caiga o se atasque
- Menos aprobaciones: una sola pasada ejecuta muchos pasos en vez de una llamada a herramienta por acción
- Predecible: se integra con cualquier agente de IA, siempre de la misma forma
Sin scripts de test. Sin selectores que mantener. Solo di qué comprobar.
Playwright, Cypress, Selenium: tú escribes el test, tú mantienes los selectores, y un cambio de nombre de clase o de maquetación los rompe. ego (lite) toma una comprobación en lenguaje natural y localiza los elementos por lo que significan, así que un cambio de interfaz no rompe el test.
Tú escribes el spec, tú mantienes los selectores
- Escribir y versionar a mano un
.specpara cada flujo que quieras cubrir - Fijar selectores como
page.click(".btn-x7f3")que se rompen la próxima vez que cambia la interfaz - Añadir esperas y reintentos tú mismo para lidiar con los tests inestables
- Construir una automatización de login o archivos de storage-state para testear tras un inicio de sesión
- Volver a ejecutar y reparar la suite después de cada rediseño
Solo dile qué comprobar
- Sin ningún spec que escribir: dile a tu agente la comprobación en una frase
- Localiza los elementos por su significado, no por una clase CSS, así que un cambio de nombre o de orden no lo rompe
- Las esperas inteligentes gestionan el contenido asíncrono, sin sleeps hechos a mano
- Testea tras tu inicio de sesión sin automatizar el login
- ¿Necesitas testing de regresión visual? El agente compara las capturas de pantalla
Para una suite versionada y headless que corra sola en CI, o para testear en Firefox y WebKit, sigue usando Playwright. ego (lite) es el ciclo rápido de desarrollo, sin ningún script, mientras construyes.
Cómo manejan ego (lite) los agentes de IA
El agente maneja el navegador escribiendo un único programa JavaScript completo. Una sola llamada agrupa todos los pasos: abrir la tienda, añadir un producto, esperar al checkout, y los ejecuta en secuencia dentro del navegador, así que el agente nunca espera a que vuelva una acción antes de enviar la siguiente.
Se encarga de lo que normalmente hace inestables los tests de navegador
Pusimos a prueba los escenarios que los desarrolladores dicen que son más difíciles de automatizar. Con ego (lite), los agentes las resolvieron todas. Su Snapshot semántico se genera dentro del propio motor de renderizado de Chromium, así que ve dentro de shadow roots e iframes entre documentos donde los scripts inyectados se quedan ciegos.
Shadow DOM
Acts inside web-component shadow roots, where injected scripts go blind.
Payment iframes
Fills card fields inside cross-document iframes, like a Stripe checkout.
Custom date pickers
Picks a date range in a custom calendar with no test ids.
Drag and drop
Real HTML5 drag: moves a kanban card, the board follows.
Infinite scroll
Scrolls a lazy feed until every item is loaded, no hand-tuned waits.
Paginated tables
Walks every page of an admin table and pulls each row.
Conditional modals
Cookie banners and dialogs that pop up mid-flow get handled, not tripped over.
Autocomplete
Types an address, waits for the suggestions, picks the right one.
Y un clic que cae sobre un botón tapado o deshabilitado se reporta como fallo, no como un falso positivo, igual que lo trataría un framework de testing real.
Tu navegador con sesión iniciada, siempre bajo tu control
Dejar a un agente suelto en el navegador donde tienes sesión iniciada es algo sobre lo que merece la pena pararse a pensar. Aquí están los límites.
Funciona en su propio Space
El agente se ejecuta en un espacio de trabajo aparte dentro del navegador. Comparte tus sesiones, pero tus pestañas y ventanas quedan intactas.
Cada paso es visible
Un navegador real y visible en tu Mac, no un proceso headless oculto. Observa la ejecución en directo e interrúmpela desde la CLI de tu agente en cualquier momento.
Nada sale de tu Mac
El historial, las cookies y las sesiones se quedan en tu ordenador. ego (lite) no las sube a ningún sitio.
Y cuando un flujo tiene efectos reales, un checkout que cobra o un borrado que borra de verdad, apunta al agente a localhost o a staging, igual que lo testearías a mano.
Cómo usarlo, paso a paso
Testing de aplicaciones web en tres pasos: apunta tu agente a localhost o a cualquier URL, dile qué comprobar, y recibe de vuelta qué ha fallado.
Un navegador Chromium que usas cada día. Un clic importa tus sesiones de Chrome, así que el agente testea como si fueras tú.
¿Qué debería testear?
/ego-browser Abre localhost:3000, recorre el checkout y dime qué está roto
Escribe /ego-browser y solo di qué comprobar, en el idioma que entienda tu agente.
| Página | Resultado |
|---|---|
| /checkout | OK |
| /product/gift-card | error de consola |
| /product/camera | imagen 404 |
Cada página rota vuelve con el error de consola o la petición fallida que lo explica, no solo un aprobado o suspendido.
Dónde encaja ego (lite), y dónde no
Pensado para el ciclo rápido de desarrollo: reproducir, depurar y verificar mientras programas.
En qué destaca ego (lite)
El ciclo rápido de desarrollo, en un navegador real.
- Reproduce y depura un bug en un navegador real y con sesión iniciada
- Testea flujos tras un inicio de sesión sin automatizar el login
- Lee errores de consola, peticiones fallidas y el estado de la página
- Ejecuta comprobaciones exploratorias en muchas páginas a la vez
- Verifica una corrección en la misma sesión donde encontraste el bug
Cuándo recurrir a Playwright
Claro sobre dónde está el límite.
- Suites de regresión headless que corren solas en CI (ego (lite) es un navegador de Mac con interfaz visible)
- Testing en Firefox y WebKit (ego (lite) es Chromium)
- Una suite de tests versionada y determinista que tú mantienes y subes a tu repositorio
Dale a tu agente un navegador real donde testear
Descarga ego (lite) para MacFAQ
No. Usas el agente de IA que ya tengas, como Claude Code, Codex o Cursor, y le dices en lenguaje natural qué comprobar. El agente escribe y ejecuta los pasos del navegador por ti. No hay ningún archivo .spec que mantener ni selectores CSS que escribir a mano, porque ego (lite) localiza los elementos a partir de un Snapshot semántico de la página.
Playwright MCP es un servidor MCP que tu agente maneja con una llamada a herramienta por acción, así que una tarea de quince pasos significa quince viajes de ida y vuelta al modelo, lento y caro en tokens. ego (lite) es el navegador en sí: el agente escribe un único fragmento corto de JavaScript que ejecuta muchos pasos a la vez, sobre tu navegador real y con sesión iniciada. En nuestra prueba con la misma tarea en Claude Code con Opus 4.8, ego (lite) terminó en unos 18 segundos con 2 idas y vueltas al modelo, frente a unos 43 segundos y 9 idas y vueltas de Playwright MCP. Además, ejecuta muchas tareas de test en paralelo, cada una en su propio Space, algo que un único navegador MCP no puede hacer.
Sí, y aquí es donde brilla. ego (lite) es tu propio navegador de cada día, ya con sesión iniciada, así que el agente testea paneles, administración interna y flujos de cuenta sin que antes tengas que construir una automatización de login. Como se comporta como una sesión humana real, también es mucho menos probable que active captchas o detección de bots que un navegador headless o recién lanzado.
Cada tarea se ejecuta en su propio Space, un espacio de trabajo aparte dentro del mismo navegador, como ventanas extra del mismo perfil. Los Space comparten tus sesiones pero mantienen sus propias páginas, así que las ejecuciones en paralelo no chocan entre sí ni con las pestañas en las que estás trabajando. Para una web, parece un único usuario con sesión iniciada y varias pestañas abiertas. Si tu aplicación solo permite una sesión activa por cuenta, ejecuta esos flujos de uno en uno o usa una cuenta de prueba.
Sí, en el sentido de que el agente captura una captura de referencia y otra nueva, las compara píxel a píxel, y te dice qué ha cambiado y dónde. Es el propio agente haciendo la comparación en tu navegador, no un producto de testing visual aparte que configurar, así que no hace falta integrar Percy ni Chromatic. Para un servicio gestionado de referencias con flujos de revisión y control en CI, sigue siendo mejor opción una herramienta de testing visual dedicada.
Hoy no. ego (lite) es un navegador real y visible en tu Mac, pensado para testear mientras desarrollas: reproducir un bug, depurarlo, verificar la corrección, comprobar tus páginas. Para una suite headless que corra sola en CI, o para testear en Firefox y WebKit, sigue usando tu suite de Playwright. ego (lite) es el ciclo rápido de desarrollo, no el runner de CI.
Problemas funcionales y de ejecución con los que se toparía un usuario real: un flujo que se rompe, un botón que no hace nada, un error de JavaScript sin capturar, una petición de red fallida, un error de consola, un valor que sale mal. El agente lee el estado de la página junto con la consola y la red, así que reporta qué ha fallado y dónde, no solo un verde o un rojo.
El agente trabaja en su propio Space, así que tus pestañas y ventanas quedan intactas, y todo ocurre en una ventana de navegador real y visible que puedes observar e interrumpir desde la CLI de tu agente en cualquier momento. Tus datos de navegación se quedan en tu propio ordenador: ego (lite) no sube tu historial, tus cookies ni tus sesiones a ningún sitio. Para flujos con efectos reales, como un checkout que cobra de verdad, apunta al agente a localhost o a staging, igual que harías tú al testear a mano. Si conectas un agente o proveedor de modelo externo, ese proveedor tiene su propia política de datos.