
ego (lite) es un navegador donde tú y tus agentes de IA trabajáis en paralelo. Tus agentes ejecutan varias tareas de navegador en sus propios Space mientras tus pestañas siguen siendo tuyas, y las tareas terminan más rápido con menos tokens.
Durante el último año, muchos hemos intentado que los agentes de IA ( Claude Code, Codex, Continue) para hacer automatización de navegador de verdad en un navegador de verdad. Extraer una lista de un panel de administración con sesión iniciada. Rellenar el formulario de un proveedor. Ejecutar QA en un entorno de staging. Las herramientas para esto existen, y aun así la experiencia real de hacerlo sigue siendo tosca.
ego (lite) es nuestro intento de solucionar esto.
Qué es ego (lite)
ego (lite) está construido en las entrañas del ecosistema de Chrome. El mismo motor que Chrome, con tus marcadores, extensiones y sesiones iniciadas heredados por completo. No tienes que cambiar cómo navegas. Funciona desde el primer momento.
Lo que de verdad lo diferencia es su soporte nativo para agentes:
- Basado en código, no en la CLI, para ejecuciones más rápidas y con menos tokens en tareas complejas. Las funciones que ego (lite) expone al agente están encapsuladas como funciones de JavaScript que el agente llama directamente. Así puede hacer lo que mejor sabe: escribir código y componer una tarea de varios pasos en una sola ejecución, en lugar de quedar atrapado en el bucle «ejecutar dos comandos, mirar el resultado y ejecutar otros dos». Frente al enfoque convencional basado en CLI, los flujos de trabajo complejos terminan entre un 20 % y un 50 % más rápido, con una mayor tasa de éxito y muchas menos llamadas a herramientas por tarea. El mismo patrón aparece en nuestras pruebas internas frente al agent-browser de Vercel: cuanto más complejo es el flujo, mayor es la diferencia.
- Un Space dedicado para cada agente. ego (lite) le da a cada agente su propio Space totalmente aislado. Tú navegas en primer plano, tu agente trabaja en segundo plano, y no se estorban entre sí. Puedes ver qué Space tiene un agente en marcha en cada momento, y tomar el control o detenerlo cuando quieras. Si has usado herramientas tipo agent-browser que se conectan a Chrome, ya conoces el caos de ventanas y pestañas apareciendo por todas partes. ego (lite) lo soluciona de raíz.
- Tus agentes hacen varias cosas a la vez en Space, espacios de trabajo en paralelo dentro del mismo navegador. Cada Space tiene su propio agente de IA o su propia tarea, todo ejecutándose a la vez. Claude Code enriqueciendo 10 leads en 10 Space en paralelo. Codex extrayendo datos de 5 webs de la competencia en 5 Space más. No chocan entre sí ni te roban las pestañas. Tu ratón se queda donde lo dejaste.
- El Snapshot de página más potente del mercado. Gracias a la personalización a nivel de motor, ego (lite) produce los Snapshot de página de mayor calidad, la vista en texto de la que dependen los modelos para "ver" y actuar sobre una página web. Gestiona con fiabilidad casos difíciles como iframes muy anidados, justo donde otros enfoques fallan sistemáticamente.
- Cualquier agente puede manejarlo a través de
ego-browser. ego-browser es la capa de conexión entre cualquier producto de agente (Claude Code, Codex, Cursor o uno propio) y ego (lite). Expone el navegador como un conjunto de herramientas JavaScript dentro de la página: snapshot, fill, click, wait, navigate, capture. El agente escribe un fragmento de JavaScript que llama a esas herramientas, y ego-browser lo ejecuta en la página de una sola vez. - Acumulación de experiencia que hace que tu agente sea más rápido cuanto más lo usas (próximamente). La mayor parte del tiempo que un agente dedica a tareas de navegador se va en prueba y error. El Skill oficial de ego (lite) destila cada acción exitosa en herramientas y flujos reutilizables, así que las tareas parecidas más adelante se ejecutan hasta 5 veces más rápido. Más sobre esto más abajo.
Por qué construimos ego (lite)
Tenemos una opinión sobre la pregunta de si "la interfaz gráfica está muriendo". La interfaz gráfica ha venido para quedarse. Lo que va a cambiar de raíz es quién la proporciona. Hoy cada plataforma ofrece su propia interfaz prediseñada. Mañana tu agente personal te genera una al vuelo.
Ese es el futuro. La realidad hoy es que los agentes ya tienen que hacer mucho trabajo real, y el mundo todavía no está construido para ellos. Muchos servicios siguen sin ofrecer API ni MCP. La información y la funcionalidad se quedan encerradas dentro de la interfaz gráfica, pensada para una persona. Si has intentado usar Codex o Claude Code para investigar, o para sacar adelante un trabajo que depende de una herramienta SaaS, ya sabes lo que eso significa. El agente todavía tiene que abrir un navegador y hablar con este mundo antiguo.
Por eso cada vez más productos de agentes le acoplan un navegador. Algunos incluyen un navegador simplificado embebido en el cliente. Otros incluyen una extensión que se conecta a tu Chrome existente. Ninguno funciona lo bastante bien. El enfoque puente con Chrome es inestable: las sesiones a veces se heredan y a veces no, las pestañas se abren en ventanas nuevas sin motivo, y los modos con o sin interfaz se descontrolan. El enfoque embebido no es un navegador real, y se viene abajo con cualquier cosa mínimamente compleja.
Hay un motivo más profundo por el que todas estas se quedan cortas. El navegador nunca se diseñó pensando en un agente. Cada detalle de interacción en Chrome (pestañas, ventanas, navegación, permisos) se diseñó pensando en una persona. Nadie se preguntó cómo trabajaría con ello un agente autónomo. Tanto las herramientas puente como las embebidas son parches sobre un sistema que nunca dejó espacio para un agente. Los problemas son la consecuencia natural.
La otra mitad del problema: ninguna de estas herramientas se ha planteado en serio qué debería ser realmente un navegador para un agente. Unas envuelven demasiado el navegador y le dan al agente unos pocos comandos de CLI, subestimando lo que un agente puede orquestar por su cuenta. Otras se van al extremo contrario, exponen el protocolo en bruto, y le echan encima al modelo todo el ruido sin procesar.
Por eso construimos ego (lite). Queríamos repensar el navegador desde cero, y convertirlo en la conexión más fluida entre tú, tu agente y la web.
Cómo construimos ego (lite)
Antes de escribir una sola línea de código, tuvimos que resolver una pregunta: ¿cómo debería interactuar un agente con un navegador?
Nuestra respuesta fueron tres capas.
La primera capa es visión y acción. El agente "ve" la página como lo haría una persona, y luego hace clic, escribe, hace scroll. Esta es la base mínima que cualquier navegador debería darle a un agente.
La segunda capa son llamadas a métodos ya envueltos. Tomamos las operaciones que aparecen con frecuencia, siendo Snapshot la más representativa, y les dimos abstracciones limpias. Nos contuvimos a propósito. Nada de amontonar cien métodos. El objetivo era mantener la abstracción precisa, no exhaustiva.
La tercera capa es el acceso directo a las capacidades subyacentes del navegador. Cuando el agente realmente necesita control en bruto, ahí está.
La gracia de las tres capas es que el agente elige la que encaja con la tarea. Un simple clic no necesita una llamada al protocolo en bruto. Un flujo complejo no se fuerza a caber en un único comando de CLI.
Por qué JavaScript, y no Python o Shell
El código por encima de la CLI es la decisión de arquitectura. Dentro de eso, ¿por qué JavaScript y no Python o Shell? Dos motivos lo explican.
El primero es la carga cognitiva. Lo que ego (lite) inyecta en la página ya es JavaScript. Si el código de orquestación en segundo plano estuviera en otro lenguaje, el agente tendría que cambiar de sintaxis entre dos contextos en cada tarea. Eso es fricción innecesaria. Un único lenguaje en toda la tarea significa que el agente solo tiene que pensar en un modo.
El segundo es la estabilidad del entorno. No podemos asumir que todo usuario tiene Python instalado, o un shell que se comporte igual que el nuestro. En vez de depender del entorno del usuario, traemos nosotros mismos el entorno de ejecución. Reutilizamos el motor V8 que ya está dentro del navegador, recortamos el resto de Node.js, e incluimos un entorno de ejecución Node completo dentro de ego (lite). El tamaño de la instalación solo aumenta 6 MB.
¿Qué tan rápido es ego (lite)?
Hicimos un benchmark de ego (lite) frente a agent-browser de Vercel en cuatro tareas complejas de automatización. ego (lite) terminó cada tarea hasta 3,45 veces más rápido, con muchos menos tokens.

Cuanto más difícil la tarea, mayor la diferencia.
Dos decisiones de diseño marcaron la diferencia. Primero, la interacción JavaScript de tres capas descrita arriba. El agente escribe un fragmento que ejecuta muchas acciones en una sola pasada, en vez de encadenar una llamada a CLI cada vez. Segundo, el Snapshot a nivel de motor construido dentro de nuestro Chromium personalizado, que llega a iframes de origen cruzado, shadow DOM y widgets de SDK de terceros que los generadores de snapshot basados en parches JS descartan en silencio.
Cuanto más lo usas, más rápido se vuelve (próximamente)
Estamos probando un mecanismo de acumulación de experiencia dentro del Skill oficial de ego (lite). Cada tarea exitosa se destila en herramientas y flujos reutilizables, acotados por dominio. La próxima vez que tu agente ejecute una tarea parecida, carga esas herramientas y se salta la prueba y error.
La versión ideal de esto sería que el agente capturara experiencia mientras ejecuta la tarea. Lo probamos primero. Los resultados de evaluación nos hicieron dar marcha atrás. Cuando se le pide al modelo que optimice a la vez la tarea en sí y la captura de experiencia en la misma ejecución, la tasa de éxito baja y la ejecución se ralentiza. Intentar hacer las dos cosas bien a la vez significa no hacer bien ninguna.
Así que lo dividimos en dos fases. Durante la ejecución, el agente se centra en la tarea y no hace nada más. Una vez terminada, entra en marcha una fase de acumulación aparte, donde el agente lee la documentación relevante y construye herramientas y lecciones. Este enfoque de revelación progresiva ha logrado la mejora de velocidad que buscábamos. Las pruebas internas en tareas complejas muestran que las ejecuciones repetidas son hasta 2,6 veces más rápido más rápidas que la primera ejecución, con muchos menos tokens.
La experiencia de usuario es donde todavía no estamos satisfechos. Cuando la tarea termina, el usuario tiene que esperar al paso de acumulación antes de recibir el resultado final, y esa espera todavía no es fluida. Una dirección que estamos valorando es poner la acumulación en manos del usuario. Dejar que decida si lanzar una captura de experiencia después de que termine una tarea. Sin espera forzada, y con más control sobre cómo crece su agente.
Todavía lo estamos puliendo, y lo lanzaremos a todo el mundo en cuanto alcance el nivel que buscamos.
El lugar de ego (lite) en nuestro stack es simple: un navegador que funciona tanto para ti como para tus agentes, ni más ni menos.
Cuál es la diferencia entre ego (lite) y las herramientas existentes
| Función | ego (lite) | Browser Use | agent-browser (Vercel) | ChatGPT Atlas | Perplexity Comet |
|---|---|---|---|---|---|
| Multitarea | ✓ | — | — | — | — |
| Skills reutilizables | ✓ | — | — | — | — |
| Hereda los datos de Chrome | ✓ | — | — | ✓ | ✓ |
| El mismo navegador, un espacio de trabajo aparte | ✓ | — | — | — | — |
| Entrada semántica comprimida | ✓ | — | ✓ | — | — |
| Controlable por agentes externos | ✓ | ✓ | ✓ | — | — |
| Datos guardados en local | ✓ | ✓ | ✓ | — | — |
| Sin fricción de inicio de sesión | ✓ | — | — | ✓ | ✓ |
| Navegador de uso diario | ✓ | — | — | ✓ | ✓ |
| Free | ✓ | ✓ | ✓ | — | — |
Por qué nos llamamos "ego"
La cultura actual se inclina fuertemente hacia el "low ego". Entendemos la intención. Demasiado ego puede hacer daño a los demás, es cierto. Pero la tendencia ha ido más allá de lo razonable. Se ha convertido en una retórica que disfraza la autosupresión de virtud, y que reduce a las personas a engranajes de una máquina mucho más grande.
A medida que la IA asume cada vez más trabajo, pensamos justo lo contrario. Este es el momento de volver a preguntarse qué vale el "yo". Cuanto más potente se vuelve la herramienta, más valioso se vuelve el criterio humano, la personalidad y el pensamiento propio que hay detrás. No deberían diluirse. Deberían amplificarse.
El verdadero peligro no es que los ordenadores empiecen a pensar como las personas, sino que las personas empiecen a pensar como ordenadores.
Así que lo llamamos ego. No es una invitación al egoísmo. Es apostar por que tu intuición, tu identidad y tu propio criterio merecen protegerse, antes que nada.
El "lite" de ego (lite) significa que esto no es todo ego. Existe una versión completa de ego con un agente personal, un entorno sandbox en la nube, capacidades a nivel de sistema más allá del navegador, y un sistema de memoria. Lanzamos los dos como productos separados.
Pruébalo
ego (lite) es gratis hoy en macOS. Windows y Linux están en la hoja de ruta. Todas las acciones del navegador las ejecuta tu propio agente, no nuestros servidores. Por eso podemos mantener ego (lite) gratis para uso individual.
La configuración inicial te hace una sola pregunta (si quieres migrar tus datos de Chrome) y se encarga del resto.
Si te has frustrado intentando conectar un agente de IA a un navegador real, prueba ego (lite), no te decepcionará.
Una última cosa que conviene tener presente: ego (lite) le da a tu agente capacidades reales de manejo del navegador, tanto leer el contenido de la página como ejecutar acciones de verdad, así que asegúrate de que el agente al que le dejas manejarlo viene de una fuente en la que confías.