ego (lite) n’est qu’un navigateur ; ego est votre agent personnel sur tous vos appareils.
Rejoindre la liste d'attente
Automatisation webNavigateur pour agents IAMultitâcheChromiumalternative au agent-browser

Le navigateur le plus rapide pour agents IA

21 mai 20268 lecture min.
Une main robotique pointant vers l'écran d'un Macintosh rétro affichant l'interface de navigation parallèle d'ego (lite), avec plusieurs cartes d'espace de travail

ego (lite) est un navigateur dans lequel vous et vos agents IA travaillez en parallèle. Vos onglets restent disponibles pendant que les agents exécutent plusieurs tâches dans leurs propres Spaces, plus rapidement et avec moins de tokens.

Depuis un an, beaucoup d'entre nous essaient de faire faire ( Claude Code, Codex, Continue) de la vraie automatisation de navigateur dans un vrai navigateur à des agents IA. Extraire une liste depuis un back-office connecté. Remplir un formulaire fournisseur. Faire de la QA dans un environnement de staging. Les outils pour ça existent, et pourtant l'expérience concrète reste laborieuse.

ego (lite) est notre réponse à ce problème.

Qu'est-ce qu'ego (lite)

ego (lite) est profondément intégré à l’écosystème Chrome. Il utilise le même moteur que Chrome et reprend tous vos favoris, extensions et sessions connectées. Vous n’avez pas à changer vos habitudes de navigation : tout fonctionne immédiatement.

Ce qui le distingue vraiment, c'est son support natif pour les agents :

  • Une base de code, pas une base CLI, pour des exécutions plus rapides et moins de jetons sur des tâches complexes. Les capacités qu'ego (lite) expose à l'agent sont enveloppées en fonctions JavaScript que l'agent appelle directement. L'agent fait ce qu'il sait faire de mieux : écrire du code, en composant une tâche à plusieurs étapes en une seule sortie, au lieu de rester coincé dans une boucle « appeler deux commandes, regarder le résultat, en appeler deux autres ». Comparé à l'approche CLI classique, les workflows complexes se terminent 20 à 50 % plus vite, avec un meilleur taux de réussite et bien moins d'appels d'outils par tâche. Le même schéma apparaît dans nos benchmarks internes face à agent-browser de Vercel : plus le workflow est difficile, plus l'écart se creuse.
  • Un Space dédié pour chaque agent. ego (lite) donne à chaque agent son propre Space entièrement isolé. Vous naviguez au premier plan pendant que l’agent travaille en arrière-plan, sans interférence. Vous voyez à tout moment dans quel Space un agent est actif et pouvez reprendre la main ou l’arrêter. Si vous avez déjà utilisé des outils comme agent-browser reliés à Chrome, vous connaissez le désordre des fenêtres et onglets qui surgissent partout. ego (lite) résout le problème à la source.
  • Vos agents mènent plusieurs tâches en parallèle dans des Spaces, des espaces de travail parallèles dans le même navigateur. Chaque Space a son propre agent IA ou sa propre tâche, tous exécutés en même temps. Claude Code enrichit 10 leads dans 10 Spaces en parallèle. Codex scrape 5 sites concurrents dans 5 autres. Ils ne se percutent jamais et ne volent pas vos onglets. Votre souris reste exactement où vous l'avez laissée.
  • Le Snapshot de page le plus puissant du marché. Grâce à sa personnalisation au niveau du noyau, ego (lite) génère des Snapshots de page de très haute qualité, la vue sur laquelle les modèles de texte s’appuient pour « voir » une page web et agir dessus. Il gère de façon fiable les cas difficiles, comme les iframes profondément imbriquées, là où les autres approches échouent régulièrement.
  • N’importe quel agent peut le faire passer ego-browser. ego-browser est la couche de connexion entre n’importe quelle CLI d’agent — Claude Code, Codex, Cursor ou une CLI personnalisée — et ego (lite). Il expose le navigateur sous forme d’outils JavaScript exécutés dans la page : snapshot, fill, click, wait, navigate et capture. L’agent écrit un extrait JavaScript qui appelle ces outils, puis ego-browser l’exécute sur la page en une seule passe.
  • Une accumulation d'expérience qui rend votre agent plus rapide à mesure que vous l'utilisez (bientôt disponible). Lors d’une tâche de navigateur, un agent passe le plus clair de son temps à essayer et corriger. La Skill officielle d’ego (lite) transforme chaque action réussie en outils et workflows réutilisables, si bien que les tâches similaires suivantes peuvent s’exécuter jusqu’à 5 fois plus vite. Nous y reviendrons plus loin.

Pourquoi on a construit ego (lite)

On a un avis sur la question « l'interface graphique est-elle en train de mourir ». L'interface graphique est là pour durer. Ce qui va changer à la racine, c'est qui la fournit. Aujourd'hui, chaque plateforme livre sa propre interface préconstruite. Demain, votre agent personnel vous en génère une à la volée.

C'est l'avenir. La réalité d'aujourd'hui, c'est que les agents doivent déjà accomplir beaucoup de vrai travail, et le monde n'est pas encore conçu pour eux. De nombreux services n'ont toujours ni API ni MCP. Les infos et fonctionnalités restent enfermées dans l'interface graphique, pensée pour un utilisateur humain. Si vous avez déjà essayé d'utiliser Codex ou Claude Code pour faire de la recherche, ou pour avancer sur un travail qui dépend d'un outil SaaS, vous savez ce que ça veut dire : l'agent doit encore ouvrir un navigateur et dialoguer avec ce vieux monde.

Alors de plus en plus de produits d'agents se greffent un navigateur. Certains embarquent un navigateur allégé directement dans le client. D'autres livrent une extension qui fait le pont vers votre Chrome existant. Aucune de ces approches ne fonctionne vraiment bien. Le pont vers Chrome est instable : les sessions connectées se transfèrent parfois, parfois non, des onglets s'ouvrent dans de nouvelles fenêtres sans raison, les modes avec ou sans interface deviennent incontrôlables. L'approche embarquée n'est pas un vrai navigateur, et elle s'effondre dès que ça se complique.

Il y a une raison plus profonde à cet échec collectif. Le navigateur n'a jamais été conçu pour un agent. Chaque détail d'interaction dans Chrome — onglets, fenêtres, navigation, permissions — a été construit autour d'un utilisateur humain. Personne ne s'est demandé comment un agent autonome pourrait l'utiliser. Les outils-ponts et les outils embarqués sont tous les deux des rustines sur un système qui n'a jamais laissé de place à un agent. Les problèmes en sont la conséquence naturelle.

L'autre moitié du problème : aucun de ces outils n'a vraiment réfléchi à ce que devrait être un navigateur pour un agent. Certains sur-encapsulent le navigateur et ne donnent à l'agent que quelques commandes CLI, sous-estimant ce qu'un agent peut orchestrer par lui-même. D'autres font l'inverse, exposent le protocole brut, et déversent tout le bruit sur le modèle.

C’est pour cette raison que nous avons créé ego (lite). Nous voulions repenser le navigateur depuis ses fondations et en faire le lien le plus fluide possible entre vous, votre agent et le web.

Comment on a construit ego (lite)

Avant d’écrire du code, nous devions régler une question : comment un agent doit-il interagir avec un navigateur ?

Notre réponse tenait en trois couches.

La première couche, c'est la vision et l'action. L'agent « voit » la page comme le ferait un humain, puis clique, saisit du texte, fait défiler. C'est le socle que tout navigateur devrait offrir à un agent.

La deuxième couche, ce sont des appels de méthode enveloppés. On a pris les opérations qui reviennent souvent — Snapshot étant la plus emblématique — et on leur a donné des abstractions propres. On s'est retenus volontairement : pas question d'empiler une centaine de méthodes. L'objectif était de garder l'abstraction précise, pas exhaustive.

La troisième couche, c'est l'accès direct aux capacités sous-jacentes du navigateur. Quand l'agent a vraiment besoin d'un contrôle brut, elle est là.

L'intérêt des trois couches, c'est que l'agent choisit celle qui convient à la tâche. Un simple clic n'a pas besoin d'un appel de protocole brut. Un parcours complexe n'est pas comprimé dans une seule commande CLI.

Pourquoi JavaScript, et pas Python ou Shell

Le code plutôt que la CLI, c'est le choix architectural. Dans ce cadre, pourquoi JavaScript et pas Python ou Shell ? Deux raisons ont motivé ce choix.

La première raison est la charge cognitive. Ce qu’ego (lite) injecte dans la page est déjà du JavaScript. Si le code d’orchestration en arrière-plan utilisait un autre langage, l’agent devrait changer de syntaxe entre deux contextes à chaque tâche. Cette friction est inutile. Avec un seul langage pour toute la tâche, l’agent n’a qu’un mode de raisonnement à gérer.

La deuxième raison est la stabilité de l’environnement. Nous ne pouvons pas supposer que chaque utilisateur dispose de Python ou d’un shell identique au nôtre. Au lieu de dépendre de son environnement, nous fournissons le runtime. Nous réutilisons le moteur V8 déjà présent dans le navigateur, allégeons le reste de Node.js et intégrons un runtime Node complet à ego (lite). L’installation ne grossit que de 6 Mo.

Quelle est la vitesse d'ego (lite) ?

Nous avons comparé ego (lite) à agent-browser de Vercel sur quatre tâches complexes d’automatisation de navigateur. ego (lite) a terminé chaque tâche jusqu’à 3,45 fois plus vite, avec nettement moins de tokens.

Graphique comparant ego (lite) et agent-browser de Vercel sur quatre tâches réelles d'automatisation web — scraper des posts X, candidater sur LinkedIn, estimer un prêt Redfin, réserver un vol Expedia. ego (lite) est plus rapide et moins cher sur chaque tâche, tandis qu'agent-browser est bloqué par la détection de bots sur la réservation Expedia.

Plus la tâche est difficile, plus l'écart se creuse.

Deux décisions de conception ont fait la différence. D'abord, l'interaction JavaScript à trois couches décrite plus haut : l'agent écrit un seul extrait qui exécute plusieurs actions en une passe, au lieu d'enchaîner un appel CLI à la fois. Ensuite, le Snapshot au niveau du noyau intégré dans notre moteur Chromium personnalisé, qui atteint les iframes cross-origin, le Shadow DOM et les widgets SDK tiers que les Snapshot en couche JavaScript laissent silencieusement de côté.

Plus vous l'utilisez, plus il devient rapide (bientôt disponible)

Nous testons un mécanisme d’accumulation d’expérience dans la Skill officielle d’ego (lite). Chaque tâche réussie est transformée en outils et workflows réutilisables, propres à chaque domaine. Lors d’une tâche similaire, votre agent charge ces outils et évite les essais et erreurs.

La version idéale, ce serait que l'agent capture son expérience tout en exécutant la tâche. C'est ce qu'on a essayé en premier. Les résultats d'évaluation nous ont fait reculer. Quand on demande au modèle d'optimiser à la fois la tâche elle-même et la capture d'expérience dans la même exécution, le taux de réussite chute et l'exécution ralentit. Vouloir bien faire les deux à la fois, c'est ne bien faire ni l'un ni l'autre.

On a donc scindé ça en deux phases. Pendant l'exécution, l'agent se concentre sur la tâche et ne fait rien d'autre. Une fois la tâche terminée, une phase d'accumulation séparée démarre, où l'agent lit la documentation pertinente et construit ses outils et ses leçons. Cette approche de divulgation progressive a atteint le gain de vitesse qu'on cherchait. Les tests internes sur des tâches complexes montrent que les runs suivants vont jusqu'à 2,6 fois plus rapide que la première tentative, avec beaucoup moins de jetons.

L'UX, c'est encore ce qui ne nous satisfait pas. Une fois la tâche finie, l'utilisateur doit attendre l'étape d'accumulation avant d'obtenir le résultat final, et cette attente n'est pas encore fluide. Une piste qu'on envisage : laisser l'utilisateur décider. Lui laisser le choix de déclencher une capture d'expérience après une tâche. Pas d'attente forcée, et plus de contrôle sur la façon dont son agent progresse.

On est encore en train de peaufiner ça, et on le déploiera largement une fois que ce sera au niveau.

La place d’ego (lite) dans notre architecture est simple : un navigateur qui fonctionne aussi bien pour vous que pour vos agents, ni plus ni moins.

Quelle est la différence entre ego (lite) et les outils existants

Fonctionnalitéego (lite)Browser Useagent-browser (Vercel)ChatGPT AtlasPerplexity Comet
Multitâche
Skills réutilisables
Reprend les données de Chrome
Le même navigateur, un espace de travail séparé
Entrée sémantique compressée
Pilotable par des agents externes
Données stockées en local
Aucune friction de connexion
Navigateur du quotidien
Gratuit

Pourquoi on s'appelle « ego »

La culture actuelle mise beaucoup sur le « low ego ». On comprend l'intention : trop d'ego peut vraiment blesser les autres. Mais la tendance est allée trop loin. C'est devenu une rhétorique qui présente l'auto-effacement comme une vertu, et qui réduit les gens à des rouages dans une machine bien plus grande.

Alors que l'IA prend en charge de plus en plus de travail, on pense l'inverse. C'est le moment de reconsidérer ce que vaut le « soi ». Plus l'outil devient puissant, plus le jugement humain, la personnalité et la pensée indépendante qui sont derrière deviennent précieux. Il ne faut pas les diluer. Il faut les amplifier.

Le vrai danger, ce n'est pas que les ordinateurs se mettent à penser comme les hommes, mais que les hommes se mettent à penser comme des ordinateurs.

Alors on l'a appelé ego. Pas un appel à l'égoïsme. Un pari : votre intuition, votre identité et votre propre jugement méritent d'être protégés, tout simplement.

Le terme « lite » dans ego (lite) signifie qu’il ne s’agit pas de l’intégralité d’ego. La version complète d’ego inclut un agent personnel, un environnement sandbox dans le cloud, des capacités système qui dépassent le navigateur et un système de mémoire. Nous proposons les deux comme des produits distincts.

Essayez-le

Aujourd’hui, ego (lite) est gratuit sur macOS ; Windows et Linux figurent sur la feuille de route. Toutes les actions du navigateur sont pilotées par votre propre agent, et non par nos serveurs. C’est ce qui nous permet de garder ego (lite) gratuit pour les particuliers.

L'onboarding vous pose une seule question (migrer ou non vos données Chrome) et gère le reste.

Si la connexion d’un agent IA à un véritable navigateur vous a frustré, essayez ego (lite) : vous ne serez pas déçu.

Un dernier point important : ego (lite) donne à votre agent de véritables capacités de contrôle du navigateur, aussi bien pour lire les pages que pour exécuter des actions. Assurez-vous donc que l’agent autorisé à le piloter provient d’une source fiable.