Browser Use
Laisser un agent IA piloter un vrai navigateur : ouvrir des pages, cliquer, saisir, remplir des formulaires
Browser Use est une bibliothèque Python et une CLI open source qui permettent à un LLM de piloter un vrai navigateur — ouvrir des pages, cliquer, saisir du texte et remplir des formulaires — pour qu'un agent puisse faire le travail web derrière lequel il n'existe aucune API. La bibliothèque est sous licence MIT et tourne sur votre propre machine avec le modèle de votre choix ; la même équipe vend un cloud hébergé, et son propre README vous y renvoie pour les CAPTCHA et pour la production. Ce partage résume honnêtement toute la catégorie : piloter le navigateur est la partie résolue, et ne pas se faire bloquer par les sites que vous voulez automatiser est celle qui décide si tout cela fonctionne.
Ce qu'est Browser Use
Browser Use (github.com/browser-use/browser-use) a démarré fin 2024 et compte aujourd'hui parmi les projets d'agents les plus étoilés de GitHub. C'est du Python, sous licence MIT, installé en une ligne sur Python 3.11 ou plus récent. Vous confiez à un agent une tâche en langage courant et un modèle — les modèles maison de l'équipe, ajustés pour la navigation, ou OpenAI, Anthropic et Google atteints par une seule clé, ou quelque chose de local via Ollama — et il travaille la page comme le ferait une personne : il lit ce qui est à l'écran, clique, saisit et extrait ce que vous avez demandé.
Il y a deux portes d'entrée, et se tromper de porte est l'erreur la plus fréquente au début. La bibliothèque Python sert à l'automatisation que vous intégrez à votre propre code : de nombreuses exécutions planifiées ou parallèles, des outils sur mesure, une sortie structurée. La CLI s'adresse à un agent que vous utilisez déjà : installer sa skill laisse un assistant de code prendre la main sur le navigateur pour une mission ponctuelle. La règle du projet mérite d'être reprise : le ponctuel par un agent, le répétable dans du code. Il publie aussi son banc d'essai d'une centaine de tâches de navigation réelles sous forme de dépôt ouvert, ce qui est plus de transparence que n'en offrent la plupart des projets d'agents, et revendique la première place d'un classement public de tâches web de longue haleine — leur mesure, pas la nôtre.
Où cela s'insère dans la panoplie de croissance d'un fondateur
Ce à quoi cela sert vraiment, c'est le travail web sans API et qui n'en aura jamais : des sites dont il faut sortir quelque chose, ou dans lesquels il faut faire entrer quelque chose, et qui n'ont été conçus que pour des humains. Pour une petite équipe, l'ordre raisonnable est celui du coût d'une exécution ratée.
- De la recherche en lecture seule Pages de tarifs des concurrents, journaux de version, fiches de places de marché, pages d'avis : la matière première de l'analyse concurrentielle. Une exécution ratée coûte ici une nouvelle tentative, la façon la moins chère de se tromper.
- Le même formulaire pour la quarantième fois Les inscriptions dans des annuaires et des places de marché sont le cas le plus net : le travail est identique à chaque fois et le gain bien réel, ce qui explique pourquoi se faire référencer dans les annuaires d'outils d'IA est si pénible à la main.
- Votre propre entonnoir, depuis un navigateur vierge S'inscrire en inconnu chaque matin révèle l'étape cassée que votre session connectée ne voit jamais. C'est plus proche du QA que de la croissance, et c'est le point ennuyeux le plus rentable de cette liste — voyez pourquoi personne ne s'inscrit pour ce qui cloche le plus souvent.
- Tout ce qui publie ou dépense Publier, écrire à des inconnus, enchérir. C'est là que l'automatisation doit s'arrêter et qu'une personne doit regarder. Une validation humaine existe précisément pour cette catégorie d'actions, et un agent de navigation compétent n'est pas une raison de la retirer.
Le mur que l'on heurte réellement
Tout récit honnête sur les agents de navigation aboutit au même endroit, et la FAQ du projet y arrive en deux réponses : pour les CAPTCHA elle renvoie à son cloud, pour l'empreinte de navigateur et les proxys, et pour la production elle avertit que Chrome consomme beaucoup de mémoire et que les exécutions parallèles sont pénibles à gérer. Ni l'un ni l'autre n'est un reproche à la bibliothèque. C'est la facture réelle, et mieux vaut la lire avant de bâtir un dispositif de croissance sur des exécutions locales gratuites.
| Ce que vous croyez difficile | Ce qui décide vraiment de l'exécution |
|---|---|
| Apprendre à l'agent à cliquer au bon endroit | Le fait que le site vous serve une page, tout simplement |
| Le coût du modèle par tâche | Proxy, empreinte de navigateur et infrastructure |
| L'échec de l'exécution | L'exécution qui réussit sur une page qui n'a jamais été le vrai contenu |
Cette dernière ligne est la nôtre, et c'est la chose la plus coûteuse que nous ayons apprise sur l'automatisation du web. AgentCeres — l'AI Growth Officer d'agentceres.com — fait tourner des navigateurs automatisés pour la recherche, et face à des sites dotés d'une vraie couche anti-bot nous ne sommes tout simplement jamais passés : le refus arrive au premier octet, avant qu'aucune page ne s'affiche, si bien que le caractère humain du clic ne change rien au résultat, et un plugin de furtivité dont nous attendions de l'aide n'avait en réalité jamais été testé contre cette couche. L'échec silencieux fut le pire. Notre propre vérification du venons-nous de heurter un mur anti-bot ne reconnaissait que les pages de contrôle en anglais : une page de contrôle servie dans une autre langue passait donc pour du contenu ordinaire et était résumée comme si elle était le site. Une exécution bloquée se voit ; une exécution qui renvoie avec aplomb la mauvaise page, non.
Donc : visez le travail web répétitif et peu risqué, budgétez l'infrastructure de navigation au lieu de la supposer gratuite, et placez un second signal sur tout ce qui fonde une décision — une vérification que le contenu est bien celui que vous croyez, et pas seulement qu'une page est revenue. Gardez une personne sur tout ce qui part vers l'extérieur. Cette dernière partie est la forme même du travail d'AgentCeres : une équipe de spécialistes rédige les contenus et les prises de contact, et chaque action sortante attend votre validation avant de partir.
FAQ
- Browser Use est-il gratuit ?
- La bibliothèque l'est, sous licence MIT : elle tourne sur votre machine et le code vous appartient pour le modifier. Ce qui n'est pas gratuit, c'est le modèle : chaque pas de l'agent est un appel au LLM, donc le coût suit le nombre de pages à traverser, pas le nombre de tâches lancées. Le cloud hébergé, avec ses navigateurs furtifs, sa rotation de proxys et ses intégrations, est un produit payant distinct de la même équipe.
- Faut-il coder pour l'utiliser ?
- Pas pour des missions ponctuelles. Installer sa skill CLI permet à un assistant de code que vous utilisez déjà de piloter le navigateur à partir d'une consigne en langage courant. La bibliothèque Python devient le bon choix dès que la même tâche se répète, tourne en parallèle ou vit dans votre propre produit — la règle du projet lui-même est : ponctuel par un agent, répétable dans du code.
- Passe-t-il la détection de bots et les CAPTCHA ?
- Pas de façon fiable sur votre propre machine, et le projet le dit : sa FAQ répond aux CAPTCHA comme à la production en renvoyant vers son cloud, qui fournit proxys et empreinte de navigateur. Prévoyez ce coût. Un site doté d'une vraie couche anti-bot refuse la connexion avant que votre automatisation ait l'occasion d'être maligne, et aucun clic réaliste n'y change quoi que ce soit.
- Que ne faut-il pas automatiser avec un agent de navigation ?
- Tout ce qui publie, écrit à un inconnu ou dépense de l'argent sans qu'une personne l'ait vu d'abord — et tout ce dont les conditions d'utilisation interdisent l'accès automatisé, ce que font beaucoup de plateformes. Le test utile est le coût d'une exécution ratée : un mauvais scraping coûte une nouvelle tentative, une mauvaise publication coûte votre réputation, et une seule des deux se répare en un après-midi.
You built it. Now grow it.
AgentCeres is a managed AI marketing team — specialists draft the SEO, social, and outreach that fill your links, you approve what ships. 14-day free trial, from $39/month.