Browser Use
Deixe um agente de IA conduzir um navegador real: abrir páginas, clicar, digitar, preencher formulários
O Browser Use é uma biblioteca Python e uma CLI de código aberto que permitem a um LLM conduzir um navegador real — abrindo páginas, clicando, digitando e preenchendo formulários —, para que um agente faça o trabalho na web que não tem nenhuma API por trás. A biblioteca é licenciada em MIT e roda na sua própria máquina com o modelo que você apontar; a mesma equipe vende uma nuvem hospedada, e o README deles manda você para lá em caso de CAPTCHA e para produção. Essa divisão é o resumo honesto da categoria inteira: conduzir o navegador é a parte resolvida, e não ser bloqueado pelos sites que você quer automatizar é a parte que decide se algo disso funciona.
O que é o Browser Use
O Browser Use (github.com/browser-use/browser-use) começou no fim de 2024 e hoje é um dos projetos de agentes com mais estrelas do GitHub. É Python, licença MIT, e instala em uma linha no Python 3.11 ou mais recente. Você entrega a um agente uma tarefa em linguagem natural e um modelo — os modelos próprios da equipe, ajustados para navegar, ou OpenAI, Anthropic e Google por uma única chave, ou algo local via Ollama — e ele trabalha a página como uma pessoa faria: lê o que está na tela, clica, digita e extrai o que você pediu.
Há duas portas de entrada, e escolher a errada é o erro mais comum no começo. A biblioteca Python é para a automação que você está construindo dentro do seu próprio código: muitas execuções agendadas ou em paralelo, ferramentas próprias, saída estruturada. A CLI é para um agente que você já usa — instalar a skill dele deixa um assistente de programação assumir o navegador para um serviço pontual. Vale adotar a regra do próprio projeto: tarefas pontuais por um agente, automação repetível em código. Ele também publica como repositório aberto seu benchmark de uma centena de tarefas reais de navegação, mais prestação de contas do que a maioria dos projetos de agentes oferece, e reivindica o primeiro lugar em um ranking público de tarefas web de longo curso — medição deles, não nossa.
Onde ele entra na pilha de crescimento de um fundador
No que isso é genuinamente bom é no trabalho de web que não tem API e nunca terá: sites dos quais você precisa tirar alguma coisa, ou colocar alguma coisa, e que só foram construídos para gente. Para um time pequeno, a ordem sensata de tentar é a ordem do que uma execução errada custa.
- Pesquisa somente de leitura Páginas de preço do concorrente, changelogs, anúncios de marketplace, páginas de avaliação: a matéria-prima por trás da análise de concorrência. Uma execução errada aqui custa repetir, que é o tipo mais barato de erro.
- O mesmo formulário pela quadragésima vez Cadastros em diretórios e marketplaces são o caso mais claro: o trabalho é idêntico toda vez e o retorno é real, que é exatamente por que aparecer nos diretórios de ferramentas de IA é tão penoso na mão.
- Seu próprio funil, de um navegador limpo Cadastrar-se como um estranho toda manhã pega o passo quebrado que a sua sessão logada nunca vê. Está mais perto de QA do que de crescimento, e é o item chato de maior valor desta lista — veja por que ninguém se cadastra para o que costuma estar errado.
- Qualquer coisa que publique ou gaste Postar, mandar mensagem para estranhos, dar lance. É aqui que a automação deve parar e uma pessoa deve olhar. Um portão de aprovação existe exatamente para essa classe de ação, e um agente de navegador competente não é motivo para removê-lo.
O muro em que você bate de verdade
Todo relato honesto sobre agentes de navegador chega ao mesmo lugar, e o FAQ do próprio projeto chega lá em duas respostas: para CAPTCHA ele manda usar a nuvem deles, por causa de impressão digital e proxies, e para produção avisa que o Chrome consome muita memória e que execuções em paralelo são chatas de administrar. Nenhuma das duas é uma crítica à biblioteca. São a conta real, e é melhor ler antes de planejar um fluxo de crescimento em cima de execuções locais gratuitas.
| O que você espera que seja difícil | O que de fato decide a execução |
|---|---|
| Ensinar o agente a clicar na coisa certa | Se o site chega a te servir uma página |
| O custo de modelo por tarefa | Proxy, impressão digital e infraestrutura de navegador |
| A execução falhar | A execução dar certo numa página que nunca foi o conteúdo real |
Essa última linha é nossa, e é a coisa mais cara que aprendemos sobre automação web. A AgentCeres — o AI Growth Officer em agentceres.com — usa navegadores automatizados para pesquisa, e contra sites com uma camada antibot séria simplesmente nunca passamos: a recusa chega no primeiro byte, antes de qualquer página renderizar, então nada sobre o quão humano o clique parece muda o resultado, e um plugin de furtividade que supúnhamos ajudar acabou nunca tendo sido testado contra aquela camada. A falha silenciosa foi a pior. Nossa própria verificação de acabamos de bater num muro antibot só reconhecia páginas de desafio em inglês, então um desafio servido em outro idioma pontuava como conteúdo comum e era resumido como se fosse o site. Uma execução bloqueada é óbvia; uma que devolve com confiança a página errada, não.
Então: aponte para o trabalho de web repetitivo e de baixo risco, orce infraestrutura de navegador em vez de supor que é grátis, e coloque um segundo sinal em qualquer coisa da qual uma decisão dependa — uma checagem de que o conteúdo é o que você acha que é, não só de que uma página voltou. Mantenha uma pessoa em tudo que sai. Essa última parte é o formato em que a AgentCeres trabalha: um time de especialistas redige o conteúdo e a prospecção, e toda ação de saída espera a sua aprovação antes de ir.
FAQ
- O Browser Use é gratuito?
- A biblioteca é, sob licença MIT: rode na sua própria máquina e o código é seu para modificar. O que não é gratuito é o modelo: cada passo que o agente dá é uma chamada de LLM, então o custo escala com quantas páginas ele precisa atravessar, e não com quantas tarefas você inicia. A nuvem hospedada, com navegadores furtivos, rotação de proxy e integrações, é um produto pago à parte da mesma equipe.
- Preciso programar para usar?
- Para serviços pontuais, não. Instalar a skill de CLI deixa um assistente de programação que você já usa conduzir o navegador a partir de uma instrução em linguagem natural. A biblioteca Python é a escolha certa quando a mesma tarefa roda repetidamente, em paralelo, ou dentro do seu próprio produto — a regra do próprio projeto é pontual por um agente, repetível em código.
- Ele passa por detecção de bot e CAPTCHA?
- Não de forma confiável na sua própria máquina, e o projeto diz isso: o FAQ responde tanto a CAPTCHA quanto a produção apontando para a nuvem deles, que fornece proxies e impressão digital de navegador. Orce esse custo. Um site com camada antibot séria recusa a conexão antes de a sua automação ter chance de ser esperta, e nenhuma quantidade de cliques realistas muda isso.
- O que eu não deveria automatizar com um agente de navegador?
- Qualquer coisa que publique, mande mensagem a um estranho ou gaste dinheiro sem uma pessoa ver antes, e qualquer coisa cujos termos de serviço proíbam acesso automatizado, como fazem muitas plataformas. O teste útil é quanto custa uma execução errada: um scraping ruim custa repetir, um post ruim custa a sua reputação, e só um dos dois se resolve numa tarde.
You built it. Now grow it.
AgentCeres is a managed AI marketing team — specialists draft the SEO, social, and outreach that fill your links, you approve what ships. 14-day free trial, from $39/month.