Uso do Navegador + Scrapeless: Um Navegador em Nuvem Indetectável para Agentes de IA
Senior Web Scraping Engineer
TL;DR:
- O uso do navegador dirige um navegador com um LLM; Scrapeless dá a esse navegador uma identidade limpa. Aponte o
cdp_urldo agente para o navegador em nuvem da Scrapeless e ele roda no verdadeiro Chromium, com uma impressão digital consistente e saída residencial — seu código de agente permanece inalterado. - Um navegador local vaza automação em três eixos: o
navigator.webdriverindicador, impressão digital padrão headless e seu próprio IP de saída. Sistemas anti-bot pontuam todos os três de uma vez. - A integração é uma linha — a URL de conexão. Construa
wss://browser.scrapeless.com/api/v2/browsercom seu token e forneça-o aBrowser(cdp_url=...). - Assista o agente ao vivo a partir da URL da sessão no Painel de Controle da Scrapeless enquanto ele raciocina e clica.
- Verificado ao vivo: um agente conectado via CDP, executou sete etapas e retornou o título da página-alvo através do navegador em nuvem da Scrapeless.
- Grátis para começar. Novas contas Scrapeless incluem tempo de execução gratuito do Navegador de Scraping — inscreva-se em app.scrapeless.com.
Introdução: dê ao seu agente um navegador que lê limpo
O uso do navegador permite que um modelo de linguagem opere um navegador real — ele decide os passos, clica nos elementos e lê a página. Execute-o contra um Chrome local e o agente herda tudo que torna a automação óbvia: anuncia-se através da propriedade navigator.webdriver, envia fontes e comportamentos de canvas padrão headless, e sai de um IP que os serviços de reputação já conhecem.
Corrigir isso localmente significa manter patches de furtividade à medida que o Chromium e os anti-bots mudam. O uso do navegador conecta-se a qualquer navegador que fale CDP através de cdp_url, e o Navegador de Scraping da Scrapeless é um navegador que fala CDP acessado através de um único ponto de extremidade WebSocket. Assim, o tempo de execução do agente, a impressão digital e o IP de saída mudam para o lado do servidor, e a única coisa que seu código altera é de onde vem o navegador.
O que você pode fazer com isso
- Executar tarefas do agente em sites protegidos por anti-bots — o navegador em nuvem elimina desafios durante a renderização.
- Localizar o comportamento — defina
proxyCountrypara que o agente veja uma página como um visitante nesse mercado veria. - Escalar além da sua máquina — as sessões rodam na nuvem, não no seu laptop.
- Manter o código do agente idêntico — troque apenas a fonte do navegador; o
Agente, a tarefa e o LLM ficam no lugar. - Assistir e depurar ao vivo — o Painel de Controle da Scrapeless transmite a sessão em execução.
Por que o Navegador de Scraping Scrapeless
O Navegador de Scraping Scrapeless é um navegador em nuvem personalizável e anti-detecção projetado para rastreadores da web e agentes de IA. Para o uso do navegador especificamente, ele traz:
- Um verdadeiro Chromium auto-desenvolvido que executa JavaScript exatamente como o Chrome, então SPAs e desafios são resolvidos.
- Uma impressão digital consistente por sessão — sem
navigator.webdriverindicativo, sem padrões headless. - Saída residencial em mais de 195 países, escolhida por sessão com um único valor
proxyCountry. - Uma única superfície CDP — cada opção é um parâmetro de consulta no mesmo ponto de extremidade WebSocket.
Obtenha sua chave API no plano gratuito em app.scrapeless.com.
Pré-requisitos
- Python 3.11 ou mais recente (o Uso do Navegador requer 3.11+)
- Uma chave API da OpenAI para o modelo de linguagem do agente
- Uma conta Scrapeless e chave API — inscreva-se em app.scrapeless.com
Os detalhes completos da conexão estão na documentação do Navegador de Scraping.
Instalar
bash
pip install browser-use
Para memória do agente em tarefas mais longas (Python < 3.13):
bash
pip install "browser-use[memory]"
Conectar seu agente ao navegador em nuvem
Construa a URL WebSocket da Scrapeless e passe-a para Browser(cdp_url=...). navigator.webdriver é um sinal que a especificação W3C WebDriver exige que drivers conformes configurem — o navegador em nuvem não a carrega.
python
import os
from urllib.parse import urlencode
from browser_use import Browser
def scrapeless_browser() -> Browser:
params = {
"token": os.environ["SCRAPELESS_API_KEY"],
"sessionTTL": 900,
"proxyCountry": "ANY",
}
ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
return Browser(cdp_url=ws)
Executar o agente
O uso do navegador conecta-se ao navegador em nuvem através de o Protocolo do Chrome DevTools, assim o Agente opera exatamente como faria localmente.
Nota: para executar isso, é necessária uma sessão ativa do Scrapeless e uma chave da API da OpenAI para
agent.run(). Forneça ambos para executá-lo.
python
import os
import asyncio
from urllib.parse import urlencode
from dotenv import load_dotenv
from browser_use import Agent, Browser, ChatOpenAI
def scrapeless_browser() -> Browser:
params = {"token": os.environ["SCRAPELESS_API_KEY"], "sessionTTL": 900, "proxyCountry": "ANY"}
ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
return Browser(cdp_url=ws)
async def main():
load_dotenv()
browser = scrapeless_browser()
await browser.start()
agent = Agent(
task="Vá para o Google, pesquise por 'Scrapeless', abra o primeiro resultado e retorne seu título",
llm=ChatOpenAI(model="gpt-4o"),
browser=browser,
)
print(await agent.run())
await browser.kill()
asyncio.run(main())
O que você recebe de volta
Em uma execução ao vivo, o agente se conectou através de cdp_url, executou sete etapas e retornou o título da página alvo — Ferramenta de Web Scraping Sem Esforço para Negócios e Desenvolvedores — através do navegador na nuvem Scrapeless. Algumas observações honestas:
- O sinal
navigator.webdriverestá ausente, portanto, a primeira verificação que um site realiza parece um Chrome real. - O IP de saída corresponde ao
proxyCountry— páginas com restrição geográfica resolvem como um visitante local as vê. - O agente se adapta — quando um caminho de busca apresenta um desafio, um agente dirigido por LLM pode contornar isso e ainda alcançar o alvo, porque ele raciocina sobre a página em vez de seguir um script fixo.
- Memória é opcional — ative-a para tarefas longas de múltiplos passos com
enable_memory=TruenoAgent.
Conclusão: mesmo agente, navegador mais limpo
O uso do navegador decide o que fazer; o Scrapeless decide como o navegador aparece para o site. A integração é uma única URL de conexão — construa wss://browser.scrapeless.com/api/v2/browser com seu token, entregue ao Browser(cdp_url=...) e execute seu agente sem alterações. Para conectar mais de uma ferramenta Python ao mesmo navegador na nuvem, consulte o guia de impressão digital não detectada e compare planos na página de preços do Scrapeless.
Pronto para Construir Seu Pipeline de Scraping com AI-Agent?
Junte-se à nossa comunidade para reivindicar um plano gratuito e conectar-se com desenvolvedores que constroem pipelines de agentes: Discord · Telegram.
Inscreva-se em app.scrapeless.com para runtime gratuito do Navegador de Scraping e aponte seu agente de Uso do Navegador para o navegador na nuvem que seus alvos não conseguem identificar.
FAQ
P: Preciso mudar meu código do agente de Uso do Navegador?
Não. Você muda de onde o navegador vem — substitua um lançamento local por Browser(cdp_url=<scrapeless url>). O Agent, tarefa e LLM são idênticos.
P: Por que não apenas executar o Chrome local?
O Chrome local roda no seu IP, anuncia automação através do navigator.webdriver e exige que você mantenha correções de furtividade. O Scrapeless é um navegador em nuvem gerenciado com saída residencial embutida e uma impressão digital consistente — mesma API, nenhuma manutenção.
P: Preciso de um proxy?
Não. A saída residencial está embutida — defina proxyCountry para uma região ou ANY.
P: Qual versão do Python eu preciso?
O uso do navegador requer Python 3.11 ou mais recente; a memória do agente, além disso, precisa do Python abaixo de 3.13.
P: Posso assistir ao agente executar?
Sim — o Painel do Scrapeless transmite a sessão ao vivo enquanto o agente raciocina e clica.
Na Scorretless, acessamos apenas dados disponíveis ao público, enquanto cumprem estritamente as leis, regulamentos e políticas de privacidade do site aplicáveis. O conteúdo deste blog é apenas para fins de demonstração e não envolve atividades ilegais ou infratoras. Não temos garantias e negamos toda a responsabilidade pelo uso de informações deste blog ou links de terceiros. Antes de se envolver em qualquer atividade de raspagem, consulte seu consultor jurídico e revise os termos de serviço do site de destino ou obtenha as permissões necessárias.



