Uso del Navegador + Sin Rasguños: Un Navegador en la Nube Indetectable para Agentes de IA
Senior Web Scraping Engineer
TL;DR:
- El uso del navegador impulsa un navegador con un LLM; Scrapeless le da a ese navegador una identidad limpia. Apunta
cdp_urldel agente a la nube de Scrapeless y se ejecuta en Chromium real, con una huella digital consistente y salida residencial: tu código de agente permanece sin cambios. - Un navegador local filtra la automatización en tres ejes: el indicador
navigator.webdriver, la huella digital predeterminada sin cabeza, y tu propia IP de salida. Los sistemas anti-bot puntúan los tres a la vez. - La integración es una línea: la URL de conexión. Construye
wss://browser.scrapeless.com/api/v2/browsercon tu token y pásaselo aBrowser(cdp_url=...). - Observa el agente en vivo desde la URL de sesión en el Panel de Control de Scrapeless mientras razona y hace clics.
- Verificado en vivo: un agente conectado a través de CDP, ejecutó siete pasos y devolvió el título de la página objetivo a través del navegador de nube Scrapeless.
- Gratis para empezar. Las nuevas cuentas de Scrapeless incluyen tiempo de ejecución gratuito del Navegador de Scraping: regístrate en app.scrapeless.com.
Introducción: dale a tu agente un navegador que se lea limpio
El uso del navegador permite que un modelo de lenguaje opere un navegador real: decide los pasos, hace clic en los elementos y lee la página. Ejecútalo contra un Chrome local y el agente hereda todo lo que hace que la automatización sea obvia: se anuncia a través de la propiedad navigator.webdriver, envía fuentes predeterminadas sin cabeza y el comportamiento del lienzo, y sale desde una IP que los servicios de reputación ya conocen.
Arreglar eso localmente significa mantener parches de sigilo a medida que Chromium y los anti-bots cambian. El uso del navegador se conecta a cualquier navegador que hable CDP a través de cdp_url, y el Navegador de Scraping de Scrapeless es un navegador que habla CDP alcanzado a través de un punto final de WebSocket. Así que el tiempo de ejecución, la huella digital y la IP de salida del agente se mueven del lado del servidor, y lo único que cambia tu código es de dónde proviene el navegador.
Lo que puedes hacer con ello
- Ejecutar tareas del agente en sitios protegidos por anti-bots: el navegador en la nube elimina desafíos durante el renderizado.
- Localizar el comportamiento: fija
proxyCountrypara que el agente vea una página como lo haría un visitante en ese mercado. - Escalar más allá de tu máquina: las sesiones se ejecutan en la nube, no en tu laptop.
- Mantener el código del agente idéntico: solo cambia la fuente del navegador; el
Agent, la tarea y el LLM permanecen intactos. - Ver y depurar en vivo: el Panel de Control de Scrapeless transmite la sesión en ejecución.
Por qué el Navegador de Scraping de Scrapeless
El Navegador de Scraping de Scrapeless es un navegador de nube personalizable y anti-detección diseñado para rastreadores web y agentes de IA. Para el uso del navegador específicamente, ofrece:
- Un Chromium real auto-desarrollado que ejecuta JavaScript exactamente como Chrome, por lo que SPAs y desafíos se resuelven.
- Una huella digital consistente por sesión: sin indicador
navigator.webdriver, sin predeterminados sin cabeza. - Salida residencial en más de 195 países, elegida por sesión con un solo valor de
proxyCountry. - Una única superficie CDP: cada opción es un parámetro de consulta en el mismo punto final de WebSocket.
Obtén tu clave API en el plan gratuito en app.scrapeless.com.
Requisitos previos
- Python 3.11 o más nuevo (El uso del navegador requiere 3.11+)
- Una clave API de OpenAI para el modelo de lenguaje del agente
- Una cuenta de Scrapeless y clave API: regístrate en app.scrapeless.com
Todos los detalles de conexión se encuentran en la documentación del Navegador de Scraping.
Instalar
bash
pip install browser-use
Para la memoria del agente en tareas más largas (Python < 3.13):
bash
pip install "browser-use[memory]"
Conecta tu agente al navegador en la nube
Construye la URL de WebSocket de Scrapeless y pásala a Browser(cdp_url=...). navigator.webdriver es una señal que la especificación W3C WebDriver exige que los controladores conformes configuren; el navegador en la nube no la lleva.
python
import os
from urllib.parse import urlencode
from browser_use import Browser
def scrapeless_browser() -> Browser:
params = {
"token": os.environ["SCRAPELESS_API_KEY"],
"sessionTTL": 900,
"proxyCountry": "ANY",
}
ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
return Browser(cdp_url=ws)
Ejecuta el agente
El uso del navegador se conecta al navegador en la nube a través de el Protocolo de Herramientas de Desarrollo de Chrome, por lo que el Agent se ejecuta exactamente como lo haría localmente.
Nota: para ejecutar esto se necesita una sesión activa de Scrapeless y una clave de API de OpenAI para
agent.run(). Proporcione ambas para ejecutarlo.
python
import os
import asyncio
from urllib.parse import urlencode
from dotenv import load_dotenv
from browser_use import Agent, Browser, ChatOpenAI
def scrapeless_browser() -> Browser:
params = {"token": os.environ["SCRAPELESS_API_KEY"], "sessionTTL": 900, "proxyCountry": "ANY"}
ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
return Browser(cdp_url=ws)
async def main():
load_dotenv()
browser = scrapeless_browser()
await browser.start()
agent = Agent(
task="Ir a Google, buscar 'Scrapeless', abrir el primer resultado y devolver su título",
llm=ChatOpenAI(model="gpt-4o"),
browser=browser,
)
print(await agent.run())
await browser.kill()
asyncio.run(main())
Lo que obtienes de vuelta
En una ejecución en vivo, el agente se conectó a través de cdp_url, realizó siete pasos y devolvió el título de la página objetivo: Kit de Herramientas de Web Scraping Sin Esfuerzo para Empresas y Desarrolladores — a través del navegador en la nube de Scrapeless. Algunas observaciones honestas:
- La señal
navigator.webdriverestá ausente, por lo que la primera verificación que ejecuta un sitio se lee como un Chrome real. - La IP de salida coincide con
proxyCountry— las páginas geobloqueadas se resuelven como las ve un visitante local. - El agente se adapta — cuando un camino de búsqueda muestra un desafío, un agente impulsado por LLM puede rodearlo y aún alcanzar el objetivo, porque razona sobre la página en lugar de seguir un script fijo.
- La memoria es opcional — habilítala para tareas largas de múltiples pasos con
enable_memory=Trueen elAgent.
Conclusión: mismo agente, navegador más limpio
Browser Use decide qué hacer; Scrapeless decide cómo se ve el navegador para el sitio. La integración es una única URL de conexión: construye wss://browser.scrapeless.com/api/v2/browser con tu token, entrégaselo a Browser(cdp_url=...) y ejecuta tu agente sin cambios. Para conectar más de una herramienta de Python al mismo navegador en la nube, consulta la guía de huella digital no detectada, y compara planes en la página de precios de Scrapeless.
¿Listo para Construir Tu Pipeline de Scraping con AI-Agent?
Únete a nuestra comunidad para reclamar un plan gratuito y conectarte con desarrolladores que construyen pipelines de agentes: Discord · Telegram.
Regístrate en app.scrapeless.com para obtener un tiempo de ejecución gratuito del Navegador de Scraping y apunta tu agente de Browser Use al navegador en la nube que tus objetivos no pueden huellear.
FAQ
Q: ¿Tengo que cambiar el código de mi agente de Browser Use?
No. Cambias de dónde viene el navegador: intercambia un lanzamiento local por Browser(cdp_url=<scrapeless url>). El Agent, la tarea y el LLM son idénticos.
Q: ¿Por qué no simplemente ejecutar Chrome localmente?
Chrome local se ejecuta en tu IP, anuncia automatización a través de navigator.webdriver, y necesitas mantener parches de sigilo. Scrapeless es un navegador en la nube gestionado con salida residencial incluida y una huella digital consistente: misma API, sin mantenimiento.
Q: ¿Necesito un proxy?
No. La salida residencial está incluida: configura proxyCountry a una región o ANY.
Q: ¿Qué versión de Python necesito?
Browser Use requiere Python 3.11 o más reciente; la memoria del agente también necesita Python por debajo de 3.13.
Q: ¿Puedo ver al agente ejecutar?
Sí: el Dashboard de Scrapeless transmite la sesión en vivo mientras el agente razona y hace clics.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



