Volver al blog

Scrapeless SDK Lanzado Oficialmente: Tu Solución Todo en Uno para Web Scraping y Navegador

Michael Lee
Michael Lee

Expert Network Defense Engineer

30-May-2025

¡Estamos encantados de anunciar que el SDK oficial de Scrapeless ya está en funcionamiento! 🎉

Es el puente definitivo entre tú y la poderosa plataforma Scrapeless, haciendo que la extracción de datos web y la automatización del navegador sean más simples que nunca.

Con solo unas pocas líneas de código, puedes realizar scraping web a gran escala y extracción de datos de SERP, proporcionando soporte estable para sistemas de IA Agentic.

El SDK de Scrapeless ofrece a los desarrolladores un wrapper oficial para todos los servicios principales, incluyendo:

  • Navegador de Scraping: Una capa de automatización basada en Puppeteer y Playwright, que admite clics reales, llenado de formularios y otras funciones avanzadas.
  • API del Navegador: Crea y gestiona sesiones de navegador, ideal para necesidades avanzadas de automatización.
  • API de Scraping: Obtén páginas web y extrae contenido en múltiples formatos.
  • API de Deep SERP: Extrae fácilmente resultados de motores de búsqueda de Google y más.
  • API de Scraping Universal: Scraping web de propósito general con renderizado JS, captura de pantalla y extracción de metadatos.
  • API de Proxy: Configura proxies al instante, incluyendo direcciones IP y geolocalización.

Ya seas un ingeniero de datos, desarrollador de crawlers o parte de una startup que construye productos impulsados por datos, el SDK de Scrapeless te ayuda a adquirir los datos que necesitas más rápido y de manera más confiable.

Desde la automatización del navegador hasta el análisis de resultados de motores de búsqueda, desde la extracción de datos web hasta la gestión automática de proxies, el SDK de Scrapeless simplifica todo tu flujo de trabajo de adquisición de datos.

👉 Ver Ejemplos de Código Completo

Referencia de Uso del SDK de Scrapeless

Requisitos Previos

Inicia sesión en el Dashboard de Scrapeless y obtén la clave API

SDK de Scrapeless

Instalación

  • npm:
Bash Copy
npm install @scrapeless-ai/sdk
  • yarn:
Bash Copy
yarn add @scrapeless-ai/sdk
  • pnpm:
Bash Copy
pnpm add @scrapeless-ai/sdk

Configuración Básica

JavaScript Copy
import { Scrapeless } from '@scrapeless-ai/sdk';

// Inicializar el cliente
const client = new Scrapeless({
  apiKey: 'tu-clave-api' // Obtén tu clave API de https://scrapeless.com
});

Variables de Entorno

También puedes configurar el SDK usando variables de entorno:

Bash Copy
# Requerido
SCRAPELESS_API_KEY=tu-clave-api

# Opcional - Puntos finales de API personalizados
SCRAPELESS_BASE_API_URL=https://api.scrapeless.com
SCRAPELESS_ACTOR_API_URL=https://actor.scrapeless.com
SCRAPELESS_STORAGE_API_URL=https://storage.scrapeless.com
SCRAPELESS_BROWSER_API_URL=https://browser.scrapeless.com
SCRAPELESS_CRAWL_API_URL=https://crawl.scrapeless.com

El módulo de Navegador de Scraping proporciona una API unificada de alto nivel para la automatización del navegador, construida sobre la API del Navegador de Scrapeless. Admite tanto Puppeteer como Playwright, y extiende el objeto de página estándar con métodos avanzados como realClick, realFill y liveURL para una automatización más similar a la humana.

Ejemplo de Puppeteer:

Python Copy
import { PuppeteerBrowser } from '@scrapeless-ai/sdk';
 
const browser = await PuppeteerBrowser.connect({
  session_name: 'mi-sesión',
  session_ttl: 180,
  proxy_country: 'US'
});
const page = await browser.newPage();
 
await page.goto('https://example.com');
await page.realClick('#login-btn');
await page.realFill('#username', 'miusuario');
const urlInfo = await page.liveURL();
console.log('URL de la página actual:', urlInfo.liveURL);
 
await browser.close();

Ejemplo de Playwright:

Python Copy
import { PlaywrightBrowser } from '@scrapeless-ai/sdk';
 
const browser = await PlaywrightBrowser.connect({
  session_name: 'mi-sesión',
  session_ttl: 180,
  proxy_country: 'US'
});
const page = await browser.newPage();
 
await page.goto('https://example.com');
await page.realClick('#login-btn');
await page.realFill('#username', 'miusuario');
const urlInfo = await page.liveURL();
console.log('URL de la página actual:', urlInfo.liveURL);
 
await browser.close();

👉 Visita nuestra documentación para más casos de uso

👉 Integración con un solo clic a través de GitHub


Ejemplo Práctico: Scrapeando Resultados de Búsqueda de “Air Max” en Nike.com

Supongamos que estás construyendo un sistema backend para una plataforma de comparación de zapatos y necesitas obtener resultados de búsqueda para “Air Max” del sitio oficial de Nike en tiempo real. Tradicionalmente, tendrías que desplegar Puppeteer, gestionar proxies, evadir bloqueos, analizar estructuras de páginas… un proceso que consume tiempo y es propenso a errores.

Ahora, con el SDK de Scrapeless, todo el proceso toma solo unas pocas líneas de código:

Paso 1. Instala el SDK

Usa tu gestor de paquetes preferido:

Python Copy
npm install @scrapeless-ai/sdk

Paso 2. Inicializa el Cliente

TypeScript Copy
import { Scrapeless } from '@scrapeless-ai/sdk';

const client = new Scrapeless({
  apiKey: 'tu-clave-api' // Obtén tu clave API de https://scrapeless.com
});

Paso 3. Scraping de SERP con un clic

TypeScript Copy
const resultados = await client.deepserp.scrape({
  actor: 'scraper.google.search',
  input: {
    q: 'Air Max site:www.nike.com'
  }
});

console.log(resultados);

No necesitas preocuparte por proxies, mecanismos anti-bots, emulación de navegador o rotación de IP: Scrapeless maneja todo eso en segundo plano.

Ejemplo de Salida

JSON Copy
{
  inline_images: [
    {
      position: 1,
      thumbnail: 'https://encrypted-tbn0.gstatic.com/images?q=tbn:ANd9GcQtHPNOwXmvXfYfaT_4UqM1IvNBqZDZe7rScA&s',
      related_content_id: 'N2x0F2OpsGqRuM,xzJA7z__Ip2bvM',
      related_content_link: 'https://www.google.com/search/about-this-image?img=H4sIAAAAAAAA_wEXAOj_ChUIx-WA-v7nv5GdARC32NG7sayq2GoyjCpjFwAAAA%3D%3D&q=https://www.nike.com/t/air-max-1-mens-shoes-2C5sX2&ctx=iv&hl=es-ES',
      source: 'Nike',
      source_logo: '',
      title: "Zapatillas Nike Air Max 1 para Hombre",
      link: 'https://www.nike.com/t/air-max-1-mens-shoes-2C5sX2',
      original: 'https://static.nike.com/a/images/t_PDP_936_v1/f_auto,q_auto:eco/c5ff2a6b-579f-4271-85ea-0cd5131691fa/NIKE+AIR+MAX+1.png',
      original_width: 936,
      original_height: 1170,
      in_stock: false,
      is_product: false
    },
   ....
}

Ahora puedes almacenar estos resultados en tu base de datos o utilizarlos directamente para la visualización y análisis de clasificación.

Instala el SDK de Scrapeless Ahora

El SDK de Scrapeless para Node.js hace que el scraping web y la automatización del navegador sean más fáciles que nunca. Ya sea que estés construyendo una herramienta de monitoreo de precios, un sistema de análisis de SERP o simulando el comportamiento real de los usuarios, una sola línea de código te conecta con la poderosa infraestructura de Scrapeless.

El SDK de Scrapeless es de código abierto bajo la licencia MIT. ¡Los desarrolladores son bienvenidos a contribuir con código, enviar problemas o unirse a nuestra comunidad en Discord para más ideas!

Prueba Gratuita Disponible
🔗 Lee la Documentación
💬 ¿Tienes preguntas? Únete a nuestra Comunidad de Discord

En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.

Artículos más populares

Catalogar