API de Scraper de Perplejidad: Captura Respuestas de IA Citadas como Datos
Senior Web Scraping Engineer
Resumen:
- El Scraper de Perplexity captura la respuesta de Perplexity con sus fuentes web. Envía un prompt a
scraper.perplexity; recibe de vuelta el texto de la respuesta, los resultados web que citó, sugerencias de seguimiento y cualquier medio. - Es un flujo asíncrono de dos llamadas. Envía el prompt para crear una tarea y luego obtén el resultado mediante
task_id— en una ejecución en vivo, la respuesta regresó en aproximadamente 12 segundos. - Las fuentes web vienen como una lista estructurada. Cada entrada de
web_resultstiene unnombre, unurly elfragmentode donde Perplexity extrajo — sin necesidad de analizar HTML. - También obtienes los prompts de seguimiento. Las preguntas sugeridas para continuar por Perplexity regresan en
related_prompt, útiles para mapear un tema. - Activa la búsqueda web por solicitud. Establece
web_search: truepara obtener la respuesta fundamentada y citada en lugar de una respuesta solo de modelo. - Gratis para empezar. Las nuevas cuentas de Scrapeless incluyen uso gratuito de la API del Scraper — regístrate en app.scrapeless.com.
Introducción: lee la respuesta de Perplexity y sus fuentes
Perplexity construyó su reputación en respuestas citadas: haz una pregunta, obtén una respuesta sintetizada con las páginas web de las que se extrajo, listadas al lado. Para cualquiera que esté rastreando cómo su marca aparece en las respuestas de IA, esa lista de citaciones es el premio — es el equivalente moderno de una página de resultados de búsqueda, decidido por un motor de respuesta en lugar de diez enlaces azules.
El Scraper Perplexity de Scrapeless lee todo ese objeto como datos. Envías un prompt al actor scraper.perplexity y recibes de vuelta el texto de la respuesta, las fuentes web detrás de ella, las preguntas de seguimiento que sugiere Perplexity y cualquier medio que haya surgido. Esta guía cubre la forma de la solicitud, un primer curl, el esquema de respuesta, una integración en Python y cómo usarlo — cada solicitud y respuesta a continuación fue capturada contra la API en vivo.
Qué puedes hacer con ello
- Captura el texto de la respuesta de Perplexity — la respuesta completa sintetizada como Markdown estilo CommonMark.
- Lee las fuentes web — las páginas que citó Perplexity, cada una con un nombre, URL y fragmento.
- Mapea un tema con seguimientos — las sugerencias de
related_promptmuestran hacia dónde va la conversación a continuación. - Rastrea la visibilidad de la marca en respuestas de IA — ejecuta preguntas de compradores y verifica qué dominios cita Perplexity.
- Localiza por región — establece
countrypara ver la respuesta como lo haría un usuario en ese mercado.
Por qué el Scraper de Perplexity de Scrapeless
El Scraper de Perplexity es parte de la línea de Scrapers de Chat LLM de Scrapeless, la forma gestionada de leer respuestas de motores de IA como datos. Para Perplexity específicamente, ofrece:
- Un contrato de solicitud único — envía un prompt, recibe la respuesta, fuentes y seguimientos; sin navegador que controlar.
- Resultados web estructurados — las fuentes regresan como campos, no como marcado que analizar.
- Proxies residenciales en más de 195 países — las respuestas se obtienen a través de salidas limpias y apropiadas para la región.
- Búsqueda web como un indicador — un campo decide la respuesta fundamentada y citada frente a una respuesta solo de modelo.
Obtén tu clave API en el plan gratuito en app.scrapeless.com.
Requisitos previos
- Una cuenta de Scrapeless y clave API — regístrate en app.scrapeless.com
curlpara la primera solicitud, y Python 3.10+ para la integración- Familiaridad básica con HTTP y JSON
Cómo funciona el Scraper de Perplexity
El flujo son dos llamadas: crea una tarea, luego obtiene su resultado.
Parámetros de solicitud
| Campo | Donde | Significado |
|---|---|---|
actor |
nivel superior | scraper.perplexity |
input.prompt |
entrada | la pregunta para hacer a Perplexity |
input.country |
entrada | código de país ISO para localizar la respuesta |
input.web_search |
entrada | true para una respuesta fundamentada y citada |
La autenticación es el encabezado x-api-token en ambas llamadas.
Captura rápida con curl
Crea la tarea:
bash
curl -X POST https://api.scrapeless.com/api/v2/scraper/request \
-H "x-api-token: ${SCRAPELESS_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"actor": "scraper.perplexity",
"input": { "prompt": "Atracciones recomendadas en Nueva York", "country": "US", "web_search": true }
}'
# { "status": "pending", "task_id": "504f46ef-…" }
Luego obtiene el resultado por task_id:
bash
curl -X GET https://api.scrapeless.com/api/v2/scraper/result/{task_id} \
-H "x-api-token: ${SCRAPELESS_API_KEY}"
Sobre la respuesta
Una vez que status es success, la respuesta y sus fuentes están en task_result:
json
// muestra ilustrativa — la forma de los campos es exacta (capturada en vivo); valores abreviados
{
"status": "success",
"task_result": {
"prompt": "Atracciones recomendadas en Nueva York",
"result_text": "Aquí hay algunas atracciones que no te puedes perder en la ciudad de Nueva York…",
"web_results": [
{ "name": "Las 20 mejores cosas para hacer en NYC", "url": "https://example.com/nyc", "snippet": "Desde la Estatua de la Libertad hasta…" }
],
"related_prompt": [
"Enfócate en la historia y la arquitectura para un viaje de dos días", "Estoy viajando con mis hijos por tres días"
Sí — establece `input.country` a un código ISO y mantenlo fijo al comparar resultados a lo largo del tiempo.
**P: ¿Necesito un proxy?**
No. La salida se maneja dentro del actor a través de IPs residenciales; solo envías el aviso, el país y la bandera `web_search`.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



