Guía de la API de Scraper de TikTok: Perfiles, Publicaciones y Datos de Tienda
Expert in Web Scraping Technologies
TL;DR:
- Tres actores cubren el flujo de trabajo principal. Usa
scraper.tiktok.user.detailpara detalles de cuentas públicas,scraper.tiktok.user.workpara las publicaciones públicas de un creador yscraper.tiktok.shop.pagepara una página de producto de Shop. - La llamada de perfil es el puente hacia los datos de las publicaciones. Acepta
unique_idy devuelvesec_uid, que es lo que espera el actor de publicaciones. - Las solicitudes de Shop necesitan contexto de producto. Envía tanto
product_idcomoregion; lee la región y la moneda devueltas antes de comparar registros. - La respuesta es JSON estructurado. Almacena identificadores como cadenas, preserva campos anulables y mantiene la respuesta en bruto junto a cualquier tabla normalizada.
- Una API de scraper de TikTok devuelve instantáneas. La programación, el historial, la puntuación y las alertas pertenecen al pipeline que la llama.
- Gratis para empezar. Las nuevas cuentas de Scrapeless incluyen crédito gratuito; crea una cuenta en el Panel de Control de Scrapeless.
Introducción: un punto final, tres conjuntos de datos útiles de TikTok
Los proyectos de datos de TikTok suelen comenzar con una pregunta simple: ¿qué campos de cuenta pública, publicación o producto puede recopilar un flujo de trabajo sin mantener un analizador de navegador? La respuesta depende del objeto. Un perfil de creador, un feed de publicaciones de un creador y una página de producto de Shop tienen diferentes identificadores y formas de respuesta.
La API de scraper de TikTok de Scrapeless expone esos objetos a través de actores gestionados detrás de un punto final de solicitud. La API devuelve JSON a través de HTTP, por lo que se adapta a scripts, trabajos de datos, herramientas internas y flujos de trabajo de agentes. Esta guía mapea los actores, envía solicitudes autenticadas y convierte sus respuestas en registros que siguen siendo comprensibles después de la primera ejecución.
Para una visión más amplia de los actores gestionados, lee la guía de la API de Scraper de Scrapeless.
Lo que hace la API de Scraper de TikTok
La API acepta una solicitud JSON que contiene un nombre de actor y un objeto input. Scrapeless ejecuta el actor y devuelve el resultado estructurado del actor. El transporte sigue la semántica estándar de solicitudes HTTP descrita en la especificación de semántica HTTP, mientras que el cuerpo de la respuesta utiliza el tipo de medio JSON registrado que figura en el registro de tipos de medios de IANA.
Los tres actores de TikTok cumplen diferentes funciones:
| Actor | Entrada requerida | Resultado principal |
|---|---|---|
scraper.tiktok.user.detail |
unique_id |
Detalles del perfil público y estadísticas de la cuenta |
scraper.tiktok.user.work |
sec_uid |
Publicaciones públicas más campos de medios, música, hashtag y engagement |
scraper.tiktok.shop.page |
product_id, region |
Campos de producto, vendedor, precio, stock, opciones, SKU y envío |
Estas superficies no proporcionan listas de seguidores, demografía de la audiencia, texto de comentarios, un catálogo completo de TikTok ni un libro de órdenes. Trata cada respuesta como una observación puntual del objeto público solicitado.
Lo que puedes construir con esto
- Investigación de creadores. Une estadísticas de perfil con una muestra reciente de publicaciones antes de que un humano revise la adecuación de la marca.
- Monitoreo de contenido. Captura descripciones, URLs de publicaciones, marcas de tiempo, hashtags y cuentas de engagement público para cuentas seleccionadas.
- Verificación de catálogos. Lee un producto conocido de Shop por ID y región, incluyendo precio, moneda, stock e información sobre variantes.
- Instantáneas de productos. Guarda respuestas de productos repetidas con marcas de tiempo de colección para construir una tabla de historial.
- Enriquecimiento interno. Agrega campos públicos de TikTok a un registro existente de creador o producto sin raspar el marcado de la página renderizada.
Puntos finales y parámetros
Los tres actores utilizan el mismo punto final:
POST https://api.scrapeless.com/api/v1/scraper/request
La autenticación utiliza el encabezado de solicitud x-api-token. El cuerpo contiene actor y input.
Parámetros de perfil
scraper.tiktok.user.detail acepta unique_id, el nombre de usuario sin el @ inicial. Su respuesta puede incluir account_id, unique_id, sec_uid, apodo, URL del perfil, biografía, avatar, estadísticas de cuenta pública, tiempo de creación de la cuenta, idioma, país y flags booleanos como verificación, privacidad y estado de vendedor.
Parámetros de publicaciones
scraper.tiktok.user.work requiere sec_uid. También acepta cursor como cadena y count como un entero positivo. El cursor predeterminado es 0, y el count predeterminado documentado es 35. Una respuesta contiene un arreglo items. No inventes un campo de continuación: avanza solo cuando la respuesta y la documentación actual proporcionen un valor de continuación verificado para el flujo de trabajo.
Parámetros de Shop
scraper.tiktok.shop.page requiere product_id y region. Ejemplos de región en la documentación incluyen GB, SG, JP, y US; son ejemplos más que una lista exhaustiva de mercados. El region de la respuesta representa la página del producto que se resolvió y debería viajar con el precio y la moneda.
Los detalles del actor están disponibles en la documentación de detalles de usuario de TikTok, documentación de trabajo de usuario de TikTok, y documentación de página de TikTok Shop.
Prerrequisitos
- Una cuenta de Scrapeless y un token API del Tablero de Scrapeless
- Un nombre de usuario público de TikTok o un ID de producto conocido de TikTok Shop
- Un propósito permitido y una política de retención para los datos que se están recopilando
Los ejemplos requieren un token API de Scrapeless en vivo. Exporte como SCRAPELESS_API_KEY antes de ejecutar el código.
Enviar una Solicitud Autenticada
Esta llamada curl obtiene datos de perfil público. Reemplace el nombre de usuario con la cuenta que su flujo de trabajo está autorizado a investigar.
bash
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header "x-api-token: ${SCRAPELESS_API_KEY}" \
--header 'content-type: application/json' \
--data '{
"actor": "scraper.tiktok.user.detail",
"input": {"unique_id": "tiktok"}
}'
El mismo sobre funciona para los otros actores. Solo cambian el actor y los campos de entrada.
Comienza a Raspado con Scrapeless
¡Potencia tu raspado web y flujo de trabajo de automatización con Scrapeless!
Regístrate hoy y obtén $5 en crédito gratuito — sin necesidad de tarjeta de crédito.Reclama tu crédito gratuito ahora en el Tablero de Scrapeless.
Unir Datos de Perfil y Publicación en Python
La clave de unión útil es sec_uid. El siguiente programa la obtiene de la respuesta del perfil y luego solicita una muestra de publicaciones limitada. La documentación de la biblioteca JSON de Python explica el comportamiento de serialización utilizado aquí.
python
import json
import os
from urllib.request import Request, urlopen
ENDPOINT = "https://api.scrapeless.com/api/v1/scraper/request"
TOKEN = os.environ["SCRAPELESS_API_KEY"]
def run_actor(actor, actor_input):
body = json.dumps({"actor": actor, "input": actor_input}).encode()
request = Request(
ENDPOINT,
data=body,
headers={
"x-api-token": TOKEN,
"content-type": "application/json",
},
method="POST",
)
with urlopen(request, timeout=60) as response:
return json.load(response)
profile = run_actor(
"scraper.tiktok.user.detail",
{"unique_id": "tiktok"},
)
posts = run_actor(
"scraper.tiktok.user.work",
{"sec_uid": profile["sec_uid"], "cursor": "0", "count": 10},
)
record = {
"profile": {
"account_id": str(profile.get("account_id", "")),
"unique_id": profile.get("unique_id"),
"sec_uid": profile.get("sec_uid"),
"nickname": profile.get("nickname"),
"statistics": profile.get("statistics", {}),
},
"posts": posts.get("items", []),
}
print(json.dumps(record, ensure_ascii=False, indent=2))
Mantenga los IDs como cadenas incluso cuando contengan solo dígitos. Eso evita la pérdida de precisión en herramientas posteriores que representan números grandes con precisión numérica limitada.
Leer el Esquema de Respuesta Sin Adivinar
Las respuestas de perfil, publicación y Shop necesitan reglas de normalización separadas.
Para perfiles, mantenga los campos de identidad junto al objeto de estadísticas anidado. Para publicaciones, preserve el ID y la URL de la publicación, descripción, tiempo de creación, conteos públicos, campos de medios, hashtags, idioma, señales de anclaje o anuncios, música, subtítulos y permisos cuando estén presentes. Las URL de medios y los subtítulos pueden estar en blanco, por lo que un valor vacío es diferente de una solicitud fallida.
Para los productos de Shop, separe los campos a nivel de producto de los campos a nivel de SKU. El precio mostrado, stock agregado, vendedor, categorías y detalles de envío describen la respuesta del producto. Cada SKU puede tener sus propias opciones y disponibilidad. sold_count es el valor devuelto por la página del producto; no es un libro de órdenes verificado ni una cifra de GMV específica de un período.
Manejo de Salida Estructurada
Una tabla duradera comienza con cuatro opciones:
- Agregar una marca de tiempo de colección fuera de la respuesta del actor.
- Conservar el JSON en bruto para auditoría y reprocesamiento.
- Normalizar perfiles, publicaciones, productos y SKUs en tablas separadas.
- Tratar campos ausentes y vacíos como desconocidos hasta que la semántica de la fuente establezca otro significado.
Para datos personales, recopile solo los campos públicos necesarios para el propósito declarado. El Marco de Privacidad NIST ofrece una estructura útil para identificar el riesgo de privacidad y establecer controles en torno a la recopilación, acceso y retención.
Scrapeless empaqueta estos actores bajo Scraping API. Consulte la página de precios actual antes de estimar el volumen de producción.
Problemas Comunes a Prevenir
- Usar un nombre de usuario donde se requiere
sec_uid. Resuelva el perfil primero y pase susec_uidal actor de publicaciones. - Tratar cada campo de medios en blanco como un error. Los campos opcionales pueden estar vacíos en una respuesta válida.
- Fusionar el stock de productos y SKU. Mantenga ambos niveles para que un cambio de variante no sobrescriba la instantánea del producto.
- Comparar precios sin región y moneda. Almacene ambos campos en cada observación.
- Llamar a un snapshot un rastreador. Un rastreador necesita un programador, almacenamiento con marca de tiempo, lógica de comparación y un destino de alerta.
Conclusión: construir alrededor de objetos estables
La API de raspador de TikTok reduce tres trabajos comunes a llamadas claras de actores: resolver una cuenta, recopilar una muestra de publicación pública limitada o obtener un producto conocido de Shop en una región. El principal trabajo de ingeniería se traslada al modelado de datos: preservar identificadores, mantener respuestas en bruto, adjuntar marcas de tiempo y separar registros de productos de variantes.
¿Listo para construir su tubería de datos de TikTok?
Únase al Discord de Scrapeless o a la comunidad de Telegram para comparar notas de implementación. Cree una cuenta en el Tablero de Scrapeless cuando esté listo para enviar la primera solicitud.
FAQ
P: ¿Qué es una API de raspador de TikTok?
Una API de raspador de TikTok convierte páginas públicas de TikTok en datos estructurados a través de una solicitud HTTP. Scrapeless expone actores separados para detalles de usuarios, publicaciones de usuarios y páginas de productos de Shop.
P: ¿Puede la API obtener publicaciones de un nombre de usuario de TikTok?
Sí, a través de un flujo de trabajo de dos llamadas. Resuelva el nombre de usuario con scraper.tiktok.user.detail, luego pase el sec_uid devuelto a scraper.tiktok.user.work.
P: ¿Devuelve la API comentarios o listas de seguidores?
No. Los actores documentados cubiertos aquí no devuelven texto de comentario, listas de seguidores o demografía de la audiencia.
P: ¿Incluye una respuesta de TikTok Shop datos de SKU?
Sí. El actor de Shop puede devolver opciones y registros de SKU junto con campos de precio a nivel de producto, moneda, stock, vendedor, categoría, imagen, calificación, reseña y envío.
P: ¿Es legal raspar datos públicos de TikTok?
La legalidad depende de la jurisdicción, los datos, el propósito, el método de acceso y los términos aplicables. Use solo datos públicos, minimice la recopilación, proteja los registros almacenados y obtenga asesoría legal para el proyecto específico.
P: ¿Necesito gestionar proxies o defensas de página?
El actor administrado maneja la superficie de recopilación detrás de la llamada a la API. Su aplicación aún necesita entradas válidas, manejo de errores claro y planificación conservadora de solicitudes.
P: ¿Puede el flujo de trabajo ejecutarse sin un agente de IA?
Sí. Cualquier cliente HTTP que pueda enviar JSON y el encabezado x-api-token puede llamar al punto final.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



