Guia da API TikTok Scraper: Perfis, Postagens e Dados da Loja
Expert in Web Scraping Technologies
TL;DR:
- Três atores cobrem o fluxo de trabalho principal. Use
scraper.tiktok.user.detailpara detalhes da conta pública,scraper.tiktok.user.workpara postagens públicas de um criador escraper.tiktok.shop.pagepara uma página de produto da loja. - A chamada de perfil é a ponte para os dados das postagens. Ela aceita
unique_ide retornasec_uid, que o ator de postagens espera. - As solicitações da loja precisam de contexto do produto. Envie
product_ideregion; leia a região e a moeda retornadas antes de comparar registros. - A resposta é um JSON estruturado. Armazene identificadores como strings, preserve campos anuláveis e mantenha a resposta bruta ao lado de qualquer tabela normalizada.
- Uma API de raspagem do TikTok retorna instantâneas. Agendamento, histórico, pontuação e alertas pertencem ao pipeline que a chama.
- Gratuito para começar. Novas contas Scrapeless incluem crédito gratuito; crie uma conta no Painel do Scrapeless.
Introdução: um endpoint, três conjuntos de dados úteis do TikTok
Projetos de dados do TikTok geralmente começam com uma pergunta simples: quais campos de conta pública, postagem ou produto um fluxo de trabalho pode coletar sem manter um analisador de navegador? A resposta depende do objeto. Um perfil de criador, um feed de postagens de criador e uma página de produto da loja têm identificadores e formatos de resposta diferentes.
A API de raspagem do TikTok da Scrapeless expõe esses objetos por meio de atores gerenciados atrás de um endpoint de solicitação. A API retorna JSON via HTTP, então se encaixa em scripts, trabalhos de dados, ferramentas internas e fluxos de trabalho de agentes. Este guia mapeia os atores, envia solicitações autenticadas e transforma suas respostas em registros que permanecem compreensíveis após a primeira execução.
Para uma visão mais ampla dos atores gerenciados, leia o guia da API de Raspagem Scrapeless.
O que a API de Raspagem do TikTok Faz
A API aceita uma solicitação JSON contendo um nome de ator e um objeto input. Scrapeless executa o ator e retorna o resultado estruturado do ator. O transporte segue a semântica padrão de solicitações HTTP descrita em especificação de Semântica HTTP, enquanto o corpo da resposta usa o tipo de mídia JSON registrado listado por o registro de tipos de mídia da IANA.
Os três atores do TikTok desempenham diferentes funções:
| Ator | Entrada necessária | Principal resultado |
|---|---|---|
scraper.tiktok.user.detail |
unique_id |
Detalhes de perfil público e estatísticas da conta |
scraper.tiktok.user.work |
sec_uid |
Postagens públicas, mais campos de mídia, música, hashtag e engajamento |
scraper.tiktok.shop.page |
product_id, region |
Produto, vendedor, preço, estoque, opções, SKU e campos de envio |
Essas superfícies não fornecem listas de seguidores, demografia do público, texto de comentários, um catálogo completo do TikTok ou um livro de pedidos. Trate cada resposta como uma observação pontual do objeto público solicitado.
O que Você Pode Construir Com Isso
- Pesquisa de criadores. Junte estatísticas de perfil com uma amostra recente de postagens antes que um humano revise a adequação da marca.
- Monitoramento de conteúdo. Capture descrições, URLs de postagens, timestamps, hashtags e contagens de engajamento público para contas selecionadas.
- Verificações de catálogo. Leia um produto conhecido da loja por ID e região, incluindo preço, moeda, estoque e informações de variantes.
- Instantâneas de produtos. Salve respostas de produtos repetidas com timestamps de coleta para construir uma tabela de histórico.
- Enriquecimento interno. Adicione campos públicos do TikTok a um registro existente de criador ou produto sem raspar a marcação da página renderizada.
Endpoints e Parâmetros
Todos os três atores usam o mesmo endpoint:
POST https://api.scrapeless.com/api/v1/scraper/request
A autenticação usa o cabeçalho de solicitação x-api-token. O corpo contém actor e input.
Parâmetros de Perfil
scraper.tiktok.user.detail aceita unique_id, o nome de usuário sem o prefácio @. Sua resposta pode incluir account_id, unique_id, sec_uid, apelido, URL do perfil, biografia, avatar, estatísticas da conta pública, horário de criação da conta, idioma, país e flags booleanas como verificação, privacidade e status de vendedor.
Parâmetros de Postagem
scraper.tiktok.user.work requer sec_uid. Ele também aceita cursor como uma string e count como um inteiro positivo. O cursor padrão é 0, e o count documentado padrão é 35. Uma resposta contém um array items. Não invente um campo de continuação: avance somente quando a resposta e a documentação atual fornecerem um valor de continuação verificado para o fluxo de trabalho.
Parâmetros da Loja
scraper.tiktok.shop.page requer product_id e region. Exemplos de região na documentação incluem GB, SG, JP e US; eles são exemplos e não uma lista de mercado exaustiva. O region da resposta representa a página do produto que foi resolvida e deve viajar com o preço e a moeda.
Os detalhes do ator estão disponíveis na documentação de detalhes do usuário TikTok, documentação de trabalho do usuário TikTok, e documentação da página da loja TikTok.
Pré-requisitos
- Uma conta Scrapeless e um token de API do Painel Scrapeless
- Um nome de usuário TikTok público ou um ID de produto da loja TikTok conhecido
- Um propósito permitido e uma política de retenção para os dados coletados
Os exemplos exigem um token de API Scrapeless ativo. Exporte-o como SCRAPELESS_API_KEY antes de executar o código.
Enviar uma Solicitação Autenticada
Esta chamada curl busca dados de perfil público. Substitua o nome de usuário pela conta que seu fluxo de trabalho está autorizado a pesquisar.
bash
curl --request POST 'https://api.scrapeless.com/api/v1/scraper/request' \
--header "x-api-token: ${SCRAPELESS_API_KEY}" \
--header 'content-type: application/json' \
--data '{
"actor": "scraper.tiktok.user.detail",
"input": {"unique_id": "tiktok"}
}'
O mesmo envelope funciona para os outros atores. Somente os campos de ator e entrada mudam.
Comece a Raspar com Scrapeless
Potencialize seu fluxo de trabalho de raspagem da web e automação com Scrapeless!
Inscreva-se hoje e ganhe $5 em crédito grátis — sem necessidade de cartão de crédito.Reivindique seu crédito grátis agora no Painel Scrapeless.
Juntar Dados de Perfil e Postagem em Python
A chave útil de junção é sec_uid. O seguinte programa obtém isso da resposta do perfil, em seguida, solicita uma amostra de postagens limitada. A documentação da biblioteca JSON do Python explica o comportamento de serialização usado aqui.
python
import json
import os
from urllib.request import Request, urlopen
ENDPOINT = "https://api.scrapeless.com/api/v1/scraper/request"
TOKEN = os.environ["SCRAPELESS_API_KEY"]
def run_actor(actor, actor_input):
body = json.dumps({"actor": actor, "input": actor_input}).encode()
request = Request(
ENDPOINT,
data=body,
headers={
"x-api-token": TOKEN,
"content-type": "application/json",
},
method="POST",
)
with urlopen(request, timeout=60) as response:
return json.load(response)
profile = run_actor(
"scraper.tiktok.user.detail",
{"unique_id": "tiktok"},
)
posts = run_actor(
"scraper.tiktok.user.work",
{"sec_uid": profile["sec_uid"], "cursor": "0", "count": 10},
)
record = {
"profile": {
"account_id": str(profile.get("account_id", "")),
"unique_id": profile.get("unique_id"),
"sec_uid": profile.get("sec_uid"),
"nickname": profile.get("nickname"),
"statistics": profile.get("statistics", {}),
},
"posts": posts.get("items", []),
}
print(json.dumps(record, ensure_ascii=False, indent=2))
Mantenha os IDs como strings, mesmo quando contiverem apenas dígitos. Isso evita perda de precisão em ferramentas a jusante que representam números grandes com precisão numérica limitada.
Ler o Esquema da Resposta Sem Adivinhar
As respostas de perfil, postagem e loja precisam de regras de normalização separadas.
Para perfis, mantenha os campos de identidade ao lado do objeto de estatísticas aninhadas. Para postagens, preserve o ID da postagem e URL, descrição, hora de criação, contagens públicas, campos de mídia, hashtags, idioma, indicadores de fixação ou anúncio, música, legendas e permissões, quando presentes. URLs de mídia e legendas podem estar em branco, portanto, um valor vazio é diferente de uma solicitação falhada.
Para produtos da loja, separe os campos de nível de produto dos campos de nível de SKU. O preço exibido, estoque agregado, vendedor, categorias e detalhes de envio descrevem a resposta do produto. Cada SKU pode ter suas próprias opções e disponibilidade. sold_count é o valor retornado pela página do produto; não é um livro razão de pedidos verificado ou uma figura GMV específica de período.
Manipulando Saída Estruturada
Uma tabela durável começa com quatro escolhas:
- Adicione um timestamp de coleção fora da resposta do ator.
- Preserve o JSON bruto para auditoria e reprocessamento.
- Normalize perfis, postagens, produtos e SKUs em tabelas separadas.
- Trate campos ausentes e vazios como desconhecidos até que a semântica da fonte estabeleça outro significado.
Para dados pessoais, colete apenas os campos públicos necessários para o propósito declarado. O Quadro de Privacidade NIST oferece uma estrutura útil para identificar o risco de privacidade e estabelecer controles em torno da coleta, acesso e retenção.
Scrapeless agrupa esses atores sob API de Rastreamento. Consulte a página de preços atual antes de estimar o volume de produção.
Problemas Comuns a Prevenir
- Usar um nome de usuário onde
sec_uidé necessário. Resolva o perfil primeiro e passe seusec_uidpara o ator de postagens. - Tratar cada campo de mídia em branco como um erro. Campos opcionais podem estar vazios em uma resposta válida.
- Mesclar estoque de produtos e SKUs. Mantenha ambos os níveis para que uma alteração de variante não sobrescreva a instantânea do produto.
- Comparar preços sem região e moeda. Armazene ambos os campos em cada observação.
- Chamando um snapshot de um rastreador. Um rastreador precisa de um agendador, armazenamento com timestamp, lógica de comparação e um destino de alerta.
Conclusão: construa em torno de objetos estáveis
A API de raspagem do TikTok reduz três tarefas comuns a chamadas de ator claras: resolver uma conta, coletar uma amostra pública limitada de postagens ou buscar um produto conhecido da Shop em uma região. O principal trabalho de engenharia se concentra na modelagem de dados: preservar identificadores, manter respostas brutas, anexar timestamps e separar registros de produtos de variantes.
Pronto para construir seu pipeline de dados do TikTok?
Junte-se ao Scrapeless Discord ou à comunidade do Telegram para comparar notas de implementação. Crie uma conta no Scrapeless Dashboard quando estiver pronto para enviar a primeira solicitação.
FAQ
Q: O que é uma API de raspagem do TikTok?
Uma API de raspagem do TikTok converte páginas públicas suportadas do TikTok em dados estruturados por meio de uma solicitação HTTP. Scrapeless expõe atores separados para detalhes do usuário, postagens do usuário e páginas de produtos da Shop.
Q: A API pode obter postagens de um nome de usuário do TikTok?
Sim, através de um fluxo de trabalho de duas chamadas. Resolva o nome de usuário com scraper.tiktok.user.detail, em seguida, passe o sec_uid retornado para scraper.tiktok.user.work.
Q: A API retorna comentários ou listas de seguidores?
Não. Os atores documentados mencionados aqui não retornam texto de comentários, listas de seguidores ou demografia de audiência.
Q: A resposta da TikTok Shop inclui dados SKU?
Sim. O ator da Shop pode retornar opções e registros SKU junto com preço, moeda, estoque, vendedor, categoria, imagem, classificação, revisão e campos de envio em nível de produto.
Q: É legal raspar dados públicos do TikTok?
A legalidade depende da jurisdição, dados, propósito, método de acesso e termos aplicáveis. Use apenas dados públicos, minimize a coleta, proteja os registros armazenados e obtenha aconselhamento jurídico para o projeto específico.
Q: Preciso gerenciar proxies ou defesas de página?
O ator gerenciado lida com a superfície de coleta por trás da chamada da API. Seu aplicativo ainda precisa de entradas válidas, tratamento claro de erros e planejamento conservador de solicitações.
Q: O fluxo de trabalho pode funcionar sem um agente de IA?
Sim. Qualquer cliente HTTP que possa enviar JSON e o cabeçalho x-api-token pode chamar o endpoint.
Na Scorretless, acessamos apenas dados disponíveis ao público, enquanto cumprem estritamente as leis, regulamentos e políticas de privacidade do site aplicáveis. O conteúdo deste blog é apenas para fins de demonstração e não envolve atividades ilegais ou infratoras. Não temos garantias e negamos toda a responsabilidade pelo uso de informações deste blog ou links de terceiros. Antes de se envolver em qualquer atividade de raspagem, consulte seu consultor jurídico e revise os termos de serviço do site de destino ou obtenha as permissões necessárias.



