Scrapeless Weekly Changelog: 7–13 de setembro de 2026
Advanced Bot Mitigation Engineer
TL;DR:
- A documentação da API de Pesquisa do Google está ao vivo. Os desenvolvedores agora têm uma introdução dedicada e referência de solicitação para dados estruturados de Pesquisa do Google.
- O ChatGPT Scraper adiciona controle de pesquisa na web em nível de solicitação. O parâmetro
web_searchpermite que cada tarefa escolha se deve usar a pesquisa na web. - As respostas do ChatGPT agora incluem
conversation_id. O novo campo torna mais fácil associar resultados armazenados com sua conversa de origem. - O ChatGPT Scraper adiciona opções de saída HTML e SSE. As equipes podem selecionar a representação da resposta que se encaixa em seu fluxo de trabalho de processamento.
- Problemas de linguagem e roteamento de tarefas foram corrigidos. As atualizações cobrem dados de dispersão da Perplexidade e erros intermitentes de “plano não encontrado” em todo o AI Scraper.
A versão de 7 a 13 de setembro oferece aos desenvolvedores mais controle sobre a coleta de respostas de IA e um caminho mais claro para dados de Pesquisa do Google. A nova documentação da API de Pesquisa do Google já está disponível, e o ChatGPT Scraper ganha controle sobre a pesquisa na web, identificadores de conversação e duas opções de saída adicionais. A versão também corrige problemas de seleção de linguagem e roteamento de tarefas em todo o AI Scraper.
🌟 A Documentação da API de Pesquisa do Google Está Ao Vivo
A nova documentação da API de Pesquisa do Google introduz a superfície da API dedicada para extrair dados estruturados de Pesquisa do Google em tempo real.
A documentação cobre controles de solicitação comuns, como consulta, país, idioma, domínio do Google, tipo de resultado, paginação e contagem de resultados. Ela fornece às equipes uma única referência para projetar monitoramento de pesquisa, pesquisa e fluxos de trabalho de enriquecimento de dados sem manter seu próprio navegador e pilha de análise.
A API de Pesquisa do Google continua disponível através dos produtos de dados de pesquisa da Scrapeless. As equipes que planejam uma nova integração podem revisar a página do produto da API de Pesquisa do Google juntamente com a referência recém-publicada.
💫 O ChatGPT Scraper Adiciona Mais Controle de Solicitação e Saída
A atualização do ChatGPT Scraper desta semana cobre como uma tarefa usa a pesquisa na web, como sua conversação é identificada e como os dados da resposta podem ser entregues.
Escolha a Pesquisa na Web Por Solicitação
O ator scraper.chatgpt agora suporta entrada personalizada web_search. Defina o booleano para cada solicitação para escolher se a pesquisa na web do ChatGPT está ativada para essa tarefa. Isso é útil quando um conjunto de dados mistura prompts somente do modelo com prompts que precisam de informações atuais da web e resultados de fonte.
A referência do ChatGPT Scraper documenta web_search como um booleano opcional. O comportamento mais amplo de respostas conectadas à web e citações é descrito no guia oficial de pesquisa na web.
Identificar a Conversa de Origem
As respostas do ChatGPT Scraper agora incluem conversation_id. As equipes de dados podem armazenar o identificador com a resposta, prompt, citações e carimbo de data/hora da coleta, para que registros da mesma conversa de origem sejam mais fáceis de rastrear e agrupar.
O campo identifica a conversa associada à resposta. Esta nota de lançamento não assume que pode ser passada de volta para continuar uma conversa; as integrações devem seguir a documentação atual de solicitação para entradas suportadas.
Selecionar Saída em HTML ou SSE
O ChatGPT Scraper agora pode fornecer formatos de saída em HTML e SSE. HTML é útil quando uma aplicação precisa da representação da resposta renderizada. SSE é adequado para fluxos de trabalho que consomem o fluxo de eventos subjacente ou o preservam para processamento posterior.
O HTML Living Standard define a sintaxe de documento que as aplicações podem usar ao validar ou transformar o HTML retornado. Consumidores de SSE devem analisar o fluxo como dados de evento em vez de tratá-lo como um único documento HTML. A especificação de Eventos Enviados pelo Servidor define o modelo de fluxo de eventos e as regras de análise usadas por clientes baseados em padrões.
Para uma visão geral mais ampla de respostas estruturadas do ChatGPT e citações, veja o guia de coleta do ChatGPT.
Comece a Raspagem com Scrapeless
Potencialize seu fluxo de trabalho de raspagem na web e automação com Scrapeless!
Inscreva-se hoje e ganhe $5 em crédito grátis — sem necessidade de cartão de crédito.
Reivindique seu crédito grátis agora no Scrapeless Dashboard.
⬆️ Correções de Confiabilidade do AI Scraper
Duas correções melhoram a consistência nas respostas do AI Scraper:
- Tratamento de linguagem de fanout de perplexidade. Os dados de fanout não retornam mais o idioma incorreto nos casos afetados.
- Erros intermitentes de roteamento de tarefas. A resposta ocasional de "plano não encontrado" que afetava as tarefas do AI Scraper foi corrigida.
Essas são correções do lado do serviço. Integrações existentes não precisam de uma migração de esquema de solicitação para o comportamento corrigido.
📍Conclusão
Este lançamento torna a API de Pesquisa do Google mais fácil de adotar e expande as maneiras como as equipes podem coletar e gerenciar respostas de IA. O ChatGPT Scraper agora oferece controle de pesquisa na web por solicitação, identificadores de conversa e saída em HTML ou SSE. As correções acompanhadas melhoram a consistência de linguagem e a execução de tarefas em todo o AI Scraper.
AI Scraper é parte da Universal Scraping API. Revise a precificação do Scrapeless ao planejar cargas de trabalho de produção.
👀 Pronto para Construir Seu Fluxo de Trabalho de Dados de Pesquisa de IA?
Junte-se a desenvolvedores que estão criando fluxos de trabalho de dados de pesquisa e respostas de IA na comunidade Scrapeless: Discord · Telegram.
Inscreva-se em app.scrapeless.com para começar.
Na Scorretless, acessamos apenas dados disponíveis ao público, enquanto cumprem estritamente as leis, regulamentos e políticas de privacidade do site aplicáveis. O conteúdo deste blog é apenas para fins de demonstração e não envolve atividades ilegais ou infratoras. Não temos garantias e negamos toda a responsabilidade pelo uso de informações deste blog ou links de terceiros. Antes de se envolver em qualquer atividade de raspagem, consulte seu consultor jurídico e revise os termos de serviço do site de destino ou obtenha as permissões necessárias.



