Mudanças Semanais Sem Resíduos: Atualizações de 13 a 19 de julho de 2026
Web Data Collection Specialist
TL;DR:
- O repositório oficial do Amazon Scraper agora é público sob a organização Scrapeless no GitHub.
- O repositório oficial do Google Search Scraper agora é público com exemplos para resultados de web, imagem, local, vídeo, compras e notícias.
- O manuseio de respostas do Gemini foi aprimorado para reduzir a truncagem de conteúdo.
- O tratamento de dados de compras no Modo AI do Google foi melhorado para uma saída estruturada mais completa.
Aqui está o que foi lançado no Scrapeless durante a semana de 13 a 19 de julho de 2026: dois novos repositórios de scraper públicos e melhorias direcionadas na saída para Gemini e Google AI Mode.
🌟 Principais Atualizações
Repositório do Amazon Scraper Agora é Público
O Scrapeless adicionou um repositório do Amazon Scraper dedicado à organização oficial do GitHub. O repositório fornece aos desenvolvedores um único local público para o projeto do scraper da Amazon e seus materiais de apoio.
Repositório do Google Search Scraper Agora é Público
O novo repositório do Google Search Scraper fornece um ponto de entrada prático para coletar dados estruturados de busca do Google através da API de Scraping do Scrapeless.
O repositório cobre seis superfícies de busca:
- Resultados da web
- Imagens do Google
- Local do Google
- Vídeos do Google
- Compras do Google
- Notícias do Google
Ele também inclui exemplos de requisições em Python, Node.js, Go, Java e PHP, facilitando a conexão do scraper a uma pilha de aplicativos existente.
Os desenvolvedores podem controlar o idioma da busca, país, localização, paginação e filtros específicos por vertical através da entrada de requisição. O resultado é um conjunto de dados de busca estruturados que pode alimentar monitoramento de SEO, pesquisa de mercado, inteligência local e pipelines de dados automatizados.
⬆️ Melhorias no Serviço
Melhor Manuseio do Comprimento da Resposta do Gemini
Aprimoramos o manuseio de conteúdo do Gemini para reduzir casos em que o texto da resposta poderia ser truncado. Fluxos de trabalho que coletam respostas mais longas agora devem receber conteúdo mais completo para análise, comparação e armazenamento a montante.
Dados de Compras Melhorados no Modo AI do Google
Melhoramos o tratamento de dados de compras retornados pelo Modo AI do Google. A atualização foca em capturar e estruturar informações relacionadas ao comércio de maneira mais consistente quando aparecem nas respostas do Modo AI.
Isso é útil para equipes que trabalham em descoberta de produtos, monitoramento de marcas, pesquisa de varejo e visibilidade em pesquisas de IA.
👀 O Que Isso Significa para os Desenvolvedores
As atualizações desta semana tornam duas superfícies de dados comuns mais fáceis de descobrir e integrar a partir do GitHub, enquanto melhoram a completude dos dados de resposta gerados por IA.
Os repositórios públicos fornecem pontos de partida reutilizáveis para projetos da Amazon e Google Search. As melhorias no Gemini e no Modo AI do Google reduzem o trabalho de limpeza em pipelines que dependem de texto de resposta e dados de compras completos.
Explore a API de Scraping do Scrapeless, revise preços ou leia o anterior Weekly Changelog.
Na Scorretless, acessamos apenas dados disponíveis ao público, enquanto cumprem estritamente as leis, regulamentos e políticas de privacidade do site aplicáveis. O conteúdo deste blog é apenas para fins de demonstração e não envolve atividades ilegais ou infratoras. Não temos garantias e negamos toda a responsabilidade pelo uso de informações deste blog ou links de terceiros. Antes de se envolver em qualquer atividade de raspagem, consulte seu consultor jurídico e revise os termos de serviço do site de destino ou obtenha as permissões necessárias.



