Volver al blog

Registro de cambios semanal sin errores: Actualizaciones del 13 al 19 de julio de 2026

Isabella Garcia
Isabella Garcia

Web Data Collection Specialist

20-Jul-2026

Resumen:

  • El repositorio oficial de Amazon Scraper ahora es público bajo la organización de GitHub Scrapeless.
  • El repositorio oficial de Google Search Scraper ahora es público con ejemplos para resultados web, de imágenes, locales, de video, de compras y de noticias.
  • Se refinó el manejo de respuestas de Gemini para reducir la truncación de contenido.
  • Se mejoró el manejo de datos de compras en el modo AI de Google para una salida estructurada más completa.

Esto es lo que se lanzó en Scrapeless durante la semana del 13 al 19 de julio de 2026: dos nuevos repositorios de scrapers públicos y mejoras en la salida dirigidas para Gemini y el modo AI de Google.

🌟 Principales Actualizaciones

Repositorio de Amazon Scraper Ahora es Público

Scrapeless ha añadido un repositorio dedicado de Amazon Scraper a la organización oficial de GitHub. El repositorio ofrece a los desarrolladores una ubicación pública única para el proyecto de scraper de Amazon y sus materiales de apoyo.

El nuevo repositorio de Google Search Scraper proporciona un punto de entrada práctico para recopilar datos estructurados de búsqueda de Google a través de la API de Scraping de Scrapeless.

El repositorio cubre seis superficies de búsqueda:

  • Resultados web
  • Imágenes de Google
  • Local de Google
  • Videos de Google
  • Compras de Google
  • Noticias de Google

También incluye ejemplos de solicitudes en Python, Node.js, Go, Java y PHP, facilitando la conexión del scraper a una pila de aplicaciones existente.

Los desarrolladores pueden controlar el idioma de búsqueda, país, ubicación, paginación y filtros específicos de vertical a través de la entrada de solicitudes. El resultado son datos de búsqueda estructurada que pueden alimentar el monitoreo de SEO, investigación de mercado, inteligencia local y tuberías de datos automatizadas.

⬆️ Mejoras en el Servicio

Mejor Manejo de la Longitud de Respuesta de Gemini

Hemos refinado el manejo del contenido de Gemini para reducir los casos en que el texto de respuesta podría ser truncado. Los flujos de trabajo que recopilan respuestas más largas deberían recibir ahora contenido más completo para análisis, comparación y almacenamiento posteriores.

Mejora de Datos de Compras del Modo AI de Google

Mejoramos el manejo de datos de compras devueltos por el modo AI de Google. La actualización se centra en capturar y estructurar información relacionada con el comercio de manera más consistente cuando aparece en las respuestas del modo AI.

Esto es útil para equipos que trabajan en descubrimiento de productos, monitoreo de marcas, investigación minorista y visibilidad en búsquedas AI.

👀 Lo Que Esto Significa Para los Desarrolladores

Las actualizaciones de esta semana hacen que dos superficies de datos comunes sean más fáciles de descubrir e integrar desde GitHub, mientras mejoran la completitud de los datos de respuesta generados por IA.

Los repositorios públicos proporcionan puntos de partida reutilizables para proyectos de Amazon y Google Search. Las mejoras de Gemini y del modo AI de Google reducen el trabajo de limpieza en las tuberías que dependen de texto de respuesta completo y datos de compras.

Explora la API de Scraping de Scrapeless, revisa precios, o lee el anterior Registro Semanal de Cambios.

En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.

Artículos más populares

Catalogar