Cambios Semanales sin Scrap: 14–20 de septiembre de 2026
Web Data Collection Specialist
TL;DR:
- Los SDK de Python, Node.js y Go agregan soporte para AI Scraper. Las versiones actuales son Python 1.3.0, Node.js 1.12.1 y Go v1.3.0.
- Gemini Scraper puede devolver datos de compras. Una nueva opción de solicitud agrega campos estructurados de producto y oferta de comerciante a las respuestas elegibles de Gemini.
- Cinco AI Scrapers pueden devolver enlaces de compartir. Las respuestas de Perplexity, Copilot, ChatGPT, Google AI Overview y Google AI Mode ahora pueden incluir un campo de enlace de compartir.
- La salida HTML de Perplexity está disponible bajo petición. Los equipos deben confirmar la habilitación con el soporte de Scrapeless antes de trabajar con este formato de respuesta.
- La calidad de la respuesta de AI Scraper recibió un amplio mantenimiento. Las correcciones cubren datos de producto, formato de salida, resolución de enlaces de redirección, URLs faltantes, disponibilidad del servicio, texto de persona y análisis de tipo ChatGPT.
La publicación del 14 al 20 de septiembre trae AI Scraper a los tres SDK de Scrapeless y amplía los datos estructurados disponibles de varios motores de respuesta. Gemini agrega datos de compras, cinco actores agregan salida de enlace para compartir y Perplexity obtiene una opción de respuesta HTML para casos de uso aprobados. Un pase de mantenimiento separado corrige problemas de respuesta y análisis a través de AI Scraper.
AI Scraper Llega a los Tres SDK de Scrapeless
Las últimas versiones de los SDK de Python, Node.js y Go exponen la creación de tareas de AI Scraper y la recuperación de resultados a través de sus interfaces de cliente nativas. Las aplicaciones pueden enviar un objeto de entrada específico del actor, recibir el identificador de la tarea y el estado, y recuperar la respuesta del actor sin construir la capa de solicitud HTTP ellas mismas.
| SDK | Versión anterior | Versión actual | Superficies de lanzamiento verificadas |
|---|---|---|---|
| Python | 1.2.1 | 1.3.0 | Etiqueta de Python SDK v1.3.0 · PyPI scrapeless 1.3.0 |
| Node.js | 1.11.0 | 1.12.1 | Etiqueta de Node SDK v1.12.1 · Registro npm para SDK 1.12.1 |
| Go | v1.2.0 | v1.3.0 | Etiqueta de Go SDK v1.3.0 · Módulo Go v1.3.0 |
Python 1.3.0 y Go v1.3.0 agregan servicios dedicados de AI Scraper. Para Node.js, el soporte para AI Scraper llegó en 1.12.0 y la versión actual 1.12.1 actualiza la documentación asociada. La versión de Python también corrige un problema con la dirección de puerta de enlace de perfil.
Cada SDK expone métodos para crear una tarea de AI Scraper y recuperar su resultado. La entrada específica del actor sigue siendo flexible, por lo que los equipos pueden usar actores compatibles sin esperar un nuevo tipo de entrada específico del idioma. La documentación del SDK de Scrapeless y la documentación de AI Scraper proporcionan los puntos de entrada de integración actuales.
Gemini Scraper Agrega Datos de Compras
Gemini Scraper ahora puede devolver datos estructurados de compras cuando la opción shopping está habilitada. Las respuestas elegibles pueden incluir títulos de productos, URLs de productos, marcas, calificaciones, rangos de precios, miniaturas, variantes, reseñas y ofertas a nivel de tienda.
Los datos de la tienda pueden incluir nombres de comerciantes, enlaces directos a productos, precios, detalles relacionados con disponibilidad, información de entrega y precio total. Esto facilita el uso de la respuesta en investigación de productos, comparación de ofertas y flujos de trabajo de visibilidad de búsqueda AI sin reconstruir tarjetas de productos a partir del texto de respuesta.
La referencia de Gemini Scraper en vivo documenta el control de solicitud y los campos de respuesta. Los datos de compras añaden procesamiento adicional y utilizan la fijación de precios descrita en esa referencia, por lo que las integraciones deberían habilitarlo solo cuando se necesite salida a nivel de producto.
Comienza a Rastrillar con Scrapeless
¡Potencia tu flujo de trabajo de raspado web y automatización con Scrapeless!
Regístrate hoy y obtén $5 en crédito gratuito — sin necesidad de tarjeta de crédito.Reclama tu crédito gratuito ahora en el Tablero de Scrapeless.
Los Enlaces de Compartir se Expanden en AI Scraper
Perplexity, Copilot, ChatGPT, Google AI Overview, y las respuestas del modo Google AI ahora pueden incluir un campo de enlace para compartir. Los equipos pueden almacenar el valor devuelto junto a la respuesta estructurada cuando un resultado necesita pasar a revisión, colaboración o flujos de trabajo de evidencia orientados al cliente.
El campo debe tratarse como un valor devuelto opaco. Este registro de cambios no asume un nombre de campo, período de retención o política de acceso que no esté presente en la respuesta. La referencia del Scraper Copilot sigue siendo la referencia pública para solicitudes y respuestas de ese actor.
Salida HTML de Perplexity y Análisis del Modo AI
El Scraper de Perplexity puede proporcionar salida HTML para cuentas con la función habilitada. Debido a que la disponibilidad se configura para requisitos específicos de los clientes, los equipos deben contactar con el soporte de Scrapeless antes de depender del formato en producción. La referencia del Scraper de Perplexity sigue siendo la base para campos generalmente disponibles.
El análisis de respuestas del modo Google AI también se ha expandido para cubrir datos devueltos adicionales. La versión mantiene esos campos en la respuesta estructurada en lugar de dejar que las integraciones los recuperen del contenido renderizado. La referencia del modo Google AI documenta el modelo de respuesta pública actual.
Fiabilidad y Soluciones de Calidad de Respuesta
El trabajo de mantenimiento de esta semana aborda varios problemas de respuesta visibles para los clientes:
- Datos de producto y formato del Scraper AI. Se corrigieron la información de producto faltante y el formato de salida inconsistente en las respuestas afectadas.
- Enlaces de redirección del Google AI Overview y del modo AI. Los valores
/goto?url=se convierten a sus destinos finales de manera más consistente. - URLs de Perplexity. Se ha solucionado un caso donde la respuesta omitía datos de URL.
- Disponibilidad de Grok. La interrupción del servicio afectado se ha resuelto y el actor está en línea nuevamente.
- Texto de persona de Amazon Rufus. Las respuestas en el flujo de trabajo afectado en EE. UU. ya no incluyen contenido de persona no deseado.
- Tipos de respuesta de ChatGPT. Se ha corregido un error de análisis de tipo de retorno para mejorar el manejo exitoso de respuestas.
Estos cambios son correcciones del lado del servicio. Las estructuras de solicitud existentes no necesitan cambiar para el comportamiento corregido.
Conclusión
Esta versión ofrece a los equipos de Python, Node.js y Go un camino SDK de primera clase hacia el Scraper AI. Los datos de compras de Gemini añaden una capa de producto más rica, los enlaces para compartir facilitan el traslado de respuestas de AI a flujos de trabajo de revisión, y las soluciones de calidad de respuesta reducen la limpieza a través de varios actores.
El Scraper AI es parte de la API Universal de Scraping. La guía de la API del Scraper de Scrapeless explica cómo el modelo de actor se integra en un flujo de trabajo de datos más amplio. Revise los precios de Scrapeless al planificar el uso en producción.
👀 ¿Listo para Construir Tu Flujo de Trabajo de Datos de Búsqueda AI?
Únete a los desarrolladores que están construyendo flujos de trabajo de respuestas de AI y datos de productos en la comunidad de Scrapeless: Discord · Telegram.
Regístrate en app.scrapeless.com para comenzar.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



