Registro de cambios semanal de Scrapeless: 7–13 de septiembre de 2026
Advanced Bot Mitigation Engineer
TL;DR:
- La documentación de la API de Google Search está en vivo. Los desarrolladores ahora tienen una introducción dedicada y referencia de solicitudes para datos estructurados de Google Search.
- ChatGPT Scraper añade control de búsqueda web a nivel de solicitud. El parámetro
web_searchpermite que cada tarea elija si utilizar búsqueda web. - Las respuestas de ChatGPT ahora incluyen
conversation_id. El nuevo campo facilita la asociación de resultados almacenados con su conversación de origen. - ChatGPT Scraper añade opciones de salida en HTML y SSE. Los equipos pueden seleccionar la representación de respuesta que se ajusta a su flujo de trabajo de procesamiento.
- Se corrigieron problemas de idioma y enrutamiento de tareas. Las actualizaciones cubren datos de dispersión de Perplexidad y errores intermitentes de "plan no encontrado" en AI Scraper.
La versión del 7 al 13 de septiembre brinda a los desarrolladores más control sobre la colección de respuestas de IA y un camino más claro hacia los datos de Google Search. La nueva documentación de la API de Google Search ya está disponible, y ChatGPT Scraper obtiene control sobre la búsqueda web, identificadores de conversación y dos opciones de salida adicionales. La versión también corrige problemas de selección de idioma y enrutamiento de tareas en AI Scraper.
🌟 La documentación de la API de Google Search está en vivo
La nueva documentación de la API de Google Search introduce la superficie de API dedicada para extraer datos estructurados de Google Search en tiempo real.
La documentación cubre controles de solicitud comunes como consulta, país, idioma, dominio de Google, tipo de resultado, paginación y conteo de resultados. Proporciona a los equipos una referencia única para diseñar flujos de trabajo de monitoreo de búsqueda, investigación y enriquecimiento de datos sin necesidad de mantener su propio navegador y pila de análisis.
La API de Google Search sigue disponible a través de los productos de datos de búsqueda de Scrapeless. Los equipos que planeen una nueva integración pueden revisar la página del producto de la API de Google Search junto con la referencia recién publicada.
💫 ChatGPT Scraper añade más control sobre solicitudes y salida
La actualización de ChatGPT Scraper de esta semana cubre cómo una tarea utiliza la búsqueda web, cómo se identifica su conversación y cómo se pueden entregar los datos de respuesta.
Elegir búsqueda web por solicitud
El actor scraper.chatgpt ahora soporta la entrada personalizada web_search. Establezca el booleano para cada solicitud para elegir si la búsqueda web de ChatGPT está habilitada para esa tarea. Esto es útil cuando un conjunto de datos mezcla indicaciones solo de modelo con indicaciones que necesitan información web actual y resultados de fuente.
La referencia del ChatGPT Scraper documenta web_search como un booleano opcional. El comportamiento más amplio de las respuestas conectadas a la web y las citas se describe en la guía oficial de búsqueda web.
Identificar la conversación de origen
Las respuestas de ChatGPT Scraper ahora incluyen conversation_id. Los equipos de datos pueden almacenar el identificador con la respuesta, la indicación, las citas y la marca de tiempo de colección para que los registros de la misma conversación de origen sean más fáciles de rastrear y agrupar.
El campo identifica la conversación asociada con la respuesta. Esta nota de lanzamiento no asume que pueda ser devuelta para continuar una conversación; las integraciones deben seguir la documentación actual de solicitudes para las entradas admitidas.
Seleccionar salida HTML o SSE
ChatGPT Scraper ahora puede proporcionar formatos de salida en HTML y SSE. HTML es útil cuando una aplicación necesita la representación de respuesta renderizada. SSE se adapta a flujos de trabajo que consumen el flujo de eventos subyacente o lo preservan para su posterior procesamiento.
La Especificación HTML Living Standard define la sintaxis del documento que las aplicaciones pueden usar al validar o transformar el HTML devuelto. Los consumidores de SSE deben analizar el flujo como datos de eventos en lugar de tratarlo como un solo documento HTML. La especificación de eventos enviados por el servidor define el modelo de flujo de eventos y las reglas de análisis utilizadas por clientes basados en estándares.
Para una visión más amplia de las respuestas estructuradas de ChatGPT y las citas, consulte la guía de colección de ChatGPT.
Comience a raspar con Scrapeless
¡Potencie su flujo de trabajo de raspado web y automatización con Scrapeless!
Regístrese hoy y obtenga $5 en crédito gratis — sin necesidad de tarjeta de crédito.
Reclama tu crédito gratuito ahora en el Scrapeless Dashboard.
⬆️ Arreglos de Fiabilidad del AI Scraper
Dos arreglos mejoran la consistencia en las respuestas del AI Scraper:
- Manejo del idioma en fanout de Perplexity. Los datos de fanout ya no devuelven el idioma incorrecto en los casos afectados.
- Errores intermitentes de enrutamiento de tareas. Se ha solucionado la ocasional respuesta de “plan no encontrado” que afectaba a las tareas del AI Scraper.
Estos son arreglos del lado del servicio. Las integraciones existentes no necesitan una migración del esquema de solicitud para el comportamiento corregido.
📍Conclusión
Esta versión hace que la API de Google Search sea más fácil de adoptar y expande las formas en que los equipos pueden recopilar y gestionar respuestas de IA. El AI Scraper ahora ofrece control de búsqueda web por solicitud, identificadores de conversación y salida en HTML o SSE. Los arreglos complementarios mejoran la consistencia del idioma y la ejecución de tareas en todo el AI Scraper.
El AI Scraper es parte de la API Universal de Scraping. Revisa la tarificación de Scrapeless al planificar cargas de trabajo en producción.
👀 ¿Listo para Construir tu Flujo de Trabajo de Datos de Búsqueda de IA?
Únete a los desarrolladores que construyen flujos de trabajo de datos de búsqueda y respuestas de IA en la comunidad Scrapeless: Discord · Telegram.
Regístrate en app.scrapeless.com para comenzar.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



