Registro de cambios semanal sin recortes: 24–30 de agosto de 2026 Actualizaciones
Senior Web Scraping Engineer
TL;DR:
- TikTok Scraper está oficialmente disponible. La documentación pública ahora cubre perfiles de creadores, listas de videos de creadores y detalles de productos de TikTok Shop.
- El servidor MCP de Scrapeless ahora incluye LLM Chat Scraper. La nueva herramienta integra la colección de respuestas de IA en flujos de trabajo conectados a MCP.
- El modo de IA de Google ahora acepta una URL como entrada. Un enlace completo de acceso al modo de IA puede reemplazar los parámetros de entrada basados en solicitudes habituales.
- La búsqueda y la colección de IA recibieron actualizaciones de fiabilidad. La API de búsqueda de Google tiene un nuevo lanzamiento, varios scrapers de LLM tienen tasas de éxito más altas y las respuestas de Amazon Rufus incluyen una mejor interpretación de referencias a fuentes.
TikTok Scraper ha pasado de vista previa a lanzamiento oficial. Durante el 24-30 de agosto, Scrapeless también agregó LLM Chat Scraper a su servidor MCP e introdujo la colección basada en URL para el modo de IA de Google. El lanzamiento incluye mejoras en la API de búsqueda de Google para cargas de trabajo comerciales más grandes, mejores tasas de éxito de scrapers de IA y datos de fuentes más ricos de Amazon Rufus.
💥 TikTok Scraper Está Oficialmente Activo
TikTok Scraper ahora tiene documentación API pública para tres tareas de colección:
| Capacidad | Actor | Caso de Uso Típico |
|---|---|---|
| Perfiles de creadores | scraper.tiktok.user.detail |
Investigar perfiles públicos de creadores |
| Listas de videos de creadores | scraper.tiktok.user.work |
Rastrear el contenido publicado por un creador |
| Detalles de productos de TikTok Shop | scraper.tiktok.shop.page |
Recoger datos de páginas de productos para investigación comercial |
Los equipos ahora pueden usar las referencias de solicitudes y respuestas publicadas para construir integraciones. Los actores separados permiten a los desarrolladores elegir la fuente de datos que su flujo de trabajo necesita, ya sea un perfil de creador, una lista de contenido o una página de producto.
Para proyectos de datos de creadores, mantén la colección limitada a información pública y almacena solo los campos necesarios para el proyecto. La disponibilidad pública no elimina la necesidad de revisar los términos de la plataforma y los requisitos aplicables de manejo de datos.
💫 LLM Chat Scraper Se Une al Servidor MCP de Scrapeless
El servidor MCP de Scrapeless ahora expone llm_chat_scraper para crear tareas de colección de respuestas de IA. La referencia de herramientas del servidor Scrapeless MCP enumera el soporte para ChatGPT, Gemini, Perplexity, Copilot, Modo IA de Google, Resumen de IA de Google, Grok y Alexa.
Esto da a los agentes conectados a MCP una herramienta directa para solicitar datos de motor de IA junto con las capacidades existentes de búsqueda, navegador y rastreo del servidor. Un flujo de trabajo de investigación puede usar las respuestas recopiladas para comparaciones de motores o monitoreo recurrente de visibilidad de IA.
Los clientes de MCP descubren herramientas nombradas y sus esquemas de entrada a través de la interfaz de descubrimiento de herramientas MCP. Consulta la lista de herramientas expuestas por tu servidor conectado antes de agregar la nueva acción a un flujo de trabajo. La visión general del servidor MCP de Scrapeless explica la integración más amplia.
Comienza a Raspar con Scrapeless
Potencia tu raspado web y flujo de trabajo de automatización con Scrapeless!
Regístrate hoy y obtén $5 en crédito gratis — sin necesidad de tarjeta de crédito.Reclama tu crédito gratis ahora en el Tablero de Scrapeless.
🌟 El Modo IA de Google Soporta Entrada Basada en URL
El Scraper del Modo IA de Google ahora acepta una cadena url que contiene un enlace completo de acceso al Modo IA de Google. Esto añade una opción de entrada para flujos de trabajo que ya tienen una URL del Modo IA.
La referencia de entrada del Modo IA de Google especifica una regla importante: cuando se suministra url, los otros parámetros de entrada no son necesarios y se ignoran si están incluidos. No esperes que un aviso separado, país, compras o configuración de ubicación anule la URL suministrada.
Pasa el enlace completo en lugar de reconstruirlo a partir de piezas seleccionadas. Si tu aplicación analiza o almacena el enlace, preserva su componente de consulta y codificación utilizando el comportamiento definido por el Estándar de URL.
⬆️ Mejores Servicios
API de Búsqueda de Google Actualizada para Cargas de Trabajo Más Grandes
La API de Búsqueda de Google recibió una nueva versión enfocada en el uso comercial a gran escala, con una estabilidad y completitud de datos mejoradas. La actualización admite equipos que realizan la recolección de datos de búsqueda recurrentes para monitoreo, investigación y aplicaciones de producción.
Mayores Tasas de Éxito en Scrapers de IA
Copilot, Perplexity y Gemini recibieron mejoras en las tasas de éxito para Austria (AT). Google AI Overview también recibió una mejora en la tasa de éxito. Estas son actualizaciones de servicio cualitativas; los resultados aún dependen del motor, la solicitud y el contexto de recolección.
Las Referencias de Fuente de Amazon Rufus Se Analizan Más Completamente
El Rastreador de Amazon Rufus ahora analiza campos de referencia de fuente adicionales de las respuestas. La información adicionada ayuda a los equipos a inspeccionar referencias asociadas con respuestas de Rufus y llevar ese contexto a análisis subsiguientes. Procesa los datos de origen cuando están presentes en lugar de asumir que cada respuesta incluye referencias.
Conclusión
La versión de esta semana hace que la recolección de TikTok esté disponible a través de actores documentados, añade la recolección de respuestas de IA a MCP y proporciona a Google AI Mode una ruta de entrada basada en URL. La confiabilidad de búsqueda y el análisis de fuentes de Rufus también mejoran los datos disponibles para flujos de trabajo posteriores.
Elige el actor relevante de la API de Scraping de Scrapeless y revisa los precios de Scrapeless al planear tu carga de trabajo.
¿Listo para Construir Tu Próximo Flujo de Trabajo de Datos?
Conéctate con desarrolladores que están construyendo flujos de trabajo de datos de la web pública y respuestas de IA en la comunidad de Scrapeless: Discord · Telegram.
Regístrate en app.scrapeless.com para comenzar.
En Scrapeless, solo accedemos a datos disponibles públicamente y cumplimos estrictamente con las leyes, regulaciones y políticas de privacidad del sitio web aplicables. El contenido de este blog es sólo para fines de demostración y no implica ninguna actividad ilegal o infractora. No ofrecemos garantías y renunciamos a toda responsabilidad por el uso de la información de este blog o enlaces de terceros. Antes de realizar cualquier actividad de scraping, consulte a su asesor legal y revise los términos de servicio del sitio web de destino u obtenga los permisos necesarios.



