🎯 一款可定制、具备反检测功能的云浏览器,由自主研发的 Chromium驱动,专为网页爬虫AI 代理设计。👉立即试用
返回博客

无废料周更新日志:2026年7月20日至26日更新

James Thompson
James Thompson

Scraping and Proxy Management Expert

27-Jul-2026

TL;DR:

  • ChatGPT Scraper 现在通过新的 raw_sse 请求参数和 sse_data 响应字段支持可选的原始服务器发送事件数据。
  • 亚马逊 Scraper 进行了优化,提高了请求成功率,无需更改集成。
  • Grok Scraper 在固定场景下不再返回空负载,提高了成功结果的交付。
  • Alexa Scraper 的代码库现在是公开的,并提供了 Python、Node.js、Go、Java 和 PHP 的示例。
  • 旧版 scraper.shopeev2scraper.shopeev3 执行者已被退役。

以下是在 2026 年 7 月 20 日至 26 日期间 Scrapeless 发布的内容:原始 ChatGPT 流访问、新的 Alexa 开发者代码库、亚马逊和 Grok 的可靠性改进、更强的服务监控,以及 Shopee 执行者退役通知。

🌟 重要更新

ChatGPT Scraper 增加原始 SSE 输出

ChatGPT Scraper 现在可以返回响应背后的原始服务器发送事件流。这使团队能够访问事件级别的数据以及现有的结构化结果。

新增了两个字段:

  • raw_sse — 一个可选布尔请求参数。将其设置为 true 以请求原始 SSE 数据。
  • sse_data — 一个字符串响应字段,其中包含请求原始输出时的 SSE 数据。

新输出对需要存档原始流、检查事件序列、构建自定义解析器或将原始传输数据与标准响应进行比较的团队非常有用。

现有集成保持兼容,因为原始 SSE 输出是可选择的。未启用 raw_sse 的请求继续使用标准响应流程。

亚马逊 Scraper 成功率改善

我们优化了 scraper.amazon 以提高请求成功率。此更新增强了现有执行者,而无需更改其集成接口,因此当前请求工作流程可以保持不变。

Grok 空响应问题已修复

我们修复了 scraper.grok 可能返回空结果的情况。此修正提高了在工作流程中收集 Grok 答案以进行监视、分析和下游自动化的成功结果交付。

🆕 新的 Alexa Scraper 代码库

官方的 Alexa Scraper 代码库 现在是公开的。它向开发者展示如何通过 Scrapeless LLM Chat Scraper 使用 scraper.alexa 执行者收集结构化的亚马逊 Alexa 答案。

返回的数据可以包括 Markdown 和纯文本答案、引用、来源链接、后续建议和购物产品卡。这支持地理监控、源分析、区域答案比较、产品推荐研究和自动化 AI 答案管道。

代码库包括现成的适应示例:

  • Python
  • Node.js
  • Go
  • Java
  • PHP

⬆️ 服务改进

更强的操作监控

我们扩大了服务监控,以便能够更早地检测到错误,并引发手动干预。这缩短了从识别服务问题到开始操作审核和整改的时间。

📍 维护和兼容性通知

旧版 scraper.shopeev2scraper.shopeev3 执行者已被退役。对任一执行者的调用现在返回:

json Copy
{
  "code": 15002,
  "message": "此执行者不再支持。如有任何问题,请联系我们的支持团队。"
}

对于仍引用任一退役执行者的集成,这是一个重大变更。请检查计划工作中的执行者名称、SDK 封装和存储的请求模板。如果您需要帮助更新受影响的工作流程,请联系 Scrapeless 支持团队。

👀 这对开发者意味着什么

本周的更新提供了更深入的 ChatGPT 响应访问、更可靠的亚马逊和 Grok 收集,以及 Alexa 数据工作流程的公共起点。更强的监控和更新的 ChatGPT 收集策略也改善了日常服务操作。

探索 Scrapeless LLM Chat Scraper,查看 定价,或阅读 之前的每周变更日志

在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。

最受欢迎的文章

目录