返回博客

无损周更日志:2026年9月14日至20日

Isabella Garcia
Isabella Garcia

Web Data Collection Specialist

22-Sep-2026

TL;DR:

  • Python、Node.js 和 Go SDK 添加了 AI Scraper 支持。 当前的版本是 Python 1.3.0、Node.js 1.12.1 和 Go v1.3.0。
  • Gemini Scraper 可以返回购物数据。 一项新的请求选项为符合条件的 Gemini 响应添加了结构化的产品和商户优惠字段。
  • 五个 AI Scraper 可以返回分享链接。 Perplexity、Copilot、ChatGPT、Google AI 概述和 Google AI 模式的响应现在可以包含一个分享链接字段。
  • Perplexity HTML 输出可根据请求提供。 团队在针对此响应格式构建之前,应与 Scrapeless 支持确认启用情况。
  • AI Scraper 响应质量进行了广泛的维护。 修复内容覆盖了产品数据、输出格式、重定向链接解析、缺失的 URL、服务可用性、角色文本和 ChatGPT 类型解析。

9月14日至20日的发布将 AI Scraper 引入所有三款 Scrapeless SDK,并扩展了来自几个回答引擎的结构化数据。Gemini 添加了购物数据,五个参与者增加了分享链接输出,而 Perplexity 为批准的用例提供了 HTML 响应选项。一个单独的维护修复了解决 AI Scraper 中的响应和解析问题。

AI Scraper 在所有三款 Scrapeless SDK 中上线

最新的 Python、Node.js 和 Go SDK 版本通过其本地客户端接口暴露了 AI Scraper 任务创建和结果检索。应用程序可以提交特定于参与者的输入对象,接收任务标识符和状态,并在无需自行构建 HTTP 请求层的情况下检索参与者响应。

SDK 先前版本 当前版本 经验证的发布信息
Python 1.2.1 1.3.0 Python SDK v1.3.0 标签 · PyPI scrapeless 1.3.0
Node.js 1.11.0 1.12.1 Node SDK v1.12.1 标签 · npm 注册表记录 SDK 1.12.1
Go v1.2.0 v1.3.0 Go SDK v1.3.0 标签 · Go 模块 v1.3.0

Python 1.3.0 和 Go v1.3.0 添加了专用的 AI Scraper 服务。对于 Node.js,AI Scraper 支持已在 1.12.0 中上线,而当前的 1.12.1 版本更新了相关文档。Python 版本还修复了一个配置网关地址的问题。

每个 SDK 都提供了创建 AI Scraper 任务和检索结果的方法。特定于参与者的输入保持灵活,因此团队可以在不等待新的语言特定输入类型的情况下使用受支持的参与者。Scrapeless SDK 文档AI Scraper 文档提供当前的集成入口点。

Gemini Scraper 添加购物数据

当启用 shopping 选项时,Gemini Scraper 现在可以返回结构化的购物数据。符合条件的响应可以包括产品标题、产品 URL、品牌、评分、价格范围、缩略图、变体、评论和店铺级优惠。

商店数据可以包括商户名称、直接产品链接、价格、与可用性相关的细节、交付信息和总价。这使得在产品研究、优惠比较和 AI 搜索可见性工作流中更容易使用响应,而无需从回答文本重建产品卡片。

实时的Gemini Scraper 参考记录了请求控制和响应字段。购物数据增加了额外的处理,并使用该参考中描述的定价,因此集成应仅在需要产品级输出时启用。

开始使用 Scrapeless 进行抓取

利用 Scrapeless 提高您的网络抓取和自动化工作流程!
今天注册并获取 5 美元的免费积分无需信用卡

现在通过 Scrapeless Dashboard 索取您的免费积分。

分享链接在 AI Scraper 中扩展

Perplexity, Copilot, ChatGPT, Google AI 概述和 Google AI 模式的响应现在可以包括共享链接字段。当结果需要进入审查、协作或客户面对证据工作流时,团队可以将返回的值存储在结构化答案旁边。

该字段应被视为不透明的返回值。本变更日志不假定响应中不存在的字段名称、保留期限或访问策略。Copilot Scraper 参考仍然是该行为者的公共请求和响应参考。

Perplexity HTML 输出和 AI 模式解析

Perplexity Scraper 可以为启用此功能的帐户提供 HTML 输出。由于可用性是根据特定客户要求配置的,团队在依赖此格式用于生产之前,应联系 Scrapeless 支持。Perplexity Scraper 参考仍然是一般可用字段的基准。

Google AI 模式的响应解析也已扩展以覆盖额外的返回数据。该版本保持这些字段在结构化响应中,而不是让集成从渲染内容中恢复它们。Google AI 模式参考文档描述了当前的公共响应模型。

可靠性和响应质量修复

本周的维护工作解决了几个客户可见的响应问题:

  • AI Scraper 产品数据和格式。 在受影响的响应中,缺失的产品信息和不一致的输出格式已被更正。
  • Google AI 概述和 AI 模式重定向链接。 /goto?url= 值更一致地转换为最终目标。
  • Perplexity URLs。 修复了响应中省略 URL 数据的情况。
  • Grok 可用性。 受影响的服务中断已解决,该行为者已恢复在线。
  • Amazon Rufus 人设文本。 受影响的美国工作流程中的响应不再包含不必要的人设内容。
  • ChatGPT 响应类型。 修复了返回类型解析错误,以改善成功响应处理。

这些更改是服务端的修正。现有请求结构不需要更改以修复行为。

结论

此版本为 Python、Node.js 和 Go 团队提供了进入 AI Scraper 的一流 SDK 路径。Gemini 购物数据增加了更丰富的产品层,分享链接使 AI 答案更容易融入审查工作流,而响应质量修复则减少了多个行为者的下游清理工作。

AI Scraper 是 Universal Scraping API的一部分。Scrapeless Scraper API 指南解释了行为者模型如何适应更广泛的数据工作流。在规划生产使用时,请查看 Scrapeless 定价

👀 准备构建您的 AI 搜索数据工作流?

加入 Scrapeless 社区中构建 AI 答案和产品数据工作流的开发人员: Discord · Telegram

app.scrapeless.com 注册以开始使用。

在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。

最受欢迎的文章

目录