返回博客

无废料每周更新日志:2026年9月7日至13日

Ethan Brown
Ethan Brown

Advanced Bot Mitigation Engineer

14-Sep-2026

TL;DR:

  • Google 搜索 API 文档已上线。 开发者现在有了专门用于结构化 Google 搜索数据的介绍和请求参考。
  • ChatGPT Scraper 添加了请求级的网络搜索控制。 web_search 参数允许每个任务选择是否使用网络搜索。
  • ChatGPT 的响应现在包含 conversation_id 这一新字段使得更容易将存储的结果与其源对话关联起来。
  • ChatGPT Scraper 添加了 HTML 和 SSE 输出选项。 团队可以选择适合其处理工作流程的响应表示形式。
  • 已修复语言和任务路由问题。 更新涵盖了 Perplexity 分发数据和 AI Scraper 中间的“未找到计划”错误。

9 月 7 日至 13 日的发布为开发者提供了更多控制 AI 答复收集的能力,同时更清晰地通向 Google 搜索数据。新的 Google 搜索 API 文档现已可用,ChatGPT Scraper 获得了网络搜索控制、对话标识符和两个附加输出选项。此发布还修正了 AI Scraper 中的语言选择和任务路由问题。

🌟 Google 搜索 API 文档已上线

新的 Google 搜索 API 文档 引入了专门的 API 界面,用于实时提取结构化 Google 搜索数据。

文档涵盖了常见请求控制项,例如查询、国家、语言、Google 域、结果类型、分页和结果数量。它为团队提供了一个单一的参考,以设计搜索监控、研究和数据增强工作流程,而无需维护自己的浏览器和解析堆栈。

Google 搜索 API 仍通过 Scrapeless 的搜索数据产品提供。计划进行新集成的团队可以查看 Google 搜索 API 产品页面 以及新发布的参考文档。

💫 ChatGPT Scraper 添加了更多请求和输出控制

本周的 ChatGPT Scraper 更新涵盖了任务如何使用网络搜索、如何识别其对话以及如何交付响应数据。

按请求选择网络搜索

现在 scraper.chatgpt 执行者支持自定义 web_search 输入。设置每个请求的布尔值,以选择是否为该任务启用 ChatGPT 网络搜索。这在数据集中混合仅模型的提示与需要当前网络信息和来源结果的提示时非常有用。

ChatGPT Scraper 参考web_search 记录为可选布尔值。网络连接的答案和引用的更广泛行为在 官方网络搜索指南 中进行了描述。

识别源对话

ChatGPT Scraper 的响应现在包含 conversation_id。数据团队可以将标识符与答案、提示、引用和收集时间戳一起存储,从而更容易追踪和分组来自同一源对话的记录。

该字段识别与响应关联的对话。此发布说明不假设它可以被传回以继续对话;集成应遵循当前请求文档以支持输入。

选择 HTML 或 SSE 输出

ChatGPT Scraper 现在可以提供 HTML 和 SSE 输出格式。当应用需要呈现的响应表示时,HTML 非常有用。SSE 适合于消耗基础事件流或为后续处理保留它的工作流程。

HTML 活标准 定义了应用在验证或转换返回 HTML 时可以使用的文档语法。SSE 消费者应将流解析为事件数据,而不是将其视为一个 HTML 文档。服务器推送事件规范 定义了标准客户端使用的事件流模型和解析规则。

有关结构化 ChatGPT 答复和引用的更广泛概述,请参阅 ChatGPT 收集指南

开始使用 Scrapeless 进行抓取

使用 Scrapeless 增强您的网页抓取和自动化工作流程!
今天注册并获得 5 美元的免费信用无需信用卡
立即在 Scrapeless Dashboard 申请您的免费积分。

⬆️ AI 数据抓取器可靠性修复

两个修复提高了 AI 数据抓取器响应的一致性:

  • 困惑度分发语言处理。 分发数据不再在受影响的情况下返回错误的语言。
  • 间歇性任务路由错误。 偶尔影响 AI 数据抓取器任务的“未找到计划”响应已被修复。

这些是服务端修复。现有集成不需要请求方案迁移以获得更正的行为。

📍结论

此次发布使 Google 搜索 API 更容易采用,并扩展了团队收集和管理 AI 答案的方式。ChatGPT 数据抓取器现在提供每请求的 Web 搜索控制、对话标识符和 HTML 或 SSE 输出。随附的修复提高了 AI 数据抓取器的语言一致性和任务执行。

AI 数据抓取器是 Universal Scraping API 的一部分。在规划生产工作负载时,请查看 Scrapeless 定价

👀 准备构建您的 AI 搜索数据工作流?

加入构建搜索数据和 AI 答案工作流的开发者,参与 Scrapeless 社区: Discord · Telegram

访问 app.scrapeless.com 开始使用。

在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。

最受欢迎的文章

目录