返回博客

Scrapeless 周刊变更日志:2026年8月17日至23日 更新

Alex Johnson
Alex Johnson

Senior Web Scraping Engineer

24-Aug-2026

TL;DR:

  • TikTok Scraper 即将上线。 计划覆盖内容包括创作者个人资料、创作者工作列表和 TikTok 商店产品详情。
  • Fanout 查询数据现在支持三个 AI 引擎。 ChatGPT、Gemini 和 Perplexity 支持此功能,相应的文档现已可用。
  • Scrapeless MCP 服务器有了新的 Crawl 工具。 连接到 MCP 的代理可以通过相同的工具界面启动更广泛的爬虫工作流。
  • ChatGPT 和 Grok 的稳定性有所提高。 服务端的改进增强了稳定性,而无需要求客户修改请求。

本周的发布扩展了团队如何收集社交商务数据、分析 AI 答案路径以及将爬虫与代理工作流连接。从 8 月 17 日到 23 日,Scrapeless 为发布准备了 TikTok Scraper,增加了三个 AI 引擎的 fanout 查询支持,推出了 Scrapeless MCP 服务器的 Crawl 工具,并提高了 ChatGPT 和 Grok 的稳定性。

💥 即将推出:TikTok Scraper

TikTok Scraper 是本周的第一个亮点。即将推出的工具旨在帮助团队收集公共创作者和商业数据,而无需为每种页面类型维护单独的浏览器工作流。

计划的覆盖范围包括:

  • 创作者个人资料 用于检索公共账户和个人资料详情。
  • 创作者工作列表 用于收集创作者发布的内容列表。
  • TikTok 商店产品详情 用于从支持的产品页面提取结构化信息。

公共文档仍在准备中,因此请求参数、响应字段和一般可用性将另行公布。评估这些工作流的团队应仅收集公共数据,并应用自己的合规、保存和访问政策。

💫 ChatGPT、Gemini 和 Perplexity 的 Fanout 查询支持

scraper.chatgpt, scraper.geminiscraper.perplexity 现在支持 fanout 查询数据,相应的文档已发布。

Fanout 数据帮助团队检查在 AI 答案工作流中生成的相关查询路径。它可以支持答案引擎监控、提示研究、内容缺口分析以及跨多个引擎的下游发现管道。

由于可用性可能取决于返回的答案,因此集成应在处理之前检查 fanout 数据是否存在。在更新生产解析器之前,请查看相关的 LLM Chat Scraper 文档

🌟 Scrapeless MCP 服务器的新 Crawl 工具

Scrapeless MCP 服务器 现在包括一个 Crawl 工具,扩展代理工作流,超越单页面检索。连接到 MCP 的应用可以使用该工具启动更广泛的爬虫任务,同时保持数据收集在同一服务器集成内部。

这符合 MCP 工具模型:服务器暴露命名功能,模型可以发现和调用,如 官方 MCP 工具规范 中所述。该规范还定义了工具参数的输入模式和结构化结果的可选输出模式。构建客户端的开发者可以参考 MCP 模式参考,而 官方示例服务器 展示了常见的集成模式。

使用 Scrapeless 开始抓取

通过 Scrapeless 提升您的网页抓取和自动化工作流!
今天注册,并获得 $5 的免费信用 —— 无需信用卡

立即在 Scrapeless Dashboard 领取您的免费信用。

⬆️ 服务可靠性改进

更稳定的 ChatGPT 收集

scraper.chatgpt 收到了服务端的稳定性改进,减少了中断收集并提高了成功结果的交付。现有的集成无需新请求参数即可受益于此更新。

Grok 状态处理修复

scraper.grok 收到了服务端的状态处理修复,以解决无效会话的问题。该更改提高了收集的连贯性,并减少了空白或中断的工作流,而无需更改面对客户的调用。

👀 这对开发者的意义

此次发布强化了现代数据工作流程的三个部分。TikTok Scraper将增加针对社交电商的覆盖,fanout查询数据提供了另一种研究AI回答行为的方法,而MCP爬虫工具使代理驱动的应用程序能够更广泛地收集数据。对ChatGPT和Grok的可靠性工作支持了更可靠的定期任务。

探索LLM Chat Scraper,查看使用Scrapeless MCP Server的五种方式,或在规划生产工作负载时查看Scrapeless定价

结论

8月17日至23日的发布预览了TikTok Scraper,增加了对ChatGPT、Gemini和Perplexity的fanout查询支持,将Crawl引入Scrapeless MCP Server,并改善了ChatGPT和Grok的可靠性。

准备好构建下一个数据工作流程了吗?

加入Scrapeless社区的开发者,构建AI回答监控、代理自动化和公开网络数据管道:Discord · Telegram

app.scrapeless.com注册并开始使用Scrapeless进行构建。

在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。

最受欢迎的文章

目录