Scrapeless 每周更新日志:2026年9月21日–27日
Scraping and Proxy Management Expert
TL;DR:
- Python、Node.js 和 Go 现在有完整的 SDK 指南。 每种语言在重新结构化的 Scrapeless 文档中都有专门的安装、身份验证、产品覆盖、配置和使用参考。
- 三个 AI 爬虫可以创建共享链接。 Perplexity、Google AI 概览 和 Google AI 模式接受
should_fetch_share_link并可以返回share_url及其完成的结果。 - Scrapeless 浏览器自动化检查现已上线并免费使用。 该页面运行 16 个浏览器环境检查,生成环境指纹 ID,并允许您将结果下载为 JSON。
- Scrapeless 文档现在有更清晰的产品和开发工具结构。 当前导航将入门、产品指南、SDK、MCP、集成和帮助内容分开。
9 月 21 日至 27 日的版本专注于更清晰的开发人员入口和更便捷的结果共享。Python、Node.js 和 Go SDK 指南已上线,三个 AI 爬虫公开了文档化的共享链接控制,而新的浏览器诊断页面将常见的自动化和指纹信号转化为可读报告。
完整的 Python、Node.js 和 Go SDK 文档
Scrapeless 现在为 Python、Node.js 和 Go 提供专门的 SDK 文档。每个指南涵盖安装、API 密钥处理、快速入门、产品覆盖、使用示例、配置、环境变量和相应源代码库的链接。
新的 SDK 概述 为团队在选择特定语言指南之前提供了一个起点:
| SDK | 包 | 文档 |
|---|---|---|
| Python | scrapeless |
Python SDK |
| Node.js | @scrapeless-ai/sdk |
Node.js SDK |
| Go | github.com/scrapeless-ai/sdk-go |
Go SDK |
所有三个指南都记录了 AI 爬虫任务的创建和结果检索以及其他支持的 Scrapeless 服务。这使得集成路径与团队已经使用的语言保持接近,而 AI 爬虫介绍 仍然是特定行为的来源。
三个 AI 爬虫的共享链接
Perplexity、Google AI 概览 和 Google AI 模式现在记录了相同的共享链接请求和响应模式。在创建任务时设置可选的 should_fetch_share_link 布尔值;合格的完成响应可以在 share_url 中包含生成的链接。
| AI 爬虫 | 参与者 | 共享链接文档 |
|---|---|---|
| Perplexity | scraper.perplexity |
Perplexity Scraper |
| Google AI 概览 | scraper.overview |
Google AI 概览 Scraper |
| Google AI 模式 | scraper.aimode |
Google AI 模式 Scraper |
返回的共享 URL 可以放在提示、回答和引用旁边,作为审查记录。团队可以将该记录传入编辑审查、品牌监测分析或客户支持工作流程,而无需重建可共享的结果页面。
开始使用 Scrapeless 抓取
使用 Scrapeless 提升您的网络抓取和自动化工作流程!
今天注册并获得 $5 的免费信用 — 无需信用卡。立即在 Scrapeless Dashboard 申请您的免费信用。
免费的浏览器自动化和指纹诊断
免费的 Scrapeless 浏览器自动化检查 显示当前浏览器在一次观察中揭示的内容。它运行 16 项检查,并将每个结果呈现为清晰、需要审核、信息性、不可用或明确的自动化信号。
这些检查涵盖了自动化指标、浏览器环境一致性、导航器和时间值、客户端提示、硬件和显示数据、网络 APIs、浏览器功能、存储和隐私信号、权限和媒体、Canvas、WebGL、音频、字体和布局、ClientRects、运行时能力和 WebRTC。
其中几个表面由开放的浏览器标准定义。 WebDriver 标准 定义了 navigator.webdriver 背后的浏览器自动化模型; HTML Canvas 规范 定义了可编程的绘图行为; WebGL 规范 描述了暴露给网页的渲染接口。
该页面还从观察到的输入创建了环境指纹 ID,支持全新运行,并下载完整报告作为 JSON。诊断在不请求相机或麦克风访问的情况下运行,不使用外部 STUN 请求进行 WebRTC 检查,并声明报告不会被存储。
结果描述当前的观察;这不能证明人类身份。清晰的 navigator.webdriver 结果也不保证每个网站都会将浏览器视为人类流量。
更清晰的 Scrapeless 文档结构
Scrapeless 文档导航已围绕团队选择和实现产品的方式进行了重组。 平台概述 现在将读者导向浏览器与爬行、AI 抓取器、网页解锁器、代理、抓取 API、开发者工具、集成和帮助。
SDK 坐落在开发者工具下,为每种支持的语言提供单独页面。产品特定的指南仍然与其请求和响应行为分组,而帮助部分提供直接类别,而不是强迫开发者通过一条漫长的故障排除路径。
结论
本周的发布缩小了可用 SDK 功能与其公共文档之间的差距。它还为 Perplexity、Google AI 概述和 Google AI 模式集成提供了一致的分享链接合同,而浏览器自动化检查提供了一种快速检查自动化工作流所暴露的浏览器信号的方法。
AI 抓取器可以通过 通用抓取 API 获得。上一期 Scrapeless 每周变更日志 涵盖了这些指南之前的 SDK 发布。计划生产使用时请查看 Scrapeless 定价。
准备好使用 Scrapeless 进行构建吗?
加入在 Scrapeless 社区中构建浏览器自动化和 AI 回答工作流的开发者: Discord · Telegram。
在 app.scrapeless.com 注册以开始。
常见问题
问:开发者在哪里可以找到新的 Scrapeless SDK 指南?
SDK 概述链接到当前 Scrapeless 文档导航中的开发者工具下的专用 Python、Node.js 和 Go 页面。
问:哪些 AI 抓取器支持文档化的分享链接字段?
Perplexity、Google AI 概述和 Google AI 模式将 should_fetch_share_link 文档化为请求控制,将 share_url 文档化为返回的分享链接。
问:浏览器自动化检查是否证明访客是人类?
不。浏览器自动化检查报告当前环境中的可观察信号;结果是诊断快照,而不是人类身份的证明,也不是对另一个网站如何分类浏览器的保证。
在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。



