无漏洞每周更新日志:2026年7月13日至19日 更新内容
Web Data Collection Specialist
TL;DR:
- 官方的 Amazon Scraper 仓库现已公开,隶属于 Scrapeless GitHub 组织。
- 官方的 Google Search Scraper 仓库现已公开,并提供 Web、图像、地方、视频、购物和新闻结果的示例。
- Gemini 响应处理进行了优化,以减少内容截断。
- Google AI 模式购物数据处理得到了改善,以提供更完整的结构化输出。
以下是 2026 年 7 月 13 日至 19 日期间 Scrapeless 发布的内容:两个新的公共爬虫仓库,以及针对 Gemini 和 Google AI 模式的输出改进。
🌟 主要更新
Amazon Scraper 仓库现已公开
Scrapeless 已在官方 GitHub 组织中添加了专门的 Amazon Scraper 仓库。该仓库为开发者提供了 Amazon 爬虫项目及其支持材料的单一公共位置。
Google Search Scraper 仓库现已公开
新的 Google Search Scraper 仓库 提供了通过 Scrapeless 爬虫 API 收集结构化 Google 搜索数据的实用入口。
该仓库覆盖六个搜索界面:
- 网页结果
- Google 图片
- Google 本地
- Google 视频
- Google 购物
- Google 新闻
它还包括 Python、Node.js、Go、Java 和 PHP 的请求示例,使爬虫更容易与现有应用堆栈连接。
开发者可以通过请求输入控制搜索语言、国家、位置、分页和特定垂直的过滤器。结果是可以为 SEO 监控、市场研究、地方情报和自动化数据管道提供支持的结构化搜索数据。
⬆️ 服务改进
更好的 Gemini 响应长度处理
我们优化了 Gemini 内容处理,以减少响应文本可能被截断的情况。收集较长答案的工作流程现在应该能够获得更完整的内容,供下游分析、比较和存储使用。
改进的 Google AI 模式购物数据
我们改善了 Google AI 模式返回的购物数据的处理。这次更新专注于在 AI 模式响应中更一致地捕获和结构化与商业相关的信息。
这对于从事产品发现、品牌监测、零售研究和 AI 搜索可见性的团队非常有用。
👀 对开发者的意义
本周的更新使得从 GitHub 中发现和集成两个常见数据界面更为简便,同时提高了 AI 生成的响应数据的完整性。
公共仓库为 Amazon 和 Google Search 项目提供了可重用的起始点。Gemini 和 Google AI 模式的改进减少了对依赖于完整答案文本和购物数据的管道的清理工作。
探索 Scrapeless Scraping API,查看 定价,或阅读 上一个每周更改日志。
在Scrapeless,我们仅访问公开可用的数据,并严格遵循适用的法律、法规和网站隐私政策。本博客中的内容仅供演示之用,不涉及任何非法或侵权活动。我们对使用本博客或第三方链接中的信息不做任何保证,并免除所有责任。在进行任何抓取活动之前,请咨询您的法律顾问,并审查目标网站的服务条款或获取必要的许可。



