スクレイプレス週間変更ログ:2026年7月13日〜19日 更新内容
Web Data Collection Specialist
TL;DR:
- 公式のAmazon ScraperリポジトリがScrapeless GitHub組織の下で公開されました。
- 公式のGoogle Search Scraperリポジトリが公開され、ウェブ、画像、ローカル、動画、ショッピング、ニュースの結果の例が示されています。
- Geminiのレスポンス処理が改善され、コンテンツの切り捨てが減少しました。
- Google AIモードのショッピングデータ処理が改善され、より完全な構造化出力が得られるようになりました。
2026年7月13日から19日の週にScrapelessでリリースされた内容は、2つの新しい公開スクレイパーリポジトリと、GeminiおよびGoogle AIモードのためのターゲット出力改善です。
🌟 主な更新
Amazon Scraperリポジトリが公開
Scrapelessは公式GitHub組織に専用のAmazon Scraperリポジトリを追加しました。このリポジトリは、Amazonスクレイパープロジェクトとそのサポート資料のための開発者のための唯一の公開場所を提供します。
Google Search Scraperリポジトリが公開
新しいGoogle Search Scraperリポジトリは、Scrapeless Scraping APIを通じて構造化されたGoogle検索データを収集するための実用的な入り口を提供します。
このリポジトリは、6つの検索面をカバーしています:
- ウェブ結果
- Google画像
- Googleローカル
- Google動画
- Googleショッピング
- Googleニュース
また、Python、Node.js、Go、Java、PHPのリクエスト例も含まれており、既存のアプリケーションスタックにスクレイパーを接続しやすくしています。
開発者はリクエスト入力を通じて検索言語、国、場所、ページネーション、垂直特有のフィルターを制御できます。その結果、SEOモニタリング、マーケットリサーチ、地域情報、そして自動データパイプラインに供給できる構造化された検索データが得られます。
⬆️ サービス改善
Geminiレスポンスの長さの改善
Geminiのコンテンツ処理を改良し、レスポンステキストが切り捨てられるケースを減少させました。より長い回答を収集するワークフローは、下流の分析、比較、保存のためにより完全なコンテンツを受け取ることができるようになりました。
Google AIモードからのショッピングデータの改善
Google AIモードから返されるショッピングデータの処理を改善しました。この更新は、AIモードのレスポンスに現れる商業関連情報をより一貫してキャプチャし、構造化することに焦点を当てています。
これは、製品発見、ブランドモニタリング、小売研究、AI検索の可視性に取り組むチームにとって便利です。
👀 開発者にとっての意味
今週の更新により、一般的なデータ面がGitHubからより簡単に発見・統合できるようになり、AI生成のレスポンスデータの完全性が向上しました。
公開リポジトリは、AmazonとGoogle検索プロジェクトのための再利用可能なスタート地点を提供します。GeminiとGoogle AIモードの改善により、完全な回答テキストとショッピングデータに依存するパイプラインでのクリーンアップ作業が削減されます。
Scrapeless Scraping APIを探査したり、価格を確認したり、前回の週次チェンジログを読むことができます。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



