Scrapeless Weekly Changelog: 2026年9月7日~13日
Advanced Bot Mitigation Engineer
TL;DR:
- Google Search APIドキュメントが公開されました。 開発者は、構造化されたGoogle Searchデータのための専用のイントロダクションとリクエストリファレンスを持っています。
- ChatGPT Scraperがリクエストレベルのウェブ検索コントロールを追加しました。
web_searchパラメータにより、各タスクがウェブ検索を使用するかどうかを選択できます。 - ChatGPTの応答には
conversation_idが含まれるようになりました。 新しいフィールドにより、保存された結果とそのソースの会話を関連付けやすくなります。 - ChatGPT ScraperがHTMLおよびSSE出力オプションを追加しました。 チームは、処理ワークフローに適した応答の表現を選択できます。
- 言語とタスクのルーティングの問題が修正されました。 更新には、PerplexityファノウトデータとAI Scraper全体にわたる間欠的な「プランが見つかりません」エラーが含まれます。
9月7日から13日のリリースは、開発者にAI応答収集のより多くの制御を提供し、Google Searchデータへの明確なパスを示しています。新しいGoogle Search APIドキュメントが利用可能になり、ChatGPT Scraperはウェブ検索コントロール、会話識別子、および2つの追加出力オプションを獲得しました。このリリースは、AI Scraper全体の言語選択およびタスクルーティングの問題も修正します。
🌟 Google Search API ドキュメントが公開
新しいGoogle Search APIドキュメントは、リアルタイムで構造化されたGoogle Searchデータを抽出するための専用のAPI表面を紹介しています。
ドキュメントは、クエリ、国、言語、Googleドメイン、結果のタイプ、ページネーション、結果の数などの一般的なリクエストコントロールをカバーしています。これにより、チームは独自のブラウザおよび解析スタックを維持することなく、検索監視、研究、およびデータ強化ワークフローを設計するための単一のリファレンスが得られます。
Google Search APIはScrapelessの検索データ製品を通じて引き続き利用可能です。新しい統合を計画しているチームは、公開されたリファレンスとともにGoogle Search API製品ページを確認できます。
💫 ChatGPT Scraperがより多くのリクエストと出力コントロールを追加
今週のChatGPT Scraperの更新は、タスクがウェブ検索をどのように使用し、会話がどのように識別され、応答データがどのように提供されるかをカバーしています。
リクエストごとにウェブ検索を選択
scraper.chatgptアクターは、カスタムweb_search入力をサポートするようになりました。各リクエストのブーリアンを設定して、そのタスクに対してChatGPTのウェブ検索が有効かどうかを選択します。これは、データセットがモデル専用のプロンプトと、現在のウェブ情報やソース結果が必要なプロンプトを混在させる場合に便利です。
ChatGPT Scraperリファレンスでは、web_searchがオプションのブーリアンとして文書化されています。ウェブ接続された回答と引用のより広い動作については、公式ウェブ検索ガイドで説明されています。
ソース会話を識別
ChatGPT Scraperの応答にはconversation_idが含まれるようになりました。データチームは、答え、プロンプト、引用、および収集のタイムスタンプとともに識別子を保存できるので、同じソース会話からの記録を簡単に追跡してグループ化できます。
このフィールドは、応答に関連付けられた会話を識別します。このリリースノートは、会話を続けるために再渡すことができると仮定していません。統合は、サポートされている入力のために現在のリクエストドキュメントに従う必要があります。
HTMLまたはSSE出力を選択
ChatGPT Scraperは、HTMLおよびSSE出力形式を提供できるようになりました。HTMLは、アプリケーションがレンダリングされた応答表現を必要とする場合に便利です。SSEは、基盤となるイベントストリームを消費するワークフローや、後で処理するために保存するために適しています。
HTML Living Standardは、アプリケーションが返されたHTMLを検証または変換する際に使用できる文書構文を定義します。SSEの消費者は、HTML文書として扱うのではなく、イベントデータとしてストリームを解析する必要があります。サーバー送信イベント仕様は、標準ベースのクライアントが使用するイベントストリームモデルおよび解析ルールを定義します。
構造化されたChatGPTの回答と引用についてのより広範な概要は、ChatGPTコレクションガイドを参照してください。
Scrapelessでスクレイピングを開始
Scrapelessでウェブスクレイピングと自動化ワークフローを強化しましょう!
今日サインアップして**$5の無料クレジット**をゲット — クレジットカードは不要。
今すぐScrapeless Dashboardで無料クレジットを請求してください。
⬆️ AIスクレーパーの信頼性修正
2つの修正により、AIスクレーパーの応答の一貫性が向上しました:
- パープレキシティファノウの言語処理。 影響を受けるケースで、ファノウデータが間違った言語を返さなくなりました。
- 間欠的なタスクルーティングエラー。 AIスクレーパーのタスクに影響を与えていた「プランが見つかりません」という応答が修正されました。
これらはサービス側の修正です。現在の統合は、修正された動作のためにリクエストスキーマの移行を必要としません。
📍結論
このリリースにより、Google Search APIの導入が容易になり、チームがAIの回答を収集・管理する方法が広がります。ChatGPTスクレーパーは、リクエストごとのウェブ検索コントロール、会話識別子、およびHTMLまたはSSE出力を提供します。関連する修正により、言語の一貫性とタスクの実行がAIスクレーパー全体で改善されます。
AIスクレーパーは、Universal Scraping APIの一部です。生産ワークロードを計画する際は、Scrapelessの価格を確認してください。
👀 AI検索データワークフローを構築する準備はできていますか?
Scrapelessコミュニティで検索データとAI回答ワークフローを構築している開発者に参加してください:Discord · Telegram。
app.scrapeless.comにサインアップして、スタートを切りましょう。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



