Scrapeless Weekly Changelog: 2026年8月17日〜23日 更新
Senior Web Scraping Engineer
TL;DR:
- TikTok Scraperが近日登場。 計画されているカバー範囲には、クリエイターのプロフィール、クリエイターの作業リスト、TikTok Shopの製品詳細が含まれます。
- ファンアウトクエリデータが3つのAIエンジンでサポートされるようになりました。 ChatGPT、Gemini、Perplexityがこの機能をサポートしており、対応するドキュメントが現在利用可能です。
- Scrapeless MCPサーバーに新しいクローリングツールが追加されました。 MCP接続エージェントは、同じツールインターフェースを介してより広範なクローリングワークフローを開始できるようになります。
- ChatGPTとGrokのコレクションがより信頼性を増しました。 サービス側の改善により、顧客向けのリクエスト変更を必要とせず安定性が強化されました。
今週のリリースは、チームがソーシャルコマースデータを収集し、AIの回答パスを分析し、クローリングをエージェントワークフローに接続する方法を拡大します。8月17日から23日まで、ScrapelessはTikTok Scraperのリリース準備を行い、3つのAIエンジン間でのファンアウトクエリサポートを追加し、Scrapeless MCPサーバーにCrawlを導入し、ChatGPTとGrokの安定性を改善しました。
💥 近日登場:TikTok Scraper
今週の最初のハイライトはTikTok Scraperです。今後のエイリアスは、各ページタイプごとに別々のブラウザワークフローを維持することなく、チームが公開されたクリエイターおよびコマースデータを収集するのを助けるように設計されています。
計画されたカバー範囲には以下が含まれます:
- クリエイタープロフィール 公開アカウントとプロフィールの詳細を取得するため。
- クリエイターの作業リスト クリエイターの公開コンテンツリストを収集するため。
- TikTok Shop製品詳細 サポートされている製品ページから構造化情報を抽出するため。
公開されたドキュメントはまだ準備中ですので、リクエストパラメーター、レスポンスフィールド、および一般的な可用性は別途発表されます。これらのワークフローを評価しているチームは、公開データのみを収集し、独自のコンプライアンス、保持、およびアクセスポリシーを適用する必要があります。
💫 ChatGPT、Gemini、Perplexityのファンアウトクエリサポート
scraper.chatgpt、scraper.gemini、およびscraper.perplexityがファンアウトクエリデータをサポートするようになり、対応するドキュメントが公開されました。
ファンアウトデータは、AI回答ワークフロー中に生成された関連クエリパスを検証するのに役立ちます。これは、回答エンジンの監視、プロンプトリサーチ、コンテンツギャップ分析、複数のエンジンを通じたダウンストリーム発見パイプラインをサポートできます。
可用性は返された回答に依存する場合があるため、統合は処理前にファンアウトデータが存在するか確認する必要があります。生産用パーサーを更新する前に、関連するLLM Chat Scraperドキュメントを確認してください。
🌟 Scrapeless MCPサーバーの新しいクローリングツール
Scrapeless MCPサーバーには、クローリングツールが追加され、エージェントワークフローが単一ページの取得を超えて拡張されます。MCP接続アプリケーションは、同じサーバー統合内でデータ収集を維持しながら、ツールを使用してより広範なクローリングタスクを開始できます。
これはMCPツールモデルに適合します:サーバーは名前付き関数を公開し、モデルはそれらを発見して呼び出すことができます。これは公式MCPツール仕様に記載されています。仕様はまた、ツールパラメーターの入力スキーマと構造化結果のオプション出力スキーマを定義します。クライアントを構築する開発者は、MCPスキーマリファレンスを参照でき、公式の例サーバーが一般的な統合パターンを示します。
Scrapelessでスクレイピングを開始
Scrapelessでウェブスクレイピングと自動化ワークフローをパワーアップ!
今日サインアップして**$5の無料クレジット**をゲット — クレジットカード不要。今すぐScrapelessダッシュボードで無料クレジットを請求してください。
⬆️ サービス信頼性の改善
より安定したChatGPTのコレクション
scraper.chatgptは、サービス側の安定性改善を受け、コレクションの中断を減らし、成功した結果の配信を改善しました。既存の統合は、更新の恩恵を受けるために新しいリクエストパラメーターを必要としません。
Grokの状態ハンドリング修正
scraper.grokは、無効なセッションに対するサービス側の状態ハンドリングの修正を受けました。この変更は、コレクションの連続性を改善し、顧客向けのアクター呼び出しを変更することなく、空のまたは中断されたワークフローを減少させます。
👀 開発者への影響
このリリースは、現代のデータワークフローの三つの部分を強化します。TikTok Scraperは、焦点を絞ったソーシャルコマースのカバレッジを追加し、ファンアウトクエリデータはAIの回答行動を研究する別の方法を提供し、MCP Crawlツールはエージェント駆動型アプリケーションに対してより広範な収集を可能にします。ChatGPTとGrokに関する信頼性向上の作業は、より信頼できる定期的なジョブをサポートします。
LLM Chat Scraperを探るか、Scrapeless MCP Serverの使用方法5選を確認するか、Scrapelessの料金プランをレビューして、プロダクションワークロードを計画してください。
結論
8月17~23日のリリースは、TikTok Scraperをプレビューし、ChatGPT、Gemini、およびPerplexity全体でファンアウトクエリのサポートを追加し、Scrapeless MCP ServerにCrawlを導入し、ChatGPTとGrokの信頼性を向上させます。
次のデータワークフローを構築する準備はできましたか?
ScrapelessコミュニティでAI回答の監視、エージェントの自動化、公共ウェブデータパイプラインを構築している開発者と一緒に参加してください:Discord ・ Telegram。
app.scrapeless.comにサインアップして、Scrapelessでの構築を始めましょう。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



