Scrapeless Weekly Changelog: 2026年8月24日~30日 更新
Senior Web Scraping Engineer
TL;DR:
- TikTok Scraperが公式に利用可能になりました。 公開されたドキュメントには、クリエイターのプロフィール、クリエイターの動画リスト、TikTok Shopの製品詳細が含まれています。
- Scrapeless MCPサーバーにLLMチャットスクレイパーが追加されました。 新しいツールは、AI回答収集をMCP接続のワークフローに統合します。
- Google AIモードがURLを入力として受け付けるようになりました。 完全なAIモードアクセスリンクが通常のプロンプトベースの入力パラメーターを置き換えることができます。
- 検索とAI収集が信頼性の更新を受けました。 Google Search APIの新しいリリース、いくつかのLLMスクレイパーがより高い成功率を持ち、Amazon Rufusの応答には改善されたソースリファレンスの解析が含まれています。
TikTok Scraperはプレリリースから正式リリースに移行しました。8月24日から30日の間に、ScrapelessはMCPサーバーにLLMチャットスクレイパーを追加し、Google AIモードに対してURLベースの収集を導入しました。このリリースには、大規模な商業作業負荷のためのGoogle Search APIの改善、より良いAIスクレイパーの成功率、そしてより豊富なAmazon Rufusソースデータが含まれています。
💥 TikTok Scraperが公式に稼働中
TikTok Scraperは現在、3つの収集タスクに関する公開APIドキュメントを持っています:
| 機能 | アクター | 一般的な使用ケース |
|---|---|---|
| クリエイターのプロフィール | scraper.tiktok.user.detail |
公開クリエイタープロフィールの調査 |
| クリエイターの動画リスト | scraper.tiktok.user.work |
クリエイターの公開コンテンツの追跡 |
| TikTok Shop製品詳細 | scraper.tiktok.shop.page |
商業研究のための製品ページデータの収集 |
チームは、公開されたリクエストとレスポンスのリファレンスを使用して統合を構築できます。別々のアクターにより、開発者は自分のワークフローに必要なデータソースを選択できます。クリエイタープロフィール、コンテンツリスト、または製品ページのいずれかです。
クリエイターデータプロジェクトのために、収集は公開情報に制限し、プロジェクトに必要なフィールドのみを保存してください。公開の可用性は、プラットフォームの規約や適用されるデータ処理要件の確認が不要になるわけではありません。
💫 LLMチャットスクレイパーがScrapeless MCPサーバーに参加
Scrapeless MCPサーバーは、AI回答収集タスクを作成するためのllm_chat_scraperを公開しています。 Scrapeless MCPサーバーツールのリファレンスには、ChatGPT、Gemini、Perplexity、Copilot、Google AIモード、Google AIオーバービュー、Grok、Alexaのサポートがリストされています。
これにより、MCP接続エージェントは、サーバーの既存の検索、ブラウジング、およびクロール機能に加えて、AIエンジンデータを要求するための直接のツールが得られます。研究ワークフローは、収集された回答をエンジン比較または定期的なAI可視性の監視に利用できます。
MCPクライアントは、MCPツール発見インターフェースを通じて、名前付きツールとその入力スキーマを発見します。新しいアクションをワークフローに追加する前に、接続されたサーバーによって公開されているツールリストを確認してください。Scrapeless MCPサーバーの概要は、より広範な統合について説明しています。
Scrapelessでスクレイピングを開始しましょう
Scrapelessでウェブスクレイピングと自動化ワークフローを強化しましょう!
今日サインアップして、$5の無料クレジットを獲得しましょう — クレジットカードは不要。Scrapelessダッシュボードで今すぐ無料クレジットを請求してください。
🌟 Google AIモードがURLベースの入力をサポート
Google AIモードスクレイパーは、url 文字列を受け付けるようになり、完全なGoogle AIモードアクセスリンクを含めることができます。これにより、既にAIモードURLを持つワークフローに対して入力オプションが追加されます。
Google AIモード入力リファレンスでは、重要なルールが指定されています:url が提供された場合、他の入力パラメーターは必要なく、含まれていても無視されます。 別のプロンプト、国、ショッピング、またはロケーション設定が提供されたURLを上書きすることは期待しないでください。
選択された部分から再構築するのではなく、完全なリンクを渡してください。アプリケーションがリンクを解析または保存する場合、URL標準によって定義された動作を使用して、クエリコンポーネントとエンコーディングを保持してください。
⬆️ サービス改善
大規模なワークロード向けに更新されたGoogle Search API
Google Search APIは、大規模な商業使用に焦点を当てた新しいリリースを受け、安定性とデータの完全性が向上しました。このアップデートは、監視、研究、製品アプリケーションのために定期的な検索データ収集を行うチームをサポートします。
AIスクレーパーの成功率が向上
Copilot、Perplexity、およびGeminiは、オーストリア(AT)の成功率を改善しました。Google AI Overviewも成功率の改善を受けました。これらは定性的なサービスのアップデートであり、結果は依然としてエンジン、リクエスト、および収集コンテキストに依存します。
Amazon Rufusソース参照がより完全に解析されるようになった
Amazon Rufus Scraperは、レスポンスから追加のソース参照フィールドを解析できるようになりました。追加された情報は、チームがRufusの答案に関連する参照を検査し、そのコンテキストを下流の分析に持ち込むのに役立ちます。すべての回答に参照が含まれていると仮定するのではなく、存在する場合にプロセスソースデータを処理してください。
結論
今週のリリースにより、文書化されたアクターを通じてTikTok収集が可能になり、AI回答収集がMCPに追加され、Google AIモードにURLベースの入力経路が提供されました。検索の信頼性とRufusソース解析も、下流のワークフローで利用可能なデータを改善します。
関連するアクターをScrapeless Scraping APIから選択し、ワークロードを計画する際にScrapelessの料金を確認してください。
次のデータワークフローを構築する準備はできましたか?
Scrapelessコミュニティで、パブリックウェブデータおよびAI回答ワークフローを構築している開発者とつながりましょう:Discord · Telegram。
app.scrapeless.comにサインアップして始めましょう。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



