ScrapelessをClaudeに接続する方法:MCPコネクタのセットアップ
Lead Scraping Automation Engineer
TL;DR:
- ScrapelessをClaudeに追加するのは、
https://api.scrapeless.com/mcpでのリモートHTTP MCPサーバーへの一つの設定エントリーです。あなたのキーはx-api-tokenヘッダーにあります。 - ハンドシェイクはプロトコル
2025-06-18上のscrapeless-mcp-serverv0.2.0を返し、tools/listは25のツールを返します —scrape_markdown、browser_*セット、crawl_*、google_search、google_trends、ai_scraperです。 - スコープは接続するかどうかを決定します。ユーザースコープでの同じエントリーは
✔ Connectedを報告し、プロジェクト.mcp.jsonでは⏸ Pending approvalを報告し、インタラクティブに承認するまで未接続のままです。 - Scrapelessは
x-api-tokenで認証を行い、Authorization: Bearerではありません。Bearerヘッダーは接続時に失敗します:Claudeは✘ Failed to connectをHTTP 401と共に報告します。 --headerでキーを渡すと、それはシェルの履歴とプロセスリストに記録されます;直接設定ファイルを記述することはしません。Connectedステータスはヘッダーが存在することを証明するだけです — Scrapelessはハンドシェイク時に任意のキー値を受け入れ、すべての25のツールをリスト表示します。ページコンテンツを返す1つの実際のツールコールでキーを証明してください。- Scrapeless無料プランでキーを取得し、約1分で接続します。
Claudeはウェブページについて詳しく推論できますが、1つを取得することはできません。MCPサーバーはそれを変えます:モデルは会話の途中で呼ぶことができるツールを取得するため、「このページが今何を言っているかを確認する」というリクエストは、貼り付けて答える必要がなくなります。
ClaudeをScrapeless MCPサーバーにリモートHTTP経由で接続するには、一つの設定エントリーで済みます。注意が必要なのは、異なる動作をする2つのスコープと、緑を報告する接続と実際に機能する接続の違いです。
接続後に得られるもの
サーバーは25のツールを公開し、文書からコピーされるのではなくライブで列挙します:
| グループ | ツール |
|---|---|
| ページコンテンツ | scrape_markdown、scrape_html、scrape_screenshot |
| クラウドブラウザ | browser_create、browser_goto、browser_click、browser_type、browser_get_text、browser_get_html、browser_snapshot、browser_screenshot、browser_scroll、browser_scroll_to、browser_wait、browser_wait_for、browser_press_key、browser_go_back、browser_go_forward、browser_close |
| クロール | crawl_start、crawl_result、crawl_cancel |
| 検索 | google_search、google_trends |
| AIアシスタントの回答 | ai_scraper |
異なるジョブに対して重要な2つのグループがあります。scrape_markdownは「このページは何と言っているか」を1回のコールで回答します。browser_*セットは、クリックやフォームの背後にあるもののために、あなたが段階的に進めるセッションです。
これらのコールはすべて、内部的にはJSON-RPCリクエストとして移動します — MCPは輸送手段およびJSON-RPC 2.0仕様のスキーマであるため、initialize / tools/list / tools/callのシーケンスがプロトコルの表面におけるすべてです。
前提条件
- Claude Codeがインストールされていること、またはリモートHTTPサーバーをサポートする他のMCPクライアントが最低限必要です。
- ダッシュボードからのScrapeless APIキー。
- サーバー自体には何もインストールする必要はありません。ホスティングされているので、パッケージはなく、実行時環境もなく、ローカルプロセスもありません。
最後のポイントは、2つの輸送手段の違いです。stdioサーバーはクライアントが起動するローカルコマンドであるため、インストールして更新し続けるためのパッケージが必要です。リモートHTTPサーバーはURLであり、モデルコンテキストプロトコルの仕様は両方を定義しています;ストリーミング可能なHTTP輸送は、まったくローカルプロセスを必要としないものです。
ステップ1: サーバーを追加する
Claude Code MCPリファレンスは、そのコマンドを1行で文書化しています:
bash
claude mcp add --transport http scrapeless https://api.scrapeless.com/mcp \
--header "x-api-token: YOUR_SCRAPELESS_API_KEY"
それは機能し、知っておく価値のあるコストがあります:--header以降のすべてはシェルの履歴に入っており、コマンドが実行されている間はプロセスリストに表示されます。設定ファイルを直接書き込むことでこの両方を回避できます。
ユーザースコープの場合、~/.claude.jsonにエントリーを追加します:
json
{
"mcpServers": {
"scrapeless": {
"type": "http",
"url": "https://api.scrapeless.com/mcp",
"headers": { "x-api-token": "YOUR_SCRAPELESS_API_KEY" }
}
}
}
ヘッダー名に注意してください。Scrapelessはx-api-tokenで認証を行い、ほとんどのMCP設定ガイドはAuthorization: Bearerを示しています。これは、HTTP認証フレームワークがベアラ資格情報のために定義するものです。この形をここでコピーすると、ハンドシェイクが完了する前に失敗します:claude mcp listは✘ Failed to connect — Server rejected the configured Authorization header (HTTP 401)を報告し、詳細はUnauthorized: Missing x-api-token headerです。
ステップ2: 使用したスコープを理解する
Claudeは複数の場所からMCP構成を読み取り、2つは初回の実行で混乱を引き起こす方式で異なります。
ユーザースコープでは、サーバーはすぐにライブです:
text
scrapeless:
Scope: User config (available in all your projects)
Status: ✔ Connected
Type: http
URL: https://api.scrapeless.com/mcp
プロジェクト.mcp.jsonの同一エントリーは接続しません:
text
scrapeless:
Scope: Project config (shared via .mcp.json)
Status: ⏸ Pending approval (run `claude` to approve)
Type: http
URL: https://api.scrapeless.com/mcp
プロジェクトスコープのファイルは、リポジトリをチェックアウトするすべての人と共有されるため、クライアントがそれに話しかける前にインタラクティブな承認で制限されています。それが正しいデフォルトです — リポジトリ内の構成ファイルは他の何かをクライアントに指し示す可能性があるため — ですが、誰かがセッションを開いて承認するまでプロジェクトエントリが壊れているように見えます。
自分のキーにはユーザースコープを使用してください。チーム全体がサーバーを取得する必要がある場合はプロジェクトスコープを使用し、各人が一度承認することを期待します。
ステップ 3: 実際に動作することを確認する
✔ Connected はハンドシェイクが成功したことを意味します。それが呼び出しが成功することを意味するわけではありません。
ツールのリストはMCPサーバー自体によって応答され、上流のAPIには到達しないため、サーバーは完全で健全なツールセットを宣伝することができますが、実際の呼び出しはすべて資格証明の失敗に終わります。それは仮説ではありません。古い保存トークンを前面に持つゲートウェイがこの同じエンドポイントを通じて、完全なツールセットをリストし、最初の実際の呼び出しで無効トークンエラーを返した一方で、良好なキーを持つ同じエンドポイントはHTTP 200を返しました。
したがって、バッジではなく呼び出しで確認してください。Claudeのセッション内では、/mcp は接続されたサーバーとそのツールをリストします。ページを要求することで、パスをエンドツーエンドで確認できます。
text
Use scrapeless to fetch https://books.toscrape.com/catalogue/category/books/mystery_3/index.html
as markdown and list the first five book titles with their prices.
エンドポイントに対して直接キャプチャされた基盤呼び出しとその結果:
text
initialize HTTP 200 server=scrapeless-mcp-server v0.2.0
tools/list HTTP 200 25 tools
tools/call scrape_markdown HTTP 200 8940 chars of page content
結果のページ内容は持っておくべき確認です。間違ったキーでも、同じ呼び出しはHTTP 200を返し、isError フラグはありません。結果のテキストは代わりに Failed to fetch data から始まります。
戻ってくるもの
scrape_markdown は、コンテンツブロック内のMarkdownとしてページを返します。これは、モデルが実際に使用できる形です:
text
Response: "- [Home](https://books.toscrape.com/index.html)
- [Books](https://books.toscrape.com/catalogue/category/books_1/index.html)
...
MarkdownでありHTMLではないのは意図的です。MCPツールを通じて、同じページは scrape_markdown から8,940文字で、scrape_html から53,800文字です。したがって、HTMLを要求することは、モデルが必要としないマークアップにおいておおよそ6倍のコンテクストを消費します。自分でパースする予定がある場合は scrape_html を、モデルが消費者である場合は scrape_markdown を利用してください。
今、コネクタセットアップを進めていますか? Scrapelessの無料プラン には、ハンドシェイクと最初の数回のツール呼び出しを完了するのに十分なコールが含まれています。
クラウドが見るものを変えるルーター
クライアントが、エンドポイントに直接ではなく、1つのURLの背後にいくつかのMCPサーバーをルーティングするゲートウェイを指す場合、ツールのリストの形が変わります。スマートルーティングゲートウェイを指した同じクライアントは、3つのツールを発見しました — ルーター自身の検索および配信メタツールです。https://api.scrapeless.com/mcp を指すと、すべての 25 を発見しました。
どちらも間違いではありません。ルーターは、多くのプロバイダーにわたって1つの資格証明と1つの監査証跡を維持しますが、モデルはツール名を1つのインダイレクション分だけ見ることになります。直接接続すると、モデルには実際のツール表面が提供されます。セットアップごとに選択し、取得したものを知るために発見されたカウントを確認してください。
適切に促す
接続されたサーバーと有用なサーバーとの違いを生む2つの習慣があります。
仕事が明確な場合はツールの名前を付けます。「このURLで scrape_markdown を使用」というのは、モデルが取得方法を決定するラウンドをスキップします。マルチステップ作業 — ログイン、フィルタリング、結果の読み取り — については、代わりにシーケンスを説明してください。browser_* ツールはセッションを共有し、順序が重要です。
戻ってほしい形を求めます。8,940文字のMarkdownを渡されたモデルは要約しますが、タイトルと価格のテーブルを返すよう指示しない限り、そうなります。ツールはドキュメントを返します。有用な出力は、モデルにそれをどう作るように指示したかに依存します。
より広いMCPの状況については、私たちのMCP統合ガイド はプロトコルとクライアントの状況を網羅しており、スクレイピングAPI ページはこれらのツールがフロントに持つアクターのファミリーを説明しています。ドキュメント は各アクターのリファレンスを持ち、料金 はコールのコストをリストしています。
結論
コネクタ全体は、URL、ヘッダー名、およびスコープの決定です。https://api.scrapeless.com/mcp が x-api-token とユーザースコープで使用されると、✔ Connected を報告し、Claudeに25のツールを渡します。同じエントリがプロジェクトファイルにある場合、壊れたセットアップと勘違いしやすい承認を待っています。
二つのことは設定を超えて持ち運ぶ価値があります。ヘッダーは x-api-token で、Bearer ではありません — Bearer シェイプは接続時に 401 で拒否されるため、claude mcp list はそれがすぐに失敗することを示しています。そして、緑のステータスはハンドシェイクです:実際のページコンテンツを返す tools/call が、それに裏打ちされた資格情報が良好である唯一の証拠です。
Claude に呼び出すことができるフェッチを与える準備はできましたか? Scrapeless の無料プランから始める そしてサーバーを追加しましょう。
FAQ
Q: Scrapeless MCPサーバーをClaudeに追加するにはどうすればよいですか?
https://api.scrapeless.com/mcp を指すリモート HTTP エントリを1つ追加し、x-api-token ヘッダーにあなたのキーを設定します。claude mcp add --transport http scrapeless https://api.scrapeless.com/mcp --header "x-api-token: ..." を実行するか、同じ type/url/headers オブジェクトを設定ファイルに書き込むことで、キーをシェルの履歴から除外できます。
Q: なぜ私のMCPサーバーは承認待ちとして表示されるのですか?
それはあなたのユーザー設定ではなく、プロジェクト .mcp.json に定義されているためです。プロジェクトファイルはリポジトリとともに移動するため、クライアントは接続する前に対話的な承認を要求します。同じエントリがユーザー範囲であれば、すぐに接続できます。セッションを開いて承認するか、キーがあなた自身のものであればエントリをユーザー範囲に移動してください。
Q: Authorization: Bearer と x-api-token のどちらを使用すべきですか?
x-api-token。Scrapeless はそのヘッダーを具体的に読み取ります — それなしのリクエストは 401 Unauthorized: Missing x-api-token header を返します。Bearer のみのエントリは接続時に同様に拒否されるため、Claude は ✘ Failed to connect を表示し ✔ Connected ではありません。
Q: 接続が本当に機能していることをどうやって知ることができますか?
1つのツール呼び出しを行ってください。ステータス出力はハンドシェイクが成功したことを示し、ツールリストは upstream API に接触することなく MCP サーバーによって提供されるため、両者が拒否された資格情報の前で健康的に見えることがあります。実際のページコンテンツを返す tools/call が証拠です;間違ったキーは Failed to fetch data で始まる結果を生み出しますが、isError フラグはまだありません。
Q: ここでのstdio と HTTP トランスポートの違いは何ですか?
stdio サーバーはクライアントが起動するローカルプロセスであるため、パッケージはインストールされ、最新の状態に保たれる必要があります。Scrapeless MCP サーバーはホストされているため、HTTP トランスポートは URL とヘッダーだけが必要です — インストールは不要で、ローカルランタイムやマシン上で追跡するバージョンも不要です。
Q: いくつのツールを見ることが期待できますか?
エンドポイントから直接25です。3つしか見えない場合、クライアントはエンドポイントではなくルーティングゲートウェイを指しており、その3つはルーター自身のディスパッチツールです。Maps、Jobs、Hotels、Flights という名前のリストが表示される場合、それは古いツールセットです — 新しい tools/list と対照してその数を確認してください。
Q: これはClaude DesktopとClaude Codeの両方で機能しますか?
両方ともMCPをサポートしていますが、異なる設定ファイルを読み込み、Desktopの設定は通常URLの代わりにローカルstdio コマンドで表示されます。上記のリモート HTTP エントリはClaude Codeの形です;Desktopのウォークスルーについては、Scrapeless MCP サーバーをClaudeで実行する際の以前の投稿をご覧いただき、ツールリストは現在の25よりも前のものであることに注意してください。
Q: モデルが呼び出すことができるツールを制限できますか?
はい — それはサーバーの設定ではなく、クライアント側の権限に関する問題です。Claude Code はツールの許可および拒否ルールを公開しているため、ページコンテンツのみが必要な設定では scrape_markdown を許可し、ブラウザセッショントールを利用できないようにできます。仕事に必要なものに絞りましょう。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



