アマゾン検索スクレーパーAPI:JSON形式のオーガニックおよびスポンサー結果
Scraping and Proxy Management Expert
TL;DR:
- Amazon検索スクレイパーは
type: "keywords"のscraper.amazonアクターです — 検索語をAmazonのランク付けされた結果をJSON形式で返します。 - 認証された
POSTを/api/v1/scraper/requestに送信することで、ポジション、ASIN、タイトル、価格、評価、レビュー数を含むオーガニックおよびスポンサーのリスティングが返されます。 - オーガニックと有料の結果が分けられているため、 商品の順位や、上位にスポンサー枠を購入している競合を追跡できます。
- 価格と評価は表示用の文字列として届きます(
"$24.98"、"4.9 out of 5 stars")、そのため、直接キャストするのではなく解析してください。 - 無料で始められます。 新しいScrapelessアカウントには無料のスクレイパAPIクレジットが含まれています — app.scrapeless.comでサインアップしてください。
Amazon検索は製品発見が行われる場所であり、結果ページの順序がどの製品が見られるかを決定します — それが理由でAmazonの売り手は自分たちのキーワード順位を注意深く追跡しています。ScrapelessのスクレイピングAPIは、キーワードの結果ページを構造化データとしてキャッチします:オーガニックランキング、スポンサー枠、そして各リスティングのASIN、価格、評価。このガイドでは、リクエスト、レスポンスの形状、および注意が必要なフィールドを示します。以下のすべてのリクエストとフィールドは、アクターのライブランからキャッチされたものです。
Amazon検索スクレイパーでできること
このアクターはキーワードを受け取り、Amazonのランク付けされた結果をJSONとして返します。実際には、以下が可能です:
- キーワードランクの追跡 — 検索語に対する商品のオーガニックポジションをキャッチし、時間の経過とともにその変動を見ることができます。
- スポンサー層の監視 — あなたのキーワードのオーガニック結果の上位に有料枠を購入しているASINを確認できます。
- カテゴリー競争のマッピング — 検索の最初のページのASIN、価格、評価をすべて引き出して比較できます。
- 価格とアソートメントモデルへのフィード — 構造化された結果をダッシュボードやアラートにパイプしてHTMLを解析せずに使用できます。
ScrapelessのAmazonアクターの理由
Amazonの検索結果ページは多くのレンダリングがされ、ボット対策が施されており、HTMLは常に変化しています。Scrapelessのアクターは検索を実行し、クリーンで開発者フレンドリーなエンベロープを返すため、コードがセレクターを維持するのではなく、フィールドを読み取ることができます。同じscraper.amazonアクターは、typeを変更することで製品詳細やルーファスアシスタントもカバーします。
エンドポイントとパラメータ
アクターは同期スクレイピングAPIエンドポイントで実行されます。x-api-tokenヘッダーでトークンを使って認証します。
- エンドポイント:
POST https://api.scrapeless.com/api/v1/scraper/request - アクター:
scraper.amazon
| 入力フィールド | 型 | 必須 | 説明 |
|---|---|---|---|
type |
文字列 | はい | 検索のためにkeywordsに設定します。 |
keywords |
文字列 | はい | 検索語。 |
domain |
文字列 | はい | Amazonストアフロント、例:www.amazon.com。 |
結果はresultオブジェクトで同期的に返されます。ポーリングは不要です。
認証されたリクエスト
最小限のリクエストはこのようになります(例示 — トークンを置き換えてください):
bash
curl 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "keywords",
"keywords": "ワイヤレスヘッドフォン",
"domain": "www.amazon.com"
}
}'
Python統合
この例は、SCRAPELESS_API_KEY環境変数からトークンを読み取り、検索を実行し、オーガニックおよびスポンサーの結果を出力します。Pythonの標準ライブラリのみを使用しています。
python
import json
import os
import urllib.request
API_URL = "https://api.scrapeless.com/api/v1/scraper/request"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]
payload = {
"actor": "scraper.amazon",
"input": {
"type": "keywords",
"keywords": "ワイヤレスヘッドフォン",
"domain": "www.amazon.com",
},
}
request = urllib.request.Request(
API_URL,
data=json.dumps(payload).encode("utf-8"),
headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
method="POST",
)
with urllib.request.urlopen(request, timeout=180) as response:
data = json.loads(response.read().decode("utf-8"))
result = data.get("result", {})
listings = result.get("result", {})
organic = listings.get("organic") or []
paid = listings.get("paid") or []
print("キーワード:", result.get("keyword"))
print("オーガニック結果:", len(organic))
print("有料結果:", len(paid))
for item in organic[:5]:
print(f" #{item.get('pos')} {item.get('asin')} {item.get('price')} {item.get('rating')}")
print(" ", (item.get("title") or "")[:70])
返される内容
Q: Amazon Search Scraperとは何ですか?
A: スクレープレス・スクレイピングAPIのアクターscraper.amazonは、type: "keywords"で、検索用語をAmazonに送信し、順位付けされた結果をJSON形式で返します — 有機とスポンサーのリストがあり、位置、ASIN、タイトル、価格、評価、レビュー数が含まれています。
Q: どのエンドポイントとパラメータを使用しますか?
A: POST https://api.scrapeless.com/api/v1/scraper/requestを使用し、actorをscraper.amazonに設定し、inputオブジェクトにtype: "keywords"、keywords、およびdomainを含めます。x-api-tokenでトークンを使って認証します。
Q: 有機結果とスポンサー結果をどうやって区別しますか?
A: 返答は二つの配列、result.organicとresult.paidを返し、それぞれのリストにはis_sponsoredフラグが付いているため、有機ランキングと有料掲載を分けることができます。
Q: 価格と評価は数値ですか?
A: いいえ、表示用文字列です — priceは"$24.98"のように、ratingは"4.9 out of 5 stars"のようになります。フィールドをキャスティングするのではなく、小さなパーサーで数値を抽出します。
Q: 応答は同期的ですか?
A: はい。resultオブジェクトは同じ応答で返され、別のエンドポイントをポーリングする必要はありません。
Q: 同じアクターが商品またはルーファスアシスタントをスクレイプできますか?
A: はい。typeをproductに変更するとASINの完全なレコードを取得でき、rufusにするとAmazonのショッピングアシスタントになります — エンドポイントと認証は同じままです。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



