アマゾンアレクサスクレイパAPI:構造化されたアレクサショッピングの回答
Advanced Data Extraction Specialist
TL;DR:
- Amazon Alexaスクレイパーは、Scrapeless LLMチャットスクレイパーアクター (
scraper.alexa) で、Alexaショッピングの質問を構造化されたJSONに変換します。 promptとcountryを含む 認証されたPOSTリクエストを/api/v2/scraper/executeに送信すると、回答とAlexaが推奨する製品が返されます — ブラウザ自動化やアプリの逆アセンブルは不要です。- 返されるのは クエリ、Markdownとプレーンテキストでの回答、価格、評価、配達、ASINを持つ
products配列、フォローアップ用の会話ID、オプションの参照と提案です。 - フィールドはnullableであり、クエリによって異なります:
references、sources、suggestionsは空の場合もあり、価格は表示文字列として返されるため、厳重に解析してください。 - 無料で始める。 新しいScrapelessアカウントには無料のスクレイパAPIクレジットが含まれています — app.scrapeless.com にサインアップしてください。
Amazon Alexaは今や、まるで人が質問するかのようにショッピングの質問に答えます — "300ドル以下の最高のノイズキャンセリングヘッドフォン" — そして、書かれた推奨と購入する製品のセットで応答します。それはAlexaをデータ面にします:それが示す製品、表示する価格、そしてそれをランク付けする順序は、すべて追跡する価値のある信号です。このガイドでは、Scrapeless スクレイピングAPIを使用してAlexaの回答を構造化データとしてキャプチャする方法、レスポンスの内容、およびフィールドの取り扱いに注意が必要な場所を示します。以下のすべてのリクエストとフィールドは、アクターのライブ実行からキャプチャされたものです。
Amazon Alexaスクレイパーでできること
アクターは自然言語のショッピングプロンプトとターゲット国を受け取り、Alexaの回答をJSONとして返します。実際には、これにより次のことが可能になります:
- 製品の推奨を追跡する — カテゴリーベースのクエリに対してAlexaが名付ける製品をキャプチャし、そのASIN、価格、評価とともに、時間の経過とともにセットがどのように変化するかを監視します。
- 地域間で比較する — 異なる
countryを使用して同じプロンプトを送信し、Alexaの選択が市場ごとにどのように変化するかを確認します。 - AIショッピングの可視性を監視する — あなたの製品または競合他社の製品が、あなたにとって重要なクエリに対してAlexaの回答に表示されるかどうかを測定します。
- ダウンストリームシステムに供給する — 構造化された回答をダッシュボード、スプレッドシート、またはアラートにパイプして、Alexaアプリを自分でスクレイプすることなく利用します。
Scrapeless Alexaアクターの理由
Alexaのショッピング回答はアプリの背後で生成されており、リクエストできる公開されたWebページとして提供されていません。Scrapelessアクターは収集を処理し、クリーンで開発者フレンドリーなエンベロープを返します。これにより、コードはプロンプトを送信し、アプリを操作するのではなくフィールドを読み取ります。AlexaはLLMチャットスクレイパーのファミリーの一員であり、ここで使用するリクエストの形状は他の回答エンジンでも機能します — actorの値を変更して、残りはそのままにします。
エンドポイントとパラメータ
アクターは同期型スクレイパAPIエンドポイント上で動作します。x-api-tokenヘッダーにAPIトークンで認証します。
- エンドポイント:
POST https://api.scrapeless.com/api/v2/scraper/execute - アクター:
scraper.alexa
| 入力フィールド | 種類 | 必須 | 説明 |
|---|---|---|---|
prompt |
文字列 | はい | Alexaに送信するショッピングの質問。 |
country |
文字列 | はい | ターゲット国コード、例:US。 |
レスポンスはsynchronousにtask_resultオブジェクトとして返されます。ポーリングは必要ありません。トークンはScrapelessダッシュボードから取得してください。
認証されたリクエスト
最小限のリクエストは以下のようになります(例示的であり、トークンを置き換えてください):
bash
curl 'https://api.scrapeless.com/api/v2/scraper/execute' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.alexa",
"input": {
"prompt": "300ドル以下の最高のノイズキャンセリングヘッドフォン",
"country": "US"
}
}'
Python統合
この例では、SCRAPELESS_API_KEY環境変数からトークンを読み取り、リクエストを送信し、回答と推薦された製品を出力します。Pythonの標準ライブラリのみを使用しています。
python
import json
import os
import urllib.request
API_URL = "https://api.scrapeless.com/api/v2/scraper/execute"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]
payload = {
"actor": "scraper.alexa",
"input": {
"prompt": "300ドル以下の最高のノイズキャンセリングヘッドフォン",
"country": "US",
},
}
request = urllib.request.Request(
API_URL,
data=json.dumps(payload).encode("utf-8"),
headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
method="POST",
)
with urllib.request.urlopen(request, timeout=180) as response:
json
データ = json.loads(response.read().decode("utf-8"))
結果 = データ.get("task_result", {})
print("ステータス:", データ.get("status"))
print("クエリ:", 結果.get("user_text"))
print("返された製品の数:", len(結果.get("products") or []))
for 製品 in (結果.get("products") or [])[:3]:
print("-", 製品.get("title"))
print(" 価格:", 製品.get("price"), "| 評価:", 製品.get("rating"))
print(" asin:", 製品.get("product_id"))
あなたが得られるもの
回答は task_result 内に届きます。以下のフィールドは最も使用するものであり、値は実行のサンプルからのもので、長さの都合で切り取られています。
json
// 実行中の scraper.alexa からの説明用サンプル — フィールド名は実際のもので、値は切り取られています。
{
"status": "成功",
"task_id": "1ba323ef-1bee-446c-9a80-090cb9c67231",
"task_result": {
"user_text": "$300以下のベストノイズキャンセリングヘッドフォン",
"md_text": "**プレミアムノイズキャンセリングヘッドフォン** ...",
"raw_text": "**プレミアムノイズキャンセリングヘッドフォン** {cite_product_1} ...",
"completed": true,
"conversation": { "id": "amzn1.conversation.866ba539-..." },
"products": [
{
"citation_id": "cite_product_1",
"product_id": "B09XS7JWHH",
"title": "ソニー プレミアムノイズキャンセリングヘッドフォン、30時間バッテリー、アレクサ音声制御",
"price": "~~$399.99~~ $248.00",
"rating": "{rating 4.2} 19,796 レビュー",
"delivery": "7月15日までに配達",
"image_url": "<製品画像URL>",
"url": "<dl.amazon.com リダイレクトが /dp/B09XS7JWHH に解決>"
}
],
"references": [],
"sources": [],
"suggestions": [],
"directives": []
}
}
| フィールド | 型 | 説明 |
|---|---|---|
user_text |
文字列 | アレクサが受け取ったショッピングの質問。 |
md_text |
文字列 | アレクサの回答がMarkdown/HTML形式で、インライン製品カードを含む。 |
raw_text |
文字列 | 回答がプレーンテキスト形式で、{cite_product_N} の引用マーカー。 |
completed |
真偽値 | 回答が生成を完了したかどうか。 |
conversation |
オブジェクト | フォローアッププロンプトに持ち込むことができる会話のid。 |
products |
配列 | 推奨製品: product_id (ASIN)、title、price、rating、delivery、image_url、url、citation_id。 |
references |
配列 | 回答の背後にある引用 — 空である可能性があります。 |
sources |
配列 | バッキングリンク — 空である可能性があります。 |
suggestions |
配列 | アレクサが提供するフォローアップのプロンプト — 空である可能性があります。 |
directives |
配列 | インタラクションからの処理指示。 |
一般的なデータ形状の問題
いくつかのフィールドは防御的解析が必要です:
user_textはクエリであり、回答ではありません。 回答はmd_text(リッチ) とraw_text(プレーン) にあります。推奨内容を読みたい場合は、これらを参照してください。- 価格は表示用文字列であり、数値ではありません。 割引されたアイテムは
~~$399.99~~ $248.00のように返され、ストライクスルーされた値がリスト価格であり、2つ目が現在の価格です。フィールドを直接キャストするのではなく、数値を解析してください。 ratingはフォーマットされた文字列です。{rating 4.2} 19,796 レビューという形で届くので、小さな正規表現を使ってスコアとレビュー数を抽出し、浮動小数点数を期待しないでください。- 空の配列は通常です。
references、sources、およびsuggestionsはクエリによっては空になることがあるため、反復する前にNoneと[]を確認してください。 - 製品URLはリダイレクトです。
urlはdl.amazon.com/redirectのリンクで、製品の/dp/<ASIN>ページに解決されます。NTASINの正式な値が必要な場合はproduct_idを使用してください。
伴奏者
アレクサが LLM チャットスクレイパーの一部であるため、同じリクエストパターンは他の回答エンジンでもカバーされています — scraper.alexa を scraper.chatgpt、scraper.gemini、scraper.perplexity などに置き換えてください。Scrapeless は、Python以外のスタートポイントが必要な場合に実行可能なコードを含むAlexa スクレイパーの例示リポジトリをオープンソースで公開しています。リクエストシェイプが同じ別の回答エンジンについては、ChatGPT スクレイパー API ガイドを参照してください。
結論
Amazon Alexa スクレイパーは、会話型ショッピングの回答を構造化された JSON に変換し、1つの認証されたリクエストで完結します: プロンプトと国を送信し、回答テキストと ASIN、価格、評価、配送を含む製品配列を読み取ります。価格と評価を文字列として扱い、いくつかの配列が空であることを期待すれば、さまざまなクエリと地域でアレクサが製品を推奨する方法を追跡するための信頼できるフィードが得られます。Amazon は 開発者向けのアレクサを文書化しており、Amazon のデバイスニュースルームではアシスタントがどのように進化しているかを説明しています。
Alexaの回答をデータとしてキャプチャする準備はできましたか?Scrapelessダッシュボードから無料で始めて、スクレイピングAPI製品ページでアクターの適合性を確認したり、Scrapelessの料金プランでプランを比較したりしてください。
FAQ
Q: Amazon Alexa Scraperとは何ですか?
A: それは、ショッピングプロンプトをAmazon Alexaに送信し、構造化されたJSONとして回答を返すScrapeless LLMチャットスクレイパーアクター(scraper.alexa)です — クエリ、Markdownとプレーンテキストでの回答、ASIN、価格、評価、配送を含むproducts配列が含まれます。
Q: どのエンドポイントとパラメーターを使用しますか?
A: POST https://api.scrapeless.com/api/v2/scraper/executeで、actorをscraper.alexaに設定し、promptとcountryを含むinputオブジェクトを使用します。x-api-tokenヘッダーでトークンで認証します。
Q: 応答は同期ですか?
A: はい。結果は同じ応答のtask_resultオブジェクトに返されるため、別の結果エンドポイントをポーリングする必要はありません。
Q: ブラウザやプロキシプールが必要ですか?
A: いいえ。ScrapelessはAPIの背後で収集を実行するため、あなたのアプリケーションはリクエストを送信し、返されたJSONを解析するだけです。
Q: references、sources、またはsuggestionsが空のことがあるのはなぜですか?
A: それらのフィールドはクエリによって異なります。単純なカテゴリプロンプトは、別の引用や追跡提案なしに製品を返すことがあるため、配列はオプショナルとみなして、反復処理の前にガードしてください。
Q: 価格と評価をどのように読み取りますか?
A: どちらも表示用の文字列です。価格は~~$399.99~~ $248.00(リスト価格が取り消し線で、現在の価格がその後)として届き、評価は{rating 4.2} 19,796 Reviewsのように届きます。フィールドを直接キャストするのではなく、小さなパーサーで数値を抽出してください。
Q: 他のAIアシスタントに同じコードを使用できますか?
A: はい。Alexaは他のエンジンと同じLLMチャットスクレイパーリクエスト形状を共有しているため、scraper.alexaをscraper.chatgpt、scraper.gemini、またはscraper.perplexityに置き換えることで、同じ統合を再利用できます。
Scrapelessでは、適用される法律、規制、およびWebサイトのプライバシーポリシーを厳密に遵守しながら、公開されているデータのみにアクセスします。 このブログのコンテンツは、デモンストレーションのみを目的としており、違法または侵害の活動は含まれません。 このブログまたはサードパーティのリンクからの情報の使用に対するすべての責任を保証せず、放棄します。 スクレイピング活動に従事する前に、法律顧問に相談し、ターゲットウェブサイトの利用規約を確認するか、必要な許可を取得してください。



