अमेज़न एलेक्सा स्क्रैपर एपीआई: संरचित एलेक्सा शॉपिंग उत्तर
Advanced Data Extraction Specialist
TL;DR:
- Amazon Alexa स्क्रैपर एक स्क्रैपलेस LLM चैट स्क्रैपर अभिनेता (
scraper.alexa) है जो Alexa खरीदारी के सवाल को संरचित JSON में बदलता है। - एक प्रामाणिक
POSTको/api/v2/scraper/executeपर एकप्रॉम्प्टऔर एकदेशके साथ उत्तर और उत्पादों को लौटाता है जो Alexa अनुशंसा करता है - बिना ब्राउज़र स्वचालन या ऐप रिवर्स-इंजीनियरिंग के। - आपको मिलेगी क्वेरी, उत्तर मार्कडाउन और सामान्य पाठ में, एक
उत्पादोंकी सरणी जिसमें मूल्य, रेटिंग, डिलीवरी, और ASIN हैं, फॉलो-अप के लिए एक वार्तालाप ID, और वैकल्पिक संदर्भ और सुझाव। - क्षेत्र nullable हैं और क्वेरी के आधार पर भिन्न होते हैं:
संदर्भ,स्रोत, औरसुझावखाली वापस आ सकते हैं, और मूल्य प्रदर्शित स्ट्रिंग के रूप में आते हैं, इसलिए सावधानी से पार्स करें। - फ्री में शुरू करें। नए स्क्रैपलेस खातों में मुफ्त स्क्रैपर API क्रेडिट शामिल हैं - app.scrapeless.com पर साइन अप करें।
Amazon Alexa अब खरीदारी के सवालों का उत्तर उसी तरह देती है जैसे कोई व्यक्ति पूछेगा - "300 डॉलर के तहत सबसे अच्छे शोर-रदर्शन करने वाले हेडफ़ोन" - और लिखित सिफारिश और खरीदने के लिए उत्पादों का सेट के साथ जवाब देती है। इससे Alexa एक डेटा सतह बन जाती है: वह उत्पाद जो वह नाम लेता है, जो कीमतें वह दिखाता है, और जिस क्रम में वह उन्हें रैंक करता है, सभी ऐसे संकेत होते हैं जो ट्रैक करने लायक होते हैं। यह गाइड दिखाता है कि कैसे Alexa का उत्तर संरचित डेटा के रूप में कैप्चर किया जा सकता है और Scrapeless स्क्रैपिंग API में क्या समाहित है, और कहां क्षेत्रों को सावधानीपूर्वक संभालने की आवश्यकता है। नीचे दिए गए प्रत्येक अनुरोध और क्षेत्र को अभिनेता के एक लाइव रन से कैप्चर किया गया था।
Amazon Alexa स्क्रैपर के साथ आप क्या कर सकते हैं
अभिनेता एक प्राकृतिक-भाषा खरीदारी प्रॉम्प्ट और एक लक्षित देश लेता है और Alexa का उत्तर JSON के रूप में लौटाता है। प्रायोगिक रूप से, इससे आपको:
- उत्पाद अनुशंसाओं को ट्रैक करें - कैप्चर करें कि उस श्रेणी क्वेरी के लिए Alexa कौन से उत्पादों को नामित करता है, उनके ASIN, मूल्य, और रेटिंग के साथ, और देखें कि सेट समय के साथ कैसे बदलता है।
- क्षेत्रों के बीच तुलना करें - विभिन्न
देशके साथ समान प्रॉम्प्ट भेजें ताकि यह देखा जा सके कि बाजार के अनुसार Alexa के चयन कैसे बदलते हैं। - AI खरीदारी की दृश्यता की निगरानी करें - मापें कि क्या आपका उत्पाद या किसी प्रतियोगी का उत्पाद उन क्वेरी के लिए Alexa के उत्तर में दिखाई देता है जो आपके लिए महत्वपूर्ण हैं।
- डाउनस्ट्रीम सिस्टम को फीड करें - बिना Alexa ऐप को खुद स्क्रैप किए हुए संरचित उत्तर को डैशबोर्ड, स्प्रेडशीट, या अलर्ट में पाइप करें।
Scrapeless Alexa अभिनेता क्यों
Alexa के खरीदारी उत्तर एक ऐप के पीछे उत्पन्न होते हैं, जो एक सार्वजनिक वेब पृष्ठ के रूप में परोसे नहीं जाते जिन्हें आप अनुरोध कर सकते हैं। Scrapeless अभिनेता संग्रहण को संभालता है और एक साफ, डेवलपर-फ्रेंडली आवरण लौटाता है, जिससे आपका कोड एक प्रॉम्प्ट भेजता है और क्षेत्रों को पढ़ता है न कि ऐप को ड्राइव करता है, बुनियादी ढांचे को घुमाता है, या चयनकर्ताओं को बनाए रखता है। Alexa LLM चैट स्क्रैपर परिवार का एक सदस्य है, जिसका मतलब है कि यहां उपयोग की जाने वाली वही अनुरोध संरचना अन्य उत्तर इंजनों के लिए भी काम करती है - आप अभिनेता मान को बदलते हैं और बाकी को बनाए रखते हैं।
एंडपॉइंट और पैरामीटर
अभिनेता समन्वित स्क्रैपर API एंडपॉइंट पर कार्य करता है। x-api-token हेडर में अपने API टोकन के साथ प्रमाणीकरण करें।
- एंडपॉइंट:
POST https://api.scrapeless.com/api/v2/scraper/execute - अभिनेता:
scraper.alexa
| इनपुट फ़ील्ड | प्रकार | आवश्यक | विवरण |
|---|---|---|---|
prompt |
स्ट्रिंग | हाँ | Alexa को भेजने के लिए खरीदारी का सवाल। |
country |
स्ट्रिंग | हाँ | लक्षित देश का कोड, जैसे कि US। |
उत्तर एक task_result ऑब्जेक्ट में समन्वित रूप से वापस किया जाता है; आपको पोलिंग करने की आवश्यकता नहीं है। अपना टोकन Scrapeless डैशबोर्ड से प्राप्त करें।
प्रमाणित अनुरोध
एक न्यूनतम अनुरोध इस तरह दिखता है (आइLLUSTRATIV - टोकन को बदलें):
bash
curl 'https://api.scrapeless.com/api/v2/scraper/execute' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.alexa",
"input": {
"prompt": "300 डॉलर के तहत सबसे अच्छे शोर-रदर्शन करने वाले हेडफ़ोन",
"country": "US"
}
}'
Python एकीकरण
यह उदाहरण SCRAPELESS_API_KEY पर्यावरण चर से टोकन पढ़ता है, अनुरोध भेजता है, और उत्तर और अनुशंसित उत्पादों को प्रिंट करता है। यह केवल Python मानक लाइब्रेरी का उपयोग करता है।
python
import json
import os
import urllib.request
API_URL = "https://api.scrapeless.com/api/v2/scraper/execute"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]
payload = {
"actor": "scraper.alexa",
"input": {
"prompt": "300 डॉलर के तहत सबसे अच्छे शोर-रदर्शन करने वाले हेडफ़ोन",
"country": "US",
},
}
request = urllib.request.Request(
API_URL,
data=json.dumps(payload).encode("utf-8"),
headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
method="POST",
)
with urllib.request.urlopen(request, timeout=180) as response:
python
data = json.loads(response.read().decode("utf-8"))
result = data.get("task_result", {})
print("स्थिति:", data.get("status"))
print("जांच:", result.get("user_text"))
print("उत्पाद लौटाए गए:", len(result.get("products") or []))
for product in (result.get("products") or [])[:3]:
print("-", product.get("title"))
print(" कीमत:", product.get("price"), "| रेटिंग:", product.get("rating"))
print(" एएसआईएन:", product.get("product_id"))
जो आपको वापस मिलता है
उत्तर task_result के अंदर आता है। नीचे के फ़ील्ड वे हैं जो आप सबसे अधिक उपयोग करेंगे; मान एक लाइव रन से एक चित्रात्मक नमूना हैं, लंबाई के लिए ट्रिम किए गए हैं।
json
// एक लाइव scraper.alexa रन से चित्रात्मक नमूना — फ़ील्ड नाम वास्तविक हैं, मान ट्रिम किए गए हैं।
{
"status": "सफलता",
"task_id": "1ba323ef-1bee-446c-9a80-090cb9c67231",
"task_result": {
"user_text": "बेस्ट नॉइज़ कैनसिलिंग हेडफ़ोन $300 के तहत",
"md_text": "**प्रीमियम नॉइज़-कैनसिलिंग हेडफ़ोन** ...",
"raw_text": "**प्रीमियम नॉइज़-कैनसिलिंग हेडफ़ोन** {cite_product_1} ...",
"completed": true,
"conversation": { "id": "amzn1.conversation.866ba539-..." },
"products": [
{
"citation_id": "cite_product_1",
"product_id": "B09XS7JWHH",
"title": "सोनी प्रीमियम नॉइज़ कैंसिलिंग हेडफ़ोन, 30-घंटे की बैटरी, एलेक्सा वॉयस कंट्रोल",
"price": "~~$399.99~~ $248.00",
"rating": "{rating 4.2} 19,796 समीक्षाएं",
"delivery": "15 जुलाई तक डिलीवरी",
"image_url": "<उत्पाद चित्र URL>",
"url": "<dl.amazon.com redirect resolving to /dp/B09XS7JWHH>"
}
],
"references": [],
"sources": [],
"suggestions": [],
"directives": []
}
}
| फ़ील्ड | प्रकार | विवरण |
|---|---|---|
user_text |
स्ट्रिंग | खरीदारी का प्रश्न जैसा एलेक्सा ने प्राप्त किया। |
md_text |
स्ट्रिंग | एलेक्सा का उत्तर Markdown/HTML में, जिसमें इनलाइन उत्पाद कार्ड शामिल हैं। |
raw_text |
स्ट्रिंग | उत्तर जैसा कि सामान्य पाठ में है, जिसमें {cite_product_N} संदर्भ मार्कर हैं। |
completed |
बूल | क्या उत्तर बनाने का काम खत्म हो गया। |
conversation |
ऑब्जेक्ट | एक बातचीत id जिसे आप एक फॉलो-अप प्रॉम्प्ट में ले जा सकते हैं। |
products |
एरे | अनुशंसित उत्पाद: product_id (एएसआईएन), title, price, rating, delivery, image_url, url, citation_id। |
references |
एरे | उत्तर के पीछे के उद्धरण — खाली भी हो सकते हैं। |
sources |
एरे | समर्थन लिंक — खाली भी हो सकते हैं। |
suggestions |
एरे | फॉलो-अप प्रॉम्प्ट्स एलेक्सा ऑफर करता है — खाली भी हो सकते हैं। |
directives |
एरे | बातचीत से प्रक्रियाकरण निर्देश। |
सामान्य डेटा-आकृति समस्याएं
कुछ फ़ील्ड को रक्षात्मक रूप से पार्स करने की आवश्यकता है:
user_textप्रश्न है, उत्तर नहीं। उत्तरmd_text(समृद्ध) औरraw_text(सादा) में है। यदि आप गद्य अनुशंसा चाहते हैं, तो उन्हें पढ़ें।- कीमतें प्रदर्शन स्ट्रिंग हैं, संख्या नहीं। एक छूट वाला आइटम इस तरह वापस आता है
~~$399.99~~ $248.00, जहां स्ट्राइक किए गए मूल्य को सूची मूल्य कहा जाता है और दूसरा वर्तमान मूल्य होता है। संख्याओं को बाहर निकालें बजाय सीधे फ़ील्ड को कास्ट करने के। ratingएक स्वरूपित स्ट्रिंग है। यह{rating 4.2} 19,796 समीक्षाएंके रूप में आती है, इसलिए स्कोर और समीक्षा गणना को छोटे regex के साथ निकालें बजाय कि एक फ्लोट की उम्मीद करने के।- खाली एरे सामान्य हैं।
references,sources, औरsuggestionsसभी प्रश्न के आधार पर खाली हो सकते हैं, इसलिए इटरेट करने से पहलेNoneऔर[]के लिए गार्ड करें। - उत्पाद यूआरएल रीडायरेक्ट हैं।
urlएकdl.amazon.com/redirectलिंक है जो उत्पाद के/dp/<ASIN>पृष्ठ की ओर जाता है; जब आप कैनोनिकल एएसआईएन चाहते हैं तोproduct_idका उपयोग करें।
साथी अभिनेता
चूंकि एलेक्सा LLM चैट स्क्रैपर परिवार का एक हिस्सा है, उसी अनुरोध पैटर्न को अन्य उत्तर इंजनों पर लागू किया गया है — scraper.alexa को scraper.chatgpt, scraper.gemini, scraper.perplexity, और बाकी के लिए स्वैप करें। Scrapeless ने एक ओपन-सोर्स एलेक्सा स्क्रेपर उदाहरण रिपॉजिटरी भी प्रकाशित की है जिसमें पांच भाषाओं में चलने योग्य कोड है यदि आप Python के बाहर एक प्रारंभिक बिंदु चाहते हैं। एक अन्य उत्तर इंजन के लिए जो समान अनुरोध आकार साझा करता है, ChatGPT स्क्रेपर API गाइड को देखें।
निष्कर्ष
अमेज़न एलेक्सा स्क्रेपर एक संवादात्मक खरीदारी उत्तर को संरचित JSON में बदलता है जिसमें एक प्रमाणित अनुरोध होता है: एक प्रॉम्प्ट और एक देश भेजें, उत्तर पाठ और एक उत्पादों की सूची पढ़ें जिसमें एएसआईएन, कीमत, रेटिंग, और डिलीवरी शामिल हैं। कीमतों और रेटिंग को स्ट्रिंग के रूप में मानें, कुछ एरे खाली होने की उम्मीद करें, और आपके पास यह सुनिश्चित करने के लिए एक विश्वसनीय फीड है कि एलेक्सा कैसे उत्पादों की अनुशंसा करती है विभिन्न Queries और क्षेत्रों में। अमेज़न दस्तावेज़ डेवलपर्स के लिए एलेक्सा, और अमेज़न के डिवाइस न्यूज़ रूम कवर करता है कि सहायक कैसे विकसित हो रहा है।
क्या आप Alexa के उत्तरों को डेटा के रूप में कैद करने के लिए तैयार हैं? Scrapeless डैशबोर्ड से मुफ्त में शुरू करें, देखें कि अभिनेता Scraping API उत्पाद पृष्ठ पर कहां फिट बैठता है, या Scrapeless मूल्य निर्धारण पर योजनाओं की तुलना करें।
अक्सर पूछे जाने वाले प्रश्न (FAQ)
Q: Amazon Alexa Scraper क्या है?
A: यह एक Scrapeless LLM Chat Scraper अभिनेता (scraper.alexa) है जो Amazon Alexa को एक खरीदारी संकेत भेजता है और उत्तर को संरचित JSON के रूप में लौटाता है - प्रश्न, Markdown और सामान्य पाठ में उत्तर, और ASIN, मूल्य, रेटिंग, और डिलीवरी के साथ एक products श्रृंखला।
Q: यह कौन सा एंडपॉइंट और पैरामीटर का उपयोग करता है?
A: POST https://api.scrapeless.com/api/v2/scraper/execute जिसमें actor को scraper.alexa पर सेट किया गया है और एक input ऑब्जेक्ट जिसमें prompt और country शामिल हैं। x-api-token हेडर में अपने टोकन के साथ प्रमाणीकरण करें।
Q: क्या प्रतिक्रिया समकालिक है?
A: हां। परिणाम उसी प्रतिक्रिया के task_result ऑब्जेक्ट में वापस आता है, इसलिए आपको अलग परिणाम एंडपॉइंट को पूछने की आवश्यकता नहीं है।
Q: क्या मुझे ब्राउज़र या प्रॉक्सी पूल की आवश्यकता है?
A: नहीं। Scrapeless API के पीछे संग्रहण चलाता है, इसलिए आपका एप्लिकेशन केवल अनुरोध भेजता है और लौटाए गए JSON को पार्स करता है।
Q: references, sources, या suggestions कभी-कभी खाली क्यों होते हैं?
A: ये फ़ील्ड प्रश्न पर निर्भर करते हैं। एक साधारण श्रेणी संकेत उन उत्पादों को वापस कर सकता है जिनके पास अलग-अलग उद्धरण या फॉलो-अप सुझाव नहीं होते, इसलिए इन सूचियों को वैकल्पिक मानते हुए और पुनरावृत्ति करने से पहले सावधानी बरतें।
Q: मैं मूल्य और रेटिंग को कैसे पढ़ूं?
A: दोनों प्रदर्शन स्ट्रिंग हैं। मूल्य इस प्रकार आता है: ~~$399.99~~ $248.00 (सूची मूल्य को रेखा के माध्यम से, वर्तमान मूल्य के बाद), और रेटिंग के लिए {rating 4.2} 19,796 Reviews। क्षेत्र को सीधे कास्ट करने के बजाय एक छोटे पार्सर के साथ संख्याओं को निकालें।
Q: क्या मैं अन्य AI सहायक के लिए वही कोड इस्तेमाल कर सकता हूँ?
A: हां। Alexa अन्य इंजनों के साथ LLM Chat Scraper अनुरोध आकार साझा करता है, इसलिए scraper.alexa को scraper.chatgpt, scraper.gemini, या scraper.perplexity में बदलने से वही इंटीग्रेशन फिर से इस्तेमाल होता है।
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



