Amazon रुफस स्क्रैपर: ASIN द्वारा उत्पाद-संबंधित उत्तर
TL;DR:
- Amazon Rufus, Amazon का इन-ऐप शॉपिंग असिस्टेंट, Scrapeless Scraping API के माध्यम से
scraper.amazonके रूप में उपलब्ध है जिसमेंtype: "rufus"है। - यह दो मोड में चलता है: श्रेणी उत्तर के लिए
keywordsभेजें जिसमें समूहित, रैंक किए गए उत्पाद के चयन — या एक विशेष आइटम के बारे में प्रोडक्ट-अवेयर प्रश्न पूछने के लिएasinजोड़ें। POST/api/v1/scraper/requestपर एक संयोजित उत्तर, समूहित चयन, एक सपाटproductsएरे, और Rufus के सुझाए गए फॉलो-अप प्रश्न लौटाता है।- प्रोडक्ट-अवेयर पैरामीटर
asinहै। जब इसे सेट किया जाता है, Rufus उस विशेष उत्पाद के बारे में उत्तर देता है; इसके बिना, वही प्रश्न सामान्य "कौन सा उत्पाद?" उत्तर प्राप्त करता है। - मुफ्त से शुरू करें। नए Scrapeless अकाउंट्स में मुफ्त Scraper API क्रेडिट शामिल हैं — app.scrapeless.com पर साइन अप करें।
Amazon Rufus शॉपिंग प्रश्नों का उत्तर साधारण भाषा में देता है — "सर्वश्रेष्ठ नॉइज कैंसिलिंग हेडफ़ोन" — और अब यह एक विशेष उत्पाद के बारे में प्रश्नों का उत्तर भी दे सकता है: "क्या यह जिम के लिए अच्छा है?" Scrapeless Scraping API दोनों को संरचित JSON के रूप में कैप्चर करता है। यह गाइड अनुरोध, दो मोड, उत्तर का स्वरूप, और एक पैरामीटर — asin — दिखाता है जो Rufus को प्रोडक्ट-अवेयर बनाता है। नीचे हर अनुरोध और फ़ील्ड को अभिनेता के लाइव रन से कैप्चर किया गया था।
Rufus Scraper के साथ आप क्या कर सकते हैं
- सिफारिश का हिस्सा ट्रैक करें — यह कैप्चर करें कि Rufus एक श्रेणी प्रश्न के लिए किन उत्पादों का नाम देता है, किस समूहित अनुभाग में, और किस क्रम में।
- स्केल पर उत्पाद-विशिष्ट प्रश्नों के उत्तर दें — एक ASIN और एक प्रश्न पास करें ताकि देखें Rufus किसी उत्पाद को फिट, उपयोग केस या तुलना के लिए कैसे वर्णित करता है।
- एक ब्रांड या प्रतिस्पर्धी की निगरानी करें — देखें कि कोई उत्पाद Rufus की सिफारिशों में समय के साथ कैसे प्रकट होता है, और इसे कैसे फ्रेम किया जाता है।
- डाउनस्ट्रीम सिस्टम को फ़ीड करें — उत्तर, समूहित चयन, और फॉलो-अप प्रश्नों को डैशबोर्ड या अलर्ट में साफ JSON के रूप में पाइप करें।
दो मोड: श्रेणी और प्रोडक्ट-अवेयर
Rufus प्रकार उस तरीके से व्यवहार करता है जिसमें आप एक asin शामिल करते हैं:
- श्रेणी मोड (
केवर्डकेवल)। Rufus एक संयोजित सिफारिश,content_blocksलौटाता है जो उत्पादों को लेबल वाले अनुभागों में समूहित करता है, एक सपाटproductsएरे, औरrelated_questionsका एक सेट। इसका उपयोग Rufus के लिए एक प्रश्न के लिए अनुशंसित वस्तुओं को देखने के लिए करें। - प्रोडक्ट-अवेयर मोड (
केवर्ड+asin). Rufus प्रश्न को उस विशेष उत्पाद तक सीमित करता है और उसके बारे में सीधे उत्तर देता है। एक लाइव रन में, "क्या यह जिम और दौड़ने के लिए अच्छा है?" पूछना, Sony WH-1000XM6 हेडफ़ोन के ASIN के साथ "नहीं, Sony WH-1000XM6 हेडफ़ोन जिम और दौड़ने के लिए आदर्श नहीं हैं..." लौटाया।asinको गिराएं और वही प्रश्न सामान्य "आप किस उत्पाद के बारे में पूछ रहे हैं?" उत्तर प्राप्त करता है — ASIN ही है जो उत्तर को उत्पाद-विशिष्ट बनाता है।
एंडपॉइंट और पैरामीटर
Rufus प्रकार समन्वित Scraping API एंडपॉइंट पर चलता है। अपने टोकन के साथ x-api-token हैडर में प्रमाणीकरण करें।
- एंडपॉइंट:
POST https://api.scrapeless.com/api/v1/scraper/request - अभिनेता:
scraper.amazon
| इनपुट फ़ील्ड | प्रकार | आवश्यक | विवरण |
|---|---|---|---|
type |
string | हाँ | इसे rufus पर सेट करें। |
keywords |
string | हाँ | शॉपिंग प्रश्न या प्रश्न। |
domain |
string | हाँ | Amazon स्टोरफ्रंट, जैसे www.amazon.com। |
asin |
string | नहीं | एक उत्पाद ASIN। जब उपस्थित हो, Rufus उस विशेष उत्पाद के बारे में उत्तर देता है। |
परिणाम को एक result ऑब्जेक्ट में समन्वयित तरीके से लौटाया गया है।
प्रमाणित अनुरोध
श्रेणी मोड (उदाहरणात्मक — टोकन को बदलें):
bash
curl 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "rufus",
"keywords": "सर्वश्रेष्ठ नॉइज कैंसिलिंग हेडफ़ोन",
"domain": "www.amazon.com"
}
}'
प्रोडक्ट-अवेयर मोड एक asin जोड़ता है:
bash
curl 'https://api.scrapeless.com/api/v1/scraper/request' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.amazon",
"input": {
"type": "rufus",
"keywords": "क्या यह जिम और दौड़ने के लिए अच्छा है?",
"domain": "www.amazon.com",
"asin": "B0GN4CFF6H"
}
}'
पायथन एकीकरण
यह उदाहरण SCRAPELESS_API_KEY वातावरण चर से टोकन पढ़ता है और एक प्रोडक्ट-अवेयर Rufus प्रश्न चलाता है। यह केवल पायथन स्टैंडर्ड लाइब्रेरी का उपयोग करता है।
python
import json
import os
import urllib.request
API_URL = "https://api.scrapeless.com/api/v1/scraper/request"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]
payload = {
"actor": "scraper.amazon",
"input": {
"type": "rufus",
"keywords": "क्या यह जिम और दौड़ने के लिए अच्छा है?",
```json
"डोमेन": "www.amazon.com",
"असिन": "B0GN4CFF6H",
},
}
अनुरोध = urllib.request.Request(
API_URL,
data=json.dumps(payload).encode("utf-8"),
headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
method="POST",
)
साथ ही urllib.request.urlopen(अनुरोध, timeout=180) के रूप में प्रतिक्रिया:
डेटा = json.loads(response.read().decode("utf-8"))
परिणाम = डेटा.get("result", {})
print("प्रश्न:", परिणाम.get("user_query"))
print("उत्तर:", (परिणाम.get("inference_text") या "")[:200])
आपको क्या मिलेगा
कैटेगरी मोड सबसे समृद्ध पेलोड लौटाता है। नीचे के फील्ड वे हैं जिनका आप सबसे अधिक उपयोग करेंगे; मान एक लाइव रन से गैर-लंबाई के लिए ट्रिम किए गए हैं।
json
// लाइव scraper.amazon (प्रकार रुफस) रन से उदाहरणात्मक नमूना - क्षेत्र के नाम वास्तविक हैं, मान ट्रिम किए गए हैं।
{
"metadata": { "type": "rufus" },
"result": {
"user_query": "सर्वश्रेष्ठ शोर रद्द करने वाले हेडफ़ोन",
"inference_text": "यहाँ कुछ बेहतरीन शोर-रद्द करने वाले हेडफ़ोन हैं ...",
"content_blocks": [
{ "type": "text" },
{ "type": "product_section", "products": [{ "asin": "B0FDKR293G" }] }
],
"products": [
{
"asin": "B0FDKR293G",
"title": "Bose QuietComfort Ultra Bluetooth Headphones (2nd Gen)",
"price": "$369.00",
"original_price": "$449.00",
"rating": "4.3",
"reviews": "2,297",
"category": "सर्वश्रेष्ठ समग्र ANC",
"delivery": "फ्री डिलीवरी रविवार, 19 जुलाई",
"image_url": "<उत्पाद छवि URL>",
"url": "<amazon उत्पाद URL>"
}
],
"related_questions": [
"वर्कआउट के लिए सबसे अच्छे ANC ईयरबड",
"Sony XM5 बनाम Bose QC Ultra की तुलना करें"
]
}
}
| क्षेत्र | प्रकार | विवरण |
|---|---|---|
metadata.type |
string | रन प्रकार, जैसे कि rufus। |
result.user_query |
string | रुफस को भेजा गया प्रश्न। |
result.inference_text |
string | रुफस का संक्षिप्त उत्तर। |
result.content_blocks |
array | क्रमबद्ध text और product_section ब्लॉक (ग्रुप किए गए, रैंक किए गए पिक्स)। |
result.products |
array | सपाट उत्पाद सूची: asin, title, price, original_price, rating, reviews, category, delivery, image_url, url। |
result.related_questions |
array | फॉलो-अप प्रश्न जो रुफस सुझाव देता है। |
उत्पाद-सचेत मोड वही लिफाफा लौटाता है, लेकिन inference_text में उत्तर आपके द्वारा भेजे गए ASIN के लिए विशिष्ट होता है, और products ऐरे आमतौर पर अनुपस्थित होता है क्योंकि रुफस एक वस्तु के बारे में उत्तर दे रहा है न कि एक सूची की सिफारिश कर रहा है।
सामान्य डेटा-आकार की समस्याएँ
asinउत्पाद-ज्ञानी स्विच है — और यहasinहोना चाहिए।product_idयाproductIdभेजने पर चुपचाप अनदेखा कर दिया जाता है; केवलasinरुफस को एक विशिष्ट उत्पाद पर सीमित करता है।- कैटेगरी और उत्पाद-सचेत उत्तर अलग हैं। एक कैटेगरी क्वेरी
productsऔरcontent_blocksलौटाती है; एक उत्पाद-सचेत क्वेरी एक उत्पाद-विशिष्टinference_textऔर आमतौर पर कोईproductsऐरे लौटाती है। यह चुनें कि आपने कौन सा भेजा। - कीमतें और रेटिंग स्ट्रिंग हैं।
price,original_price,rating, औरreviewsप्रदर्शन स्ट्रिंग्स के रूप में वापस आते हैं ("$369.00","2,297"), इसलिए सीधे कास्ट करने के बजाय इन्हें पार्स करें। content_blocksसमूहण ले जाते हैं। सपाटproductsऐरे अनुभाग लेबल खो देता है; पढ़ेंcontent_blocksजब आपको यह जानने की आवश्यकता हो कि रुफस ने एक उत्पाद को किस अनुभाग में रखा।- उत्तर प्रति-प्रश्न स्नैपशॉट होते हैं। रुफस का उत्तर एक समय में एक प्रश्न को प्रतिबिंबित करता है, न कि कैटलॉग निर्यात, इसलिए समय के साथ पकड़ें ट्रैक करें।
साथी अभिनीत और संबंधित पढ़ाई
रुफस प्रकार अमेज़न अभिनेता का एक मोड है। Scrapeless एक खुला स्रोत रुफस स्क्रेपिंग उदाहरण रिपॉजिटरी के साथ पांच भाषाओं में चलाने योग्य कोड प्रकाशित करता है। सहायक के लिए पृष्ठभूमि के लिए, अमेज़न रुफस, इसका जनरेटिव शॉपिंग असिस्टेंट पेश करता है, और अपने रिटेल न्यूज़ रूम में व्यापक पंक्ति को कवर करता है। एक अन्य एआई उत्तर इंजन के लिए, ChatGPT स्क्रैपर API गाइड देखें।
निष्कर्ष
रुफस स्क्रैपर अमेज़न के शॉपिंग असिस्टेंट को संरचित JSON में बदलता है, एक एंडपॉइंट से दो मोड में: समूहित, रैंक की गई सिफारिश के लिए keywords भेजें, या एक विशिष्ट वस्तु के बारे में उत्पाद-सचेत उत्तर के लिए asin जोड़ें। यह चुनें कि आपने कौन सा मोड भेजा, प्रदर्शन-स्ट्रिंग कीमतों और रेटिंग्स का विश्लेषण करें, और समूहण की आवश्यकता होने पर content_blocks को पढ़ें। यह रुफस की अनुशंसा और उत्पादों का वर्णन करने का ट्रैक रखने के लिए एक विश्वसनीय फीड है।
क्या आप रुफस के उत्तरों को डेटा के रूप में कैप्चर करने के लिए तैयार हैं? स्क्रैपलेस डैशबोर्ड से मुफ्त शुरू करें, देखें कि अभिनेता स्क्रैपिंग एपीआई उत्पाद पृष्ठ पर कहाँ फिट बैठता है, या स्क्रैपलेस मूल्य निर्धारण पर योजनाओं की तुलना करें।
अक्सर पूछे जाने वाले प्रश्न
प्रश्न: अमेज़न रुफस स्क्रेपर क्या है?
उत्तर: यह स्क्रैपलेस स्क्रैपिंग एपीआई अभिनेता scraper.amazon है जिसमें type: "rufus" है, जो अमेज़न रुफस को एक प्रश्न भेजता है और उत्तर को संरचित JSON के रूप में लौटाता है - संश्लेषित उत्तर, समूहित उत्पाद चयन, एक समतल products ऐरे, और सुझाए गए अनुसरण प्रश्न।
प्रश्न: मैं किसी विशेष उत्पाद के बारे में कैसे पूछता हूँ?
उत्तर: input में एक asin फ़ील्ड जोड़ें। फिर रुफस उस विशेष उत्पाद के बारे में उत्तर देता है। बिना asin के, वही प्रश्न एक सामान्य "कौन सा उत्पाद?" उत्तर लौटाता है।
प्रश्न: यह किस एंडपॉइंट और पैरामीटर का उपयोग करता है?
उत्तर: POST https://api.scrapeless.com/api/v1/scraper/request जिसमें actor को scraper.amazon पर सेट किया जाता है और एक input ऑब्जेक्ट जिसमें type: "rufus", keywords, domain, और वैकल्पिक रूप से asin शामिल होता है। अपने टोकन के साथ x-api-token में प्रमाणीकरण करें।
प्रश्न: क्या product_id asin के बजाय काम करता है?
उत्तर: नहीं। केवल asin रुफस को किसी विशेष उत्पाद पर स्कोप करता है; product_id और productId को नजरअंदाज किया जाता है।
प्रश्न: मैं जानूंगा कि किसी उत्पाद को किस श्रेणी के तहत समूहबद्ध किया गया था?
उत्तर: content_blocks पढ़ें। समतल products ऐरे श्रेणी लेबलों को छोड़ देता है, जबकि content_blocks उस product_section समूह को बनाए रखता है जिसका उपयोग रुफस ने किया था।
प्रश्न: क्या उत्तर समकालिक है?
उत्तर: हाँ। result ऑब्जेक्ट उसी प्रतिक्रिया में लौटाया जाता है; आपको एक अलग एंडपॉइंट को पोल करने की आवश्यकता नहीं है।
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



