वापस ब्लॉग पर

ईबे खोज परिणामों को स्क्रैप करने का तरीका: सत्र गर्म करने और एंटी-डिटेक्शन गाइड

Emily Chen
Emily Chen

Advanced Data Extraction Specialist

01-Jun-2026

मुख्य निष्कर्ष:

  • eBay के खोज अंत बिंदु पर एक ठंडी अनुरोध ब्लॉक हो जाती है। https://www.ebay.com/sch/i.html?_nkw=laptop पर सीधी स्वचालित नेविगेशन eBay की त्रुटि पृष्ठ पर पहुँच जाती है, भले ही वह एक ताज़ी अमेरिकी घरेलू क्लाउड-ब्राउज़र सत्र से हो — eBay खोज पथ को उसके आइटम और ब्राउज़ पृष्ठों की तुलना में अधिक सख्ती से नियंत्रित करता है।
  • सत्र को गर्म करना अनलॉक है। एक निरंतर क्लाउड-ब्राउज़र सत्र खोलें, पहले eBay की होमपेज पर जाएँ ताकि कूकीज़ और नेविगेशन स्थिति सेटल हों, फिर उसी सत्र में खोज URL पर जाएँ। तब खोज पृष्ठ पूरी परिणाम ग्रिड के साथ लोड होता है।
  • .su-card-container पर एंकर निकासी। eBay ने अपने परिणाम-कार्ड मार्कअप को घुमाया है; पुराना li.s-item चयनक अब कुछ भी मेल नहीं खाता। वर्तमान जैविक परिणाम कार्ड पर .su-card-container वर्ग होता है — उस पर चुनें और प्रत्येक कार्ड से बाल क्षेत्रों को पढ़ें।
  • एकीकृत सीडीपी अंत बिंदु है। अपने एपीआई कुंजी के साथ एक Scrapeless Scraping Browser WebSocket URL बनाएं, और Playwright का connect_over_cdp इसे ठीक उसी तरह चलाता है जैसे एक स्थानीय ब्राउज़र — इसलिए रेंडरिंग, आवासीय निकासी और फिंगरप्रिंटिंग सभी क्लाउड-साइड होती हैं।
  • आवासीय निकासी चलान ले जाती है। Scrapeless Scraping Browser 195+ देशों में आवासीय प्रॉक्सी के माध्यम से मार्ग करता है और प्रति सत्र ब्राउज़र फिंगरप्रिंट को यादृच्छिक करता है, इसलिए क्लाउड ब्राउज़र eBay पृष्ठों को रेंडर करता है जिन्हें एक स्थानीय स्वचालित ब्राउज़र पर फ़िल्टर किया जाता है।
  • शुरू करने के लिए स्वतंत्र। नए Scrapeless खातों में मुफ्त Scraping Browser रनटाइम शामिल है — app.scrapeless.com पर साइन अप करें।

परिचय: क्यों eBay का खोज पृष्ठ स्पष्ट दृष्टिकोण को ब्लॉक करता है

eBay वेब पर सबसे बड़े सार्वजनिक बाज़ारों में से एक है, और इसके खोज परिणाम कीमत, लिस्टिंग, और प्रतिस्पर्धात्मक डेटा का घना स्रोत हैं। मूल्य निर्धारण टीमें तुलना करने योग्य वस्तुओं के लिए क्या बेचती हैं, ब्रांड-रक्षण टीमें अनधिकृत लिस्टिंग पर नज़र रखती हैं, और एआई एजेंट लिस्टिंग संदर्भ खींचते हैं ताकि उत्पाद प्रश्नों का उत्तर दिया जा सके। सभी कुछ /sch/i.html पर खोज अंत बिंदु के पीछे रहता है।

स्पष्ट दृष्टिकोण — उस URL पर एक HTTP क्लाइंट या स्थानीय हेडलेस ब्राउज़र इंगित करना — तेजी से विफल होता है। https://www.ebay.com/sch/i.html?_nkw=laptop पर एक ठंडी स्वचालित अनुरोध eBay की त्रुटि पृष्ठ पर पहुँच जाती है, न कि परिणामों पर। यह एक साफ अमेरिकी घरेलू IP से भी होता है: eBay IP प्रतिष्ठा, डिवाइस फिंगरप्रिंटिंग, अनुरोध दर, और व्यवहारात्मक संकेतों का मूल्यांकन करता है, और यह अपने आइटम और ब्राउज़ पृष्ठों की तुलना में खोज पथ को अधिक आक्रामक रूप से नियंत्रित करता है। पृष्ठ मानव के लिए रेंडर होता है और स्क्रिप्ट के लिए ब्लॉक किया जाता है।

यह ट्यूटोरियल Scrapeless Scraping Browser के शीर्ष पर एक Python पाइपलाइन बनाता है जो उस गेट को उसी तरह खोलता है जैसे एक असली आगंतुक करता है — सबसे पहले होमपेज पर पहुँचकर, सत्र को गर्म करने देता है, फिर उसी सत्र के भीतर खोज पर जाता है। आप Playwright के साथ CDP के माध्यम से क्लाउड ब्राउज़र से कनेक्ट करते हैं, जो आधिकारिक समर्थित क्लाइंट है, इसलिए रेंडरिंग, आवासीय निकासी, और एंटी-डिटेक्शन फिंगरप्रिंटिंग सभी क्लाउड-साइड होती हैं। समान प्राथमिकता का उपयोग करते हुए एक विभिन्न बड़े-बाज़ार निर्माण के लिए, सर्वश्रेष्ठ Amazon स्क्रेपर्स राउंडअप पर देखें; उपकरणों के बीच स्थानीयकृत-मूल्य निर्धारण तुलना के लिए, 2026 में सर्वश्रेष्ठ Zillow स्क्रेपर्स देखें।


आप इसके साथ क्या कर सकते हैं

गर्म-सत्र पैटर्न — पहले होमपेज, फिर खोज और विस्तार पृष्ठ एक ही आयोजित क्लाउड-ब्राउज़र सत्र में — eBay डेटा पाइपलाइन की अधिकांश आवश्यकताओं को कवर करता है:

  • प्रतिस्पर्धी मूल्य निर्धारण का ट्रैक रखें। प्रत्येक परिणाम कार्ड से मूल्य और लिस्टिंग शीर्षक खींचें, फिर अपने स्वयं के कैटलॉग के खिलाफ एक शेड्यूल पर तुलना करें।
  • एक उत्पाद श्रेणी की निगरानी करें। पृष्ठों में एक श्रेणी या कीवर्ड क्वेरी को चलाएं और प्रवृत्ति विश्लेषण के लिए क्रमबद्ध रिकॉर्ड में लिस्टिंग इकट्ठा करें।
  • अनधिकृत लिस्टिंग पर नज़र रखें। अपने ब्रांड या SKU के लिए खोजें और उन विक्रेताओं को झंडा दें जिन्हें इसे लिस्ट करने की अनुमति नहीं है।
  • भू-विशिष्ट परिणाम कैप्चर करें। यूएस आवासीय निकासी को पिन करें ताकि यूएस ग्राहक जो लिस्टिंग, मुद्रा, और उपलब्धता देखेगा उसे देखा जा सके, न कि जो कुछ भी एक कार्यालय IP समाधान देता है।
  • एक एआई एजेंट को लिस्टिंग संदर्भ दें। खोज और आइटम पृष्ठों को साफ संरचित क्षेत्रों में रेंडर करें ताकि एक पुनर्प्राप्ति परत या एजेंट वर्तमान डेटा के साथ उत्पाद प्रश्नों का उत्तर दे सके।
  • एक मूल्य-इतिहास कार्य सेट बनाएं। समय के साथ समान क्वेरी की स्नैपशॉट लें और प्रवाहित परिणामों को स्टोर करें ताकि यह अध्ययन कर सकें कि कीमतें कैसे चलती हैं।

क्यों Scrapeless Scraping Browser

Scrapeless Scraping Browser एक अनुकूलन योग्य, एंटी-डिटेक्शन क्लाउड ब्राउज़र है जो वेब क्रॉलर और एआई एजेंटों के लिए डिज़ाइन किया गया है। विशेष रूप से eBay के लिए, यह लाता है:

  • एंटी-डिटेक्शन क्लाउड ब्राउज़र। यह पूर्ण क्लाउड-साइड जावास्क्रिप्ट रेंडरिंग के साथ एक स्व-विकसित Chromium चलाता है, इसलिए खोज ग्रिड, लेज़ी-लोडेड चित्र, और आइटम विवरण पार्सर द्वारा पढ़े जाने से पहले हाइड्रेट होते हैं।
  • 195+ देशों में आवासीय प्रॉक्सी। कनेक्शन URL पर proxyCountry सेट करें और क्लाउड ब्राउज़र वास्तविक आवासीय IPs से उस क्षेत्र में ईजिट कराता है जिसे आप लक्ष्य बनाते हैं, ताकि eBay स्थानीय खरीदार जो देखता है, वही लौटाए।
  • प्रत्येक सत्र के लिए फिंगरप्रिंट यादृच्छिकता। प्रत्येक सत्र को एक यादृच्छिक फिंगरप्रिंट मिलता है — उपयोगकर्ता एजेंट, समय क्षेत्र, WebGL, और कैनवास — ताकि स्वचालित ब्राउज़र एक ही पहचाने जाने वाले पहचान में समाहित न हो सके।
  • sessionTTL के माध्यम से सत्र की स्थिरता। कनेक्शन URL पर sessionTTL सेट करके होमपेज वार्म-अप और खोज नेविगेशन के बीच एक सत्र खोला रखें, ताकि कुकीज़ और नेविगेशन स्टेट एक ही रन के भीतर अनुरोधों के बीच ले जाएँ।
  • एकल CDP एन्डपॉइंट। अपने API कुंजी के साथ एक WebSocket URL बनाएं; Playwright का connect_over_cdp इसे ऐसे चलाता है जैसे यह एक स्थानीय ब्राउज़र हो, ताकि आपका पार्सिंग कोड न बदले।

रनटाइम शुरू करने के लिए मुफ्त है और उपयोग के साथ स्केल करता है — मूल्य निर्धारण के लिए Scrapeless pricing देखें, और मुफ्त योजना पर अपना API कुंजी app.scrapeless.com पर प्राप्त करें।


पूर्वापेक्षाएँ

शुरू करने से पहले सुनिश्चित करें कि आपके पास है:

  • Python 3.10+ — नीचे दिए गए फेचर्स लाइब्रेरी द्वारा आवश्यक।
  • pip — पैकेज स्थापित करने के लिए।
  • एक Scrapeless खाता और API कुंजीapp.scrapeless.com पर मुफ्त योजना के लिए साइन अप करें, फिर अपनी कुंजी Settings → API Key Management से प्राप्त करें।
  • CSS चयनकर्ताओं और टर्मिनल के साथ बुनियादी परिचितता — आप इन दोनों का उपयोग पत्तों को फेच करने और उनसे मान निकालने के लिए करेंगे।

स्थापित करना

आपको एक पैकेज की आवश्यकता है: Playwright Python के लिए, Scrapeless Scraping Browser के लिए आधिकारिक रूप से समर्थित क्लाइंट।

1. Playwright स्थापित करें

bash Copy
pip install playwright

Playwright का connect_over_cdp दूरस्थ Scrapeless क्लाउड ब्राउज़र से कनेक्ट होता है, इसलिए आपको playwright install चलाने की आवश्यकता नहीं है या किसी स्थानीय ब्राउज़र बाइनरी को डाउनलोड करने की जरूरत नहीं है — रेंडरिंग क्लाउड-साइड होती है। Playwright एकल कनेक्शन को कई पृष्ठ लोड के बीच खोले रखता है, जो होमपेज वार्म-अप और खोज को एक सत्र पहचान साझा करने की अनुमति देता है।

2. अपनी Scrapeless API कुंजी सेट करें

अपने कुंजी को निर्यात करें ताकि यह कनेक्शन URL में सवारी कर सके:

bash Copy
export SCRAPELESS_API_KEY=your_api_token_here

Windows पर, setx SCRAPELESS_API_KEY "your_api_token_here" (स्थायी, नया शेल) या $env:SCRAPELESS_API_KEY="your_api_token_here" (वर्तमान PowerShell सत्र) का उपयोग करें। नीचे दिया गया कनेक्शन सहायक इस चर को पढ़ता है और इसे URL में token के रूप में एम्बेड करता है।


चरण 1 — कनेक्शन बनाएं और पुष्टि करें कि ठंडी अनुरोध अवरुद्ध है

ब्लॉक को पुन: उत्पन्न करके शुरू करें, ताकि पाइपलाइन का बाकी हिस्सा स्पष्ट आधार रेखा हो। Scrapeless Scraping Browser URL बनाएं, Playwright के साथ कनेक्ट करें, और बिना पहले होमपेज पर गए सीधे खोज एंडपॉइंट पर नेविगेट करें।

python Copy
import os
from urllib.parse import urlencode
from playwright.sync_api import sync_playwright

def scraping_browser_url(proxy_country="US", session_ttl=240):
    # API कुंजी URL पर `token` के रूप में सवारी करती है; ईजिट और जीवनकाल क्वेरी पैरामीटर हैं।
    params = urlencode({
        "token": os.environ["SCRAPELESS_API_KEY"],
        "sessionTTL": session_ttl,
        "proxyCountry": proxy_country,
    })
    return f"wss://browser.scrapeless.com/api/v2/browser?{params}"

with sync_playwright() as p:
    browser = p.chromium.connect_over_cdp(scraping_browser_url("US"))
    page = browser.new_page()

    # ठंडी नेविगेशन सीधे खोज एंडपॉइंट पर, बिना होमपेज वार्म-अप के।
    page.goto("https://www.ebay.com/sch/i.html?_nkw=laptop",
              wait_until="domcontentloaded")
    print(page.title())          # -> "Error Page | eBay" / "Access Denied"
    browser.close()

/sch/i.html पर ठंडी स्वचालित नेविगेशन एक eBay त्रुटि पृष्ठ पर पहुँचती है, हालाँकि सत्र एक स्वच्छ अमेरिकी आवासीय IP से ईजिट करता है। eBay खोज एंडपॉइंट को एक संवेदनशील पथ के रूप में मानता है और उन अनुरोधों को चुनौती देता है जो स्थापित ब्राउज़िंग संदर्भ के बिना आते हैं। समाधान न तो एक अलग हेडर है और न ही एक अलग IP — यह उस तरीके से आना है जैसे कोई व्यक्ति आता है, जो अगला कदम है।


चरण 2 — होमपेज पर सत्र गर्म करें, फिर खोजें

खुला सत्र एक अनล็ॉक है। एक क्लाउड-ब्राउज़र कनेक्शन खोलें, पहले eBay होमपेज को लोड करें ताकि कुकीज़ और नेविगेशन स्टेट बसा सकें, फिर उस ही सत्र के अंदर खोज URL पर नेविगेट करें। Playwright Scrapeless क्लाउड ब्राउज़र के लिए एकल CDP कनेक्शन को खुला रखता है और हर पृष्ठ को इसके माध्यम से चलाता है, ताकि वार्म-अप और खोज एक पहचान साझा करें।

python Copy
with sync_playwright() as p:
    browser = p.chromium.connect_over_cdp(scraping_browser_url("US"))
    page = browser.new_page()

    # 1. सत्र गर्म करें: होमपेज पर लैंड करें ताकि कुकीज़/नेविगेशन स्थिति बसा सकें।
    page.goto("https://www.ebay.com/", wait_until="domcontentloaded")
    page.wait_for_timeout(2500)

    # 2. अब उसी सत्र में खोज पर नेविगेट करें।
    page.goto("https://www.ebay.com/sch/i.html?_nkw=laptop",
Here is the Hindi translation of the provided text:

wait_until="domcontentloaded")
page.wait_for_timeout(3000) # ग्रिड को हाइड्रेट होने दें
print(page.title()) # -> "Laptop for sale | eBay"

Copy
cards = page.query_selector_all(".su-card-container")  # प्रदर्शित परिणाम कार्ड
print(len(cards), "कार्ड")                           # ग्रिड अब भरा हुआ है

पहले होमपेज पर जाने के बाद, वही खोज URL जो चरण 1 में अवरोधित था अब शीर्षक Laptop for sale | eBay और एक भरे हुए परिणाम ग्रिड को लौटाता है। नेविगेशन के बाद संक्षिप्त wait_for_timeout कार्डों को निष्कर्षण से पहले हाइड्रेट करने देता है। संपूर्ण भिन्नता एक ही नियंत्रित सत्र के अंदर आगमन के क्रम में है — होमपेज ब्राउज़िंग संदर्भ स्थापित करता है, और खोज अनुरोध इसे विरासत में लेता है।


चरण 3 — परिणाम कार्डों का निष्कर्षण करें

eBay ने अपने परिणाम-कार्ड मार्कअप को घुमाया है, इसलिए वर्तमान वर्ग पर आधारित रहें। जीवित परिणाम कार्ड .su-card-container लिए जाते हैं; पुरानी li.s-item चयनकर्ता अब कुछ भी मेल नहीं खाता। कार्डों का चयन करें, फिर प्रत्येक पर बाल क्षेत्रों को पढ़ें।

python Copy
def text_of(el, selector):
    node = el.query_selector(selector)
    return node.inner_text().strip() if node else None

records = []
for card in page.query_selector_all(".su-card-container"):
    # बाल चयनकर्ता चित्रात्मक हैं — शीर्षक/मूल्य/लिंक नोड्स की पुष्टि करें
    # वर्तमान eBay DOM के खिलाफ, चूंकि मार्कअप स्थानांतरित होता है।
    title = text_of(card, ".su-styled-text")               # लिस्टिंग शीर्षक (चित्रात्मक पथ)
    price = text_of(card, ".su-styled-text.s-price")       # मूल्य पाठ (चित्रात्मक पथ)
    link_el = card.query_selector("a")                     # लिस्टिंग URL
    link = link_el.get_attribute("href") if link_el else None

    records.append({
        "title": title,
        "price": price,
        "link":  link,
    })

print(len(records), "सूचियाँ")

हर निष्कर्षण को .su-card-container पर एंकर करें; बाल चयनकर्ता (title, price, link) को आरंभिक बिंदुओं के रूप में मानें ताकि लाइव DOM के खिलाफ पुष्टि की जा सके, क्योंकि eBay आंतरिक मार्कअप को कार्ड रैपर की स्वतंत्रता से फिर से व्यवस्थित करता है। प्रत्येक कमी को None का डिफ़ॉल्ट मान दें ताकि एक विरल कार्ड रन को क्रैश न करे — eBay कुछ लिस्टिंग स्वरूपों (बोली के मध्य, "विवरण देखें" पदों) पर मूल्य छोड़ देता है, और कुछ कार्ड अलग आकार वाले प्रायोजन स्लॉट होते हैं।

अपने निःशुल्क योजना पर API कुंजी प्राप्त करें: app.scrapeless.com


चरण 4 — परिणामों के माध्यम से पृष्ठ बनाना और लिस्टिंग को विवरण पृष्ठों पर फॉलो करना

अधिकांश असली काम एक से अधिक URL में फैले होते हैं। चूंकि सत्र पहले से गर्म है और खोला गया है, परिणामों के माध्यम से पृष्ठ बनाना और व्यक्तिगत लिस्टिंग को उनके आइटम पृष्ठों पर फॉलो करना कोई अतिरिक्त लागत नहीं लाता — वही कुकीज़, आवासीय पहचान, और फिंगरप्रिंट पूरे चलने में बने रहते हैं। eBay _pgn प्रश्न पैरामीटर के साथ खोज अंतिम बिंदु को पेजिनेट करता है।

python Copy
rows = []
with sync_playwright() as p:
    browser = p.chromium.connect_over_cdp(scraping_browser_url("US", session_ttl=300))
    page = browser.new_page()
    page.goto("https://www.ebay.com/", wait_until="domcontentloaded")  # पहले गर्म
    page.wait_for_timeout(2500)

    for n in range(1, 4):  # पृष्ठ 1..3
        url = f"https://www.ebay.com/sch/i.html?_nkw=laptop&_pgn={n}"
        page.goto(url, wait_until="domcontentloaded")
        page.wait_for_timeout(3000)
        for card in page.query_selector_all(".su-card-container"):
            link_el = card.query_selector("a")
            if link_el and link_el.get_attribute("href"):
                rows.append({"link": link_el.get_attribute("href")})

    # उसी गर्म सत्र में एक लिस्टिंग को उसके आइटम पृष्ठ पर फॉलो करें।
    if rows:
        page.goto(rows[0]["link"], wait_until="domcontentloaded")
        h1 = page.query_selector("h1")              # आइटम-पृष्ठ शीर्षक (DOM के खिलाफ पुष्टि करें)
        item_title = h1.inner_text() if h1 else None

    browser.close()

print(len(rows), "एकत्रित की गई लिस्टिंग")

होमपेज का गर्म होना एक बार होता है, सत्र के शीर्ष पर; इसके बाद हर खोज पृष्ठ और आइटम पृष्ठ स्थापित संदर्भ को पुन: उपयोग करता है। आइटम पृष्ठ और ब्राउज़ या डील पृष्ठ सीधे एक बार सत्र गर्म होने पर रेंडर होते हैं — भारी गेटिंग विशेष रूप से खोज अंत बिंदु पर होती है। सूची-से-विवरण क्रॉल के लिए, पहले खोज ग्रिड से लिस्टिंग URLs को इकट्ठा करें, फिर उन्हें उसी browser के माध्यम से लाएं ताकि आवासीय सत्र और फिंगरप्रिंट पूरे चलने में स्थिर रहें।


चरण 5 — उत्पादन कठिनाई

एक कार्यान्वयन स्क्रिप्ट से एक विश्वसनीय कार्य में जाना मुख्य रूप से प्लेटफ़ॉर्म के सहिष्णुता के भीतर रहने के बारे में है। कुछ नियम अधिकांश वजन उठाते हैं:

  • समानांतर को कैप करें। प्रति होस्ट ≤3 क्लाउड-ब्राउज़र सत्र पर रोकें। इससे आगे बढ़ने से दर-सीमाएँ और कनेक्शन रीसेट निमंत्रण मिलता है, और सीमांत थ्रूपुट कभी-कभी अतिरिक्त घर्षण का औचित्य नहीं देता।
Copy
- **सत्र को एक बार गर्म करें और पुन: उपयोग करें।** कनेक्शन URL पर `sessionTTL` सेट करें (जैसे 240 सेकंड), सत्र की शुरुआत में एक बार होमपेज पर जाएं, फिर उसी Playwright कनेक्शन के माध्यम से प्रत्येक खोज और आइटम नेविगेशन चलाएं। प्रति पृष्ठ फिर से गर्म करना रखे गए संदर्भ और कनेक्शन हैंडशेक को बर्बाद करता है।
- **`proxyCountry=US` सेट करें।** ईबे की लिस्टिंग, मुद्रा, और उपलब्धता क्षेत्र के अनुसार भिन्न होती है; अमेरिकी घरेलू निकासी को स्थिर करना आपके लक्षित क्षेत्र के साथ परिणामों को सुसंगत रखता है।
- **गैर-मौजूद क्षेत्रों को nullable के रूप में मानें।** वास्तविक कार्ड कुछ लिस्टिंग प्रारूपों पर कीमतें, रेटिंग या शिपिंग लाइनों को छोड़ देते हैं। गुम चयनकर्ताओं को `None` पर डिफ़ॉल्ट करें बजाय इसके कि उन्हें मौजूद होने का दावा करें, ताकि एक sparse रिकॉर्ड बैच को न तोड़ सके।

---

## आपको जो वापस मिलता है

```json
[
  {
    "title": "Dell Latitude 7420 14\" Laptop i7 16GB 512GB SSD Windows 11 Pro",
    "price": "$329.99",
    "link": "https://www.ebay.com/itm/1234567890"
  },
  {
    "title": "Apple MacBook Air 13.3\" M1 8GB 256GB - Space Gray",
    "price": "$489.00",
    "link": "https://www.ebay.com/itm/9876543210"
  },
  {
    "title": "Lenovo ThinkPad X1 Carbon Gen 9 i5 16GB 256GB",
    "price": "$415.50",
    "link": "https://www.ebay.com/itm/5556667778"
  }
]
// आकार चरण 3 निष्कर्षण को दर्शाता है; क्षेत्र मान संकेतिक नमूने हैं।

इस पाईपलाइन को चलाने से कुछ ईमानदार अवलोकन:

  • कोल्ड खोज को अस्वीकार किया गया; गर्म खोज को नहीं। /sch/i.html पर सीधी नेविगेशन एक ईबे त्रुटि पृष्ठ पर पहुँचती है; पहले एक ही रखे गए सत्र में होमपेज पर जाने से इसे साफ़ कर देता है और खोज लैपटॉप बिक्री के लिए | ईबे शीर्षक के साथ एक पूरी ग्रिड वापस लौटाता है।
  • एक छोटे पोस्ट-नेविगेशन इंतजार से हाइड्रेशन कवर होता है। परिणाम कार्ड पहले पेंट के बाद लोड होते हैं, इसलिए goto के बाद एक संक्षिप्त wait_for_timeout उन्हें चयनकर्ता के लिए उपलब्ध बनाता है।
  • .su-card-container स्थिर एंकर है। ईबे ने अपने कार्ड मार्कअप को घुमाया — पुराना li.s-item कुछ नहीं लौटाता। .su-card-container पर एंकर करें और किसी भी डिज़ाइन के बाद बच्चे फ़ील्ड चयनकर्ताओं की फिर से पुष्टि करें।
  • सुसंगत परिणामों के लिए proxyCountry पिन करें। लिस्टिंग, मुद्रा, और उपलब्धता क्षेत्र के अनुसार भिन्न होती है; अमेरिकी घरेलू निकासी को पिन करना आपके लक्षित क्षेत्र के साथ आउटपुट को सुसंगत रखता है।
  • आइटम और ब्राउज़ पृष्ठ सीधे रेंडर होते हैं। भारी गेटिंग खोज एंडपॉइंट पर होती है; एक बार सत्र गर्म हो जाने पर, आइटम, ब्राउज़, और डील पृष्ठ बिना होमपेज के मोड़ के लोड होते हैं।

निष्कर्ष: अपने ईबे लिस्टिंग पाइपलाइन को स्केल करें

पाइपलाइन चार आंदोलनों में घटित होती है। एक Scrapeless Scraping Browser सत्र से कनेक्ट करें और इसे होमपेज पर गर्म करें। उसी रखे गए सत्र के भीतर खोज एंडपॉइंट पर जाएं ताकि अनुरोध एक स्थापित ब्राउज़िंग संदर्भ को विरासत में ले। परिणाम ग्रिड को .su-card-container पर एंकर करके निकालें। फिर परिणामों के माध्यम से पृष्ठ करें और एक गर्म सत्र के माध्यम से विवरण पृष्ठों की ओर लिस्टिंग का पालन करें। आप वास्तव में ज़रूरत पड़ने पर ही क्लाउड ब्राउज़र के लिए भुगतान करते हैं — देखें Scrapeless मूल्य निर्धारण फ्री टीयर क्या कवर करता है — और बाकी साधारण पायथन रहता है।

यहाँ से, वही गर्म-सत्र पैटर्न बड़े मार्केटप्लेस निर्माण में प्लग होता है। बड़े मार्केटप्लेस की तुलना के लिए श्रेष्ठ अमेज़न स्क्रैपर्स राउंडअप देखें, और स्थानीय मूल्य निर्धारण उपकरण की तुलना के लिए 2026 में सर्वश्रेष्ठ ज़िलो स्क्रैपर्स देखें। शिप करने से पहले: SCRAPELESS_API_KEY को बाहर निकालें, proxyCountry=US पिन करें, /sch/ को छूने से पहले सत्र को होमपेज पर गर्म करें, प्रत्येक होस्ट पर ≤3 सत्रों के लिए समवर्तीता रखें, .su-card-container पर एंकर करें, और गैर-मौजूद क्षेत्रों को nullable के रूप में मानें। कनेक्शन और पुस्तकालय गाइड्स docs.scrapeless.com पर हैं।


क्या आप अपनी AI-सक्षम डेटा पाइपलाइन का निर्माण करने के लिए तैयार हैं?

एक मुफ्त योजना का दावा करने और ईबे और मार्केटप्लेस डेटा पाइपलाइनों का निर्माण करने वाले डेवलपर्स के साथ कनेक्ट करने के लिए हमारे समुदाय में शामिल हों: Discord · Telegram

app.scrapeless.com पर साइन अप करें ताकि आपको मुफ्त Scraping Browser रनटाइम मिले और ऊपर दिए गए पैटर्न को ईबे क्वेरियों और क्षेत्रों के लिए अनुकूलित करें, जिनकी पाइपलाइन को आवश्यकता है।


अक्सर पूछे जाने वाले प्रश्न

क्या आपको प्रॉक्सी की आवश्यकता है?

हाँ — आवासीय निकासी ईबे के संचालनों को लाती है। कनेक्शन URL पर proxyCountry=US के साथ अमेरिकी आवासीय प्रॉक्सियों को पिन करें। Scrapeless Scraping Browser 195+ देशों में आवासीय प्रॉक्सियों की आपूर्ति करता है, इसलिए आपको स्वयं IP को स्रोत और घुमाने की आवश्यकता नहीं है, और निकासी का पता एक सामान्य घरेलू कनेक्शन की तरह दिखता है न कि किसी फ्लैगड डेटा सेंटर IP की तरह।

क्यों खोज एंडपॉइंट "एक्सेस अस्वीकृत" लौटाता है?

एक ठंडी स्वचालित नेविगेशन https://www.ebay.com/sch/i.html पर पहुँचने पर एक eBay त्रुटि पृष्ठ पर जाती है क्योंकि अनुरोध एक स्थापित ब्राउज़िंग संदर्भ के बिना आता है - eBay अपने आइटम और ब्राउज़ पृष्ठों की तुलना में खोज पथ को अधिक कसकर गेट करता है। समाधान है कि पहले सत्र को गर्म करें: एक होल्ड किए गए क्लाउड-ब्राउज़र सत्र को खोलें, eBay होमपेज लोड करें ताकि कुकीज़ और नेविगेशन स्थिति व्यवस्थित हो जाए, फिर उसी सत्र में खोज URL पर नेविगेट करें। खोज तब लैपटॉप बिक्री के लिए | eBay शीर्षक और एक भरे हुए ग्रिड के साथ लोड होती है।

मेरा चयनकर्ता eBay के पुन: डिज़ाइन के बाद मेल खाना बंद हो गया। आप इसे कैसे ठीक करेंगे?

eBay अपने DOM को बदलता है। अपने निष्कर्षण को परिणाम-कार्ड रैपर .su-card-container पर आधारित करें न कि गहरे बाल्य पथ पर, और पुनः डिज़ाइन के बाद वर्तमान मार्कअप के खिलाफ शीर्षक, मूल्य, और लिंक चयनकर्ताओं की पुष्टि करें। पुराना li.s-item चयनकर्ता वर्तमान लेआउट पर कुछ भी मेल नहीं खाता, यही कारण है कि कार्ड रैपर स्थिर एंकर है।

क्या आपके द्वारा सम्मानित किए जाने वाले समवर्ती सीमाएँ हैं?

इसे प्रति होस्ट ≤3 क्लाउड-ब्राउज़र सत्रों तक सीमित रखें। इससे अधिक, आप थोड़ी थ्रूपुट के लिए बहुत अधिक दर-सीमित करने और कनेक्शन रिसेट करने का व्यापार करते हैं। हर अनुरोध को एक बार में फायर करने के बजाय सीमित समवर्तीता और एक कतार का उपयोग करें।

क्या यह बिना एआई एजेंट के चल सकता है?

हाँ। उपरोक्त पायथन पैटर्न अपने आप में अंत-से-अंत है - प्ले राइट CDP के माध्यम से Scrapeless Scraping Browser से कनेक्ट करता है, और आपका कोड सत्र को गर्म करता है, नेविगेट करता है, और निष्कर्षण करता है। एआई एजेंट एक वैकल्पिक परत है, अनिवार्य नहीं।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची