🎯 कस्टमाइज़ करने योग्य, डिटेक्शन-प्रतिरोधी क्लाउड ब्राउज़र जो स्व-विकसित Chromium द्वारा संचालित है, वेब क्रॉलर और एआई एजेंट्स के लिए डिज़ाइन किया गया। 👉अभी आज़माएं
वापस ब्लॉग पर

प्ले राइट undetected फ़िंगरप्रिंट ब्राउज़र के साथ स्क्रेपलेस

Sophia Martinez
Sophia Martinez

Specialist in Anti-Bot Strategies

09-Jul-2026

TL;DR:

  • Playwright किसी भी CDP ब्राउज़र से chromium.connectOverCDP() के साथ कनेक्ट होता है, इसलिए इसे Scrapeless पर सेट करना एक URL है। एक स्थानीय chromium.launch() को क्लाउड ब्राउज़र से कनेक्शन के लिए स्वैप करें और हर स्क्रिप्ट एक साफ पहचान पर चलती है।
  • एक स्थानीय Playwright ब्राउज़र तीन धुरियों पर स्वचालन लीक करता है: navigator.webdriver फ्लैग, एक हेडलेस-डिफॉल्ट फिंगरप्रिंट, और आपका अपना एक्सिट आईपी। एंटी-बॉट सिस्टम इन तीनों को एक साथ स्कोर करते हैं।
  • Scrapeless स्क्रैपिंग ब्राउज़र तीनों का उत्तर सर्वर-साइड पर देता है — असली आत्म-विकसित क्रोमियम, बिना webdriver बताने वाला एक सुसंगत प्रति-सेशन फिंगरप्रिंट, और 195+ देशों में आवासीय एग्रेस।
  • आपका Playwright कोड अपरिवर्तित है। page.goto, page.locator, page.evaluate, और वेट्स बिल्कुल उसी तरह व्यवहार करते हैं जैसे कि वे स्थानीय होते हैं; केवल कनेक्शन लाइन स्थानांतरित होती है।
  • विश्वसनीय लाइव: एक connectOverCDP() सत्र ने navigator.webdriver को false के रूप में पढ़ा और Scrapeless क्लाउड ब्राउज़र के माध्यम से लक्षित पृष्ठ का असली शीर्षक लौटाया।
  • शुरू करने के लिए स्वतंत्र। नए Scrapeless खातों में मुफ्त स्क्रैपिंग ब्राउज़र रUNTIME शामिल है — app.scrapeless.com पर साइन अप करें।

परिचय: Playwright को एक ब्राउज़र से कनेक्ट करें जो साफ पढ़ता है

Playwright क्रोमियम, फायरफॉक्स, या वेबकीट को एकल API के माध्यम से चलाता है। अपने स्वयं के मशीन पर क्रोमियम लॉन्च करें और प्रत्येक स्क्रिप्ट उन संकेतों को विरासत में मिलती है जो स्वचालन को स्पष्ट करते हैं: यह खुद को कोड>navigator.webdriver प्रॉपर्टी के माध्यम से घोषित करता है, हेडलेस-डिफॉल्ट फॉन्ट और कैनवस व्यवहार भेजता है, और एक आईपी से बाहर निकलता है जिसे प्रतिष्ठा सेवाएं पहले से पहचानती हैं।

आप इनमें से प्रत्येक को हाथ से पैच कर सकते हैं और फिर पैच करते रह सकते हैं जब क्रोमियम और डिटेक्टर्स आगे बढ़ते हैं। एक छोटा रास्ता है। Playwright किसी भी ब्राउज़र से कनेक्ट करता है जो chromium.connectOverCDP() के माध्यम से एक डेवटूल्स एन्डपोइंट प्रदर्शित करता है, और Scrapeless स्क्रैपिंग ब्राउज़र एक Chrome DevTools प्रोटोकॉल एन्डपोइंट है जो एक वेब-सॉकेट URL के माध्यम से पहुंचा जा सकता है। Playwright को इस पर सेट करें और फिंगरप्रिंट, व्यवहारात्मक सतह, और एक्सिट आईपी सर्वर-साइड स्थानांतरित हो जाते हैं — आपकी स्क्रिप्ट वही रहती है।


आप इसके साथ क्या कर सकते हैं

  • एंटी-बॉट-सुरक्षित साइटों के खिलाफ स्क्रिप्ट चलाएं — क्लाउड ब्राउज़र रेंडर के दौरान चुनौतियों को साफ करता है, इसलिए page.goto सामग्री तक पहुंचता है।
  • सत्र को स्थानीयकरण करेंproxyCountry को पिन करें ताकि एक पृष्ठ उस बाजार में विज़िटर के दृष्टिकोण से हल किया जा सके।
  • एक सुसंगत फिंगरप्रिंट भेजें — एक fingerprint ऑब्जेक्ट पास करें ताकि उपयोगकर्ता एजेंट, प्लेटफ़ॉर्म, स्क्रीन, और टाइमज़ोन समरूप बने रहें।
  • लॉगिन राज्य को बनाए रखें — एक profileId ले जाएं ताकि कुकीज़ और स्थानीय संग्रह रन के बीच जीवित रहें।
  • अपनी मशीन से बढ़ें — सत्र क्लाउड में चलते हैं, आपके लैपटॉप पर नहीं।
  • स्वचालन को समान बनाए रखें — लोकेटर्स, page.evaluate, क्लिक, और ऑटो-वेटिंग अपरिवर्तित हैं।

Scrapeless स्क्रैपिंग ब्राउज़र क्यों

Scrapeless स्क्रैपिंग ब्राउज़र एक अनुकूलन योग्य, एंटी-डिटेक्शन क्लाउड ब्राउज़र है जो वेब क्रॉलर और एआई एजेंटों के लिए डिज़ाइन किया गया है। विशेष रूप से Playwright के लिए, यह लाता है:

  • असल अपने-निर्मित क्रोमियम जो पृष्ठ जावास्क्रिप्ट को ठीक उसी तरह चलाता है जैसे क्रोम, इसलिए SPAs और चुनौतियाँ हल होती हैं।
  • एक सुसंगत प्रति-सेशन फिंगरप्रिंट — कोई navigator.webdriver बताने वाला नहीं, कोई हेडलेस डिफॉल्ट्स लीक करने वाला नहीं।
  • 195+ देशों में आवासीय एग्रेस, प्रति सत्र एक ही proxyCountry मान के साथ चुना जाता है।
  • profileId के माध्यम से सत्र की निरंतरता, ताकि एक पुष्टिकृत प्रवाह अपनी स्थिति बनाए रख सके।
  • एक कनेक्शन सतह — हर विकल्प एक ही वेब-सॉकेट एन्डपोइंट पर एक क्वेरी पैरामीटर है।

मुफ्त योजना पर अपनी API कुंजी प्राप्त करें app.scrapeless.com पर।


पूर्वापेक्षाएँ

  • Node.js 18 या नया
  • playwright-core स्थापित (कोई बंडल किए गए ब्राउज़र की आवश्यकता नहीं — आप एक दूरस्थ से कनेक्ट करते हैं)
  • एक Scrapeless खाता और API कुंजी — app.scrapeless.com पर साइन अप करें

पूर्ण कनेक्शन विवरण Scraping Browser दस्तावेज़ में रहते हैं।


स्थापित करें

playwright-core का उपयोग करें — यह ब्राउज़र डाउनलोड को छोड़ देता है, क्योंकि क्रोमियम क्लाउड में है।

bash Copy
npm install playwright-core
export SCRAPELESS_API_KEY=your_api_token_here   # मुफ्त कुंजी https://app.scrapeless.com पर

कनेक्शन कॉन्फ़िगर करें

एन्डपोइंट wss://browser.scrapeless.com/api/v2/browser है, और हर विकल्प एक क्वेरी पैरामीटर है। एक आवासीय क्षेत्र के लिए proxyCountry को पिन करें।

javascript Copy
import { URLSearchParams } from "node:url";

function scrapelessEndpoint(extra = {}) {
```javascript
const params = new URLSearchParams({
    token: process.env.SCRAPELESS_API_KEY,
    sessionTTL: "180",       // सेकंड
    proxyCountry: "US",
    ...extra,
  });
  return `wss://browser.scrapeless.com/api/v2/browser?${params}`;
}

कनेक्ट करें और चलाएँ

chromium.launch() को chromium.connectOverCDP() के साथ बदलें और इसे एंडपॉइंट दें। इसके बाद जो कुछ भी है वह सामान्य प्लेवाइट है।

javascript Copy
import { chromium } from "playwright-core";
import { URLSearchParams } from "node:url";

const params = new URLSearchParams({
  token: process.env.SCRAPELESS_API_KEY,
  sessionTTL: "180",
  proxyCountry: "US",
});
const endpoint = `wss://browser.scrapeless.com/api/v2/browser?${params}`;

const browser = await chromium.connectOverCDP(endpoint);
const page = await browser.newPage();

await page.goto("https://www.scrapeless.com/en", { waitUntil: "domcontentloaded", timeout: 60000 });
console.log("title:", await page.title());
console.log("navigator.webdriver:", await page.evaluate(() => navigator.webdriver));

await browser.close();

इस स्क्रिप्ट का लाइव रन ने पृष्ठ शीर्षक Effortless Web Scraping Toolkit - Scrapeless और navigator.webdriver: false प्रिंट किया - वही प्लेवाइट API जो आप पहले से उपयोग कर रहे हैं, बादल ब्राउज़र के माध्यम से स्रोतित।

अपने फ्री प्लान पर API की प्राप्त करें: app.scrapeless.com

एक संगत फिंगरप्रिंट भेजें

एक fingerprint ऑब्जेक्ट ब्राउज़र की विज्ञापित पहचान को स्थिर रखता है - उपयोगकर्ता एजेंट, प्लेटफ़ॉर्म, स्क्रीन और टाइमज़ोन सभी सहमत हैं। इसे JSON-कोड करें, URL-कोड करें, और इसे एक और पैरामीटर के रूप में पास करें। W3C WebDriver विनिर्देश आवश्यक करता है कि अनुकूलन विविधता webdriver फ्लैग को उजागर करे; बादल ब्राउज़र इसे नहीं ले जाता, इसलिए आप जो फिंगरप्रिंट भेजते हैं उसके विपरीत कुछ नहीं है।

javascript Copy
const fingerprint = {
  userAgent: "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/126.0.0.0 Safari/537.36",
  platform: "Windows",
  screen: { width: 1920, height: 1080 },
  localization: { languages: ["en-US", "en"], timezone: "America/New_York" },
};
const endpoint = scrapelessEndpoint({ fingerprint: encodeURIComponent(JSON.stringify(fingerprint)) });

स्थानीय प्लेवाइट कहाँ रुकता है

अपनी खुद की क्रोमियम पर प्लेवाइट चलाना खुली, अव्यवस्थित पृष्ठों के लिए ठीक है। समस्या तब शुरू होती है जब लक्ष्य ब्राउज़र का स्कोर करता है: एक चुनौती इंटरस्टेशियल जो डेटा केंद्र IP पर रुकता है, एक पृष्ठ जो हेडलेस डिफॉल्ट्स को फिंगरप्रिंट करता है, या एक लॉगिन दीवार जो विज़िट के दौरान एक स्थिर पहचान चाहती है। प्रत्येक एक फिंगरप्रिंट, व्यवहार या IP समस्या है - ठीक तीन जो बादल ब्राउज़र सर्वर-साइड पर संभालता है। Scrapeless से कनेक्ट करना उन मामलों को एक प्रबंधित सत्र में सौंपता है जबकि आपके लोकेटर और page कॉल समान रहते हैं।


आपको क्या मिलता है

सत्र किसी भी प्लेवाइट सत्र की तरह व्यवहार करता है - लोकेटर, page.goto, page.evaluate, ऑटो-वेटिंग और कूकीज़ सभी काम करते हैं। बादल ब्राउज़र पर चलाने से कुछ ईमानदार अवलोकन:

  • navigator.webdriver false है, इसलिए पहले चेक साइट चलाता है जैसा कि एक असली क्रोम पढ़ता है।
  • connectOverCDP एक सामान्य Browser लौटाता है - newPage, संदर्भ और लोकेटर अपरिवर्तित हैं।
  • एक्सिट IP proxyCountry से मेल खाता है - भू-गेटेड पृष्ठ एक स्थानीय आगंतुक कैसे उन्हें देखता है।
  • जिद्दी पृष्ठों के लिए सत्र को गर्म करें - इस साइट का मुख्य पृष्ठ पहले लोड करें इससे पहले कि संरक्षित पृष्ठ लोड हो, ताकि व्यवहारिक सतह एक सामान्य विज़िट की तरह पढ़े।

निष्कर्ष: वही प्लेवाइट, साफ़ ब्राउज़र

प्लेवाइट यह तय करता है कि क्या करना है; Scrapeless यह तय करता है कि ब्राउज़र साइट के लिए कैसा दिखता है। एक पंक्ति का एकीकरण है - बादल ब्राउज़र के खिलाफ chromium.connectOverCDP() - और आपकी स्क्रिप्ट का बाकी भाग न छेड़ा गया है। proxyCountry को एक आवासीय क्षेत्र पर पिन करें, एक संगत fingerprint पास करें, और प्राधिकृत प्रवाह के लिए profileId का पुन: उपयोग करें। यदि आप उसी बादल ब्राउज़र को पायथन से चलाना चाहते हैं, तो Scrapling उत्पादन-स्क्रैपर गाइड देखें, और Scrapeless मूल्य निर्धारण पृष्ठ पर योजनाओं की तुलना करें।


क्या आप अपने प्लेवाइट स्क्रैपिंग पाइपलाइन बनाने के लिए तैयार हैं?

हमारे समुदाय में शामिल हों, एक मुफ्त योजना प्राप्त करें और उन विकसित विकसकों के साथ कनेक्ट करें जो प्लेवाइट पाइपलाइनों का निर्माण कर रहे हैं: Discord · Telegram

साइन अप करें app.scrapeless.com पर मुफ्त स्क्रैपिंग ब्राउज़र रनटाइम के लिए और connectOverCDP() को उस क्लाउड ब्राउज़र पर निर्देशित करें जिसे आपके लक्ष्य पहचान नहीं सकते।


अक्सर पूछे जाने वाले प्रश्न

प्रश्न: क्या मुझे अपना प्लेयराइट कोड बदलना होगा?
नहीं। आप यह बदलते हैं कि ब्राउज़र कैसे प्राप्त किया जाता है — chromium.connectOverCDP(endpoint) के बजाय chromium.launch()। इसके बाद हर लोकेटर और पृष्ठ कॉल समान होता है।

प्रश्न: playwright या playwright-core?
playwright-core का उपयोग करें। यह ब्राउज़र डाउनलोड को छोड़ देता है क्योंकि आप क्लाउड ब्राउज़र से कनेक्ट करते हैं न कि किसी स्थानीय ब्राउज़र को लॉन्च करते हैं।

प्रश्न: क्या connectOverCDP सभी तीन ब्राउज़र इंजनों का समर्थन करता है?
CDP कनेक्शन क्रोमियम-आधारित है, जो स्क्रैपलेस क्लाउड ब्राउज़र द्वारा प्रदर्शित किया जाता है। chromium.connectOverCDP() को अंत बिंदु पर निर्देशित करें; आपके क्रोमियम-लक्षित स्क्रिप्ट बिना बदले चलेंगे।

प्रश्न: क्या मुझे प्रॉक्सी की आवश्यकता है?
नहीं। आवासीय निकासी अंतर्निहित है - proxyCountry को किसी क्षेत्र या ANY पर सेट करें। इसे कनेक्ट करने के लिए कोई अलग प्रॉक्सी नहीं है।

प्रश्न: क्या प्लेयराइट के साथ वेब स्क्रैपिंग कानूनी है?
सार्वजनिक रूप से उपलब्ध डेटा तक पहुँच सामान्यतः अनुमति प्राप्त है, लेकिन नियम क्षेत्राधिकार और साइट के अनुसार भिन्न होते हैं। लक्ष्य की सेवा की शर्तों की समीक्षा करें, रोबोट निर्देशों का सम्मान करें, और संवेदनशील किसी भी चीज के लिए कानूनी सलाह लें।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची