🎯 कस्टमाइज़ करने योग्य, डिटेक्शन-प्रतिरोधी क्लाउड ब्राउज़र जो स्व-विकसित Chromium द्वारा संचालित है, वेब क्रॉलर और एआई एजेंट्स के लिए डिज़ाइन किया गया। 👉अभी आज़माएं
वापस ब्लॉग पर

क्या है ऑब्स्क्यूरा? AI एजेंटों के लिए रस्ट हेडलेस ब्राउज़र

Ava Wilson
Ava Wilson

Expert in Web Scraping Technologies

10-Jul-2026

TL;DR:

  • Obscura एक ओपन-सोर्स हेडलेस ब्राउज़र इंजन है जो Rust में लिखा गया है, जो V8 के माध्यम से असली JavaScript चलाता है और Chrome DevTools Protocol से बातें करता है — इसलिए Puppeteer और Playwright स्क्रिप्ट्स इसे उसी तरीके से जोड़ती हैं जैसे वे हेडलेस Chrome से जुड़ती हैं।
  • Obscura के प्रकाशित बैंचमार्क प्रति इंस्टेंस लगभग 30 MB मेमोरी रिपोर्ट करते हैं जबकि हेडलेस Chrome के लिए 200+ MB है, एक छोटे बाइनरी और लगभग तुरंत स्टार्ट करने के साथ — यही वजह है कि यह लॉन्च के तुरंत बाद 10,000 GitHub सितारे पार कर गया।
  • आप एकल WebSocket एंडपॉइंट के माध्यम से कनेक्ट करते हैं: obscura serve --port 9222 शुरू करें, फिर puppeteer.connect या Playwright के connectOverCDP को ws://127.0.0.1:9222 पर प्वाइंट करें।
  • इंजन केवल स्क्रैपिंग स्टैक का आधा हिस्सा है। Obscura आपको रेंडरिंग और अंतर्निहित स्टेल्थ देता है, लेकिन आप अभी भी सर्वर चलाते हैं, प्रॉक्सी ईग्रस प्रदान करते हैं, और चुनौती पृष्ठों को स्वयं संभालते हैं — वे हिस्से जो यह तय करते हैं कि अनुरोध बड़े पैमाने पर सफल होते हैं या नहीं।
  • Scrapeless Scraping Browser उस ऑपरेशनल आधे को कवर करता है: वही Puppeteer connect कार्यप्रवाह, लेकिन सेशन एक प्रबंधित क्लाउड ब्राउज़र से आता है जिसमें 195+ देशों में आवासीय प्रॉक्सियाँ और अंतर्निहित एंटी-डिटेक्शन होता है — कोई सर्वर चलाने की आवश्यकता नहीं।
  • शुरुआत करने के लिए मुफ्त। नए Scrapeless खाते में मुफ्त Scraping Browser रनटाइम शामिल है — app.scrapeless.com पर साइन अप करें।

परिचय: एक हेडलेस ब्राउज़र जो हर एजेंट को अपना खुद का देने के लिए छोटा है

AI एजेंट और स्क्रैपिंग पाइपलाइनों अब ब्राउज़र को उसी तरह स्पिन करते हैं जैसे पहले के सिस्टम थ्रेड्स को स्पिन करते थे — एक बार में दर्जनों या सैकड़ों, प्रत्येक एक उपयोगी डेटा के एक भी बाइट के वापस आने से पहले JavaScript रेंडर करता है। हेडलेस Chrome कभी उस कार्यभार के आकार के लिए डिज़ाइन नहीं किया गया था: प्रत्येक इंस्टेंस एक डेस्कटॉप ब्राउज़र का मेमोरी फुटप्रिंट उठाता है, और उनकी बेड़े जल्दी महंगे हो जाते हैं।

Obscura उस असमानता का एक नया उत्तर है। यह एक हेडलेस ब्राउज़र इंजन है जो Rust में लिखा गया है जो असली JavaScript को V8 इंजन के माध्यम से निष्पादित करता है और Chrome DevTools Protocol को उजागर करता है, जो इसे Puppeteer और Playwright स्क्रिप्टों के लिए एक ड्रॉप-इन लक्ष्य बनाता है जो टीमें पहले से ही हैं। यह प्रोजेक्ट Apache-2.0 लाइसेंस के तहत ओपन-सोर्स है और लॉन्च के तुरंत बाद 10,000 GitHub सितारे पार कर गया।

यह गाइड बताता है कि Obscura क्या है, इसे कैसे स्थापित करें, Puppeteer और Playwright को इससे कैसे जोड़ा जाए, और — इसे जानना उतना ही महत्वपूर्ण है — एक स्वयं-होस्टेड इंजन कब खत्म होता है और एक प्रबंधित क्लाउड ब्राउज़र कब संभालता है।

Obscura क्या है?

Obscura एक हल्का, ओपन-सोर्स हेडलेस ब्राउज़र इंजन है जो Rust में वेब स्क्रैपिंग और AI-एजेंट स्वचालन के लिए बनाया गया है। पूरी डेस्कटॉप ब्राउज़र को एम्बेड करने के बजाय, यह वास्तव में उपयोग में आने वाले रेंडरिंग और प्रोटोकॉल सतह स्वचालन का कार्यान्वयन करता है: एक JavaScript रनटाइम (V8), पृष्ठ लोड करना, DOM पहुंच, और रिमोट कंट्रोल के लिए Chrome DevTools Protocol।

तीन डिज़ाइन विकल्प इसे परिभाषित करते हैं:

  • Rust कोर, V8 कार्यान्वयन। इंजन स्वयं स्वदेशी Rust है; पृष्ठ का JavaScript V8 में चलता है, इसलिए क्लाइंट-रेंडर किए गए साइटें Chrome की तरह व्यवहार करते हैं न कि एक JS-रहित HTTP क्लाइंट की तरह।
  • CDP के अनुकूलता। चूंकि Obscura DevTools Protocol से बातें करता है, इसलिए मौजूदा Puppeteer और Playwright कोड इसे बिना री-राइट के लक्षित करता है — आप कनेक्शन लाइन को बदलते हैं, स्क्रिप्ट नहीं।
  • स्वचालन-प्रथम फुटप्रिंट। प्रोजेक्ट के प्रकाशित बैंचमार्क रिपोर्ट के अनुसार प्रति इंस्टेंस लगभग 30 MB मेमोरी बनाम हेडलेस Chrome के लिए 200+ MB, ~70 MB बाइनरी बनाम 300+ MB, और पृष्ठ लोड और स्टार्टअप समय मिलीसेकंड में मापे जाते हैं, न कि सेकंड में। ये प्रोजेक्ट के अपने आंकड़े हैं — ईमानदार टेकअवे यह है कि यह माप का क्रम है, जो महत्वपूर्ण है जब आप प्रति-एजेंट के बजाय प्रति-मशीन ब्राउज़र चलाते हैं।

Obscura अंतर्निहित एंटी-डिटेक्शन व्यवहार प्रदान करता है न कि एक प्लगइन के रूप में, जो हेडलेस Chrome में नहीं होता। टीम एक होस्टेड संस्करण, Obscura Cloud, बना रही है, जो प्रकाशन के समय केवल वेटलिस्ट-केवल है — इसलिए आज Obscura चलाना इसका स्वयं-होस्टेड होना है।

Obscura स्थापित करें

प्रीबिल्ट बाइनरीज़ लिनक्स (x86_64 और aarch64), macOS, और Windows के लिए हैं। लिनक्स x86_64 पर:

bash Copy
# नवीनतम रिलीज़ तारबाल डाउनलोड करें और अनपैक करें
curl -LO https://github.com/h4ckf0r0day/obscura/releases/latest/download/obscura-x86_64-linux.tar.gz
tar xzf obscura-x86_64-linux.tar.gz

# संग्रह में दो बाइनरी हैं जो एक ही निर्देशिका में रहनी चाहिए:
# obscura (CLI/सेवा) और obscura-worker (रेंडर प्रोसेस)
./obscura --version

लिनक्स निर्माणों को glibc 2.35 या नए की आवश्यकता होती है (Ubuntu 22.04+)। यदि आप कंटेनरों को प्राथमिकता देते हैं, तो आधिकारिक छवि एक डिस्ट्रोलैस निर्माण है जो लगभग 57 MB संकुचित है:

bash Copy
docker run -d --name obscura -p 127.0.0.1:9222:9222 h4ckf0r0day/obscura

एक त्वरित स्मोक टेस्ट जो पूरे रेंडर पथ का परीक्षण करता है - एक पृष्ठ लाएं और इसके खिलाफ जावास्क्रिप्ट का मूल्यांकन करें:

bash Copy
./obscura fetch https://example.com --eval "document.title"
# "Example Domain"

Puppeteer या Playwright से कनेक्ट करें

Obscura को एक CDP सर्वर के रूप में शुरू करें:

bash Copy
obscura serve --port 9222

यह ws://127.0.0.1:9222 पर सुनता है। Puppeteer से, puppeteer-core स्थापित करें (सिर्फ कनेक्ट-केवल पैकेज - आपको बंडल की गई Chromium डाउनलोड नहीं चाहिए) और कनेक्ट करें:

js Copy
import puppeteer from 'puppeteer-core';

const browser = await puppeteer.connect({
  browserWSEndpoint: 'ws://127.0.0.1:9222',
});

const page = await browser.newPage();
await page.goto('https://example.com');
console.log(await page.title());

await browser.disconnect();

Playwright से, समकक्ष connectOverCDP है। यह अंतर महत्वपूर्ण है: Playwright का connectOverCDP DevTools प्रोटोकॉल से बात करता है, जबकि साधारण connect Playwright के अपने प्रोटोकॉल से बात करता है, जिसे Obscura लागू नहीं करता।

js Copy
import { chromium } from 'playwright';

const browser = await chromium.connectOverCDP('ws://127.0.0.1:9222');
const context = browser.contexts()[0] || await browser.newContext();
const page = await context.newPage();

await page.goto('https://example.com');
console.log(await page.title());

await browser.close();

यह पूरी एकीकरण है। page.goto, चयनकर्ताओं और page.evaluate पर आधारित कोई भी स्क्रिप्ट अब एक ऐसे ब्राउज़र इंजन के खिलाफ चलती है जो उसके लिए लिखे गए एक क्रम के हल्के होते हैं।

आप अपनी API कुंजी मुफ्त योजना पर प्राप्त कर सकते हैं: app.scrapeless.com

जहां Obscura रुकता है

Obscura इंजन की समस्या का समाधान करता है - सस्ते, सामूहिक पैमाने पर, और अविश्वसनीय विशेषताओं के साथ जावास्क्रिप्ट को रेंडर करना। यह जानबूझकर संचालन की समस्या का समाधान नहीं करता है, और उत्पादन स्क्रैपिंग के लिए संचालन की समस्या आमतौर पर कठिन होती है:

  • आप बुनियादी ढांचा चलाते हैं। Obscura एक बाइनरी (या कंटेनर) है जिसे आप तैनात, मॉनिटर, पैच और स्केल करते हैं। सौ समवर्ती सत्र का मतलब है क्षमता की योजना बनाना और एक ऑर्केस्ट्रेशन परत जो आपके पास है।
  • ईग्रेस आपका है। हर अनुरोध आपके सर्वर के IP से बाहर जाता है। जो साइटें दर-सीमा या डेटा केंद्र रेंज को अवरोधित करती हैं वे इसे इस परवाह के बिना करेंगी कि ब्राउज़र की उंगली कितनी विश्वसनीय है - Obscura का अपना पारिस्थितिकी तंत्र उपयोगकर्ताओं को इस कारण से थर्ड-पार्टी प्रॉक्सी प्रदाताओं की ओर संकेत करता है। आवासीय ईग्रेस को घुमाना एक अलग उत्पाद है जिसे आपको खरीदना और जोड़ना होगा।
  • चुनौती पृष्ठ आपकी समस्या है। एक गुप्त इंजन ट्रैफ़िक-मान्यता इंटर्स्टिशल्स के होने की आवृत्ति को कम करता है; यह उन लोगों को हल नहीं करता जो करते हैं। उन्हें संभालने का मतलब है अतिरिक्त उपकरण और प्रति-साइट कार्य।
  • प्रबंधित विकल्प अभी शिपिंग नहीं हो रहा है। Obscura क्लाउड - प्रबंधित बुनियादी ढांचे और आवासीय प्रॉक्सी के साथ होस्ट की गई संस्करण - प्रकाशन के समय प्रतीक्षा सूची-केवल है। आज, Obscura को अपनाने का मतलब उपरोक्त सभी को अपनाना है।

इसमें से कोई भी आलोचना नहीं है; यह एक स्वयं-होस्टेड इंजन का मानक आकार है। इसका मतलब यह है कि तुलना करने योग्य बात यह नहीं है "Obscura बनाम हेडलेस क्रोम" - Obscura इस पर आराम से जीतता है - बल्कि "स्वयं-होस्टेड इंजन बनाम प्रबंधित क्लाउड ब्राउज़र" है।

प्रबंधित पथ: Scrapeless Scraping Browser

Scrapeless Scraping Browser एक अनुकूलन योग्य, एंटी-डिटेक्शन क्लाउड ब्राउज़र है जो वेब क्रॉलर्स और एआई एजेंटों के लिए डिज़ाइन किया गया है। यह आपकी कोड में उस ही स्लॉट पर कब्जा करता है जो Obscura करता है - एक CDP एपिंट जिसे Puppeteer कनेक्ट करता है - लेकिन सत्र Scrapeless के क्लाउड में बनाया गया है जिसमें संचालन का आधा हिस्सा पहले से संभाला गया है:

  • 195+ देशों में आवासीय प्रॉक्सी, प्रति सत्र proxy_country पैरामीटर के साथ चुने गए - कोई अलग प्रॉक्सी अनुबंध नहीं।
  • एंटी-डिटेक्शन ब्राउज़र बुनियादी ढाँचे पर क्लाउड-साइड जावास्क्रिप्ट रेंडरिंग।
  • लोगिन-गेटेड और बहु-चरण प्रवाह के लिए सत्र की स्थिरता।
  • चलाने के लिए कोई सर्वर नहीं - सत्र API द्वारा बनाए गए हैं और आपकी सेट की गई TTL पर समाप्त होते हैं।

कार्यप्रवाह बिल्कुल Obscura वाले की तरह है: Scrapeless SDK एक सत्र बनाता है, और Puppeteer उस WebSocket अंत बिंदु से कनेक्ट करता है जिसे यह वापस करता है:

js Copy
import { Scrapeless } from '@scrapeless-ai/sdk';
import puppeteer from 'puppeteer-core';

const client = new Scrapeless({ apiKey: process.env.SCRAPELESS_API_KEY });

// US आवासीय ईग्रेस के साथ एक क्लाउड ब्राउज़र सत्र बनाना
const session = await client.browser.create({
  session_name: 'obscura-guide-demo',
  session_ttl: 180,
  proxy_country: 'US',
});

// वही कनेक्ट कॉल जिसका आपने Obscura के लिए उपयोग किया था - केवल अंत बिंदु बदलता है
const browser = await puppeteer.connect({
  browserWSEndpoint: session.browserWSEndpoint,
  defaultViewport: null,
});

const page = await browser.newPage();

Here is the translation of the provided text into Hindi:

hi Copy
पृष्ठ.goto('https://example.com', { waitUntil: 'domcontentloaded' });
console.log(await page.title()); // "Example Domain"

await browser.close();

क्योंकि दोनों पक्ष सामान्य सीडीपी हैं, इसलिए दोनों स्वाभाविक रूप सेCompose होते हैं: ऑब्स्क्यूरा उन साइटों के लिए उच्च-परिवर्तनशील रेंडरिंग के लिए जो ऑटोमेशन का विरोध नहीं करती हैं, जबकि स्क्रेपलेस स्क्रेपिंग ब्राउज़र उन लक्ष्यों के लिए जहां निकासी गुणवत्ता और चुनौती प्रबंधन परिणाम का निर्धारण करते हैं। पेपराजिंग उपयोग पर आधारित है, और मुफ्त योजना इस गाइड में सब कुछ चलाने के लिए पर्याप्त है। इस पारिस्थितिकी तंत्र में प्रॉक्सी वायरिंग पर एक गहरी नज़र के लिए, प्यूपेटियर अनडिटेक्टेड फिंगरप्रिंट ब्राउज़र गाइड उसी सत्र-निर्माण कार्यप्रवाह को दिखाता है जो पहचान-गहन लक्ष्यों की ओर इंगित करता है।

कैसे चुनें

आयाम ऑब्स्क्यूरा (स्वयं-होस्टेड) स्क्रेपलेस स्क्रेपिंग ब्राउज़र (प्रबंधित)
सेटअप बाइनरी डाउनलोड करें / कंटेनर चलाएं एपीआई कॉल सत्र लौटाता है
लागत मॉडल आपका कंप्यूट + आपके प्रॉक्सी उपयोग आधारित योजना
निकासी अपना खुद का लाएं आवासीय, 195+ देश, प्रति सत्र
पैमाना आप उदाहरणों का संचालन करते हैं ऑन-डिमांड सत्र
चुनौती वाले पृष्ठ आपके उपकरण प्लेटफार्म द्वारा निपटाया गया
सर्वोत्तम फिट सहकारी साइटों का उच्च-परिवर्तनशील रेंडरिंग; आपकी स्वयं की अवसंरचना पर एजेंट बेड़े संरक्षित लक्ष्य, भू-विशिष्ट डेटा, बिना खर्च के टीमें

यदि आपका कार्यभार उन साइटों के हजारों हल्के रेंडर हैं जो विरोध नहीं करती हैं, तो ऑब्स्क्यूरा का पदचिह्न एक वास्तविक लाभ है और स्वयं-होस्टिंग की लागत कम है। यदि आपके आवश्यक डेटा की पहुँच दर सीमाओं, भू-दीवारों या ट्रैफ़िक सत्यापन के पीछे है, तो इंजन कभी भी बाधा नहीं था — सत्र की गुणवत्ता थी, और यही प्रबंधित पक्ष का कार्य है।

निष्कर्ष: इंजन और संचालन

ऑब्स्क्यूरा एक वास्तविक इंजीनियरिंग उपलब्धि है: एक रस्ट हेडलेस ब्राउज़र जिसमें वी8 निष्पादन और सीडीपी संगतता है जो प्रति-एजेंट ब्राउज़र को आर्थिक रूप से स्वस्थ बनाती है, यह अपाचे-2.0 के तहत ओपन-सोर्स है। इसे इंस्टॉल करें, 'puppeteer-core' को 'ws://127.0.0.1:9222' की ओर इशारा करें, और मौजूदा ऑटोमेशन बस काम करता है — यह वादा का भाग सच होता है।

इसे इंजन परत के रूप में मानें, और स्पष्ट रूप से समझें कि उत्पादन स्क्रेपिंग में संचालन की परत भी होती है: प्रॉक्सी निकासी, चुनौती प्रबंधन, और बेड़े अवसंरचना। स्क्रेपलेस स्क्रेपिंग ब्राउज़र इस परत को समान 'puppeteer.connect' कार्यप्रवाह के माध्यम से प्रदान करता है, इसलिए दोनों आसान संयोजन हैं न कि कठिन विकल्प — जहाँ आप कर सकते हैं वहाँ सस्ता रेंडर करें, और जहाँ लक्ष्य इसकी मांग करता है वहाँ क्लाउड ब्राउज़र के माध्यम से रूट करें।


क्या आप अपने एआई-पावर्ड डेटा पाइपलाइन बनाने के लिए तैयार हैं?

हमारे समुदाय में शामिल हों और ब्राउज़र-ऑटोमेशन पाइपलाइनों का निर्माण करने वाले डेवलपर्स से जुड़ें: डिस्कॉर्ड · टेलीग्राम

app.scrapeless.com पर साइन अप करें और जहां आपके लक्ष्य वापस धकेलते हैं वहां इसे ऊपर दिए गए पैटर्न के साथ जोड़ें।

सामान्य प्रश्न

प्रश्न: क्या ऑब्स्क्यूरा क्रोमियम की एक शाखा है?
नहीं। ऑब्स्क्यूरा एक स्वतंत्र हेडलेस ब्राउज़र इंजन है जो रस्ट में लिखा गया है। यह JavaScript निष्पादन के लिए V8 को एम्बेड करता है और संगतता के लिए क्रोम डेवलपर टूल प्रोटोकॉल को लागू करता है, लेकिन स्वयं इंजन क्रोमियम नहीं है।

प्रश्न: क्या मेरा मौजूदा प्यूपेटियर या प्ले राइट कोड ऑब्स्क्यूरा के साथ काम करता है?
प्रमुख रूप से हाँ, क्योंकि एकीकरण سطح सीडीपी है। प्यूपेटियर 'puppeteer.connect({ browserWSEndpoint })' के माध्यम से जड़ता है 'puppeteer-core'; प्ले राइट को 'connectOverCDP' का उपयोग करना होगा, 'connect' नहीं, क्योंकि ऑब्स्क्यूरा प्ले राइट के स्वदेशी प्रोटोकॉल को लागू नहीं करता। एक युवा इंजन के रूप में, विशेषताओं की कवरेज अभी भी परिपक्व हो रही है — अपने विशेष स्क्रिप्ट का परीक्षण करें न कि क्रोम के साथ पूर्ण समानता का अनुमान लगाएं।

प्रश्न: क्या ऑब्स्क्यूरा का उपयोग करना मुफ्त है?
हाँ। इंजन अपाचे-2.0 लाइसेंस के तहत ओपन-सोर्स है जिसमें कोई फीचर गेटिंग नहीं है। होस्टेड ऑब्स्क्यूरा क्लाउड ऑफ़र एक अलग, वेटलिस्ट-केवल उत्पाद है।

प्रश्न: क्या मुझे अभी भी प्रॉक्सी की आवश्यकता है यदि ऑब्स्क्यूरा में एंटी-डिटेक्शन बनाया गया है?
हाँ, किसी भी साइट के लिए जो आईपी द्वारा फ़िल्टर करती है। फिंगरप्रिंट स्टेल्थ और निकासी की गुणवत्ता स्वतंत्र समस्याएँ हैं: एक विश्वसनीय ब्राउज़र पहचान मदद नहीं करता जब अनुरोध एक फ्लैग्ड पते रेंज से आता है। स्वयं-होस्टेड ऑब्स्क्यूरा निकासी को आपके लिए छोड़ देता है; स्क्रेपलेस स्क्रेपिंग ब्राउज़र प्रति सत्र 195+ देशों में आवासीय प्रॉक्सियों को शामिल करता है।

प्रश्न: क्या ऑब्स्क्यूरा और स्क्रेपलेस स्क्रेपिंग ब्राउज़र को एक ही परियोजना में उपयोग किया जा सकता है?

Copy
हाँ, और यह एक स्वाभाविक विभाजन है। दोनों CDP एंडपॉइंट्स को उजागर करते हैं, इसलिए एक Puppeteer कोडबेस सहयोगात्मक, उच्च मात्रा वाले लक्ष्यों को एक स्थानीय Obscura इंस्टेंस और सुरक्षित या भौगोलिक-विशिष्ट लक्ष्यों को एक Scrapeless क्लाउड सत्र में रूट कर सकता है - प्रत्येक लक्ष्य में एकमात्र अंतर यह है कि स्क्रिप्ट किस WebSocket एंडपॉइंट से जुड़ती है।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची