🎯 कस्टमाइज़ करने योग्य, डिटेक्शन-प्रतिरोधी क्लाउड ब्राउज़र जो स्व-विकसित Chromium द्वारा संचालित है, वेब क्रॉलर और एआई एजेंट्स के लिए डिज़ाइन किया गया। 👉अभी आज़माएं
वापस ब्लॉग पर

ब्राउज़र उपयोग + स्क्रेपलेस: एआई एजेंटों के लिए एक अप्रयुक्त क्लाउड ब्राउज़र

Alex Johnson
Alex Johnson

Senior Web Scraping Engineer

08-Jul-2026

TL;DR:

  • ब्राउज़र का उपयोग एक ब्राउज़र को LLM के साथ संचालित करता है; स्क्रैपलेस उस ब्राउज़र को एक साफ पहचान देता है। एजेंट के cdp_url को स्क्रैपलेस क्लाउड ब्राउज़र पर इंगित करें और यह वास्तविक क्रोमियम, एक सुसंगत फिंगरप्रिंट, और आवासीय निकासी पर चलता है — आपका एजेंट कोड अपरिवर्तित रहता है।
  • स्थानीय ब्राउज़र तीन धुरियों पर स्वचालन लीक करता है: navigator.webdriver का संकेत, हेडलेस-डिफ़ॉल्ट फिंगरप्रिंट, और आपका अपना निकासी आईपी। एंटी-बॉट सिस्टम सभी तीनों को एक साथ स्कोर करते हैं।
  • एक लाइन में एकीकरण — कनेक्शन URL। अपने टोकन के साथ wss://browser.scrapeless.com/api/v2/browser बनाएं और इसे Browser(cdp_url=...) को सौंपें।
  • सुविधा से एजेंट को जीते हुए देखें स्क्रैपलेस डैशबोर्ड में सत्र URL से, जब यह तर्क करता है और क्लिक करता है।
  • सत्यापित लाइव: एक एजेंट ने CDP के माध्यम से कनेक्ट किया, सात चरणों को चलाया, और स्क्रैपलेस क्लाउड ब्राउज़र के माध्यम से लक्षित पृष्ठ के शीर्षक को वापस किया।
  • शुरू करने के लिए मुफ़्त। नए स्क्रैपलेस खातों में मुफ़्त स्क्रैपिंग ब्राउज़र रनटाइम शामिल है — app.scrapeless.com पर साइन अप करें।

परिचय: अपने एजेंट को एक ऐसा ब्राउज़र दें जो साफ पढ़ता है

ब्राउज़र उपयोग एक भाषा मॉडल को एक असली ब्राउज़र संचालित करने की अनुमति देता है — यह चरणों का निर्णय करता है, तत्वों पर क्लिक करता है, और पृष्ठ को पढ़ता है। इसे एक स्थानीय क्रोम के खिलाफ चलाएँ और एजेंट स्वचालन को स्पष्ट बनाने वाली हर चीज को विरासत में लेता है: यह the navigator.webdriver property के माध्यम से खुद की घोषणा करता है, हेडलेस-डिफ़ॉल्ट फ़ॉन्ट और कैनवास व्यवहार वितरित करता है, और एक आईपी प्रतिष्ठा सेवा से बाहर निकलता है जिसे पहले से ही ज्ञात है।

स्थानीय रूप से इसे ठीक करने का अर्थ है कि क्रोमियम और एंटी-बॉटों के परिवर्तन के रूप में स्टेल्थ पैच को बनाए रखना। ब्राउज़र उपयोग किसी भी CDP-भाषी ब्राउज़र से cdp_url के माध्यम से कनेक्ट होता है, और स्क्रैपलेस स्क्रैपिंग ब्राउज़र एक CDP-भाषी ब्राउज़र है जो एक वेब्सॉकेट एंडपॉइंट के माध्यम से पहुँचा जाता है। इसलिए एजेंट का रनटाइम, फिंगरप्रिंट, और निकासी आईपी सर्वर-साइड चलता है, और आपका कोड केवल ब्राउज़र के स्रोत कहां से आता है, यह बदलता है।


आप इसके साथ क्या कर सकते हैं

  • एंटी-बॉट-सुरक्षित साइटों पर एजेंट कार्य चलाएँ — क्लाउड ब्राउज़र रेंडर के दौरान चुनौतियों को साफ करता है।
  • व्यवहार का स्थानीयकरण करेंproxyCountry को स्थापित करें ताकि एजेंट एक पृष्ठ को ऐसे देख सके जैसे वह उस बाजार में एक आगंतुक होगा।
  • अपने मशीन से परे स्केल करें — सत्र क्लाउड में चलते हैं, आपके लैपटॉप पर नहीं।
  • एजेंट कोड को समान रखें — केवल ब्राउज़र का स्रोत बदलें; एजेंट, कार्य, और LLM वही रहते हैं।
  • जीवित देखें और डिबग करें — स्क्रैपलेस डैशबोर्ड चल रहे सत्र को स्ट्रीम करता है।

स्क्रैपलेस स्क्रैपिंग ब्राउज़र क्यों

स्क्रैपलेस स्क्रैपिंग ब्राउज़र एक अनुकूलन योग्य, एंटी-डिटेक्शन क्लाउड ब्राउज़र है जिसे वेब क्रॉलर्स और एआई एजेंटों के लिए डिजाइन किया गया है। विशेष रूप से ब्राउज़र उपयोग के लिए, यह लाता है:

  • वास्तविक स्व-विकसित क्रोमियम जो JavaScript को बिल्कुल Chrome की तरह चलाता है, ताकि SPAs और चुनौतियाँ हल हो सकें।
  • प्रत्येक सत्र में सुसंगत फिंगरप्रिंट — कोई navigator.webdriver संकेत, कोई हेडलेस डिफ़ॉल्ट नहीं।
  • 195+ देशों में आवासीय निकासी, जो एक proxyCountry मान के साथ सत्र के अनुसार चुनी जाती है।
  • एकल CDP सतह — प्रत्येक विकल्प एक ही वेब्सॉकेट एंडपॉइंट पर एक क्वेरी पैरामीटर है।

app.scrapeless.com पर मुफ़्त योजना पर अपना API कुंजी प्राप्त करें।


पूर्वापेक्षाएँ

  • Python 3.11 या नया (ब्राउज़र उपयोग के लिए 3.11+ आवश्यक है)
  • एजेंट के भाषा मॉडल के लिए एक OpenAI API कुंजी
  • एक स्क्रैपलेस खाता और API कुंजी — app.scrapeless.com पर साइन अप करें

पूर्ण कनेक्शन विवरण स्क्रैपिंग ब्राउज़र प्रलेखन में उपलब्ध हैं।


इंस्टॉल

bash Copy
pip install browser-use

लंबे कार्यों पर एजेंट मेमोरी के लिए (Python < 3.13):

bash Copy
pip install "browser-use[memory]"

अपने एजेंट को क्लाउड ब्राउज़र से कनेक्ट करें

स्क्रैपलेस वेब्सॉकेट URL बनाएं और इसे Browser(cdp_url=...) को सौंपें। navigator.webdriver एक संकेत है कि W3C WebDriver विनिर्देश आवश्यक रूप से अनुपालन करने वाले ड्राइवरों को सेट करता है — क्लाउड ब्राउज़र इसे नहीं ले जाता है।

python Copy
import os
from urllib.parse import urlencode
from browser_use import Browser

def scrapeless_browser() -> Browser:
    params = {
        "token": os.environ["SCRAPELESS_API_KEY"],
        "sessionTTL": 900,
        "proxyCountry": "ANY",
    }
    ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
    return Browser(cdp_url=ws)

एजेंट चलाएँ

ब्राउज़र उपयोग क्लाउड ब्राउज़र से Chrome डेवलपर्स प्रोटोकॉल के माध्यम से कनेक्ट करता है, इसलिए एजेंट ठीक उसी तरह चलता है जैसे यह स्थानीय रूप से होगा।

नोट: इसे चलाने के लिए एक लाइव Scrapeless सत्र और agent.run() के लिए एक OpenAI API कुंजी की आवश्यकता है। इसे निष्पादित करने के लिए दोनों प्रस्तुत करें।

python Copy
import os
import asyncio
from urllib.parse import urlencode
from dotenv import load_dotenv
from browser_use import Agent, Browser, ChatOpenAI

def scrapeless_browser() -> Browser:
    params = {"token": os.environ["SCRAPELESS_API_KEY"], "sessionTTL": 900, "proxyCountry": "ANY"}
    ws = f"wss://browser.scrapeless.com/api/v2/browser?{urlencode(params)}"
    return Browser(cdp_url=ws)

async def main():
    load_dotenv()
    browser = scrapeless_browser()
    await browser.start()

    agent = Agent(
        task="Google पर जाएं, 'Scrapeless' के लिए खोजें, पहले परिणाम को खोलें और उसका शीर्षक लौटाएं",
        llm=ChatOpenAI(model="gpt-4o"),
        browser=browser,
    )
    print(await agent.run())
    await browser.kill()

asyncio.run(main())

आपको क्या प्राप्त होगा

एक लाइव रन में एजेंट cdp_url पर कनेक्ट हुआ, सात चरणों का संचालन किया, और लक्ष्य पृष्ठ का शीर्षक - बिजनेस और डेवलपर्स के लिए effortless वेब स्क्रैपिंग टूलकिट - Scrapeless क्लाउड ब्राउज़र के माध्यम से लौटाया। कुछ ईमानदार अवलोकन:

  • navigator.webdriver संकेत अनुपस्थित है, इसलिए पहले जांच जो एक साइट चलाती है, असली Chrome की तरह लगती है।
  • बाहर निकलने वाला IP proxyCountry से मेल खाता है - भू-गेटेड पृष्ठ स्थानीय आगंतुक द्वारा देखे गए रूप में हल होते हैं।
  • एजेंट अनुकूलन करता है - जब एक खोज पथ में चुनौती दिखाई देती है, एक LLM-निर्देशित एजेंट उसके चारों ओर मार्गदर्शन कर सकता है और अभी भी लक्ष्य तक पहुँच सकता है, क्योंकि यह पृष्ठ के बारे में तर्क करता है न कि एक निश्चित स्क्रिप्ट का पालन करता है।
  • स्मृति वैकल्पिक है - Agent पर enable_memory=True के साथ लंबी मल्टी-स्टेप कार्यों के लिए इसे सक्षम करें।

निष्कर्ष: वही एजेंट, साफ़ ब्राउज़र

Browser Use यह तय करता है कि क्या करना है; Scrapeless यह तय करता है कि ब्राउज़र साइट के लिए कैसा दिखता है। एकल कनेक्शन URL के साथ एकीकृत किया गया है - अपने टोकन के साथ wss://browser.scrapeless.com/api/v2/browser बनाएं, इसे Browser(cdp_url=...) को सौंपें, और अपने एजेंट को बिना बदले चलाएं। एक ही क्लाउड ब्राउज़र से एक से अधिक Python टूल को कनेक्ट करने के लिए, undetected-fingerprint गाइड देखें, और Scrapeless मूल्य निर्धारण पृष्ठ पर योजनाओं की तुलना करें।


क्या आप अपना AI-एजेंट स्क्रैपिंग पाइपलाइन बनाने के लिए तैयार हैं?

हमारी समुदाय में शामिल हों, एक मुफ्त योजना प्राप्त करें और एजेंट पाइपलाइनों का निर्माण कर रहे डेवलपर्स के साथ जुड़ें: Discord · Telegram.

app.scrapeless.com पर मुफ्त Scraping Browser रनटाइम के लिए साइन अप करें और अपने Browser Use एजेंट को उस क्लाउड ब्राउज़र की ओर निर्देशित करें जिसे आपके लक्ष्य फ़िंगरप्रिंट नहीं कर सकते।


सामान्य प्रश्न

प्रश्न: क्या मुझे अपने Browser Use एजेंट कोड में परिवर्तन करना होगा?
नहीं। आप यह बदलते हैं कि ब्राउज़र कहां से आया है - Browser(cdp_url=<scrapeless url>) के लिए एक स्थानीय लॉन्च के साथ स्वैप करें। Agent, कार्य, और LLM समान हैं।

प्रश्न: केवल स्थानीय Chrome क्यों नहीं चलाएं?
स्थानीय Chrome आपके IP पर चलता है, navigator.webdriver के माध्यम से स्वचालन की घोषणा करता है, और आपको स्टील्थ पैच बनाए रखने की आवश्यकता होती है। Scrapeless एक प्रबंधित क्लाउड ब्राउज़र है जिसमें बंडल किया गया निवास egress और एक सुसंगत फिंगरप्रिंट है - वही API, रखरखाव की कोई आवश्यकता नहीं।

प्रश्न: क्या मुझे प्रॉक्सी की आवश्यकता है?
नहीं। निवास egress एकीकृत है - proxyCountry को एक क्षेत्र या ANY पर सेट करें।

प्रश्न: मुझे कौन सा Python संस्करण चाहिए?
Browser Use को Python 3.11 या नए की आवश्यकता है; एजेंट मेमोरी को अतिरिक्त रूप से Python 3.13 से नीचे चाहिए।

प्रश्न: क्या मैं एजेंट को चलते हुए देख सकता हूँ?
हाँ - Scrapeless डैशबोर्ड लाइव सत्र को स्ट्रीम करता है जबकि एजेंट तर्क करता है और क्लिक करता है।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची