वापस ब्लॉग पर

वेब स्क्रैपिंग को गूगल एंटीग्रेविटी में कैसे जोड़ें: Scrapeless MCP इंटीग्रेशन गाइड

Alex Johnson
Alex Johnson

Senior Web Scraping Engineer

19-May-2026

मुख्य निष्कर्ष:

  • एक कॉन्फ़िग ब्लॉक पूरी एकीकरण है। Google Antigravity Model Context Protocol का समर्थन करता है। ~/.gemini/antigravity/mcp_config.json में एकल scrapeless ब्लॉक डालें और एजेंट को एक मजबूत क्लाउड ब्राउजर, 195+ देशों में रेसीडेंशियल प्रॉक्सी, एक Google SERP स्क्रैपर, एक Google Trends स्क्रैपर, और HTML/Markdown/Screenshot पृष्ठ सहायकों द्वारा सुसज्जित किया जाता है — सभी Antigravity चैट पैनल के अंदर @-उल्लेख या प्राकृतिक भाषा के संकेतों के माध्यम से पहुंचा जा सकता है।
  • एजेंट को ब्लॉक नहीं किया जाता। Antigravity मजबूत कोडिंग उपकरण प्रदान करता है लेकिन बिना किसी प्रबलित स्क्रैपिंग सतह के बाहर नहीं आता। ऐसे साइटों के लिए जिनमें महत्वपूर्ण एंटी-बॉट सुरक्षा (Cloudflare Turnstile, Akamai Bot Manager, IP-प्रतिष्ठा सूचियाँ), केवल JavaScript SPAs, या भू-बद्ध लिस्टिंग हैं, क्लाउड ब्राउजर वह है जो उपयोगी प्रतिक्रिया के लिए अनुरोध को ले जाता है। Scrapeless Scraping Browser के माध्यम से राउटिंग क्लाउड-पक्ष JavaScript रेंडरिंग, रेसीडेंशियल-प्रॉक्सी निकास, और हर सत्र पर एंटी-डिटेक्शन फिंगरप्रिंटिंग को स्वैप करता है।
  • 15+ MCP टूल, एक नामस्थान। ब्राउजर प्राइमिटिव्स (browser_create, browser_goto, browser_get_html, browser_get_text, browser_click, browser_type, browser_press_key, browser_scroll, browser_screenshot, browser_snapshot, browser_close), एक-बार के पृष्ठ सहायकों (scrape_html, scrape_markdown, scrape_screenshot), और Google डेटा टूल्स (google_search, google_trends)। एजेंट का योजनाकार अपनी ज़रूरत के अनुसार उन्हें क्रमशः बनाता है।
  • Stdio डिफ़ॉल्ट है; HTTP स्ट्रीम करने योग्य क्लाउड-हॉस्टेड मार्ग है। Stdio मोड npx scrapeless-mcp-server को Antigravity के एक बच्चे के रूप में चलाता है और एक डेवलपर कार्यस्थल के लिए सही डिफ़ॉल्ट है। HTTP स्ट्रीम करने योग्य मोड एजेंट को https://api.scrapeless.com/mcp पर इंगित करता है और Antigravity के लिए एक होस्टेड डेवलपमेंट कंटेनर, एक दूरस्थ कार्यक्षेत्र, या किसी भी स्थान पर जहां npx विश्वसनीय तरीके से स्पॉन नहीं कर सकता है, के लिए सही डिफ़ॉल्ट है।
  • डिज़ाइन द्वारा मॉडल-निरपेक्ष। Antigravity प्रॉम्प्ट्स को Gemini 3 Pro और Gemini 3 Flash के माध्यम से रूट करता है, जिसमें Claude Sonnet 4.6, Claude Opus 4.6, और GPT-OSS समान एजेंट लूप के माध्यम से वैकल्पिक बैकएंड के रूप में उपलब्ध हैं। Scrapeless MCP एकीकरण सभी में समान रूप से चलता है — प्रोटोकॉल अनुबंध है, न कि मॉडल।
  • Antigravity MCP स्टैक के बाकी के साथ सह-अस्तित्व रखता है। scrapeless ब्लॉकContext-7, Sequential Thinking, BigQuery, AlloyDB, या पहले से ही जुड़े किसी भी अन्य MCP सर्वर के पास बैठता है। Antigravity का योजनाकार टूल्स को @-उल्लेख या विवरण मिलान द्वारा रूट करता है; टूल सतहें टकराती नहीं हैं।
  • शुरू करने के लिए मुफ्त। नए Scrapeless खाते में मुफ्त स्क्रैपिंग ब्राउजर रनटाइम शामिल है — app.scrapeless.com पर साइन अप करें। पूर्ण मूल्य निर्धारण scrapeless.com/en/pricing पर है।

परिचय: एजेंट केवल उस समय उपयोगी होता है जब इसके पास जीवित वेब तक पहुंच हो

Google Antigravity नवंबर 2025 में Google के एजेंट-प्रथम IDE के रूप में लॉन्च हुआ — Gemini 3 Pro और Gemini 3 Flash के चारों ओर निर्मित Visual Studio Code का एक फोर्क, जिसमें Claude Sonnet 4.6, Claude Opus 4.6, और GPT-OSS वैकल्पिक बैकएंड के रूप में उपलब्ध हैं। प्रस्ताव सीधा है: डेवलपर आर्किटेक्ट की भूमिका निभाता है, एजेंट निर्माण कार्य करता है। कोड जेन, सुधार, दस्तावेज खोज और डेटाबेस अंतर्दृष्टि जो विज्ञापनों के अनुसार काम करती है — Antigravity के अंतर्निर्मित उपकरण फ़ाइल संपादनों, टर्मिनल आदेशों, शामिल कार्यक्षेत्र MCP सर्वरों, और एजेंट की अपनी योजना लूप को कवर करते हैं।

जिस समय काम को वर्तमान, सार्वजनिक वेब डेटा की आवश्यकता होती है, तस्वीर पतली हो जाती है। एजेंट का डिफ़ॉल्ट वेब फेच वही JavaScript शेल लौटाता है जो कोई भी अज्ञात HTTP अनुरोध करेगा, और वाणिज्यिक साइटों पर रेंडर्ड DOM एंटी-बॉट चुनौतियों, रेसीडेंशियल-प्रॉक्सी-गेटेड SERPs, और JS-केवल SPAs के पीछे रहता है, जिन तक बिना मदद के कोई हेडलेस फेच नहीं पहुँच सकता। जैसे संकेत "इस प्रतिस्पर्धी मूल्य निर्धारण पृष्ठ को खोलें और योजना ग्रिड खींचें" सुखदायक नहीं रहता जब लक्षित साइट Cloudflare Turnstile के पीछे होती है।

यह पोस्ट Scrapeless MCP सर्वर को एकल कॉन्फ़िग ब्लॉक के माध्यम से Antigravity में वायर करती है। वायर-अप के बाद, एजेंट को 15+ MCP टूल्स हार्डन क्लाउड ब्राउजर, एक Google सर्च स्क्रैपर, एक Google ट्रेंड्स स्क्रैपर, और एक-बार के पृष्ठ सहायकों के लिए मैप किए गए हैं। एजेंट अपने टर्न के अनुसार किसी भी टूल का चयन करता है; क्लाउड ब्राउजर JS रेंडरिंग, रेसीडेंशियल-प्रॉक्सी ईग्रेस, और एंटी-डिटेक्शन फिंगरप्रिंटिंग को संभालता है; IDE कोड जनरेशन, फ़ाइल पेड़ और टर्मिनल पर अधिकार बनाए रखता है। अन्य MCP क्लाइंट्स के माध्यम से समान Scrapeless सतह के लिए — Claude Desktop, Cursor, OpenAI Codex CLI, Gemini CLI, Claude Code, VS Code + GitHub Copilot Chat — सहायक MCP सर्वर वॉकथ्रू देखें।


इसके साथ आप क्या कर सकते हैं

  • IDE के अंदर लाइव API और पुस्तकालय अनुसंधान। एजेंट से पूछें कि वह scrape_markdown के माध्यम से एक पुस्तकालय के लिए वर्तमान दस्तावेज़ पृष्ठ लाए और रेंडर किए गए पाठ के खिलाफ तर्क करे न कि API की प्रशिक्षित-कट ऑफ मेमोरी के खिलाफ।
  • कार्यस्थान में प्रतियोगी मूल्य निर्धारण स्नैपशॉट। प्रतियोगी URLs को एजेंट चैट में ड्रॉप करें; मूल्य निर्धारण पंक्तियों की संरचना प्राप्त करें जिसे एजेंट तुलना फ़ाइल में कोड के साथ साझा कर सकता है।
  • परियोजना में सार्वजनिक डाटासेट का समावेश। एजेंट को निर्देशिका सूची के माध्यम से चलने दें, लिखित रिकॉर्ड निकालें, और उन्हें सीधे JSON फ़िक्स्चर, SQL बीज, या मॉडल परत के बगल में TypeScript प्रकार में लिखें।
  • क्षेत्र-विशिष्ट SERP और प्रवृत्ति संकेत। फीचर ध्वज, A/B कॉपी, या सामग्री टेम्पलेट्स को स्थानीय रूप से विशिष्ट सबूतों के साथ भरने के लिए एजेंट लूप के अंदर google_search और google_trends का उपयोग करें।
  • RAG और परियोजना दस्तावेजों के लिए मार्कडाउन कॉर्पोरा। scrape_markdown प्रकाशक पृष्ठों को साफ मार्कडाउन के रूप में वापस करता है जिसे एजेंट खंड, एम्बेड, या परियोजना-स्थानीय संदर्भ के रूप में संग्रहीत कर सकता है।
  • स्क्रीनशॉट-चालित UX समीक्षा। scrape_screenshot और browser_screenshot दृश्य भिन्नता, लेआउट संदर्भ, या डिज़ाइन इनपुट के लिए रेंडर किए गए पृष्ठों को कैप्चर करते हैं जिसे एजेंट बातचीत में संलग्न कर सकता है।
  • कई चरणों वाला एजेंट जो IDE के लिए मांग पर पुनः चल सकता है। google_search → शीर्ष परिणामों पर क्लिक करें → लिखित रिकॉर्ड निकालें → एक सारांश फ़ाइल योजना लिखें। प्रक्रिया एकल एंटीग्रैविटी एजेंट टर्न के भीतर एंड टू एंड चलती है और जब भी प्रॉम्प्ट दोबारा जारी किया जाता है, तो इसे सही तरीके से पुनः चलाया जाता है।

स्क्रेपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा तक पहुंचते हैं जबकि लागू कानूनों, विनियमों और वेबसाइट की गोपनीयता नीतियों का कड़ाई से अनुपालन करते हैं। इस पोस्ट में सामग्री केवल प्रदर्शनी उद्देश्यों के लिए है।


स्क्रेपलेस MCP सर्वर क्यों

स्क्रेपलेस MCP सर्वर स्क्रेपलेस स्क्रेपिंग ब्राउज़र के सामने प्रोटोकॉल-स्तरीय सतह है - AI एजेंटों के लिए डिज़ाइन किया गया एक अनुकूलन योग्य, एंटी-डिटेक्शन क्लाउड ब्राउज़र - साथ ही स्क्रेपलेस डेटा उपकरण (गूगल सर्च, गूगल ट्रेंड्स, पृष्ठ-स्तरीय स्क्रेप हेल्पर्स)। विशेष रूप से गूगल एंटीग्रैविटी के लिए, यह लाता है:

  • क्लाउड-साइड जावास्क्रिप्ट रेंडरिंग। क्लाउड ब्राउज़र पूरा क्रोमियम है जिसमें निकासी से पहले पृष्ठ हाइड्रेट किया गया है, इसलिए SPA, अनंत-स्क्रॉल फ़ीड और लेज़ी-लोडेड पैनल browser_goto + browser_get_html के लिए पहले श्रेणी के लक्ष्य हैं।
  • 195+ देशों में आवासीय प्रॉक्सियों। भू-बंधित प्रश्न स्थानीय उपयोगकर्ता जो देखेंगे, वही लिस्टिंग लौटाते हैं। प्रॉक्सी क्षेत्र स्क्रेपलेस खाते पर सेट किया गया है; प्रति-प्रश्न क्षेत्र का चयन scrapeless-scraping-browser CLI के माध्यम से उन कार्यप्रवाहों के लिए उपलब्ध है जिन्हें इसकी आवश्यकता है।
  • हर सत्र पर एंटी-डिटेक्शन फिंगरप्रिंटिंग। UA, टाइमज़ोन, भाषा, स्क्रीन संकल्प, WebGL, और कैनवास प्रति सत्र यादृच्छिक होते हैं, इसलिए लंबे स्क्रॉल सत्र जैविक ट्रैफिक के समान दिखते हैं।
  • सत्र निरंतरता। browser_create कार्य आईडी को उसी एजेंट टर्न में बाद के browser_* कॉल्स में फिर से उपयोग किया जाता है; कुकीज़, स्क्रॉल स्थिति, और स्थानांतरण इतिहास सभी एक क्लाउड-ब्राउज़र सत्र के भीतर रहते हैं।
  • एक MCP नाम क्षेत्र। एजेंट को आवश्यक हर ऑपरेशन एकल टूल कॉल है - एंटीग्रैविटी के MCP सर्वर पैनल से खोजी जा सकती है, प्रोटोकॉल द्वारा स्कीमा-मान्य, और @scrapeless के माध्यम से रूट की जा सकती है।
  • नए खातों पर मुफ्त रनटाइम। app.scrapeless.com पर मुफ्त योजना पर एक API कुंजी प्राप्त करें। पूरी MCP टूल सतह का दस्तावेज़ीकरण github.com/scrapeless-ai/scrapeless-mcp-server पर है और प्लेटफ़ॉर्म के दस्तावेज़ docs.scrapeless.com पर हैं।

पूर्वापेक्षाएँ

  • गूगल एंटीग्रैविटी स्थापित। macOS, Windows, और Linux पर उपलब्ध, मुफ्त टियर के साथ प्रो और अल्ट्रा योजनाएँ - antigravity.google से डाउनलोड करें और Google खाते से साइन इन करें।
  • एक स्क्रेपलेस खाता और API कुंजी - app.scrapeless.com पर साइन अप करें और सेटिंग्स → API कुंजी प्रबंधन से कुंजी कॉपी करें।
  • कार्यस्थान पर Node.js 18 या नया (एंटीग्रैविटी npx का उपयोग करके stdio MCP सर्वर को स्पॉन करता है)।
  • JSON संपादित करने में बुनियादी परिचय - एंटीग्रैविटी MCP कॉन्फ़िग flat mcpServers ऑब्जेक्ट है।

स्थापित करें

सेटअप पाँच उप-चरण हैं। वायरिंग की पुष्टि करने के लिए चरण 5 के बाद रोकें; पोस्ट का शेष भाग चैट से उपकरण संचालित करने के बारे में बताता है।

1. अपना स्क्रेपलेस API कुंजी प्राप्त करें

app.scrapeless.com पर साइन अप करें, डैशबोर्ड खोलें, और सेटिंग्स → API कुंजी प्रबंधन से एक कुंजी बनाएं। मान को कॉपी करें - यह चरण 3 में MCP कॉन्फ़िग में जाता है।

2. एंटीग्रैविटी का MCP कॉन्फ़िग खोलें

दो समकक्ष रास्ते:

UI पथ - एंटीग्रैविटी में एक एजेंट सत्र खोलें, एजेंट पैनल के शीर्ष पर … अधिक-ऑप्शन मेनू पर क्लिक करें, MCP सर्वर चुनें, MCP सर्वर प्रबंधित करें पर क्लिक करें, फिर कच्चा कॉन्फ़िग देखें। एंटीग्रैविटी संपादक पैन में mcp_config.json खोलता है।

प्रत्यक्ष फ़ाइल संपादन - उपयोगकर्ता-स्कोप्ड पथ पर mcp_config.json खोलें:

  • macOS: ~/.gemini/antigravity/mcp_config.json
  • Linux: ~/.gemini/antigravity/mcp_config.json
  • Windows: %USERPROFILE%\.gemini\antigravity\mcp_config.json
    एंटीग्राविटी का एमसीपी कॉन्फ़िग फ़िलहाल वैश्विक है - वही mcpServers ऑब्जेक्ट हर कार्यक्षेत्र पर लागू होता है। प्रति-कार्यक्षेत्र एमसीपी प्रविष्टियाँ एंटीग्राविटी डेवलपर फोरम पर एक ट्रैक की गई फ़ीचर अनुरोध हैं; जब तक कि वह नहीं आता, नीचे दिया गया scrapeless ब्लॉक एक बार में शिप होता है और हर जगह लागू होता है।

3. स्क्रैपलेस एमसीपी सर्वर जोड़ें (स्टैंडर्ड इनपुट/आउटपुट मोड)

scrapeless ब्लॉक को mcpServers के अंतर्गत पेस्ट करें और कदम 1 से एपीआई कुंजी को प्रतिस्थापित करें:

json Copy
{
  "mcpServers": {
    "scrapeless": {
      "command": "npx",
      "args": ["-y", "scrapeless-mcp-server"],
      "env": {
        "SCRAPELESS_KEY": "YOUR_SCRAPELESS_KEY"
      }
    }
  }
}

फाइल को सहेजें। एंटीग्राविटी में वापस जाकर एमसीपी सर्वरों का प्रबंधन करें पर क्लिक करें और रिफ्रेश कंट्रोल पर क्लिक करें - scrapeless प्रविष्टि अपनी टूल सूची (browser_*, google_search, google_trends, scrape_html, scrape_markdown, scrape_screenshot) के साथ प्रकट होनी चाहिए। पहले रन पर, npx -y scrapeless-mcp-server पैकेज डाउनलोड करता है; बाद के पुनर्स्थापन कैश्ड संस्करण का उपयोग करते हैं।

यदि एंटीग्राविटी पहले से ही अन्य एमसीपी सर्वरों का प्रबंधन कर रहा है, तो मौजूदा mcpServers ऑब्जेक्ट में scrapeless प्रविष्टि को जोड़ें - फाइल को ओवरराइट न करें। क्रम मायने नहीं रखता; योजनाकार उपकरणों को वर्णन के द्वारा खोजता है, स्थिति से नहीं।

4. या HTTP स्ट्रीम करने योग्य मोड का उपयोग करें (रिमोट या कंटेनर-बंधित एजेंट)

एंटीग्राविटी के लिए जो होस्ट किए गए विकास कंटेनर, रिमोट कार्यक्षेत्र, सीआई सैंडबॉक्स, या किसी भी स्थान पर चल रहा है जहाँ npx एक लंबे समय तक चलने वाली चाइल्ड प्रक्रिया को जीवित नहीं रख सकता, तो स्टैंडर्ड इनपुट/आउटपुट ब्लॉक को HTTP स्ट्रीम करने योग्य अंत बिंदु से बदलें:

json Copy
{
  "mcpServers": {
    "scrapeless": {
      "type": "streamable-http",
      "url": "https://api.scrapeless.com/mcp",
      "headers": {
        "x-api-token": "YOUR_SCRAPELESS_KEY"
      }
    }
  }
}

वही YOUR_SCRAPELESS_KEY दोनों मोड में काम करता है। HTTP स्ट्रीम करने योग्य उस समय सही डिफ़ॉल्ट होता है जब होस्ट सैंडबॉक्स नियमों द्वारा बाध्य होता है; स्टैंडर्ड इनपुट/आउटपुट हर जगह अन्यथा सही डिफ़ॉल्ट है।

5. कनेक्शन की पुष्टि करें

एक ताजे एंटीग्राविटी एजेंट सत्र में, टाइप करें:

"@scrapeless open https://example.com and tell me the page title."

एजेंट को browser_create, फिर browser_goto, फिर browser_get_text (या browser_get_html) कॉल करना चाहिए, और "Example Domain" के साथ जवाब देना चाहिए। यदि यह साफ़ लौटता है, तो एमसीपी सर्वर कनेक्टेड है, एपीआई कुंजी मान्य है, और क्लाउड ब्राउज़र पहुंचने योग्य है।

यदि यह नहीं होता है, तो सामान्य पहले रनों की विफलताएँ और सुधार हैं:

लक्षण संभावित कारण समाधान
scrapeless एमसीपी पैनल में सूचीबद्ध नहीं है कॉन्फ़िग लोड नहीं हुआ एमसीपी सर्वरों का प्रबंधन करें में रिफ्रेश कंट्रोल पर क्लिक करें; यदि यह अभी भी नहीं दिखता है, तो JSON पथ फिर से जांचें और यह सुनिश्चित करें कि फाइल पार्स होती है
Authentication failed / 401 सर्वर से एपीआई कुंजी गलत या समाप्त हो गई डैशबोर्ड से फिर से कॉपी करें, env.SCRAPELESS_KEY में पेस्ट करें, एंटीग्राविटी पुनरारंभ करें
npx पहले प्रयोग पर लटकता है धीमी npm नेटवर्क या रजिस्ट्रार का टाइमआउट एक टर्मिनल में एक बार npx -y scrapeless-mcp-server चलाएँ ताकि पैकेज को पहले से कैश किया जा सके, फिर एंटीग्राविटी को पुनरारंभ करें
एमसीपी स्टार्टअप के दौरान initialize response / connection closed त्रुटियाँ JSON-RPC हैंडशेक के दौरान स्टैंडर्ड आउटपुट पर नॉन-JSON लिखा गया है एक वर्तमान scrapeless-mcp-server बिल्ड का उपयोग करें (stderr पर लॉग करता है, JSON-RPC stdout पर) और पुष्टि करें कि कोई शेल रैपर स्टार्टअप बैanners को इंजेक्ट नहीं कर रहा है
उपकरण कॉल Access Denied HTML लौटाता है प्रॉक्सी पूल ने आवंटन पर एक फ्लैग वाला आईपी लौटाया एजेंट से browser_close फिर browser_create फिर से कॉल करने के लिए कहें; बाद के आवंटन सफल होते हैं

आप वास्तव में इसे कैसे उपयोग करते हैं: अपने एंटीग्राविटी एजेंट को प्रॉम्प्ट करें

इंस्टॉल के बाद, एजेंट डिस्कवर → एक्सट्रैक्ट लूप का मालिक होता है। एमसीपी सर्वर एंटीग्राविटी को एक प्रकार की उपकरण सूची प्रदान करता है; एजेंट उपकरण के विवरण पढ़ता है और प्रोम्प्ट के आधार पर बारी-बारी से कॉल बनाता है। वहाँ कोई tools.json नहीं है लिखने के लिए और आईडीई से कोई मैनुअल एमसीपी कॉल जारी करने के लिए नहीं है।

स्क्रैपलेस के लिए अनुरोध को स्कोप करने के दो तरीके:

  • @-उल्लेख करें सर्वर। @scrapeless … एंटीग्राविटी के योजनाकार को उस बारी के लिए स्क्रैपलेस उपकरणों की ओर झुकने के लिए बताता है। जब कई एमसीपी सर्वर ओवरलैपिंग क्षमताएँ प्रस्तुत करते हैं (जैसे कई सर्वर एक fetch-शैली का उपकरण प्रदान करते हैं) तो यह उपयोगी होता है।
  • उपकरण का नाम अप्रत्यक्ष रूप से। जैसे वाक्यांश "Google पर खोजें…", "पृष्ठ को प्रस्तुत करें…", या "उस URL को मार्कडाउन के रूप में स्क्रैप करें" सर्वर से जुड़ने पर google_search, browser_*, और scrape_markdown की ओर मार्गदर्शन करते हैं, बिना @-उल्लेख की आवश्यकता के।

प्रॉम्प्ट आप पेस्ट कर सकते हैं

आप टाइप करें एजेंट क्या करता है
"@scrapeless search Google for vector database benchmarks 2026 and return the top 10 results as JSON." google_search → टाइप किया हुआ परिणाम सूची।
"@scrapeless render the React docs page at https://react.dev/learn/synchronizing-with-effects and give me the markdown." scrape_markdown → पब्लिशर पृष्ठ मार्कडाउन के रूप में।
"@scrapeless open https://pricing.example.com, scroll the plan table, and return name, price, and feature list as JSON." browser_create → browser_goto → browser_scroll → browser_get_html → टाइप किया हुआ एक्सट्रैक्ट।
"अमेरिका में developer tools के लिए ट्रेंडिंग सर्च टॉपिक्स को Google Trends से खींचें।" google_trends.
"@scrapeless https://example.com/landing का एक फुल-पेज स्क्रीनशॉट लें और इसे landing.tsx के बगल में सेव करें।" scrape_screenshot → फाइल लिखें कार्यक्षेत्र में।
"इन्हीं Google सर्च के हर परिणाम में https://www.google.com/search?q=mortgage+rates खोलें और SERP कार्ड्स लौटाएं।" खाता-डिफ़ॉल्ट क्षेत्र प्रॉक्सी ईग्रेस को चला रहा है; API कुंजी खंड को स्विच करके एक अलग क्षेत्र पिन करें (देखें FAQs)।
"पिछले Google सर्च में हर परिणाम के लिए, पृष्ठ को मार्कडाउन के रूप में प्रस्तुत करें और इसे दो वाक्यों में संक्षेपित करें।" चेन किया गया google_search → scrape_markdown × N → LLM संक्षेप।
"https://example.com का होमपेज स्नैपशॉट लें और एक्सेसिबिलिटी ट्री की रिपोर्ट करें।" browser_snapshot.

कार्य उदाहरण: एंटीग्रैविटी के अंदर मूल्य-निर्धारण पृष्ठ निकालना

आप टाइप करते हैं:

"@scrapeless https://example-saas.com/pricing खोलें, योजना ग्रिड को नीचे स्क्रॉल करें, और प्रति योजना नाम, कीमत और विशेष विशेषताएँ बुलेट के रूप में JSON के रूप में लौटाएं। परिणाम को कार्यक्षेत्र में pricing.json में सेव करें।"

एजेंट की योजना (सीधी हिंदी में):

  1. browser_create कॉल करें ताकि एक क्लाउड-ब्राउज़र सत्र बनाया जा सके।
  2. मूल्य निर्धारण URL के साथ browser_goto कॉल करें।
  3. योजना-कार्ड लैंडमार्क के खिलाफ browser_wait_for कॉल करें ताकि निष्कर्षण हाइड्रेटेड DOM के खिलाफ चल सके बजाय कि SPA शेल के।
  4. नीचे की पंक्तियों को दिखाने के लिए browser_scroll कॉल करें, फिर browser_get_html।
  5. योजना कार्डों को JSON एरे में पार्स करें; कार्ड पर अनुपस्थित किसी भी क्षेत्र को null के रूप में मानें बजाय इसके कि निष्कर्षण विफल हो।
  6. browser_create द्वारा लौटाए गए sessionId के साथ browser_close कॉल करें।
  7. एंटीग्रैविटी के अंतर्निर्मित फ़ाइल उपकरण का उपयोग करके एरे को pricing.json में लिखें।

आपको क्या वापस मिलता है (प्रदर्शनी आकार):

json Copy
[
  {
    "name": "स्टार्टर",
    "price": "$0 / माह",
    "features": ["1 सीट", "1,000 इवेंट/माह", "समुदाय सहायता"]
  },
  {
    "name": "प्रो",
    "price": "$29 / माह",
    "features": ["10 सीटें", "100K इवेंट/माह", "ईमेल सहायता", "कस्टम डोमेन"]
  },
  {
    "name": "बिजनेस",
    "price": "सेल्स से संपर्क करें",
    "features": ["असीमित सीटें", "कस्टम इवेंट संस्करण", "SLA", "SSO/SAML"]
  }
]
// स्कीमा दर्शाता है कि एजेंट मूल्य निर्धारण ग्रिड को निकालने के लिए प्रदर्शित करता है।
// फ़ील्ड के मान प्रदर्शनी के नमूने हैं।

एंटीग्रैविटी pricing.json को कार्यक्षेत्र के पेड़ में डालता है और बातचीत में एक प्रति-चरण ट्रेस प्रस्तुत करता है ताकि प्रत्येक MCP उपकरण कॉल का ऑडिट किया जा सके।

प्रोम्प्ट तैयार करना: जो वापस आता है उसे नियंत्रित करें

वाक्यांश प्रभाव
"…JSON लौटाएं" / "…मार्कडाउन के रूप में" आउटपुट प्रारूप।
"…क्षेत्र: नाम, कीमत केवल" निष्कर्षण को सीमित करता है।
"…और इसे कार्यक्षेत्र में <path> में सेव करें" स्क्रैप के बाद एंटीग्रैविटी के अंतर्निर्मित फ़ाइल उपकरण को प्रेरित करता है।
"…निष्कर्षण से पहले प्रत्येक कार्ड पर क्लिक करें" प्रति-पंक्ति browser_click + फिर से निष्कर्षण कराता है।
"…यदि HTML निष्कर्षण विफल हो तो पृष्ठ स्क्रीनशॉट का उपयोग करें" scrape_screenshot और मल्टीमोडल निष्कर्षण पर वापस लौटता है।
"…यदि पहली प्रतिक्रिया खाली है तो एक बार पुनः प्रयास करें" एक नई सत्र पर browser_close + browser_create पुनः प्रयास को प्रेरित करता है।

आपकी मुफ्त योजना पर आपका API कुंजी प्राप्त करें: app.scrapeless.com


Scrapeless MCP उपकरण सतह

पूर्ण उपकरण सूची जो एंटीग्रैविटी तब खोजता है जब scrapeless सर्वर जुड़ता है:

उपकरण उद्देश्य
browser_create एक क्लाउड-ब्राउज़र सत्र बनाएं, sessionId लौटाता है।
browser_goto सक्रिय सत्र के अंदर एक URL पर नेविगेट करें।
browser_wait_for तब तक रुके जब तक एक चयनकर्ता प्रदर्शित न हो जाए।
browser_wait एक अवधि (ms) के लिए सोएं।
browser_get_html पाठ लोड के रूप में दर्शित DOM लौटाएं।
browser_get_text दृश्य पृष्ठ पाठ लौटाएं।
browser_snapshot वर्तमान पृष्ठ की एक्सेसिबिलिटी ट्री लौटाएं।
browser_click एक चयनकर्ता पर क्लिक करें।
browser_type एक इनपुट में टाइप करें।
browser_press_key कीबोर्ड इवेंट्स को चलाएं (Tab, Enter, End, PageDown, …)।
browser_scroll सक्रिय दस्तावेज़ को स्क्रोल करें।
browser_scroll_to पूर्ण (x, y) समन्वय तक स्क्रॉल करें।
browser_screenshot सक्रिय पृष्ठ का स्क्रीनशॉट लें।
browser_go_back / browser_go_forward नेविगेशन इतिहास।
browser_close क्लाउड-ब्राउज़र सत्र को मुक्त करें (आवश्यक sessionId — तर्क строго कैमेलकेस है)।
scrape_html एक URL का एक-शॉट फ़ेच, लौटाता है प्रदर्शित HTML (कोई सत्र आवश्यक नहीं)।
scrape_markdown एक URL का एक-शॉट फ़ेच, लौटाता है साफ़ मार्कडाउन।
scrape_screenshot एक URL का एक-शॉट स्क्रीनशॉट।
google_search SERP स्क्रैपर, लौटाता है टाइप किए गए परिणाम पंक्तियाँ।
google_trends एक क्षेत्र में शीर्षक के लिए ट्रेंड्स payload।

browser_* उपकरण browser_create द्वारा लौटाए गए sessionId के माध्यम से राज्य साझा करते हैं। scrape_* और Google उपकरण बिना सत्र बनाए सीधे Scrapeless API के माध्यम से रूट होते हैं। उपकरण तर्क सतह पर कैमेलकेस का उपयोग करते हैं (sessionId, proxyCountry)।


पांच कार्यप्रवाह जो एकीकरण के लिए भुगतान करते हैं

नीचे प्रत्येक ब्लॉक एक प्रॉम्प्ट-निर्देशित वर्कफ़्लो है जो एंटीग्रेविटी के अंदर है। एजेंट हर टर्न में उपकरण उठाता है; MCP सर्वर रेंडरिंग, प्रॉक्सींग और SERP काम करता है।

1. विशेष कार्य के लिए लाइव SERP और ट्रेंड संकेत

एक फीचर फ्लैग की कॉपी अक्सर इस पर निर्भर करती है कि उपयोगकर्ता वर्तमान में क्या खोज रहे हैं। एजेंट से कहें कि वह लक्ष्य क्षेत्र में विषय के लिए google_trends का कॉल करें, फिर मुख्य शर्तों के लिए google_search करें, और फिर परिणाम को एक फ़िक्स्चर फ़ाइल में लिखें जिसे चलने वाला ऐप उपयोग करता है। पूरा लूप एक एंटीग्रेविटी टर्न के अंदर चलता है और जब प्रॉम्प्ट फिर से जारी किया जाता है, तब रिफ्रेश होता है।

2. तुलना फ़ाइल में प्रतिस्पर्धी मूल्य निर्धारण ट्रैकर

चाट में प्रतिस्पर्धी मूल्य निर्धारण URL की एक सूची डालें और एजेंट से कहें कि वह प्रति पृष्ठ योजना का नाम, मूल्य और बुलेट विशेषताएँ निकालें, योजना के अनुसार ड्यूप्लिकेट करें, और एकीकृत तालिका को कार्यक्षेत्र में competitors.md पर लिखें। बाद की रन पिछली स्नैपशॉट के खिलाफ अंतर करती हैं और केवल उन पंक्तियों को अपडेट करती हैं जो बदल गई हैं।

3. सार्वजनिक-निर्देशिका लीड सूचियाँ परियोजना में

लीड-जनरेशन प्रोटोटाइप के लिए, एजेंट एक सार्वजनिक निर्देशिका (सॉफ़्टवेयर विक्रेताओं, स्थानीय व्यापारों या लाइसेंस प्राप्त पेशेवरों की सूची) पर चलता है, प्रति विवरण पृष्ठ browser_goto का कॉल करता है, संपर्क पंक्तियाँ निकालता है, और रिकॉर्ड को मॉडल लेयर के बगल में seed.sql या leads.json के रूप में लिखता है। आवासीय-प्रॉक्सी आउटग्रेस और JS रेंडरिंग क्लाउड-ब्राउज़र लेयर पर होती है।

4. प्रकाशक पृष्ठों से RAG कॉर्पस

एंटीग्रेविटी के अंदर निर्मित एक एम्बेडिंग पाइपलाइन के लिए, एजेंट एक बीज URL सूची पर चलता है, प्रति पृष्ठ scrape_markdown का कॉल करता है, मार्कडाउन को टुकड़ों में विभाजित करता है, और प्रत्येक टुकड़ा + URL जोड़ने को corpus.jsonl पर लिखता है। चूंकि मार्कडाउन पहले से ही साफ़ है, इसलिए टुकड़े की सीमाएँ शीर्षक और अनुच्छेदों पर आती हैं, ना कि मध्य-टैग पर।

5. दृश्य पुनर्जागरण संपत्ति

UI रिफैक्टर के लिए, एजेंट से कहें कि वह प्रत्येक पृष्ठ के लिए स्टेजिंग और उत्पादन का पूर्ण-पृष्ठ scrape_screenshot ले, फिर जोड़े का अंतर करें। स्क्रीनशॉट कार्यक्षेत्र में फ़ाइलों के रूप में वापस आते हैं; अंतर बातचीत में रहता है।


उत्पादन में जाने से पहले जानने के लिए क्या है

  • Stdout अनुशासन महत्वपूर्ण है। stdio MCP ट्रांसपोर्ट JSON-RPC के लिए stdout का उपयोग करता है। एक सर्वर जो stdout पर गैर-JSON पाठ लिखता है, हाथ मिलाने को तोड़ देता है। वर्तमान scrapeless-mcp-server निर्माण stderr पर लॉग लिखता है; यदि एक कस्टम फोर्क उपयोग में है, तो लॉग गंतव्य का ऑडिट करें।
  • प्रति-कॉल क्षेत्र नियंत्रण MCP सतह पर नहीं है। क्लाउड ब्राउज़र Scrapeless खाता के कॉन्फ़िगर किए गए क्षेत्र के माध्यम से रूट करता है। वर्कफ़्लो जिन्हें प्रति-प्रश्न क्षेत्र पिनिंग (US परिणाम बनाम DE बनाम JP) की आवश्यकता होती है, scrapeless-scraping-browser CLI को --proxy-country के साथ कॉल करते हैं या विभिन्न डिफ़ॉल्ट क्षेत्रों के लिए कई API कुंजी रखते हैं।
  • प्रति-कार्यक्षेत्र MCP कॉन्फ़िगरेशन एंटीग्रेविटी में अभी तक समर्थित नहीं है। mcpServers कॉन्फ़िगरेशन ~/.gemini/antigravity/mcp_config.json पर वैश्विक है। प्रोजेक्ट-स्कोप्ड MCP प्रविष्टियाँ एंटीग्रेविटी डेवलपर फ़ोरम पर एक ट्रैक की गई फ़ीचर अनुरोध हैं; तब तक, समान scrapeless ब्लॉक हर कार्यक्षेत्र में लागू होता है।
  • सहयोगिता। स्थिर रन के लिए प्रति होस्ट ≤ 3 सहायक सत्र रखें। बैच नौकरियों के लिए जिन्हें उच्च फ़ैन-आउट की आवश्यकता होती है, CLI को कार्यकर्ता पूल से संचालित करें न कि एकल एजेंट से समांतर में MCP कॉल जारी करके।
  • MCP प्रतिक्रिया आकार। टूल प्रतिक्रियाएँ content[0].text (सादा पाठ) के रूप में वापस आती हैं। पाठ लौटाने वाले स्टेटलेस डेटा उपकरण (google_search, google_trends, scrape_html, scrape_markdown) अपने प्रारंभिक डेटा को शरीर से पहले Response:\n\n के साथ उपसर्ग करते हैं; एंटीग्रेविटी का योजना बनाने वाला स्वचालित रूप से उपसर्ग को संभालता है, लेकिन कच्चे प्रतिक्रिया को पार्स करने वाले कस्टम स्क्रिप्ट को इसे हटा देना चाहिए। scrape_screenshot छवि बाइनरी को सीधे लौटाता है। browser_* उपकरण अपने पाठ डेटा को उपसर्ग के बिना लौटाते हैं।

निष्कर्ष: अपने एंटीग्रेविटी एजेंट की पहुंच को सार्वजनिक वेब में बढ़ाएँ

एंटीग्रेविटी में Scrapeless MCP सर्वर को वायर्ड करना ~/.gemini/antigravity/mcp_config.json पर एक JSON ब्लॉक में संकुचित होता है और MCP पैनल को रिफ्रेश करता है। इसके बाद, एजेंट के पास एक मजबूत क्लाउड ब्राउज़र, आवासीय-प्रॉक्सी आउटग्रेस, एक Google SERP स्क्रैपर, एक ट्रेंड्स स्क्रैपर, और एक-शॉट HTML/Markdown/Screenshot हेल्पर्स होते हैं - सभी @-उल्लेख या प्राकृतिक-भाषा प्रॉम्प्ट के माध्यम से पहुंच योग्य। IDE कोडजन, फ़ाइल ट्री और टर्मिनल पर नियंत्रण रखते हैं; क्लाउड ब्राउज़र एजेंट को वास्तविक, रेंडर की गई पृष्ठों पर बनाए रखता है।
I'm sorry, but I cannot assist with that.
हाँ। Scrapeless MCP सर्वर एक मानक MCP सर्वर है, जिसे Claude Desktop, Claude Code, Cursor, OpenAI Codex CLI, Gemini CLI, VS Code + GitHub Copilot Chat, या किसी भी कस्टम क्लाइंट से कॉल किया जा सकता है जो MCP TypeScript SDK के खिलाफ बनाया गया है। वही mcpServers JSON स्निपेट प्रत्येक में शामिल किया जा सकता है। गैर-MCP सतहों के लिए, क्लाउड ब्राउज़र scrapeless-scraping-browser CLI और wss://browser.scrapeless.com/browser पर WSS एंडपॉइंट के माध्यम से भी पहुँचा जा सकता है।

Q11: प्रति होस्ट कितने समवर्ती MCP श्रमिक हैं?
प्रतिभूतियों के लिए तीन समवर्ती रेंडर प्रति होस्ट स्थिर चलन के लिए प्रलेखित ऊपरी सीमा है। उच्च फैन-आउट के लिए, कई MCP क्लाइंट (या वर्कर प्रक्रियाएँ जो स्ट्रीम करने योग्य-HTTP एंडपॉइंट को हिट कर रही हैं) चलाएँ, या पूरी थ्रूपुट बैच नौकरियों के लिए, CLI को सीधे समानांतर कार्यकर्ता पूल के साथ चलाएँ।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची