पाइ एजेंट को वेब से कैसे जोड़ें: स्क्रेपलेस एमसीपी सर्वर एकीकरण गाइड
Senior Web Scraping Engineer
मुख्य बिंदु:
- Pi एजेंट एक जानबूझकर न्यूनतम टर्मिनल-आधारित कोडिंग एजेंट है। इसमें चार उपकरण होते हैं (
read,write,edit,bash) और बाकी सब कुछ ऑप्ट-इन एक्सटेंशन के माध्यम से जोड़ा जाता है, जो संदर्भ विंडो को छोटा रखता है लेकिन इसका मतलब यह है कि वेब एक्सेस अंतर्निहित नहीं है। pi-mcp-adapterPi को किसी भी MCP सर्वर से एक ~200-टोकन प्रॉक्सी टूल के माध्यम से जोड़ता है। सर्वर डिफ़ॉल्ट रूप से सुस्त होते हैं — वे केवल तब शुरू होते हैं जब एजेंट उनमें से किसी एक उपकरण को कॉल करता है — इसलिए कई MCP सर्वरों को कनेक्ट करना संदर्भ बजट को नहीं बढ़ाता।- स्क्रेपलेस MCP सर्वर stdio और
https://api.scrapeless.com/mcpपर एक स्ट्रीम करने योग्य HTTP एंडपॉइंट के माध्यम से 21 उपकरणों को उजागर करता है। कवर मेंgoogle_search,google_trends, पूर्ण 16-उपकरणbrowser_*सतह (195+ देशों में आवासीय प्रॉक्सी के साथ एक क्लाउड-होस्टेड एंटी-डिटेक्शन ब्राउज़र) और तीन Stateless scraping tools (scrape_html,scrape_markdown,scrape_screenshot) शामिल हैं। - एक
.mcp.jsonफ़ाइल Pi को स्क्रेपलेस से कनेक्ट करती है। एडाप्टर मानक MCP कॉन्फ़िग प्रारूप को पढ़ता है जिसका उपयोग क्लॉड डेस्कटॉप, कर्सर, और अन्य MCP क्लाइंट पहले से ही करते हैं, इसलिए वही JSON स्निपेट इनमें से किसी में भी गिराया जा सकता है। - अंत से अंत का पैटर्न: प्रॉम्प्ट → Pi →
pi-mcp-adapter→scrapeless-mcp-server→ क्लाउड ब्राउज़र → रैंकित परिणाम या निकाले गए मार्कडाउन → लाइव डेटा के खिलाफ उत्पन्न कोड। Pi केवल प्रशिक्षण-केवल ज्ञान से उत्पन्न होना बंद कर देता है और जिस पृष्ठ को उसने अभी स्क्रैप किया है, उसमें आउटपुट को ज़मीन पर लाना शुरू करता है। - शुरू करने के लिए मुफ्त। नए स्क्रेपलेस खातों में मुफ्त स्क्रेपिंग ब्राउज़र रनटाइम शामिल है — app.scrapeless.com पर साइन अप करें।
परिचय: लाइव वेब उपकरणों के साथ एक न्यूनतम कोडिंग एजेंट
अधिकतर टर्मिनल कोडिंग एजेंट कई विशेषताओं के साथ आते हैं जिनका आप कभी उपयोग नहीं कर सकते। Pi एजेंट इसके विपरीत दृष्टिकोण अपनाता है: चार उपकरण, पूर्ण पारदर्शिता, बाकी सब कुछ मांग पर जोड़ा जाता है। यह एजेंट को तेज और संदर्भ विंडो को सस्ता बनाए रखता है, लेकिन इसका मतलब यह भी है कि Pi एक पुस्तकालय के नवीनतम दस्तावेज़ को Fetch नहीं कर सकता, पिछले सप्ताह प्रकाशित एक रिलीज पृष्ठ को नहीं पढ़ सकता, या अपने आप से सार्वजनिक वेब पृष्ठ से लाइव डेटा नहीं खींच सकता।
समाधान यह है कि Pi को एक मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वर से जोड़ा जाए जो वेब टूल्स को उजागर करता है। scrapeless-mcp-server पैकेज बिल्कुल यही करता है - स्क्रेपलेस स्क्रेपिंग ब्राउज़र के माध्यम से, एक क्लाउड-होस्टेड एंटी-डिटेक्शन ब्राउज़र जो 195+ देशों में आवासीय प्रॉक्सी के माध्यम से निकासी करता है।
यह पोस्ट pi-mcp-adapter (Pi के लिए कम्युनिटी MCP एक्सटेंशन) और एक सिंगल .mcp.json फ़ाइल के माध्यम से दोनों को एक साथ कैसे जोड़ा जाए, इस पर चर्चा करती है। Pi जिस एंडपॉइंट से कनेक्ट होता है, वह वही है जिसका उपयोग क्लॉड डेस्कटॉप, कर्सर, और अन्य MCP क्लाइंट करते हैं; वही JSON स्निपेट इनमें से सभी में काम करता है।
आप इसके साथ क्या कर सकते हैं
- लाइव दस्तावेज़ में कोड जनरेशन को आधार बनाएं। Pi को एक पुस्तकालय का वर्तमान README Fetch करने के लिए कहें इससे पहले कि एक उदाहरण उत्पन्न हो - अब प्रशिक्षण कट मॉडल ज्ञान से पुराने एपीआई नहीं।
- एक बार में खोजें और स्क्रैप करें। Pi उम्मीदवार पृष्ठों को रैंक करने के लिए
google_searchकॉल करता है, फिर सबसे प्रासंगिक को साफ मार्कडाउन के रूप में खींचने के लिएscrape_markdownका उपयोग करता है। - एक टर्मिनल प्रॉम्प्ट से एंटी-डिटेक्शन क्लाउड ब्राउज़र चलाएं।
browser_goto,browser_click,browser_type, औरbrowser_get_htmlजैसे उपकरण Pi को एक वास्तविक क्लाउड क्रोमियम पर सत्रीय निरंतरता के साथ पूर्ण नियंत्रण देते हैं। - आवासीय प्रॉक्सी के माध्यम से क्षेत्र-विशिष्ट डेटा खींचें। एजेंट के उपकरण कॉल से सीधे
gl=usयाgl=deपर खोज का स्कोप करें। - एक ही टर्मिनल सत्र के भीतर रहें। कोई ब्राउज़र टैब स्विचिंग नहीं, कोई curl आउटपुट की कॉपी-पेस्ट नहीं, कोई अलग स्क्रैपिंग CLI नहीं।
स्क्रेपलेस पर, हम केवल सार्वजनिक रूप से उपलब्ध डेटा तक पहुंच बनाते हैं जबकि लागू कानूनों, नियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से पालन करते हैं। इस पोस्ट में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है।
Pi एजेंट क्या है?
Pi एजेंट एक टर्मिनल-आधारित कोडिंग एजेंट है जिसे मारीओ जेक्नर (libGDX गेम ढांचे के निर्माता) द्वारा बनाया गया है। बुट करने पर यह मॉडल को चार उपकरण देता है:
read— फ़ाइलों और निर्देशिकाओं को पढ़ेंwrite— फ़ाइलें बनाएं और संपादित करेंedit— मौजूदा फ़ाइलों में लक्षित संपादन करेंbash— शेल कमांड निष्पादित करें
बाकी सब कुछ ऑप्ट-इन है। आप Pi को TypeScript एक्सटेंशन, कौशल, और प्रॉम्प्ट टेम्पलेट्स के माध्यम से बढ़ाते हैं जिन्हें पैकेज के रूप में बंडल किया गया है और npm या git के माध्यम से इंस्टॉल किया जा सकता है। एजेंट चार मोड में चलता है - इंटरएक्टिव (संवादी), प्रिंट/JSON (स्क्रिप्टेड), RPC (stdin/stdout एकीकरण), और SDK (जड़ित)। प्रदाता समर्थन विस्तृत है: एंथ्रोपिक, ओपनAI, गूगल, मिस्टरल, ग्रोक, और अधिक।
इसे npm के साथ वैश्विक स्तर पर स्थापित करें:
bash
npm install -g @mariozechner/pi-coding-agent
व्यापार स्पष्ट है: एक छोटा प्रारंभिक सतह जिसे आप अपके वर्कफ़्लो के अनुरूप बढ़ाते हैं, बजाय एक एक आकार के सभी टूलबॉक्स के।
Pi को वेब एक्सेस की आवश्यकता क्यों है
Pi की तर्कशक्ति उस आधारभूत मॉडल पर निर्भर करती है जिस पर इसे प्रशिक्षित किया गया था। इसका अर्थ यह है कि यह नहीं कर सकता:
- प्रशिक्षण कटऑफ के बाद किसी पुस्तकालय के नवीनतम API परिवर्तनों को देखना
- वर्तमान दस्तावेज़ पृष्ठों, परिवर्तन लॉग या रिलीज़ नोट्स FETCH करें
- किसी सार्वजनिक पृष्ठ को पढ़ें ताकि एक कॉन्फ़िगरेशन तालिका, एक मूल्य, या एक स्कीमा खींच सकें
- यह सत्यापित करें कि इसके प्रशिक्षण डेटा में एक उदाहरण आज के पैकेज संस्करण के खिलाफ अभी भी संकलित होता है
तेजी से बदलते पारिस्थितिकी तंत्र के लिए - कोई भी वेब, फ्रंटेंड, AI टूलिंग, बुनियादी ढांचा - यह महत्वपूर्ण है। Pi को एक वेब-सक्षम MCP सर्वर से कनेक्ट करें और आपको एक कोडिंग एजेंट मिलता है जो वर्तमान जानकारी के लिए खोज करता है और कोड जनरेट करने से पहले वह आवश्यक पृष्ठों को स्क्रैप करता है। आउटपुट पुराने मेमोरी से एक सर्वोत्तम अनुमान बनना बंद कर देता है और अभी हाल के पृष्ठ पर आधारित हो जाता है जो अभी रेंडर हुआ है।
Scrapeless MCP सर्वर क्या है?
Scrapeless MCP सर्वर एक मॉडल कॉन्टेक्स्ट प्रोटोकॉल सर्वर है जो Scrapeless क्लाउड ब्राउज़र, खोज, और स्क्रैप एपीआई को MCP उपकरणों के रूप में प्रदर्शित करता है। कोई भी MCP-संगत क्लाइंट - Pi, Claude Desktop, Cursor, Codex CLI, Gemini CLI, Windsurf, VS Code Copilot Chat - सीधे वार्तालाप से इन्हें कॉल कर सकता है।
प्रकाशन के समय, सर्वर तीन श्रेणियों में 21 उपकरण प्रदर्शित करता है:
- खोज और प्रवृत्तियाँ -
google_search,google_trends - ब्राउज़र ऑटोमेशन (16 उपकरण) -
browser_create,browser_close,browser_goto,browser_go_back,browser_go_forward,browser_click,browser_type,browser_press_key,browser_wait,browser_wait_for,browser_screenshot,browser_snapshot,browser_get_html,browser_get_text,browser_scroll,browser_scroll_to - Stateless scraping -
scrape_html,scrape_markdown,scrape_screenshot
दो ट्रांसपोर्ट मोड समर्थित हैं:
- Stdio -
npx -y scrapeless-mcp-serverको MCP क्लाइंट के एक चाइल्ड प्रोसेस के रूप में सर्वर चलाने के लिए। यह Pi जैसे डेस्कटॉप और टर्मिनल एजेंटों के लिए सही डिफ़ॉल्ट है। - Streamable HTTP - क्लाइंट को
https://api.scrapeless.com/mcpपर पॉइंट करें। यह क्लाउड-होस्टेड एजेंटों के लिए सही डिफ़ॉल्ट है जोnpxके लिए शेल नहीं कर सकते।
दोनों मोड एक ही Scrapeless API कुंजी द्वारा समर्थित हैं। सर्वर का स्रोत github.com/scrapeless-ai/scrapeless-mcp-server पर है; पूर्ण उपकरण संदर्भ docs.scrapeless.com पर है। app.scrapeless.com पर मुफ्त योजना पर अपनी API कुंजी प्राप्त करें।
MCP ब्रिज: pi-mcp-adapter
Pi बॉक्स से बाहर MCP समर्थन के साथ नहीं आता है। यह एक जानबूझकर किया गया निर्णय है: Mario दलील करते हैं है कि MCP उपकरण परिभाषाएँ एक न्यूनतम एजेंट के लिए बहुत टोकन-भारी हैं। लोकप्रिय MCP सर्वर जैसे Playwright MCP 21 उपकरणों को प्रदर्शित करते हैं और लगभग 13.7k टोकन का उपभोग करते हैं; Chrome DevTools MCP 26 उपकरणों को प्रदर्शित करता है और लगभग 18k टोकन का उपभोग करता है। कुछ सर्वरों को कनेक्ट करना बातचीत शुरू होने से पहले कॉन्टेक्स्ट विंडो का एक महत्वपूर्ण हिस्सा जला सकता है।
समुदाय की प्रतिक्रिया pi-mcp-adapter है: एक Pi एक्सटेंशन जो प्रायोगिक उपकरण (~200 टोकन) को प्रदर्शित करता है, बजाय इसके कि हर MCP उपकरण परिभाषा को पहले से लोड किया जाए। एजेंट आवश्यकता के अनुसार उपकरणों को खोजता और कॉल करता है:
mcp({ search: "screenshot" })
mcp({ tool: "scrapeless_scrape_markdown", args: '{"url": "https://example.com"}' })
सर्वर डिफ़ॉल्ट रूप से आलसी होते हैं - वे केवल तब शुरू होते हैं जब एजेंट पहली बार उनके उपकरणों में से एक को कॉल करता है, और वे 10 मिनट के सुस्त समय के बाद डिस्कनेक्ट हो जाते हैं (कॉन्फ़िगर करने योग्य)। उपकरण मेटाडेटा को डिस्क में कैश किया जाता है ताकि खोज और विवरण बिना लाइव कनेक्शन के काम कर सकें।
एडाप्टर मानक MCP कॉन्फ़िग फ़ाइलों को इस प्राथमिकता क्रम में पढ़ता है:
~/.config/mcp/mcp.json(उपयोगकर्ता-सामान्य साझा)<Pi एजेंट डायरेक्टरी>/mcp.json(Pi वैश्विक ओवरराइड, आमतौर पर~/.pi/agent/mcp.json).mcp.json(परियोजना-स्थानीय साझा).pi/mcp.json(Pi परियोजना ओवरराइड)
इसे एक कमांड के साथ इंस्टॉल करें (Pi के अंदर या Pi CLI के माध्यम से चलाएं):
bash
pi install npm:pi-mcp-adapter
प्रकाशन के समय एडाप्टर का संस्करण 2.6.1 है।
Pi एजेंट को Scrapeless MCP सर्वर से कैसे कनेक्ट करें
पूर्वापेक्षाएँ
- Node.js 18 या नया। Pi एजेंट और
pi-mcp-adapterदोनों को इसकी आवश्यकता होती है; Pi के जेमिनी CLI संस्करण को Node 20 या नए की आवश्यकता है। - एक Scrapeless खाता और API कुंजी। app.scrapeless.com पर साइन अप करें। नए खातों में मुफ्त स्क्रैपिंग ब्राउज़र रनटाइम शामिल है।
- एक API कुंजी किसी मॉडल प्रदाता से जिसे Pi समर्थन करता है - Anthropics, OpenAI, Google Gemini, Mistral, DeepSeek, Groq, या किसी और से जो Pi
/loginपर सूचीबद्ध करता है।
कदम 1 - Pi एजेंट स्थापित करें
अपने टर्मिनल को खोलें और चलाएँ:
bash
npm install -g @mariozechner/pi-coding-agent
इंस्टॉलेशन की पुष्टि करें:
bash
pi --version
प्रकाशन के समय Pi बाइनरी है @mariozechner/pi-coding-agent संस्करण 0.73.1।
कदम 2 - pi-mcp-adapter स्थापित करें
Pi स्थापित करने के बाद, MCP एडाप्टर एक्सटेंशन जोड़ें:
bash
pi install npm:pi-mcp-adapter
पुनः प्रारंभ करें Pi स्थापना के बाद। यह एडाप्टर एकल mcp प्रॉक्सी टूल को खींचता है जिसकी लागत लगभग 200 टोकन है, साथ ही इंटरैक्टिव सर्वर प्रबंधन के लिए /mcp स्लैश आदेश भी है।
चरण 3 — अपना Scrapeless API कुंजी प्राप्त करें
app.scrapeless.com पर लॉग इन करें, Settings → API Keys खोलें, और अपनी कुंजी कॉपी करें। इसे अगले चरण के लिए क्लिपबोर्ड पर रखें।
चरण 4 — .mcp.json कॉन्फ़िगर करें
अपने प्रोजेक्ट फ़ोल्डर में, एक फ़ाइल बनाएं जिसका नाम .mcp.json हो। यह मानक MCP कॉन्फ़िग फ़ाइल प्रारूप है जिसे pi-mcp-adapter स्टार्टअप पर पढ़ता है (कोई Pi-विशिष्ट सिंटैक्स की आवश्यकता नहीं है):
json
{
"mcpServers": {
"scrapeless": {
"command": "npx",
"args": ["-y", "scrapeless-mcp-server"],
"env": {
"SCRAPELESS_KEY": "YOUR_SCRAPELESS_KEY"
}
}
}
}
YOUR_SCRAPELESS_KEY को चरण 3 की कुंजी से बदलें। MCP सर्वर API कुंजी को SCRAPELESS_KEY पर्यावरण चर से पढ़ता है - यह नाम सत्यता का स्रोत है; इसे SCRAPELESS_API_KEY में बदलें नहीं।
पहली बार चलाने पर, npx -y scrapeless-mcp-server पैकेज को डाउनलोड करता है और stdio के माध्यम से सर्वर शुरू करता है। कोई अलग इंस्टॉल कमांड की आवश्यकता नहीं है।
यदि आप stdio छोड़ना चाहते हैं और स्ट्रीम करने योग्य HTTP परिवहन का उपयोग करना चाहते हैं, तो प्रविष्टि को बदलें:
json
{
"mcpServers": {
"scrapeless": {
"url": "https://api.scrapeless.com/mcp",
"headers": {
"x-api-token": "YOUR_SCRAPELESS_KEY"
}
}
}
}
दोनों रूप समान Scrapeless API कुंजी का उपयोग करते हैं और समान 21 टूल को प्रदर्शित करते हैं। वर्कस्टेशन के लिए stdio सही डिफ़ॉल्ट है; HTTP सही डिफ़ॉल्ट है यदि Pi किसी क्लाउड होस्ट पर चल रहा है जो npx को शेल नहीं कर सकता।
चरण 5 — एक मॉडल प्रदाता से कनेक्ट करें
Pi शुरू करें:
bash
pi
आपको Extensions के तहत pi-mcp-adapter सूचीबद्ध दिखाई देना चाहिए। /login टाइप करें और अपने प्रमाणीकरण विधि का चयन करें (सदस्यता या API कुंजी)। उस प्रदाता का चयन करें जिसका आप उपयोग करना चाहते हैं, API कुंजी पेस्ट करें, और Pi भविष्य की सत्रों के लिए क्रेडेंशियल को सहेज लेगा। मॉडल चयन पैनल खोलने के लिए /model टाइप करें और एक मॉडल चुनें।
अपने Scrapeless API कुंजी को निःशुल्क योजना पर प्राप्त करें: app.scrapeless.com
चरण 6 — कनेक्शन को सत्यापित करें
MCP पैनल खोलने के लिए /mcp टाइप करें। scrapeless सर्वर सूचीबद्ध है लेकिन सुस्त है - पहले यह 0/21 दिखा सकता है क्योंकि कनेक्शन अभी तक नहीं खोला गया है। तीर की कुंजियों के साथ पंक्ति को हाइलाइट करें और फिर से कनेक्ट करने के लिए Ctrl+R दबाएं (या कोई Scrapeless टूल कॉल करें, जो एक सुस्त कनेक्ट को ट्रिगर करता है)।
एक बार कनेक्ट होने के बाद, टर्मिनल के नीचे MCP: 1/1 servers दिखाई देगी। अब 21 टूल खोजे जा सकते हैं। उन्हें सूचीबद्ध करके पुष्टि करने के लिए:
mcp({ search: "scrapeless" })
आपको परिणाम में google_search, google_trends, browser_*, और scrape_* टूल दिखाई देने चाहिए। पैनल बंद करने के लिए Esc दबाएं।
चरण 7 — एक वास्तविक कार्य चलाएँ
Pi को एक प्रॉम्प्ट दें जिसे लाइव वेब डेटा की आवश्यकता हो। उदाहरण के लिए:
ऑफिशियल axios npm दस्तावेज़ के लिए वेब खोजें, सबसे प्रासंगिक पृष्ठ को स्क्रैप करें,
और एक कार्यशील JavaScript उदाहरण उत्पन्न करें जो उचित त्रुटि
हैंडलिंग के साथ GET अनुरोध करता है। इसे axios-example.js के रूप में सहेजें।
Pi पहले scrapeless_google_search को कॉल करता है, जो परिणामों की रैंक की गई सूची लौटाता है जिसमें शीर्षक, URLs, और आधिकारिक axios दस्तावेज़ से स्निपेट्स शामिल हैं। फिर यह सबसे प्रासंगिक URL का चयन करता है और पृष्ठ को साफ Markdown के रूप में खींचने के लिए scrapeless_scrape_markdown को कॉल करता है - क्लाउड ब्राउज़र JavaScript रेंडरिंग और किसी भी एंटी-डिटेक्शन चुनौतियों से निपटता है जो रास्ते में आती हैं, और Pi निकाली गई सामग्री प्राप्त करता है न कि कच्चा HTML।
प्रासंगिक संदर्भ में दस्तावेज़ के साथ, Pi उसी API संस्करण के खिलाफ axios-example.js उत्पन्न करता है जिसे उसने अभी जांचा। यदि एक अस्थायी os error 10054 या HTTP 503 दिखाई देता है, तो कॉल को पुनः प्रयास करें - क्लाउड ब्राउज़र बेड़े सत्रों को पुनर्चक्रित करता है और पुनः जारी करना आमतौर पर सफल होता है।
चरण 8 — आउटपुट का अन्वेषण करें
Pi axios-example.js को आपके प्रोजेक्ट फ़ोल्डर में लिखता है। फ़ाइल में एक उदाहरण होता है जो पैटर्न का प्रतिबिंबित करता है जिसे उसने अभी स्क्रैप किया है - async/await, स्थिति कोड शाखाएँ, और त्रुटि निरीक्षण जो वर्तमान axios दस्तावेज़ों की सिफारिश के साथ सुसंगत हैं:
javascript
async function fetchPost() {
try {
const response = await axios.get('https://jsonplaceholder.typicode.com/posts/1');
console.log('Status:', response.status);
console.log('Title:', response.data.title);
console.log('Body:', response.data.body);
} catch (error) {
if (error.response) {
console.error('Status:', error.response.status);
console.error('Data:', error.response.data);
} else if (error.request) {
console.error('No response received from server');
} else {
console.error('Request setup error:', error.message);
}
}
}
इसे चलाएँ:
bash
npm install axios
node axios-example.js
आपको क्या वापस मिलता है
एक प्रतिनिधि tools/list प्रतिक्रिया Scrapeless MCP सर्वर से इस रूप में होती है (स्कीमा प्रकाशन पर लाइव सर्वर को दर्शाता है; फ़ील्ड मान उदाहरणात्मक नमूने हैं):
json
{
"tools": [
{
"name": "google_search",
"description": "सार्वभौमिक सूचना खोज इंजन",
"inputSchema": {
"type": "object",
"properties": {
"q": { "type": "string", "default": "शीर्ष समाचार हेडलाइन" },
"gl": { "type": "string", "default": "us" },
"hl": { "type": "string", "default": "en" }
}
}
},
{
"name": "scrape_markdown",
"description": "एक URL को स्क्रैप करें और इसकी सामग्री को Markdown के रूप में लौटाएं",
"inputSchema": {
"type": "object",
"properties": { "url": { "type": "string", "format": "uri" } },
"required": ["url"]
}
},
{ "name": "browser_create", "description": "एक नया क्लाउड ब्राउज़र सत्र बनाएं" },
{ "name": "browser_goto", "description": "एक मौजूदा सत्र में एक URL पर जाएं" },
{ "name": "browser_get_html", "description": "सक्रिय पृष्ठ का प्रदर्शित HTML लौटाएं" }
// …16 और
]
}
इस सब को एक साथ जोड़ने के बाद ईमानदार अवलोकन:
- टोकन लागत को प्रॉक्सी टूल ने हावी किया है, 21 अधीनस्थ टूल द्वारा नहीं। एडेप्टर डिस्क कैश में मेटाडेटा रखता है; कुछ भी सिस्टम प्रॉम्प्ट में तब तक लोड नहीं होता जब तक आप एक सर्वर पर
directToolsको कॉल नहीं करते। - ** आलसी स्टार्टअप ठंडे सत्रों पर जीतता है। ** Scrapeless MCP सर्वर केवल पहली बार Pi के किसी भी टूल को कॉल करने पर चालू होता है, इसलिए एक Pi सत्र जो सर्वर को कॉन्फ़िगर करता है, का खुलना अतिरिक्त लागत नहीं है।
google_search+scrape_markdownसामान्य जोड़ी है। पृष्ठ खोजने के लिए खोजें, इसे पढ़ने के लिए स्क्रैप करें।browser_*टूल्स उन प्रवाहों के लिए आरक्षित हैं जिन्हें लॉगिन, क्लिक-थ्रू, या पृष्ठांकन की आवश्यकता होती है।- क्षणिक
os error 10054/ HTTP 503 होता है। यह Scrapeless गाइड में प्रलेखित है और क्लाउड-ब्राउज़र सत्र चर्न पर सतह पर आता है। सत्र को फिर से शुरू करने के बजाय Pi से टूल कॉल को पुनः प्रयास करें। SCRAPELESS_KEYमानक env var है। अन्य Scrapeless सतहें (स्टैंडअलोन CLI, एजेंट स्किल)SCRAPELESS_API_KEYका उपयोग करती हैं। MCP सर्वर अपवाद है।
निष्कर्ष: एक न्यूनतम कोडिंग एजेंट जो लाइव वेब को पढ़ता है
Pi एजेंट डिफ़ॉल्ट रूप से न्यूनतम रहता है; Scrapeless MCP सर्वर बिना इसे बदले 21 वेब टूल जोड़ता है। संबंधी संघर्ष pi-mcp-adapter है - एक प्रॉक्सी टूल, ~200 टोकन, आलसी सर्वर स्टार्टअप - और एक .mcp.json फ़ाइल जो व्यापक MCP पारिस्थितिकी तंत्र पहले से ही समझता है। वही JSON स्निपेट Claude Desktop, Cursor, Codex CLI, Gemini CLI, Windsurf, या VS Code Copilot Chat में बिना बदले डाला जा सकता है।
गुणात्मक अंतर पहले बार दिखाई देता है जब आप Pi से एक पुस्तकालय के खिलाफ कोड उत्पन्न करने के लिए पूछते हैं जिसे आपने पिन नहीं किया है: प्रशिक्षण-डेटा मेमोरी से अनुमान लगाने के बजाय, Pi खोजता है, मानक दस्तावेज़ को स्क्रैप करता है, और इसे वास्तव में सक्रिय संस्करण के खिलाफ अपनी उदाहरण लिखता है। इस गाइड को Scrapeless MCP सर्वर अवलोकन के साथ पूरा टूल कैटलॉग के लिए जोड़ें, या AWS Strands + Scrapeless MCP गाइड के साथ यदि वही MCP सर्वर एक ढांचा-आधारित एजेंट के बजाय एक टर्मिनल एक में तारांकित हो रहा है। सामान्य उपयोग के लिए प्रॉक्सी-केवल मोड पिन करें, जब आप चाहते हैं कि मॉडल उन्हें अपने सिस्टम प्रॉम्प्ट में देखे तो व्यक्तिगत टूल्स को directTools में बढ़ावा दें, और ठंडे सत्रों को सस्ते रखने के लिए lifecycle: lazy रखें।
क्या आप अपने एआई-समर्थित डेटा पाइपलाइन बनाने के लिए तैयार हैं?
हमारे समुदाय में शामिल हों, एक मुफ्त योजना का दावा करें और MCP-चालित एजेंट पाइपलाइनों का निर्माण कर रहे डेवलपर्स से जुड़ें: Discord · Telegram।
app.scrapeless.com पर मुफ्त स्क्रैपिंग ब्राउज़र रUNTIME के लिए साइन अप करें, फिर ऊपर दिए गए .mcp.json स्निपेट को Pi (या किसी अन्य MCP क्लाइंट) में डालें और लाइव वेब डेटा में कोड जनरेशन को आधारभूत करना शुरू करें। मूल्य निर्धारण विवरण scrapeless.com/en/pricing पर उपलब्ध हैं।
अक्सर पूछे जाने वाले प्रश्न
1. क्या Pi के माध्यम से Scrapeless MCP सर्वर के साथ स्क्रैपिंग कानूनी है?
MCP सर्वर केवल सार्वजनिक रूप से उपलब्ध सामग्री तक पहुँचता है, वही सामग्री जो एक लॉग-आउट उपयोगकर्ता एक ब्राउज़र में देखेगा। कानूनीता अधिकार क्षेत्र और लक्ष्य साइट की सेवा की शर्तों पर निर्भर करती है। किसी भी साइट के ToS की समीक्षा करें जिसे Pi को स्क्रैप करने के लिए कहा गया है और उच्च-स्टेक उपयोग के मामलों के लिए सलाह लें।
2. क्या मुझे Scrapeless MCP सर्वर पर एक प्रॉक्सी की आवश्यकता है?
नहीं। क्लाउड ब्राउज़र पहले से ही 195+ देशों में आवासीय प्रॉक्सी के माध्यम से बाहर निकलता है। क्षेत्र को पिन करने के लिए google_search पर gl पैरामीटर (या एजेंट प्रॉम्प्ट में --proxy-country शैली का संकेत) का उपयोग करें।
3. यदि एक टूल कॉल ERR_TUNNEL_CONNECTION_FAILED, os error 10054, या HTTP 503 पर हिट होती है तो Pi क्या देखता है?
یہ کلاؤڈ براؤزر کی کھیپ پر عارضی خامیاں ہیں۔ Pi ماڈل کو خامی کی نشاندہی کرتا ہے، جو عام طور پر خودبخود دوبارہ کوشش کرتا ہے؛ اگر نہیں، تو پروام کو دوبارہ جاری کریں۔ یہ اس بات کی علامت نہیں ہیں کہ MCP کی وائرنگ ٹوٹ گئی ہے۔
4. Pi اسکرپلیس سرور دکھاتا ہے لیکن 0/21 ٹولز — کیا غلط ہے؟
کچھ نہیں۔ سرورز بطور ڈیفالٹ سست ہیں pi-mcp-adapter میں۔ جب بھی Pi ایک اسکرپلیس ٹول کو کال کرتا ہے، گنتی 21/21 میں تبدیل ہو جاتی ہے۔ زبردستی کنکشن کرنے کے لیے، /mcp میں سرور کو ہائی لائٹ کریں اور Ctrl+R دبائیں، یا پرامپٹ لائن سے /mcp reconnect scrapeless چلائیں۔
5. پروکسی ٹول بہترین ہے، لیکن کیا میں اسکرپلیس ٹولز کو براہ راست Pi کے ماڈل کے لیے ظاہر کر سکتا ہوں؟
جی ہاں — scrapeless اندراج میں .mcp.json میں "directTools": true (یا چند ٹولز کو فروغ دینے کے لیے "directTools": ["google_search", "scrape_markdown"] شامل کریں۔ براہ راست ٹولز سسٹم پرامپٹ میں ہر ایک کے لیے تقریباً 150–300 ٹوکن کی قیمت رکھتے ہیں؛ ان کو منتخب کریں جو ایجنٹ سب سے زیادہ استعمال کرتا ہے۔
6. کیا وہی .mcp.json کا بٹوہ Pi سے باہر استعمال کیا جا سکتا ہے؟
جی ہاں۔ mcpServers کا آبجیکٹ معیاری MCP کنفیگ لفافہ ہے۔ Claude Desktop، Cursor، Codex CLI، Gemini CLI، Windsurf، اور VS Code Copilot Chat سب اسے پڑھ سکتے ہیں (کچھ میں معمولی راستے یا فائل کے نام میں فرق کے ساتھ)۔ اوپر والا اسکرپلیس بلاک ان سب میں کام کرتا ہے۔
7. Pi ایک وقت میں کتنے MCP سرورز سے جڑ سکتا ہے؟
کوئی سخت حد نہیں ہے — pi-mcp-adapter ہر ایک کو سست رکھتا ہے اور 10 منٹ بے عملی کے بعد منقطع ہو جاتا ہے، لہذا ٹوکن اور پروسس کی قیمت جتنے بھی سرورز کی فہرست ہو، ویسے ہی رہتی ہے۔ متعلقہ حد ماڈل فراہم کرنے والے کی سیاق و سباق کی ونڈو اور Pi کے اپنے فی ٹول بجٹ ہے۔
8. کیا یہ بغیر AI ایجنٹ کے کام کرتا ہے — کیا میں اسکرپلیس MCP سرور کو اسکرپٹ سے کال کر سکتا ہوں؟
جی ہاں۔ https://api.scrapeless.com/mcp پر اسٹریم ایبل HTTP اینڈ پوائنٹ کو کسی بھی HTTP کلائنٹ سے initialize → tools/list → tools/call JSON-RPC ترتیب کے ساتھ کال کیا جا سکتا ہے؛ اس پر curl دھواں ٹیسٹ کرنے پر serverInfo.name: "scrapeless-mcp-server" اور بعد کی کالز کے لیے mcp-session-id ہیڈر ملتا ہے۔ Pi سہولت کی پرت ہے، ایک سخت انحصار نہیں۔
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



