🎯 कस्टमाइज़ करने योग्य, डिटेक्शन-प्रतिरोधी क्लाउड ब्राउज़र जो स्व-विकसित Chromium द्वारा संचालित है, वेब क्रॉलर और एआई एजेंट्स के लिए डिज़ाइन किया गया। 👉अभी आज़माएं
वापस ब्लॉग पर

जेमिनी स्क्रैपर एपीआई: डेटा के रूप में गूगल जेमिनी उत्तर कैप्चर करें

Isabella Garcia
Isabella Garcia

Web Data Collection Specialist

08-Jul-2026

TL;DR:

  • जेमिनी स्क्रैपर गूगल जेमिनी के उत्तर को संरचित डेटा के रूप में कैप्चर करता है। scraper.gemini पर एक प्रॉम्प्ट भेजें; उत्तर पाठ के साथ-साथ उन उद्धरणों को वापस प्राप्त करें जिन पर जेमिनी ने अपना आधार बनाया।
  • यह एक दो-कॉल एसिंक्रोनस फ्लो है। कार्य बनाने के लिए प्रॉम्प्ट को POST करें, फिर task_id द्वारा परिणाम प्राप्त करें - लाइव रन में उत्तर लगभग 12 सेकंड में वापस आया।
  • उद्धरण संरचित आते हैं, HTML से स्क्रैप नहीं। प्रत्येक में title, url, website_name, snippet, favicon, और जेमिनी द्वारा उपयोग की गई हाइलाइट की गई अंश शामिल होते हैं।
  • देश कोड के साथ स्थानीयकरण करें। country फ़ील्ड उत्तर को एक क्षेत्र में आकार देती है, उसी तरह जैसे वहां का एक उपयोगकर्ता इसे देखता है।
  • यहाँ आप एआई उत्तरों में ब्रांड दृश्यता की निगरानी कैसे कर सकते हैं। जेमिनी से आपके ग्राहकों द्वारा पूछे गए प्रश्न पूछें और पढ़ें कि यह किस स्रोत का हवाला देता है।
  • शुरू करने के लिए मुफ्त। नए स्क्रैपलेस खाते में मुफ्त स्क्रैपर एपीआई उपयोग शामिल है - app.scrapeless.com पर साइन अप करें।

परिचय: जानें कि जेमिनी वास्तव में क्या उत्तर देता है

एआई उत्तर इंजन अब उपयोगकर्ताओं और खुले वेब के बीच स्थित हैं। जब कोई गूगल जेमिनी से "सर्वश्रेष्ठ प्रॉक्सी सेवा" या "न्यूयॉर्क में करने की चीज़ें" पूछता है, तो उत्तर - और यह जिन स्रोतों का हवाला देता है - उस उपयोगकर्ता के विश्वास को आकार देते हैं इससे पहले कि वे कुछ भी क्लिक करें। ब्रांड की निगरानी, प्रतिस्पर्धात्मक अनुसंधान, और उत्तर-इंजन ऑप्टिमाइजेशन के लिए, सवाल अब "मैं गूगल पर कहाँ रैंक करता हूँ" नहीं बल्कि "जेमिनी क्या कहता है, और यह किसका हवाला देता है" है।

स्क्रैपलेस जेमिनी स्क्रैपर इसका प्रोग्रामेटिक उत्तर देता है। आप scraper.gemini अभिनेता को एक प्रॉम्प्ट भेजते हैं और उत्तर पाठ के साथ-साथ इसके पीछे के संरचित उद्धरण प्राप्त करते हैं। यह गाइड अनुरोध आकार, एक पहला curl, प्रतिक्रिया स्कीमा, एक पायथन इंटीग्रेशन, और इसका उपयोग कैसे करें - सभी अनुरोध और प्रतिक्रिया नीचे लाइव एपीआई के खिलाफ कैप्चर की गई हैं।


आप इसके साथ क्या कर सकते हैं

  • जेमिनी के उत्तर पाठ को कैप्चर करें — पूरा उत्तर कॉमनमार्क-शैली मार्कडाउन के रूप में, संग्रहित या विश्लेषण करने के लिए तैयार।
  • उद्धरण पढ़ें — स्रोत जिन्हें जेमिनी ने उत्तर पर आधारित किया, प्रत्येक का शीर्षक, यूआरएल, और इस्तेमाल किया गया अंश।
  • एआई उत्तरों में ब्रांड उल्लेखों की ट्रैकिंग करें — उन प्रश्नों को पूछें जो आपके खरीदार पूछते हैं और देखें कि क्या आप प्रकट होते हैं।
  • क्षेत्र के अनुसार स्थानीयकरण करेंcountry को सेट करें ताकि आप उस बाजार में एक उपयोगकर्ता की तरह उत्तर देख सकें।
  • निगरानी पाइपलाइन को फीड करें — एक शेड्यूल पर समान प्रॉम्प्ट्स चलाएं और समय के साथ स्रोतों में परिवर्तन को देखिए।

स्क्रैपलेस जेमिनी स्क्रैपर क्यों

जेमिनी स्क्रैपर स्क्रैपलेस LLM चैट स्क्रैपर लाइन का एक हिस्सा है, जो डेटा के रूप में एआई-इंजिन उत्तर पढ़ने का प्रबंधित तरीका है। विशेष रूप से जेमिनी के लिए, यह लाता है:

  • एकल अनुरोध अनुबंध — प्रॉम्प्ट भेजें, उत्तर और इसके उद्धरण प्राप्त करें; कोई ब्राउज़र नहीं है।
  • संरचित उद्धरण — स्रोत क्षेत्र के रूप में वापस आते हैं, न कि मार्कअप जिसे आपको पार्स करना है।
  • 195+ देशों में आवासीय प्रॉक्सी — उत्तर स्वच्छ, क्षेत्र-उपयुक्त निकासी के माध्यम से प्राप्त होते हैं।
  • देश के अनुसार स्थानीयकरण — एक फ़ील्ड उत्तर को बाजार के लिए आकार देती है।

app.scrapeless.com पर मुफ्त योजना पर अपना एपीआई कुंजी प्राप्त करें।


पूर्वापेक्षाएँ

  • एक स्क्रैपलेस खाता और एपीआई कुंजी — app.scrapeless.com पर साइन अप करें।
  • पहले अनुरोध के लिए curl, और इंटीग्रेशन के लिए पायथन 3.10+।
  • HTTP और JSON के साथ बुनियादी परिचितता।

जेमिनी स्क्रैपर कैसे काम करता है

यह प्रक्रिया दो कॉल की होती है: कार्य बनाएँ, फिर उसका परिणाम प्राप्त करें।

अनुरोध पैरामीटर

फ़ील्ड स्थान अर्थ
actor शीर्ष स्तर scraper.gemini
input.prompt इनपुट जेमिनी से पूछे जाने वाला प्रश्न
input.country इनपुट उत्तर को स्थानीयकरण करने के लिए ISO देश कोड

प्राधिकरण दोनों कॉल पर x-api-token हेडर है।

त्वरित कैप्चर विद कर्ल

कार्य बनाएँ:

bash Copy
curl -X POST https://api.scrapeless.com/api/v2/scraper/request \
  -H "x-api-token: ${SCRAPELESS_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "actor": "scraper.gemini",
    "input": { "prompt": "न्यूयॉर्क में अनुशंसित आकर्षण", "country": "US" }
  }'
# { "status": "pending", "task_id": "3886db31-…" }

फिर task_id द्वारा परिणाम प्राप्त करें:

bash Copy
curl -X GET https://api.scrapeless.com/api/v2/scraper/result/{task_id} \
  -H "x-api-token: ${SCRAPELESS_API_KEY}"

प्रतिक्रिया लिफाफा

एक बार status success होने पर, उत्तर और उद्धरण task_result में होते हैं:

json Copy
// चित्रणात्मक उदाहरण — फ़ील्ड आकार सटीक है (लाइव कैप्चर किया गया); मान संक्षिप्त
{
  "status": "success",
  "task_result": {
    "prompt": "न्यूयॉर्क में अनुशंसित आकर्षण",
    "result_text": "न्यूयॉर्क शहर संस्कृति, इतिहास का एक सुंदर अराजकता है …",
    "citations": [
      {
        "title": "न्यूयॉर्क में करने के लिए 20 सर्वश्रेष्ठ चीजें",
        "url": "https://example.com/nyc",
        "website_name": "एक्सample यात्रा",
        "snippet": "स्वतंत्रता की प्रतिमा से…",
        "favicon": "https://example.com/favicon.ico",
        "highlights": ["स्वतंत्रता की प्रतिमा", "सेंट्रल पार्क"]
      }
    ]
  }

}

Copy
एक लाइव रन में यह लगभग 12 सेकंड में 15 उद्धरणों के साथ वापस आया, प्रत्येक में उपरोक्त छह क्षेत्र शामिल हैं।

---

## पाइथन में एपीआई को एकीकृत करना

कार्य बनाएँ, पूर्ण होने तक पोल करें, और उत्तर पढ़ें:

```python
import os
import time
import requests

API_KEY = os.environ["SCRAPELESS_API_KEY"]
BASE = "https://api.scrapeless.com"
HEADERS = {"x-api-token": API_KEY, "Content-Type": "application/json"}

def ask_gemini(prompt: str, country: str = "US") -> dict:
    created = requests.post(
        f"{BASE}/api/v2/scraper/request",
        headers=HEADERS,
        json={"actor": "scraper.gemini", "input": {"prompt": prompt, "country": country}},
        timeout=60,
    )
    task_id = created.json()["task_id"]

    for _ in range(30):
        time.sleep(3)
        got = requests.get(f"{BASE}/api/v2/scraper/result/{task_id}", headers=HEADERS, timeout=60)
        data = got.json()
        if data.get("status") in ("success", "failed"):
            return data
    raise TimeoutError("परिणाम समय पर तैयार नहीं है")

result = ask_gemini("न्यूयॉर्क में अनुशंसित आकर्षण")
answer = result["task_result"]
print(answer["result_text"])
for c in answer["citations"]:
    print("-", c["website_name"], c["url"])

अपने एपीआई कुंजी को मुफ्त योजना पर प्राप्त करें: app.scrapeless.com


सामान्य समस्याओं से कैसे बचें

  • कोई क्षेत्र जो मौजूद नहीं है, वह शून्य है, त्रुटि नहीं। हर उत्तर में 'हाइलाइट्स' या 'फेविकॉन' नहीं होते; प्रत्येक उद्धरण क्षेत्र को वैकल्पिक मानें और इसकी अनुपस्थिति के लिए सुरक्षित रखें।
  • परिणाम तुरंत प्राप्त करें। परिणाम task_id द्वारा प्राप्त किया जाता है; कार्य बनाने के तुरंत बाद पोल करें, न कि लंबे समय बाद, और पढ़ने के लिए लंबे अंतराल के बजाय एक छोटे पोल अंतराल को प्राथमिकता दें।
  • देश को उस बाजार में सीमित करें जिसका आप अध्ययन कर रहे हैं। country क्षेत्र उत्तर को बदलता है; इसे निगरानी रन के अनुसार निश्चित रखें ताकि परिणाम समय के साथ तुलनीय हों।
  • उत्तर विभिन्न चलनों के बीच भिन्न होते हैं। जेमिनी की शब्दावली हर रन में बदलती है, इसलिए उद्धरण स्रोतों की तुलना समय के साथ करें, न कि सटीक गद्य — उत्तर इंजन कैसे पृष्ठों को प्रस्तुत करते हैं, इसके बारे में विवरण Google के अपने एआई-फीचर्स मार्गदर्शन के लिए वेब में है, और HTTP अनुबंध जिसे आप कॉल कर रहे हैं वह HTTP अर्थशास्त्र विनिर्देश का पालन करता है।

निष्कर्ष: आपका ब्रांड, जैसा कि जेमिनी इसे देखता है

जेमिनी स्क्रैपर एक एआई उत्तर को डेटा में परिवर्तित करता है जिसे आप ट्रैक कर सकते हैं: प्रतिक्रिया पाठ और इसके पीछे के सटीक स्रोत, एक दो कॉल प्रवाह में। अपने ग्राहकों द्वारा पूछे गए संकेतों को चलाएँ, उद्धरण संग्रहीत करें, और देखें कि समय के साथ जेमिनी के उत्तरों में आपकी दृश्यता कैसे बदलती है। इसे यूनिवर्सल स्क्रैपिंग एपीआई लाइन के अन्य इंजनों के साथ जोड़ें, क्यों उत्तर इंजन ने खोज को बदला पर पढ़ें, और दस्तावेज़ प्रत्येक क्षेत्र को कवर करते हैं।


क्या आप अपने एआई-संचालित डेटा पाइपलाइन बनाने के लिए तैयार हैं?

हमारे समुदाय से जुड़ें, मुफ्त योजना का दावा करें और एआई उत्तरों की निगरानी करने वाले डेवलपर्स के साथ संपर्क करें: Discord · Telegram

मुफ्त स्क्रैपर एपीआई उपयोग के लिए app.scrapeless.com पर साइन अप करें, और पैमाने के लिए मूल्य निर्धारण देखें।


सामान्य प्रश्न

प्रश्न: जेमिनी स्क्रैपर क्या लौटाता है?
उत्तर पाठ Markdown के रूप में (result_text) और एक citations सूची - प्रत्येक उद्धरण में title, url, website_name, snippet, favicon, और highlights होते हैं जो जेमिनी ने उपयोग किया। एक लाइव रन में एक संकेत ने 15 उद्धरण लौटाए।

प्रश्न: क्या यह समकालीन है?
नहीं। आप कार्य बनाने के लिए संकेत को POST करते हैं और task_id द्वारा उत्तर प्राप्त करते हैं। एक लाइव रन में उत्तर लगभग 12 सेकंड में तैयार था।

प्रश्न: क्या मैं उत्तर को स्थानीयकरण कर सकता हूं?
हां - 'input.country' को एक ISO कोड पर सेट करें। उत्तर उस बाजार के अनुसार आकार दिया जाता है, इसलिए जब आप समय के साथ परिणामों की तुलना करते हैं तो इसे निश्चित रखें।

प्रश्न: उत्तरों में अंतर क्यों है?
संविधानिक उत्तर शब्दों में भिन्न होते हैं। निगरानी के लिए, उद्धरण स्रोतों और यह कि आपका ब्रांड प्रकट होता है, पर नज़र रखें, न कि सटीक गद्य।

प्रश्न: क्या मुझे एक प्रॉक्सी की आवश्यकता है?
नहीं। निकास को निवासी आईपी के माध्यम से अभिनेता के भीतर संभाला जाता है; आप केवल संकेत और देश भेजते हैं।

स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।

सबसे लोकप्रिय लेख

सूची