जेमिनी स्क्रैपर एपीआई: डेटा के रूप में गूगल जेमिनी उत्तर कैप्चर करें
Web Data Collection Specialist
TL;DR:
- जेमिनी स्क्रैपर गूगल जेमिनी के उत्तर को संरचित डेटा के रूप में कैप्चर करता है।
scraper.geminiपर एक प्रॉम्प्ट भेजें; उत्तर पाठ के साथ-साथ उन उद्धरणों को वापस प्राप्त करें जिन पर जेमिनी ने अपना आधार बनाया। - यह एक दो-कॉल एसिंक्रोनस फ्लो है। कार्य बनाने के लिए प्रॉम्प्ट को POST करें, फिर
task_idद्वारा परिणाम प्राप्त करें - लाइव रन में उत्तर लगभग 12 सेकंड में वापस आया। - उद्धरण संरचित आते हैं, HTML से स्क्रैप नहीं। प्रत्येक में
title,url,website_name,snippet,favicon, और जेमिनी द्वारा उपयोग की गई हाइलाइट की गई अंश शामिल होते हैं। - देश कोड के साथ स्थानीयकरण करें।
countryफ़ील्ड उत्तर को एक क्षेत्र में आकार देती है, उसी तरह जैसे वहां का एक उपयोगकर्ता इसे देखता है। - यहाँ आप एआई उत्तरों में ब्रांड दृश्यता की निगरानी कैसे कर सकते हैं। जेमिनी से आपके ग्राहकों द्वारा पूछे गए प्रश्न पूछें और पढ़ें कि यह किस स्रोत का हवाला देता है।
- शुरू करने के लिए मुफ्त। नए स्क्रैपलेस खाते में मुफ्त स्क्रैपर एपीआई उपयोग शामिल है - app.scrapeless.com पर साइन अप करें।
परिचय: जानें कि जेमिनी वास्तव में क्या उत्तर देता है
एआई उत्तर इंजन अब उपयोगकर्ताओं और खुले वेब के बीच स्थित हैं। जब कोई गूगल जेमिनी से "सर्वश्रेष्ठ प्रॉक्सी सेवा" या "न्यूयॉर्क में करने की चीज़ें" पूछता है, तो उत्तर - और यह जिन स्रोतों का हवाला देता है - उस उपयोगकर्ता के विश्वास को आकार देते हैं इससे पहले कि वे कुछ भी क्लिक करें। ब्रांड की निगरानी, प्रतिस्पर्धात्मक अनुसंधान, और उत्तर-इंजन ऑप्टिमाइजेशन के लिए, सवाल अब "मैं गूगल पर कहाँ रैंक करता हूँ" नहीं बल्कि "जेमिनी क्या कहता है, और यह किसका हवाला देता है" है।
स्क्रैपलेस जेमिनी स्क्रैपर इसका प्रोग्रामेटिक उत्तर देता है। आप scraper.gemini अभिनेता को एक प्रॉम्प्ट भेजते हैं और उत्तर पाठ के साथ-साथ इसके पीछे के संरचित उद्धरण प्राप्त करते हैं। यह गाइड अनुरोध आकार, एक पहला curl, प्रतिक्रिया स्कीमा, एक पायथन इंटीग्रेशन, और इसका उपयोग कैसे करें - सभी अनुरोध और प्रतिक्रिया नीचे लाइव एपीआई के खिलाफ कैप्चर की गई हैं।
आप इसके साथ क्या कर सकते हैं
- जेमिनी के उत्तर पाठ को कैप्चर करें — पूरा उत्तर कॉमनमार्क-शैली मार्कडाउन के रूप में, संग्रहित या विश्लेषण करने के लिए तैयार।
- उद्धरण पढ़ें — स्रोत जिन्हें जेमिनी ने उत्तर पर आधारित किया, प्रत्येक का शीर्षक, यूआरएल, और इस्तेमाल किया गया अंश।
- एआई उत्तरों में ब्रांड उल्लेखों की ट्रैकिंग करें — उन प्रश्नों को पूछें जो आपके खरीदार पूछते हैं और देखें कि क्या आप प्रकट होते हैं।
- क्षेत्र के अनुसार स्थानीयकरण करें —
countryको सेट करें ताकि आप उस बाजार में एक उपयोगकर्ता की तरह उत्तर देख सकें। - निगरानी पाइपलाइन को फीड करें — एक शेड्यूल पर समान प्रॉम्प्ट्स चलाएं और समय के साथ स्रोतों में परिवर्तन को देखिए।
स्क्रैपलेस जेमिनी स्क्रैपर क्यों
जेमिनी स्क्रैपर स्क्रैपलेस LLM चैट स्क्रैपर लाइन का एक हिस्सा है, जो डेटा के रूप में एआई-इंजिन उत्तर पढ़ने का प्रबंधित तरीका है। विशेष रूप से जेमिनी के लिए, यह लाता है:
- एकल अनुरोध अनुबंध — प्रॉम्प्ट भेजें, उत्तर और इसके उद्धरण प्राप्त करें; कोई ब्राउज़र नहीं है।
- संरचित उद्धरण — स्रोत क्षेत्र के रूप में वापस आते हैं, न कि मार्कअप जिसे आपको पार्स करना है।
- 195+ देशों में आवासीय प्रॉक्सी — उत्तर स्वच्छ, क्षेत्र-उपयुक्त निकासी के माध्यम से प्राप्त होते हैं।
- देश के अनुसार स्थानीयकरण — एक फ़ील्ड उत्तर को बाजार के लिए आकार देती है।
app.scrapeless.com पर मुफ्त योजना पर अपना एपीआई कुंजी प्राप्त करें।
पूर्वापेक्षाएँ
- एक स्क्रैपलेस खाता और एपीआई कुंजी — app.scrapeless.com पर साइन अप करें।
- पहले अनुरोध के लिए
curl, और इंटीग्रेशन के लिए पायथन 3.10+। - HTTP और JSON के साथ बुनियादी परिचितता।
जेमिनी स्क्रैपर कैसे काम करता है
यह प्रक्रिया दो कॉल की होती है: कार्य बनाएँ, फिर उसका परिणाम प्राप्त करें।
अनुरोध पैरामीटर
| फ़ील्ड | स्थान | अर्थ |
|---|---|---|
actor |
शीर्ष स्तर | scraper.gemini |
input.prompt |
इनपुट | जेमिनी से पूछे जाने वाला प्रश्न |
input.country |
इनपुट | उत्तर को स्थानीयकरण करने के लिए ISO देश कोड |
प्राधिकरण दोनों कॉल पर x-api-token हेडर है।
त्वरित कैप्चर विद कर्ल
कार्य बनाएँ:
bash
curl -X POST https://api.scrapeless.com/api/v2/scraper/request \
-H "x-api-token: ${SCRAPELESS_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"actor": "scraper.gemini",
"input": { "prompt": "न्यूयॉर्क में अनुशंसित आकर्षण", "country": "US" }
}'
# { "status": "pending", "task_id": "3886db31-…" }
फिर task_id द्वारा परिणाम प्राप्त करें:
bash
curl -X GET https://api.scrapeless.com/api/v2/scraper/result/{task_id} \
-H "x-api-token: ${SCRAPELESS_API_KEY}"
प्रतिक्रिया लिफाफा
एक बार status success होने पर, उत्तर और उद्धरण task_result में होते हैं:
json
// चित्रणात्मक उदाहरण — फ़ील्ड आकार सटीक है (लाइव कैप्चर किया गया); मान संक्षिप्त
{
"status": "success",
"task_result": {
"prompt": "न्यूयॉर्क में अनुशंसित आकर्षण",
"result_text": "न्यूयॉर्क शहर संस्कृति, इतिहास का एक सुंदर अराजकता है …",
"citations": [
{
"title": "न्यूयॉर्क में करने के लिए 20 सर्वश्रेष्ठ चीजें",
"url": "https://example.com/nyc",
"website_name": "एक्सample यात्रा",
"snippet": "स्वतंत्रता की प्रतिमा से…",
"favicon": "https://example.com/favicon.ico",
"highlights": ["स्वतंत्रता की प्रतिमा", "सेंट्रल पार्क"]
}
]
}
}
एक लाइव रन में यह लगभग 12 सेकंड में 15 उद्धरणों के साथ वापस आया, प्रत्येक में उपरोक्त छह क्षेत्र शामिल हैं।
---
## पाइथन में एपीआई को एकीकृत करना
कार्य बनाएँ, पूर्ण होने तक पोल करें, और उत्तर पढ़ें:
```python
import os
import time
import requests
API_KEY = os.environ["SCRAPELESS_API_KEY"]
BASE = "https://api.scrapeless.com"
HEADERS = {"x-api-token": API_KEY, "Content-Type": "application/json"}
def ask_gemini(prompt: str, country: str = "US") -> dict:
created = requests.post(
f"{BASE}/api/v2/scraper/request",
headers=HEADERS,
json={"actor": "scraper.gemini", "input": {"prompt": prompt, "country": country}},
timeout=60,
)
task_id = created.json()["task_id"]
for _ in range(30):
time.sleep(3)
got = requests.get(f"{BASE}/api/v2/scraper/result/{task_id}", headers=HEADERS, timeout=60)
data = got.json()
if data.get("status") in ("success", "failed"):
return data
raise TimeoutError("परिणाम समय पर तैयार नहीं है")
result = ask_gemini("न्यूयॉर्क में अनुशंसित आकर्षण")
answer = result["task_result"]
print(answer["result_text"])
for c in answer["citations"]:
print("-", c["website_name"], c["url"])
अपने एपीआई कुंजी को मुफ्त योजना पर प्राप्त करें: app.scrapeless.com
सामान्य समस्याओं से कैसे बचें
- कोई क्षेत्र जो मौजूद नहीं है, वह शून्य है, त्रुटि नहीं। हर उत्तर में 'हाइलाइट्स' या 'फेविकॉन' नहीं होते; प्रत्येक उद्धरण क्षेत्र को वैकल्पिक मानें और इसकी अनुपस्थिति के लिए सुरक्षित रखें।
- परिणाम तुरंत प्राप्त करें। परिणाम
task_idद्वारा प्राप्त किया जाता है; कार्य बनाने के तुरंत बाद पोल करें, न कि लंबे समय बाद, और पढ़ने के लिए लंबे अंतराल के बजाय एक छोटे पोल अंतराल को प्राथमिकता दें। - देश को उस बाजार में सीमित करें जिसका आप अध्ययन कर रहे हैं।
countryक्षेत्र उत्तर को बदलता है; इसे निगरानी रन के अनुसार निश्चित रखें ताकि परिणाम समय के साथ तुलनीय हों। - उत्तर विभिन्न चलनों के बीच भिन्न होते हैं। जेमिनी की शब्दावली हर रन में बदलती है, इसलिए उद्धरण स्रोतों की तुलना समय के साथ करें, न कि सटीक गद्य — उत्तर इंजन कैसे पृष्ठों को प्रस्तुत करते हैं, इसके बारे में विवरण Google के अपने एआई-फीचर्स मार्गदर्शन के लिए वेब में है, और HTTP अनुबंध जिसे आप कॉल कर रहे हैं वह HTTP अर्थशास्त्र विनिर्देश का पालन करता है।
निष्कर्ष: आपका ब्रांड, जैसा कि जेमिनी इसे देखता है
जेमिनी स्क्रैपर एक एआई उत्तर को डेटा में परिवर्तित करता है जिसे आप ट्रैक कर सकते हैं: प्रतिक्रिया पाठ और इसके पीछे के सटीक स्रोत, एक दो कॉल प्रवाह में। अपने ग्राहकों द्वारा पूछे गए संकेतों को चलाएँ, उद्धरण संग्रहीत करें, और देखें कि समय के साथ जेमिनी के उत्तरों में आपकी दृश्यता कैसे बदलती है। इसे यूनिवर्सल स्क्रैपिंग एपीआई लाइन के अन्य इंजनों के साथ जोड़ें, क्यों उत्तर इंजन ने खोज को बदला पर पढ़ें, और दस्तावेज़ प्रत्येक क्षेत्र को कवर करते हैं।
क्या आप अपने एआई-संचालित डेटा पाइपलाइन बनाने के लिए तैयार हैं?
हमारे समुदाय से जुड़ें, मुफ्त योजना का दावा करें और एआई उत्तरों की निगरानी करने वाले डेवलपर्स के साथ संपर्क करें: Discord · Telegram。
मुफ्त स्क्रैपर एपीआई उपयोग के लिए app.scrapeless.com पर साइन अप करें, और पैमाने के लिए मूल्य निर्धारण देखें।
सामान्य प्रश्न
प्रश्न: जेमिनी स्क्रैपर क्या लौटाता है?
उत्तर पाठ Markdown के रूप में (result_text) और एक citations सूची - प्रत्येक उद्धरण में title, url, website_name, snippet, favicon, और highlights होते हैं जो जेमिनी ने उपयोग किया। एक लाइव रन में एक संकेत ने 15 उद्धरण लौटाए।
प्रश्न: क्या यह समकालीन है?
नहीं। आप कार्य बनाने के लिए संकेत को POST करते हैं और task_id द्वारा उत्तर प्राप्त करते हैं। एक लाइव रन में उत्तर लगभग 12 सेकंड में तैयार था।
प्रश्न: क्या मैं उत्तर को स्थानीयकरण कर सकता हूं?
हां - 'input.country' को एक ISO कोड पर सेट करें। उत्तर उस बाजार के अनुसार आकार दिया जाता है, इसलिए जब आप समय के साथ परिणामों की तुलना करते हैं तो इसे निश्चित रखें।
प्रश्न: उत्तरों में अंतर क्यों है?
संविधानिक उत्तर शब्दों में भिन्न होते हैं। निगरानी के लिए, उद्धरण स्रोतों और यह कि आपका ब्रांड प्रकट होता है, पर नज़र रखें, न कि सटीक गद्य।
प्रश्न: क्या मुझे एक प्रॉक्सी की आवश्यकता है?
नहीं। निकास को निवासी आईपी के माध्यम से अभिनेता के भीतर संभाला जाता है; आप केवल संकेत और देश भेजते हैं।
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



