चैटजीपीटी स्क्रैपर एपीआई: संरचित मानचित्र और स्थानीय व्यवसाय डेटा निकालें
Web Data Collection Specialist
TL;DR:
- ChatGPT स्क्रैपर (
scraper.chatgpt) अब एक संरचितmapऑब्जेक्ट लौटाता है जब ChatGPT का उत्तर स्थानीय व्यवसायों को शामिल करता है। - एक
POST/api/v2/scraper/executeपर एक स्थानीय इरादे वाले प्रम्प्ट से क्रमबद्ध स्थान मिलते हैं जिनमें नाम, समन्वय, पता, फोन, वेबसाइट, घंटे, रेटिंग, समीक्षा संख्या, मूल्य स्तर, और लिस्टिंग प्रदाता शामिल होते हैं। - अब कोई प्रोस को पार्स करने की ज़रूरत नहीं: ChatGPT द्वारा "बेस्ट कॉफी नजदीक…" उत्तर में नामित स्थान अब एक साफ़ एरे के रूप में वापस आते हैं जिसे आप क्रमबद्ध, फ़िल्टर, और संग्रहीत कर सकते हैं।
- फ़ील्ड्स नल हो सकते हैं और प्रदाता द्वारा प्रदान किए गए हैं: रेटिंग, घंटे, और दूरी एक इकाई के अनुसार गायब हो सकते हैं, इसलिए परिभाषित रूप से पार्स करें।
- नि:शुल्क शुरू करें। नए Scrapeless खाते में मुफ़्त Scraper API क्रेडिट शामिल हैं — app.scrapeless.com पर साइन अप करें।
जब आप ChatGPT से एक स्थानीय सवाल करते हैं - "Times Square के पास सबसे अच्छी रेटेड कॉफी की दुकानें" - तो उत्तर में वास्तविक स्थानों का नाम होता है, और हाल ही तक यह डेटा प्रोस में लॉक था। Scrapeless Scraping API अब इसे एक समर्पित map ऑब्जेक्ट के रूप में प्रस्तुत करता है: व्यवसायों की क्रमबद्ध सूची उनके पूर्ण प्रोफ़ाइल के साथ, रैंक करने या मॉनिटर करने के लिए तैयार। यह गाइड दिखाता है कि इसे कैसे अनुरोध किया जाए, ऑब्जेक्ट में क्या शामिल है, और कहाँ फील्ड्स को ध्यान से देखने की आवश्यकता है। नीचे प्रत्येक अनुरोध और फ़ील्ड को एक लाइव रन से कैप्चर किया गया था।
ChatGPT मैप डेटा के साथ आप क्या कर सकते हैं
कार्यकर्ता एक स्थानीय इरादे वाले प्रम्प्ट को लेता है और उन व्यवसायों को लौटाता है जिन्हें ChatGPT संरचित इकाइयों के रूप में प्रस्तुत करता है। व्यावहारिक रूप से, यह आपको अनुमति देता है:
- स्थानीय-पैक दृश्यता को ट्रैक करें - देखें कि ChatGPT "बेस्ट X नजदीक Y" क्वेरी के लिए कौन से व्यवसायों का नाम लेता है, किस क्रम में, उनके रेटिंग और समीक्षा संख्या के साथ।
- स्थान डेटा सेट बनाएं - उत्तर में स्थानों के लिए नाम, समन्वय, पता, फोन, और वेबसाइट निकालें, वही प्रोफ़ाइल फ़ील्ड जो प्लेस API द्वारा उजागर किया जाता है, बिना मानचित्र UI को स्क्रैप किए।
- एक ब्रांड या प्रतिस्पर्धी की निगरानी करें - यह जांचें कि क्या एक विशिष्ट व्यवसाय समय के साथ ChatGPT की स्थानीय सिफारिशों में प्रकट होता है।
- डाउनस्ट्रीम सिस्टम को फ़ीड करें - क्रमबद्ध इकाइयों को डैशबोर्ड, मानचित्र, या अलर्ट में क्लीन JSON के रूप में पाइप करें।
Scrapeless ChatGPT अभिनेता क्यों
ChatGPT के उत्तर एक इंटरफ़ेस के पीछे उत्पन्न होते हैं, ना कि संरचित फ़ीड के रूप में प्रदान किए जाते हैं। Scrapeless अभिनेता क्वेरी चलाता है और एक डेवलपर-फ्रेंडली एन्वेलप लौटाता है, ताकि आपका कोड फ़ील्ड पढ़ता है बजाय इसके कि किसी उत्तर को regex-पार्स करके, ब्राउज़र चलाकर, या एंटी-ब्लॉकिंग इन्फ्रास्ट्रक्चर को बनाए रखकर। map ऑब्जेक्ट उसी प्रतिक्रिया का हिस्सा है जो आपको पहले से ही ChatGPT अभिनेता से मिलता है, उत्तर पाठ, खोज परिणामों और उत्पादों के साथ।
एंडपॉइंट और पैरामीटर
अभिनेता समकालिक स्क्रैपर API एंडपॉइंट पर चलता है। x-api-token हेडर में अपने टोकन के साथ प्रमाणित करें।
- एंडपॉइंट:
POST https://api.scrapeless.com/api/v2/scraper/execute - अभिनेता:
scraper.chatgpt
| इनपुट फ़ील्ड | प्रकार | आवश्यक | वर्णन |
|---|---|---|---|
prompt |
स्ट्रिंग | हाँ | ChatGPT को भेजने के लिए प्रश्न। स्थानीय इरादे का उपयोग करें (जैसे "बेस्ट कॉफी नजदीक…") map को भरने के लिए। |
country |
स्ट्रिंग | हाँ | लक्षित देश का कोड, जैसे US। |
web_search |
बोलियन | नहीं | वेब-सर्च संपन्नता सक्षम करें; स्थानीय प्रश्नों के लिए अनुशंसित। |
shopping |
बोलियन | नहीं | products में उत्पाद डेटा लाएं (उच्च दर पर बिल किया जाएगा)। |
जब उत्तर में स्थानीय व्यवसाय होते हैं तो map ऑब्जेक्ट task_result में प्रकट होता है; एक गैर-स्थानीय प्रम्प्ट एक खाली map लौटाता है।
प्रमाणित अनुरोध
एक न्यूनतम अनुरोध इस तरह दिखता है (उदाहरण के लिए — टोकन को प्रतिस्थापित करें):
bash
curl 'https://api.scrapeless.com/api/v2/scraper/execute' \
--header 'Content-Type: application/json' \
--header 'x-api-token: YOUR_API_TOKEN' \
--data '{
"actor": "scraper.chatgpt",
"input": {
"prompt": "Times Square New York के पास सबसे अच्छी रेटेड कॉफी की दुकानें",
"country": "US",
"web_search": true
}
}'
पाइथन इंटीग्रेशन
यह उदाहरण SCRAPELESS_API_KEY पर्यावरण चर से टोकन पढ़ता है, एक स्थानीय क्वेरी भेजता है, और map ऑब्जेक्ट से क्रमबद्ध स्थानों को प्रिंट करता है। यह केवल पायथन मानक पुस्तकालय का उपयोग करता है।
python
import json
import os
import urllib.request
API_URL = "https://api.scrapeless.com/api/v2/scraper/execute"
API_TOKEN = os.environ["SCRAPELESS_API_KEY"]
payload = {
"actor": "scraper.chatgpt",
"input": {
"prompt": "Times Square New York के पास सबसे अच्छी रेटेड कॉफी की दुकानें",
"country": "US",
"web_search": True,
},
}
request = urllib.request.Request(
API_URL,
data=json.dumps(payload).encode("utf-8"),
headers={"Content-Type": "application/json", "x-api-token": API_TOKEN},
method="POST",
)
with urllib.request.urlopen(request, timeout=180) as response:
python
data = json.loads(response.read().decode("utf-8"))
result = data.get("task_result", {})
entities = (result.get("map") or {}).get("entities") or []
print("स्थिति:", data.get("status"))
print("मानचित्र संस्थाएं:", len(entities))
for place in entities[:5]:
inner = place.get("entity", {})
print("-", place.get("name"))
print(" रेटिंग:", inner.get("rating"), "| समीक्षाएं:", inner.get("review_count"), "| कीमत:", inner.get("price_str"))
print(" पता:", inner.get("address"))
मानचित्र ऑब्जेक्ट
map ऑब्जेक्ट task_result में स्थित है और एक रैंक की गई entities सूची के साथ-साथ एक अ排名 कृत raw_search_entities सूची को रखता है। नीचे दिए गए फ़ील्ड वे हैं जिन्हें आप सबसे अधिक उपयोग करेंगे; मान एक जीवंत प्रतिक्रिया के उदाहरण हैं, जो लंबाई के लिए संक्षिप्त हैं।
json
// लाइव scraper.chatgpt रन से उदाहरणात्मक नमूना — फ़ील्ड नाम वास्तविक हैं, मान संक्षेपित हैं।
{
"status": "सफलता",
"task_result": {
"map": {
"entities": [
{
"name": "Frisson Espresso",
"category": "कॉफी_दुकान",
"latitude": 40.760837,
"longitude": -73.9889995,
"entity": {
"address": "326 W 47th St, न्यूयॉर्क, NY 10036, संयुक्त राज्य",
"phone": "+1 646-850-3928",
"website_url": "<व्यापार वेबसाइट>",
"hours": [{ "day": 5, "start": "0700", "end": "1800" }],
"is_open": false,
"categories": ["कॉफी की दुकान", "कैफे", "एस्प्रेसो बार"],
"rating": 4.6,
"review_count": 1006,
"price_str": "$",
"provider": "yelp-feed",
"provider_url": "<प्रदाता सूची URL>",
"distance_meters": null
}
}
],
"raw_search_entities": []
}
}
}
| फ़ील्ड | प्रकार | विवरण |
|---|---|---|
entities |
सरणी | रैंक की गई स्थान ChatGPT ने प्रश्न के लिए उठाया। |
entities[].name |
स्ट्रिंग | व्यवसाय का नाम। |
entities[].latitude / longitude |
संख्या | मानचित्र पिन के लिए समन्वय। |
entities[].category |
स्ट्रिंग | इकाई प्रकार, जैसे कॉफी_दुकान। |
entities[].entity.address |
स्ट्रिंग | पूरा सड़क पता। |
entities[].entity.phone |
स्ट्रिंग | फोन नंबर। |
entities[].entity.website_url |
स्ट्रिंग | आधिकारिक वेबसाइट। |
entities[].entity.hours |
सरणी | दिन के अनुसार खुलने का समय। |
entities[].entity.is_open |
बूल | क्या यह अब खुला है। |
entities[].entity.categories |
सरणी | मानव-पाठ्य श्रेणी लेबल। |
entities[].entity.rating |
संख्या | औसत रेटिंग। |
entities[].entity.review_count |
संख्या | समीक्षाओं की संख्या। |
entities[].entity.price_str |
स्ट्रिंग | मूल्य स्तर, जैसे $। |
entities[].entity.provider |
स्ट्रिंग | सूची का स्रोत, जैसे yelp-feed। |
entities[].entity.provider_url |
स्ट्रिंग | प्रदाता की सूची पृष्ठ। |
entities[].entity.distance_meters |
संख्या | खोजे गए स्थान से दूरी; शून्य हो सकती है। |
raw_search_entities |
सरणी | अ排名 उम्मीदवार संस्थाएं। |
एक जीवंत प्रश्न ने टाइम्स स्क्वायर के पास कॉफी के लिए आठ रैंक की गई स्थान लौटाए; शीर्ष परिणाम, फ्रिसन एस्प्रेसो, ने 1,006 समीक्षाओं पर 4.6 रेटिंग के साथ, $ मूल्य स्तर के साथ, पूरे खुलने के घंटे के साथ, और इसकी सूची प्रदाता के साथ वापस आया।
सामान्य डेटा-आकार समस्याएं
mapगैर-स्थानीय संकेतों के लिए खाली है। ऑब्जेक्ट केवल तब भरता है जब उत्तर में व्यवसाय शामिल होते हैं। अगर आपको खालीmapमिलता है, तो प्रश्न का कोई स्थानीय इरादा नहीं था — संकेत में एक स्थान जोड़ें औरweb_searchको सक्षम करें।- स्थान प्रोफ़ाइल एक स्तर नीचे नेस्टेड है। रैंकिंग फ़ील्ड (
name,latitude,longitude,category) इकाई पर होते हैं, लेकिन संपर्क और प्रोफ़ाइल फ़ील्डentity.*के तहत होते हैं।place["entity"]["rating"]पढ़ें,place["rating"]नहीं। - क्षेत्र प्रदाता-स्रोत और शून्य हो सकते हैं।
distance_meters,hours, और यहां तक किratingकिसी दिए गए इकाई के लिए शून्य हो सकते हैं, इसलिए उनका उपयोग करने से पहले guarda करें। - पुनः प्राप्ति के लिए
raw_search_entitiesका उपयोग करें। रैंक की गईentitiesसूची वह है जो ChatGPT ने प्रदर्शित की;raw_search_entitiesअतिरिक्त उम्मीदवारों को रखता है जब आपको व्यापक कवरेज की आवश्यकता होती है।
साथी अभिनेता
map ऑब्जेक्ट ChatGPT प्रतिक्रिया का एक हिस्सा है, जो उत्तर पाठ, search_result, और products को भी ले जाता है। वही अनुरोध आकार अन्य उत्तर इंजनों को कवर करता है — scraper.chatgpt को scraper.gemini, scraper.perplexity, और बाकी के लिए स्वैप करें। Scrapeless एक ओपन-सोर्स ChatGPT स्क्रैपर उदाहरण भंडार के साथ चलने योग्य कोड प्रदान करता है, और पूर्ण प्रतिक्रिया लिफाफे के लिए ChatGPT स्क्रैपर API गाइड को देखें।
निष्कर्ष
ChatGPT स्क्रैपर का map ऑब्जेक्ट एक संवादात्मक स्थानीय अनुशंसा को संरचित डेटा में परिवर्तित करता है: एक स्थानीय-उद्देश्य की प्रांप्ट भेजें, व्यवसायों की एक रैंक की गई सूची को निर्देशांश, संपर्क विवरण, घंटे, रेटिंग और प्रदाता के साथ पढ़ें। याद रखें कि प्रोफ़ाइल फ़ील्ड entity के तहत नेस्टेड हैं, कि कुछ फ़ील्ड नल योग्य हैं, और कि एक गैर-स्थानीय प्रांप्ट एक खाली मानचित्र लौटाता है। अंतर्निहित स्थान डेटा प्रदाताओं जैसे Yelp से प्राप्त किया गया है, और चारों ओर की उत्तर संरचना चैटजीपीटी अभिनेता संदर्भ में दस्तावेजीकृत है।
क्या आप ChatGPT के स्थानीय डेटा को कैप्चर करने के लिए तैयार हैं? Scrapeless डैशबोर्ड से मुफ्त में शुरू करें, देखें कि यह अभिनेता Scraping API उत्पाद पृष्ठ पर कहां फिट बैठता है, या Scrapeless मूल्य निर्धारण पर योजनाओं की तुलना करें।
अक्सर पूछे जाने वाले प्रश्न
प्रश्न: ChatGPT मानचित्र वस्तु क्या है?
उत्तर: यह scraper.chatgpt प्रतिक्रिया में एक संरचित फ़ील्ड है जो स्थानीय व्यवसायों की सूची बताता है जो ChatGPT एक प्रश्न के लिए प्रदर्शित करता है — प्रत्येक का नाम, निर्देशांश, पता, फोन, वेबसाइट, घंटे, रेटिंग, समीक्षा की संख्या, कीमत स्तर और लिस्टिंग प्रदाता होता है।
प्रश्न: मैं मानचित्र वस्तु को कैसे जनित करूँ?
उत्तर: एक स्थानीय इरादे (एक "Y के निकट सर्वश्रेष्ठ X" शैली का प्रश्न) के साथ प्रांप्ट भेजें और web_search सक्षम करें। एक गैर-स्थानीय प्रांप्ट एक खाली map लौटाता है।
प्रश्न: यह किस एंडपॉइंट और पैरामीटर का उपयोग करता है?
उत्तर: POST https://api.scrapeless.com/api/v2/scraper/execute के साथ actor को scraper.chatgpt पर सेट करें और एक input ऑब्जेक्ट में prompt, country, और वैकल्पिक रूप से web_search शामिल करें। अपने टोकन के साथ x-api-token में प्रमाणित करें।
प्रश्न: प्रतिक्रिया में रेटिंग और पता कहां हैं?
उत्तर: रैंकिंग फ़ील्ड जैसे name और निर्देशांश एन्टिटी पर हैं, लेकिन संपर्क और प्रोफ़ाइल फ़ील्ड्स — address, phone, rating, review_count, hours — entity.* के तहत होते हैं। पढ़ें place["entity"]["rating"]।
प्रश्न: क्या फ़ील्ड हमेशा मौजूद होते हैं?
उत्तर: नहीं। मान प्रदाता द्वारा प्राप्त होते हैं, इसलिए किसी दिए गए एन्टिटी के लिए distance_meters, hours, और rating नल हो सकते हैं। उनका उपयोग करने से पहले गुम मानों के लिए सावधानी बरतें।
प्रश्न: क्या मैं अन्य एआई सहायक के लिए वही कोड का उपयोग कर सकता हूँ?
उत्तर: हाँ। ChatGPT अभिनेता LLM Chat Scraper अनुरोध आकार को साझा करता है, इसलिए scraper.chatgpt को scraper.gemini या scraper.perplexity के लिए स्वैप करना उसी एकीकरण का पुन: उपयोग करता है।
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



