TikTok हैशटैग प्रदर्शन विश्लेषण ट्रैक किए गए रचनाकारों के लिए
Web Data Collection Specialist
TL;DR:
- टिकटोक हैशटैग प्रदर्शन विश्लेषण एक परिभाषित पोस्ट नमूने के साथ शुरू होता है। ट्रैक किए गए पोस्टों के साथ लौटाए गए हैशटैग उस नमूने का वर्णन करते हैं, न कि टिकटोक पर प्रत्येक पोस्ट का।
- हैशटैग स्ट्रिंग्स को समूह बनाने से पहले सामान्यीकरण की आवश्यकता होती है। अग्रणी हैश को हटा दें, यूनिकोड सामान्यीकरण लागू करें, और केस-संवेदी तुलना करें।
- एक पोस्ट कई हैशटैग समूहों में योगदान कर सकती है। टैग-स्तरीय कुल ओवरलैप होते हैं और उन्हें एक विशेष श्रेणी में संबंधित प्रत्येक पोस्ट के रूप में एक साथ नहीं जोड़ा जाना चाहिए।
- मध्यम और नमूना गणनाएँ हैशटैग तुलना को ऑडिट करना आसान बनाती हैं। एक उच्च-प्ले पोस्ट औसत और कुल को विकृत कर सकती है।
- हैशटैग सह-उपस्थिति वर्णनात्मक सबूत है। एक टैग के लिए एक मजबूत मेट्रिक यह साबित नहीं करता है कि टैग ने परिणाम का कारण बना।
- शुरू करने के लिए मुक्त। नए स्क्रैपलेस खातों में स्क्रैपलेस डैशबोर्ड के माध्यम से मुफ्त क्रेडिट शामिल होता है।
परिचय: एक हैशटैग रिपोर्ट केवल उतनी ही स्पष्ट होती है जितनी इसकी तुलना सेट
टिकटोक पोस्ट अक्सर कई हैशटैग ले जाते हैं, जबकि उनके सार्वजनिक काउंटर पोस्ट को संपूर्ण रूप में वर्णन करते हैं। यह एक अनुदान समस्या पैदा करता है: प्रत्येक टैग जो एक पोस्ट से जुड़ा होता है, उसी प्ले, लाइक, टिप्पणी और संग्रह गणनाओं को विरासत में लेता है।
एक उपयोगी टिकटोक हैशटैग प्रदर्शन विश्लेषण इसलिए ज्ञात निर्माताओं और अवलोकन विंडो से सीमित सेट के पोस्ट के साथ शुरू होता है। यह गाइड दर्शाता है कि टिक टोक पोस्ट में हैशटैग कैसे विश्लेषण करें, टैग नामों को सामान्यीकरण करें, संग्रहीत नमूने के भीतर संलग्नता की तुलना करें, और एक रिपोर्ट प्रकाशित करें जो ओवरलैप और अनिश्चितता को स्पष्ट रखे।
टिकटोक अभिनेता गाइड इस वर्कफ़्लो में उपयोग किए गए प्रोफ़ाइल, पोस्ट और शॉप अभिनेताओं को कवर करता है।
पाइपलाइन एक नज़र में
| चरण | क्रिया | आउटपुट |
|---|---|---|
| एकत्र करें | ट्रैक किए गए निर्माताओं के लिए सार्वजनिक पोस्ट को सहेजें | समय-चिह्नित कच्चे स्नैपशॉट |
| सामान्यीकृत करें | हैशटैग स्ट्रिंग्स और पहचानकर्ताओं को साफ करें | पोस्ट-टू-टैग पंक्तियाँ |
| समूहबद्ध करें | निर्माता और अवलोकन विंडो द्वारा विभाजित करें | قابل сравним टैग नमूने |
| मापें | गणनाएँ, मध्यम, और संलग्नता दर की गणना करें | हैशटैग तुलना तालिका |
| समीक्षा करें | छोटे नमूनों, ओवरलैप, और बाहरी तत्वों को चिह्नित करें | विश्लेषण-तैयार रिपोर्ट |
यह रिपोर्ट एकत्रित पोस्टों को मापती है। यह एक प्लेटफ़ॉर्म-व्यापी टिकटोक ट्रेंड सूचकांक नहीं है।
पूर्वापेक्षाएँ
scraper.tiktok.user.workसे एक सहेजा गया JSON प्रतिक्रिया- प्रत्येक प्रतिक्रिया के साथ संग्रहित निर्माता पहचानकर्ता और संग्रहण समय
- मानक पुस्तकालय के साथ Python 3
- टैग को रैंक करने से पहले चुनी गई न्यूनतम-सैंपल नियम
- नए स्नैपशॉट एकत्र करते समय स्क्रैपलेस डैशबोर्ड से एक स्क्रैपलेस खाता और API कुंजी
परिवर्तन कार्य ब्लॉक एक पूर्वापेक्षा अंतर है क्योंकि पाठक सहेजे गए प्रतिक्रिया देता है। यह एक आविष्कारित लाइव परिणाम प्रस्तुत नहीं करता है।
चरण 1: निर्माता और समय विंडो को परिभाषित करें
एक हैशटैग तुलना के लिए एक स्थिर हरियाली की आवश्यकता होती है। प्रत्येक कच्चे लोड के बगल में निर्माता आईडी, संग्रहण टाइमस्टैम्प, अनुरोधित कर्सर, अनुरोधित गणना, और लौटाए गए पोस्टों की गणना को स्टोर करें। यदि कई निर्माताओं की तुलना की जाती है, तो संयुक्त दृश्य उत्पन्न करने से पहले प्रत्येक निर्माता को एक अलग समूह के रूप में बनाए रखें।
टिकटोक डेवलपर स्पेकिफिकेशन वीडियो-प्रश्न क्षेत्रों में हैशटैग नामों और सार्वजनिक इंटरएक्शन गणनाओं की सूचि बनाता है प्रश्न वीडियो दस्तावेज़ीकरण में। स्क्रैपलेस टिकटोक पोस्ट अभिनेता के माध्यम से समानांतर पोस्ट क्षेत्रों को लौटाता है, जिसमें hashtags, play_count, digg_count, comment_count, और collect_count शामिल हैं।
एक निर्माता के पूर्ण बैक कैटलॉग की तुलना किसी अन्य निर्माता के हालिया पोस्ट से न करें और अंतर को हैशटैग प्रभाव लेबल न करें। मेल खाते अवलोकन विंडो का उपयोग करें या तालिका में असंगति को स्पष्ट करें।
चरण 2: स्रोत मूल्य खोए बिना हैशटैग को सामान्यीकृत करें
प्रतिक्रिया में हैशटैग स्ट्रिंग्स जैसे #Example शामिल हैं। समीक्षा के लिए कच्ची मान बनाए रखें और एक अलग सामान्यीकृत कुंजी बनाएं:
- यूनिकोड NFKC सामान्यीकरण लागू करें।
- सफेद स्थान ट्रिम करें।
- एक अग्रणी
#हटाएं। casefold()के साथ केस-संवेदी तुलना लागू करें।- पोस्ट-टू-टैग तालिका में खाली मानों को हटा दें।
Python का यूनिकोड डेटाबेस दस्तावेज़ीकरण उदाहरण में उपयोग की गई सामान्यीकरण प्रक्रिया को परिभाषित करता है। सामान्यीकृत कुंजी दृष्टिगत रूप से समान स्ट्रिंग्स को अलग पंक्तियों में विभाजित होने से रोकती है, जबकि कच्चा टैग स्रोत द्वारा लौटाए गए को बनाए रखता है।
स्क्रैपलेस के साथ स्क्रैपिंग शुरू करें
अपनी वेब स्क्रैपिंग और स्वचालन कार्यप्रवाह को स्क्रैपलेस के साथ पावरअप करें!
आज साइन अप करें और $5 का मुफ्त क्रेडिट प्राप्त करें — कोई क्रेडिट कार्ड की आवश्यकता नहीं।
अपने मुफ्त क्रेडिट को Scrapeless Dashboard पर अभी प्राप्त करें।
चरण 3: प्रत्येक पोस्ट-हैशटैग जोड़ी के लिए एक पंक्ति बनाएं
प्रत्येक पोस्ट को एक अद्वितीय सामान्यीकृत हैशटैग के लिए एक पंक्ति में विभाजित करें। एक पोस्ट में दोहराए गए टैग को हटाएं ताकि एक पोस्ट एक ही टैग के लिए दो बार गिना न जाए। टैग समूहों की ओवरलैपिंग के कारण हर पंक्ति पर पोस्ट आईडी रखें।
नोट: निचे का कोड एक पाठक द्वारा प्रदान किए गए
posts-snapshot.jsonकी आवश्यकता करता है जोscraper.tiktok.user.workसे सहेजा गया है। फ़ाइल में या तो लौटाई गई पोस्ट की सूची हो सकती है या एक ऑब्जेक्ट जिसमेंdataफ़ील्ड उस सूची को शामिल करती है।
python
import csv
import json
import statistics
import unicodedata
def normalize_tag(value):
text = unicodedata.normalize("NFKC", str(value or "")).strip()
return text.removeprefix("#").casefold()
def number(value):
try:
return int(value)
except (TypeError, ValueError):
return 0
with open("posts-snapshot.json", encoding="utf-8") as source:
payload = json.load(source)
posts = (
payload.get("items", payload.get("data", payload))
if isinstance(payload, dict) else payload
)
groups = {}
for post in posts:
play_count = number(post.get("play_count"))
engagements = sum(number(post.get(field)) for field in (
"digg_count", "comment_count", "collect_count"
))
engagement_rate = engagements / play_count if play_count else None
tags = {normalize_tag(tag) for tag in (post.get("hashtags") or [])}
for tag in sorted(tag for tag in tags if tag):
group = groups.setdefault(tag, {
"post_ids": set(), "plays": [], "rates": []
})
group["post_ids"].add(str(post.get("video_id") or ""))
group["plays"].append(play_count)
if engagement_rate is not None:
group["rates"].append(engagement_rate)
rows = []
for tag, group in groups.items():
rows.append({
"hashtag": tag,
"post_count": len(group["post_ids"]),
"median_plays": statistics.median(group["plays"]),
"median_engagement_rate": (
statistics.median(group["rates"]) if group["rates"] else ""
),
})
rows.sort(key=lambda row: (-row["post_count"], -row["median_plays"]))
with open("hashtag-performance.csv", "w", newline="", encoding="utf-8") as output:
writer = csv.DictWriter(output, fieldnames=rows[0].keys() if rows else [
"hashtag", "post_count", "median_plays", "median_engagement_rate"
])
writer.writeheader()
writer.writerows(rows)
कोड केवल गायब गिनती फ़ील्ड के लिए शून्य का उपयोग करता है। एक गायब या शून्य प्ले गिनती सहभागिता दर को खाली छोड़ देती है क्योंकि विभाजन उपयोगी तुलना नहीं करेगा।
चरण 4: समान संदर्भ में हैशटैग की तुलना करें
एक व्यावहारिक TikTok निर्माता हैशटैग विश्लेषण तालिका में निर्माता, अवलोकन विंडो, हैशटैग, पोस्ट की संख्या, मध्य प्ले, मध्य सहभागिता दर, और एक छोटे नमूने का ध्वज शामिल होना चाहिए। पायथन की गणितीय सांख्यिकी संबंधी दस्तावेज रूपांतरण में उपयोग की गई मध्य राशि को परिभाषित करता है।
विश्लेषक दृश्य में दोनों मध्य और अधिकतम मान बनाए रखें। मध्य एक सामान्य नमूना पोस्ट का वर्णन करता है, जबकि अधिकतम एक ब्रेकआउट पोस्ट को दृश्यमान बनाता है। एक देखी गई पोस्ट के साथ एक टैग को अधिक व्यापक नमूने द्वारा समर्थित टैग से ऊपर रैंक करने से बचें बिना स्पष्ट चेतावनी दिए।
एक TikTok हैशटैग सहभागिता की तुलना के लिए, पहले निर्माता-स्तरीय पंक्तियों की गणना करें। एक संयुक्त पंक्ति तब उन निर्माता-स्तरीय परिणामों का सारांश दे सकती है बिना उच्च मात्रा वाले खाते को हर टैग पर हावी होने की अनुमति दिए।
चरण 5: ओवरलैप दिखाने वाली रिपोर्ट प्रकाशित करें
अंतिम TikTok सामग्री हैशटैग रिपोर्ट इस संरचना का उपयोग कर सकती है:
| निर्माता | हैशटैग | पोस्ट | मध्य प्ले | मध्य सहभागिता दर | नमूना ध्वज |
|---|---|---|---|---|---|
| ट्रैक किया गया खाता | सामान्यीकृत टैग | टैग ले जाने वाले पोस्ट | पोस्ट-स्तरीय मध्य | पोस्ट-स्तरीय मध्य | पर्याप्त या समीक्षा |
एक नोट जोड़ें कि पोस्ट एक से अधिक हैशटैग पंक्ति में दिखाई दे सकती हैं। इसलिए हैशटैग पंक्तियों में कुल गैर-जोड़नीय हैं। यदि एक पोस्ट में तीन टैग होते हैं, तो इसके मैट्रिक्स उस पोस्ट का वर्णन करते हैं और तीन वर्णात्मक समूहों में दिखाई देते हैं; डेटा यह अलग नहीं कर सकता कि किस टैग ने वितरण को प्रभावित किया।
Scrapeless TikTok अभिनेताओं को Scraping API के माध्यम से उजागर करता है। निर्माता कवरेज और संग्रह आवृत्ति चुनने से पहले वर्तमान मूल्य निर्धारण पृष्ठ की जांच करें।
निर्माता डेटा का जिम्मेदारी से प्रबंधन करें
उन सार्वजनिक फ़ील्ड्स को एकत्र करें जो दिए गए विश्लेषण के लिए आवश्यक हैं, निर्माता पहचानकर्ताओं को केवल तब तक बनाए रखें जब तक रिपोर्टिंग के उद्देश्य की आवश्यकता हो, और कच्चे डेटा तक पहुँच को सीमित करें। NIST प्राइवेसी फ्रेमवर्क गोपनीयता जोखिम प्रबंधन के लिए एक सामान्य संरचना प्रदान करता है।
हैशटैग विश्लेषण को सामग्री समीक्षा का समर्थन करना चाहिए, न कि किसी व्यक्तिगत निर्माता के बारे में स्वचालित निर्णय। सार्वजनिक पोस्ट डेटा को एकत्रित करने और उपयोग करने के समय लागू शर्तों, प्लेटफ़ॉर्म नियंत्रणों और स्थानीय कानूनों का सम्मान करें।
निष्कर्ष: नमूने के भीतर हैशटैग दावा बनाए रखें
TikTok हैशटैग प्रदर्शन विश्लेषण तब बचाव योग्य हो जाता है जब रिपोर्ट अपने संग्रह विंडो, निर्माता समूहों, ओवरलैपिंग टैग और नमूना आकारों को बनाए रखती है। टैग कुंजी को सामान्यीकृत करें, पोस्ट-स्तरीय मध्य का उपयोग करें, बाहरी पोस्ट दिखाएं, और परिणाम का वर्णन एक संग्रहित पोस्ट के भीतर एक संबंध के रूप में करें, न कि कारणात्मक या वैश्विक प्रवृत्ति दावे के रूप में।
क्या आप हैशटैग रिपोर्ट बनाने के लिए तैयार हैं?
पोस्ट-से-टैग स्कीमा पर चर्चा करने के लिए Scrapeless Discord या Telegram समुदाय से जुड़ें। जब निर्माता वॉचलिस्ट तैयार हो जाए, तो Scrapeless Dashboard में एक खाता बनाएं।
सामान्य प्रश्न
प्रश्न: एक टीम TikTok पोस्ट में हैशटैग का विश्लेषण कैसे कर सकती है?
एक टीम TikTok पोस्ट में हैशटैग का विश्लेषण सीमित पोस्ट नमूने को सहेजकर, प्रत्येक लौटाए गए टैग को सामान्यीकृत करके, पोस्ट को पोस्ट-से-टैग पंक्तियों में विस्तारित करके, और नमूना गिनती के साथ मैट्रिक्स की तुलना करके कर सकती है।
प्रश्न: क्या सबसे अधिक प्ले वाला हैशटैग बेहतर प्रदर्शन का कारण बनता है?
नहीं। हैशटैग ले जाने वाले पोस्ट के लिए उच्च प्ले नमूने में एक संघ को दिखाते हैं और यह स्थापित नहीं करते कि हैशटैग ने परिणाम का कारण बना।
प्रश्न: हैशटैग रिपोर्ट में मध्य का उपयोग क्यों किया जाना चाहिए?
मध्य एक असामान्य रूप से बड़े पोस्ट के प्रभाव को कम करता है और सामान्य नमूना पोस्ट की तुलना करना आसान बनाता है।
प्रश्न: क्या यह कार्यप्रवाह वैश्विक TikTok हैशटैग प्रवृत्तियों की पहचान कर सकता है?
यह कार्यप्रवाह वैश्विक TikTok हैशटैग ट्रेंड्स की पहचान नहीं कर सकता क्योंकि यह एकत्र किए गए निर्माता पोस्ट से जुड़े हैशटैग का विश्लेषण करता है न कि प्लेटफ़ॉर्म-व्यापी हैशटैग खोज।
Q: क्या टीमों को पोस्ट-पृष्ठ सेलेक्टर्स का प्रबंधन करने की आवश्यकता है?
TikTok पोस्ट अभिनेता API के माध्यम से संरचित पोस्ट फ़ील्ड वापस करता है। कॉलर निर्माता चयन, अवलोकन विंडो, भंडारण, सामान्यीकरण और रिपोर्टिंग का प्रबंधन करता है।
Q: क्या सार्वजनिक TikTok पोस्ट डेटा को स्क्रैप करना कानूनी है?
कानूनीता क्षेत्राधिकार, उद्देश्य, पहुँच विधि, लागू शर्तों, और एकत्र किए गए फ़ील्ड पर निर्भर करती है। सार्वजनिक डेटा का उपयोग अनुमत उद्देश्य के लिए करें और उद्देश्य के कार्यप्रवाह के लिए कानूनी सलाह लें।
स्क्रैपलेस में, हम केवल सार्वजनिक रूप से उपलब्ध डेटा का उपयोग करते हैं, जबकि लागू कानूनों, विनियमों और वेबसाइट गोपनीयता नीतियों का सख्ती से अनुपालन करते हैं। इस ब्लॉग में सामग्री केवल प्रदर्शन उद्देश्यों के लिए है और इसमें कोई अवैध या उल्लंघन करने वाली गतिविधियों को शामिल नहीं किया गया है। हम इस ब्लॉग या तृतीय-पक्ष लिंक से जानकारी के उपयोग के लिए सभी देयता को कोई गारंटी नहीं देते हैं और सभी देयता का खुलासा करते हैं। किसी भी स्क्रैपिंग गतिविधियों में संलग्न होने से पहले, अपने कानूनी सलाहकार से परामर्श करें और लक्ष्य वेबसाइट की सेवा की शर्तों की समीक्षा करें या आवश्यक अनुमतियाँ प्राप्त करें।



