इस प्रोजेक्ट के बारे में

wechat-data-analysis एक स्थानीय डेस्कटॉप टूल है जिसका उपयोग आधिकारिक खाता लेख बैकएंड डेटा को एकीकृत और विश्लेषण करने के लिए किया जाता है। मुख्य कार्यों में शामिल हैं: `data/` निर्देशिका में लेख विवरण फाइलों को स्वचालित रूप से स्कैन करना, जो `.xls`, `.xlsx`, `.csv`, `.json` प्रारूपों का समर्थन करता है; डुप्लिकेट फाइलों को स्वचालित रूप से पहचानना और छोड़ना; पारदर्शी सूत्रों के साथ Excel सांख्यिकीय तालिकाएं और पढ़ने में आसान HTML विज़ुअलाइज़ेशन रिपोर्ट उत्पन्न करना; एक स्वच्छ डेस्कटॉप GUI इंटरफ़ेस प्रदान करना, जो एक-क्लिक विश्लेषण का समर्थन करता है; इसे सिंगल-फाइल exe के रूप में पैक किया जा सकता है जिसे सीधे Windows पर डबल-क्लिक करके चलाया जा सकता है। आउटपुट Excel में पांच वर्कशीट्स शामिल हैं: सारांश डैशबोर्ड, डेटा विवरण, लेख विश्लेषण, संकेतक विवरण और प्रोसेसिंग लॉग। HTML रिपोर्ट में समग्र संकेतक, मासिक रुझान, चैनल संरचना, TOP10 लेख और क्षमता वाले लेख शामिल हैं। स्कोरिंग सिस्टम बहु-आयामी वेटिंग का उपयोग करता है: रीडिंग परफॉरमेंस स्कोर (70% रीडिंग संख्या पर्सेंटाइल + 30% ओपन रेट पर्सेंटाइल), इंटरेक्शन परफॉरमेंस स्कोर (35% शेयर रेट + 25% लाइक रेट + 15% 'Looking' रेट + 10% कलेक्शन रेट + 15% कमेंट रेट), रिटेंशन परफॉरमेंस स्कोर (65% पूर्ण रीडिंग रेट + 35% औसत ठहराव समय), और कन्वर्जन परफॉरमेंस स्कोर (100% फॉलो रेट)। समग्र सूचकांक 4:3:2:1 के वेटिंग अनुपात के अनुसार संकलित किया जाता है। उपयोग के तीन तरीके हैं: GUI खोलने के लिए `python main.py` चलाएं; कमांड लाइन `python gzh_analyzer.py --input data --output-dir output`; या सीधे उत्पन्न `gzh_report_tool.exe` पर डबल-क्लिक करें, प्रोग्राम स्वचालित रूप से समान स्तर या डेस्कटॉप की data/output निर्देशिका को पहचान लेगा। डिफ़ॉल्ट इनपुट निर्देशिका सॉफ़्टवेयर के समान स्तर की `data/` है, और आउटपुट निर्देशिका `output/` है। यदि वर्तमान निर्देशिका लिखने योग्य नहीं है, तो यह स्वचालित रूप से डेस्कटॉप पर वापस चला जाएगा।