इस प्रोजेक्ट के बारे में
Presidio टेक्स्ट और छवियों में संवेदनशील डेटा (PII) का पता लगाने और उसे अनाम करने के लिए एक ओपन-सोर्स फ्रेमवर्क है। यह क्रेडिट कार्ड नंबर, नाम, स्थान, सामाजिक सुरक्षा नंबर और अन्य जैसी इकाइयों के लिए तेज़ पहचान और अनामीकरण मॉड्यूल प्रदान करता है। मुख्य विशेषताओं में Named Entity Recognition, नियमित अभिव्यक्तियों, नियम-आधारित तर्क, और कई भाषाओं में संदर्भ के साथ चेकसम का उपयोग करके पूर्वनिर्धारित और कस्टम PII पहचानकर्ता शामिल हैं। यह बाहरी PII पहचान मॉडल का समर्थन करता है, Python/PySpark से Docker/Kubernetes तक कई उपयोग विकल्प प्रदान करता है, और छवियों (DICOM चिकित्सा छवियों सहित) में PII को संपादित करने के लिए एक मॉड्यूल शामिल करता है। परियोजना विस्तारशीलता और अनुकूलनशीलता पर जोर देती है, इस चेतावनी के साथ कि स्वचालित पहचान सभी संवेदनशील जानकारी नहीं खोज सकती है। इंस्टॉलेशन pip, Docker, या स्रोत से उपलब्ध है, साथ में व्यापक दस्तावेज़ीकरण और उदाहरण हैं।
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.