منصوبے کے بارے میں
میگیکا گوگل کا ایک اے آئی سے چلنے والا فائل مواد کی قسم کی شناخت کا آلہ ہے جو ایک کمپیکٹ ڈیپ لرننگ ماڈل (صرف چند ایم بی) استعمال کرتا ہے تاکہ فائل کے مواد کی اقسام کی شناخت کی جا سکے۔ README کے مطابق، اسے تقریباً 100 ملین نمونوں پر تربیت اور جانچ دی گئی ہے جو 200 سے زیادہ مواد کی اقسام کا احاطہ کرتے ہیں، بشمول بائنری اور متنی فارمیٹس، اور اس کے ٹیسٹ سیٹ پر تقریباً 99% اوسط درستگی اور یادداشت کی اطلاع دیتا ہے۔ ماڈل لوڈ ہونے کے بعد ایک سی پی یو پر فی فائل تقریباً 5 ملی سیکنڈ لگتے ہیں، اور وقت فائل کے سائز سے تقریباً مستقل رہتا ہے کیونکہ صرف مواد کا ایک محدود حصہ استعمال ہوتا ہے۔
یہ پروجیکٹ رسٹ میں لکھے گئے کمانڈ لائن ٹول، پائتھون API، اور رسٹ، جاوا اسکرپٹ/ٹائپ اسکرپٹ (ایک npm پیکیج کے ساتھ جو براؤزر پر مبنی ڈیمو کو طاقت دیتا ہے)، اور گو (جسے کام جاری ہے) کے لیے بائنڈنگز کے طور پر تقسیم کیا گیا ہے۔ تنصیب کے اختیارات میں pipx، Homebrew، Unix اور PowerShell کے لیے انسٹالر اسکرپٹ، cargo، pip، اور npm شامل ہیں۔
CLI تکراری اسکیننگ، معیاری ان پٹ سے پڑھنے، JSON اور JSONL آؤٹ پٹ، حسب ضرورت آؤٹ پٹ فارمیٹس، MIME قسم اور لیبل آؤٹ پٹ، اور اسکور پرنٹنگ کی حمایت کرتا ہے۔ یہ پیشن گوئی کے طریقوں جیسے اعلی اعتماد، درمیانی اعتماد، اور بہترین اندازہ بھی پیش کرتا ہے، اس کے علاوہ فی مواد کی قسم کی حد کا نظام جو عام لیبل جیسے "عمومی متن دستاویز" یا "نامعلوم بائنری ڈیٹا" واپس کر سکتا ہے جب ماڈل کو اعتماد نہ ہو۔
README میں کہا گیا ہے کہ میگیکا گوگل کے اندر بڑے پیمانے پر استعمال ہوتا ہے تاکہ Gmail، Drive، اور Safe Browsing فائلوں کو مناسب سیکیورٹی اور مواد کی پالیسی اسکینرز تک پہنچایا جا سکے، اور یہ کہ اسے VirusTotal اور abuse.ch کے ساتھ مربوط کیا گیا ہے۔ ایک ویب ڈیمو براؤزر میں مقامی طور پر چلتا ہے۔ یہ پروجیکٹ Apache 2.0 کے تحت لائسنس یافتہ ہے اور اس میں ایک دستبرداری شامل ہے کہ یہ گوگل کا سرکاری پروجیکٹ نہیں ہے۔
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.