عن المشروع

Open Chinese Convert (OpenCC) هو مشروع مفتوح المصدر شامل مصمم لتحويل نصي عالي الجودة بين مجموعات الحروف الصينية المختلفة واتفاقيات الكتابة الإقليمية. يدعم التحويل بين الصينية التقليدية، الصينية المبسطة، شينجيتاي اليابانية (أشكال الحروف الجديدة)، وتفضيلات الصياغة الإقليمية المحددة الموجودة في الصين القارية وتايوان وهونغ كونغ. الميزات الرئيسية تشمل: - تحويل حتمي قائم على القاموس لا يعتمد على نماذج لغوية كبيرة (LLMs)، مما يضمن نتائج مستقرة ومتوقعة وسريعة دون اتصال. - قواميس ومكتبات منفصلة، مما يسمح بالتعديلات والإضافات المخصصة. - تمييز صارم بين تعيينات المبسط-التقليدي وتعيينات متغيرات الحروف، مع الالتزام بمبدأ "الفصل كلما كان التمييز ممكنًا". - دعم التعبيرات الاصطلاحية الإقليمية ومتغيرات الحروف (مثل تحويل "鼠标" إلى "滑鼠"). - دعم محدود للتحويل بين شينجيتاي اليابانية وكيو جيتاي (أشكال الحروف القديمة). يوفر المشروع واجهات وأدوات متعددة: - **المكتبات**: متاحة لـ C++، C، Python، و Node.js، مما يتيح التكامل في تطبيقات متنوعة. - **واجهة سطر الأوامر (CLI)**: أداة CLI أصلية لتحويل نصي مباشر، وفحص التقسيم، واكتشاف الغموض عبر أوضاع التشخيص (`--segmentation`، `--inspect`، `--ambiguities`). - **ملفات ثنائية مبنية مسبقًا**: متاحة لـ Windows، Linux، و macOS عبر مديري الحزم مثل Homebrew، WinGet، وحزم Debian. - **محول عبر الإنترنت**: واجهة ويب في opencc.js.org. يتضمن OpenCC مجموعة واسعة من ملفات التكوين لمسارات تحويل محددة، مثل من المبسط إلى التقليدي (قياسي، تايوان، هونغ كونغ)، والتحويلات عبر المناطق مع تعديلات العبارات. كما يدعم إضافات تجريبية مثل `opencc-jieba` للتقسيم المتقدم. البرنامج مرخص تحت رخصة Apache 2.0 ويستخدم على نطاق واسع في مشاريع مثل طرق الإدخال (ibus-pinyin، fcitx)، القواميس (GoldenDict)، وقواعد البيانات البحثية.