منصوبے کے بارے میں

لیمونیڈ ایک مقامی AI سرور ہے جس کا مقصد کلاؤڈ APIs کے بجائے صارف کے اپنے ہارڈویئر پر AI ماڈلز چلانا ہے۔ یہ دو شکلوں میں تقسیم کیا جاتا ہے: لیمونیڈ سرور، جو ایک سروس انسٹال کرتا ہے جو معیاری OpenAI، Anthropic اور Ollama کے مطابق APIs فراہم کرتا ہے تاکہ موجودہ ایپس جڑ سکیں، اور ایمبیڈ ایبل لیمونیڈ، ایک پورٹیبل بائنری جو دوسری ایپلیکیشنز میں شامل کرنے کے لیے ہے تاکہ صارف کے PC کے مطابق ملٹی موڈل مقامی AI فراہم کرے۔ یہ پروجیکٹ ٹیکسٹ جنریشن، اسپیچ ٹو ٹیکسٹ، ٹیکسٹ ٹو اسپیچ، آڈیو جنریشن، امیج جنریشن، 3D جنریشن اور ٹیکسٹ کلاسیفیکیشن کی حمایت کرتا ہے۔ یہ GGUF، FLM اور ONNX ماڈل فارمیٹس کے ساتھ کام کرتا ہے اور اس میں ایک ماڈل کیٹلاگ کے ساتھ ساتھ ماڈلز کو براؤز اور ڈاؤن لوڈ کرنے کے لیے ایک ماڈل منیجر شامل ہے۔ حسب ضرورت GGUF یا ONNX ماڈلز Hugging Face یا ModelScope سے حاصل کیے جا سکتے ہیں۔ ایک CLI کمانڈز فراہم کرتا ہے جیسے `lemonade run` ماڈل لانچ کرنے اور اس سے چیٹ کرنے کے لیے، `lemonade launch claude` کوڈنگ ورک فلو کے لیے، `lemonade list` اور `lemonade pull` ماڈل مینجمنٹ کے لیے، `lemonade backends` مشین پر دستیاب انفرنس بیک اینڈز کا معائنہ کرنے کے لیے، اور `lemonade alias` ماحول سے آزاد ماڈل نام دینے اور ایکٹو اسٹینڈ بائی فیل اوور کے لیے۔ ہائبرڈ سیٹ اپس مقامی ماڈلز کے ساتھ ساتھ OpenAI کے مطابق کلاؤڈ فراہم کنندگان کو بھی درخواستیں روٹ کر سکتے ہیں، جسے تجرباتی قرار دیا گیا ہے۔ انفرنس مختلف ہارڈویئر تقاضوں والے متعدد انجنوں کے ذریعے سنبھالا جاتا ہے۔ ٹیکسٹ جنریشن کے لیے ان میں llamacpp شامل ہے جس میں سسٹم، Metal، CUDA، Vulkan، ROCm اور CPU بیک اینڈز ہیں، نیز XDNA2 NPUs کے لیے تجرباتی llamacpp-hrx، flm اور ryzenai-llm، اور AMD Strix Halo کے لیے تجرباتی vllm اور ds4۔ اسپیچ ٹو ٹیکسٹ whispercpp اور moonshine استعمال کرتا ہے؛ ٹیکسٹ ٹو اسپیچ kokoro اور تجرباتی openmoss استعمال کرتا ہے؛ آڈیو جنریشن تجرباتی thinksound اور acestep استعمال کرتا ہے؛ امیج جنریشن sd-cpp اور تجرباتی thenoise استعمال کرتا ہے؛ 3D جنریشن تجرباتی trellis استعمال کرتا ہے؛ اور ٹیکسٹ کلاسیفیکیشن تجرباتی onnxruntime استعمال کرتا ہے۔ معاون آپریٹنگ سسٹمز میں Windows 11، متعدد Linux ڈسٹری بیوشنز (Arch، Debian، Fedora، Ubuntu، Snap، Docker) اور macOS شامل ہیں، جن میں .msi، .deb، .rpm، .pkg اور کنٹینر امیجز جیسے پیکجز دستیاب ہیں۔ OpenAI کے مطابق کلائنٹس کے لیے انٹیگریشن سیدھی ہے: کلائنٹ کو مقامی سرور کے بیس URL کی طرف اشارہ کریں۔ README میں Python، C++، Java، C#، Node.js، Go، Ruby، Rust اور PHP کے لیے کلائنٹ لائبریریاں درج ہیں، اور ایک Python مثال دکھائی گئی ہے۔ ایک مارکیٹ پلیس میں Claude Code، Open WebUI، AnythingLLM، Dify، n8n، OpenHands، GitHub Copilot اور دیگر سمیت مطابقت پذیر ایپلیکیشنز کی فہرست ہے۔ iOS اور Android کے لیے موبائل ایپس کا بھی حوالہ دیا گیا ہے۔ یہ پروجیکٹ کمیونٹی کے ذریعے بنایا گیا ہے جس میں AMD انجینئرز کی جانب سے Ryzen AI، Radeon اور Strix Halo PCs کے لیے اصلاحات شامل ہیں، اور اسے AMD کی سرپرستی حاصل ہے۔ یہ Apache 2.0 کے تحت لائسنس یافتہ ہے اور llama.cpp، whisper.cpp، stable-diffusion.cpp، Kokoros، OnnxRuntime GenAI، Hugging Face Hub اور ModelScope جیسے ٹولز پر تعمیر کیا گیا ہے۔ README میں کہا گیا ہے کہ یہ پروگرام معلومات کو نیٹ ورک والے نظاموں میں منتقل نہیں کرتا جب تک درخواست نہ کی جائے، اور یہ کہ ماڈل ڈاؤن لوڈز یا رجسٹری لک اپس منتخب کردہ ماخذ کے لحاظ سے Hugging Face Hub یا ModelScope سے رابطہ کر سکتے ہیں۔