منصوبے کے بارے میں

Rapid-MLX ایک اعلیٰ کارکردگی والا مقامی AI انجن ہے جو خاص طور پر Apple Silicon (M1-M4) کے لیے ڈیزائن کیا گیا ہے۔ یہ OpenAI اور Anthropic APIs کے لیے ڈراپ-ان متبادل فراہم کرتا ہے، جس سے Claude Code، Cursor، Aider، اور LangChain جیسے موجودہ کلائنٹس بغیر ایڈاپٹر کے جڑ سکتے ہیں۔ اہم خصوصیات میں شامل ہیں: - **کارکردگی**: Native MLX kernels، continuous batching، prompt caching، اور quantized KV cache کے ساتھ Ollama کے تھروپٹ سے 3 گنا تک زیادہ ہونے کا دعویٰ۔ - **API مطابقت**: `/v1/chat/completions`، `/v1/responses`، `/v1/messages`، `/v1/embeddings`، `/v1/audio/*`، `/v1/videos`، اور `/v1/images/*` کی معاونت۔ - **ماڈل سپورٹ**: متن، وژن، آڈیو (TTS/STT/voice cloning)، ویڈیو جنریشن، تصویر جنریشن، اور embeddings۔ مختلف سائز اور میموری کی ضروریات کے لیے aliases کے ساتھ ماڈل کیٹلاگ شامل ہے۔ - **ایجنٹ انٹیگریشن**: 12 ایجنٹ CLIs (مثلاً Claude Code، Codex CLI، Aider) اور 3 Python فریم ورکس (LangChain، PydanticAI، smolagents) کے ساتھ wire-verified مطابقت۔ Tier-1 ایجنٹس ہر ریلیز سے پہلے حقیقی weights پر end-to-end دوبارہ تصدیق شدہ ہوتے ہیں۔ - **انسٹالیشن**: Homebrew، pip، یا guided installer کے ذریعے دستیاب۔ macOS کے لیے ڈیسک ٹاپ ایپ۔ - **استعمال کے کیسز**: ٹرمینل چیٹ، ایپس کے لیے OpenAI-compatible سرور، ایجنٹ بیک اینڈز، اور بینچ مارکنگ۔ - **اضافی خصوصیات**: تصویر، ویڈیو، آڈیو، اور system-one (typed decisions) صلاحیتوں کے لیے اختیاری پیکجز۔ Rapid-MLX کو Apple ہارڈویئر پر ڈویلپرز اور AI شائقین کے لیے ایک تیز، مقامی متبادل کے طور پر پیش کیا گیا ہے، جس میں کارکردگی، مطابقت، اور آسانی پر زور دیا گیا ہے۔