Unreal Engine 5-এর জন্য একটি লোকাল মাল্টিমোডাল LLM প্লাগইন, যা টেক্সট, স্পিচ-টু-টেক্সট এবং টেক্সট-টু-স্পিচের জন্য অফলাইন ইনফারেন্স প্রদান করে।
ওপেন সোর্স। নতুন সম্ভাবনা।
মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।
কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।
THE FIRST COLLECTIONজানো একটি হালকাweight OpenAI-সামঞ্জস্যপূর্ণ রাউটার যা একই GPU-তে একাধিক লোকাল LLM-কে বুদ্ধিমানভাবে রিকোয়েস্ট ব্যাচিং ও মডেল সওয়াপ কমানোর মাধ্যমে শেয়ার করতে সাহায্য করে।
Lexos একটি ইভেন্ট-চালিত AI ডকুমেন্ট প্রসেসিং ইঞ্জিন, যা Go গেটওয়ে, Python ওয়ার্কার, Redis কিউ এবং সেলফ-হোস্টেড মডেল ব্যবহার করে অফলাইন RAG, সারাংশ এবং স্পিচ ট্রান্সক্রিপশন সক্ষম করে।
ELI একটি সম্পূর্ণ স্থানীয়, ব্যক্তিগত AI সহায়ক যা আপনার নিজের হার্ডওয়্যারে চলে। এটি ভয়েস, ভিশন, মেমরি এবং ১৭টি ক্ষেত্রে ২২৭টি ক্ষমতা অফার করে, যার মধ্যে কম্পিউটার নিয়ন্ত্রণ, মিডিয়া প্লেব্যাক, ডকুমেন্ট হ্যান্ডলিং, কোডিং এবং টাস্ক অটোমেশন অন্তর্ভুক্ত। ডিফল্টভাবে অফলাইন, এটি যেকোনো স্থানীয় GGUF মডেল ব্যবহার করে এবং মডেল-অ্যাগনস্টিক, ঐচ্ছিক GPU ত্বরণ এবং LAN অ্যাক্সেসের জন্য ওয়েব ড্যাশবোর্ড সহ।
vtmate হলো একটি টার্মিনাল-ভিত্তিক ভয়েস AI টুলকিট, যার বৈশিষ্ট্য অতি-কম লেটেন্সি, ৪১টি ভাষার সমর্থন এবং সমন্বিত TTS/STT। এটি লাইভ ভয়েস কথোপকথন, বিতর্ক, ভয়েস ক্লোনিং, সেশন এক্সপোর্ট এবং গ্লোবাল শর্টকাটসহ ব্যাকগ্রাউন্ড ডেমন মোড সক্ষম করে।
MoziAI-35B একটি লোকালি ডিপ্লয়যোগ্য ওপেন-সোর্স মাল্টিমোডাল LLM, যার 35B MoE আর্কিটেকচার MoziSmartBit কোয়ান্টাইজেশনের মাধ্যমে ~15.9 GB-এ সংকুচিত; 256K কনটেক্সট, ভিশন, টুল কলিং এবং ফিন্যান্স-কেন্দ্রিক রিজনিং ফ্রেমওয়ার্ক রয়েছে।
Mimora is a free, fully local pronunciation trainer for English and Spanish. It uses on-device TTS, speech recognition, and a local LLM to generate phrases and score user attempts with word-level feedback, requiring no cloud or API keys.
Xinference একটি ইউনিফাইড ইনফারেন্স লাইব্রেরি যা ভাষা, বক্তৃতা এবং মাল্টিমোডাল মডেল পরিবেশন করে। এটি OpenAI-সামঞ্জস্যপূর্ণ RESTful API, হেটেরোজেনিয়াস GPU/CPU ব্যবহার, বিতরণকৃত ডিপ্লয়মেন্ট এবং LangChain, LlamaIndex, Dify, Chatbox-এর সাথে ইন্টিগ্রেশন প্রদান করে।
SenseVoiceSmall একটি ওপেন-সোর্স স্পিচ ফাউন্ডেশন মডেল যা ASR, ভাষা শনাক্তকরণ, আবেগ শনাক্তকরণ এবং অডিও ইভেন্ট সনাক্তকরণের জন্য ব্যবহৃত হয়। এটি ম্যান্ডারিন, ক্যান্টোনিজ, ইংরেজি, জাপানি এবং কোরিয়ান ভাষা সমর্থন করে এবং দ্রুত নন-অটোরিগ্রেসিভ ইনফারেন্স প্রদান করে।