OPEN SOURCE, OPEN TO EVERYONE

ওপেন সোর্স। নতুন সম্ভাবনা।

মানসম্মত ওপেন-সোর্স প্রজেক্ট আবিষ্কার করুন, বেনামে প্রজেক্ট জমা দিন এবং নিজের প্রজেক্ট দাবি করে সম্পাদনা করুন।

সম্পাদকের পছন্দ · ভালো ওপেন সোর্স খুঁজুন4102আবিষ্কৃত

কৌতূহল নিয়ে ওপেন সোর্স আবিষ্কার করুন।

THE FIRST COLLECTION
Topic: tts清除
gpt-sovitsRVC-Boss
নতুন

GPT-SoVITS একটি ওপেন-সোর্স ফিউ-শট ভয়েস কনভার্সন এবং TTS সিস্টেম যা শূন্য-শট (৫ সেকেন্ড) এবং ফিউ-শট (১ মিনিট) ভয়েস ক্লোনিং, চীনা, জাপানি, কোরিয়ান, ক্যান্টোনিজ এবং ইংরেজি ভাষায় সাপোর্ট করে। এতে অডিও সепারেশন, ASR এবং ডেটাসেট প্রস্তুতির জন্য WebUI টুলস অন্তর্ভুক্ত রয়েছে।

সঙ্গীতMusic generation
pyvideotransjianchang512
নতুন

pyVideoTrans একটি ওপেন-সোর্স ভিডিও অনুবাদ টুল যা ভাষান্তর, অডিও ট্রান্সক্রিপশন, AI ডাবিং এবং সাবটাইটেল অনুবাদের পূর্ণাঙ্গ কাজের ধারা প্রদান করে। এটি স্থানীয়ভাবে এবং বিভিন্ন অনলাইন API-এর মাধ্যমে ব্যবহার করা যায়।

কৃত্রিম বুদ্ধিমত্তাচলচ্চিত্র, ভিডিও ও মিডিয়াMultimodal AI
speechNVIDIA-NeMo
নতুন

NVIDIA NeMo Speech হলো speech AI মডেল তৈরির Apache-2.0 PyTorch ফ্রেমওয়ার্ক। এটি ASR, TTS এবং Speech LLM সমর্থন করে, প্রি-ট্রেইন্ড checkpoint ও Docker/uv ইনস্টল পদ্ধতি অন্তর্ভুক্ত।

কৃত্রিম বুদ্ধিমত্তাসঙ্গীতModel runtime
funttsfarfarfun
নতুন

FunTTS হলো একটি ইউনিফাইড ইন্টারফেস সমৃদ্ধ টেক্সট-টু-স্পিচ লাইব্রেরি, যা বিভিন্ন ওপেন সোর্স TTS ইঞ্জিনের নিরবচ্ছিন্ন সুইচিং সমর্থন করে এবং সাবটাইটেল জেনারেশন, মাল্টি-রোল সংলাপ ও অ্যাসিনক্রোনাস প্রসেসিংয়ের মতো সুবিধা প্রদান করে।

ডেভেলপার টুলসঙ্গীতTemplates & starters
vtmateDavidValin
নতুন

vtmate হলো একটি টার্মিনাল-ভিত্তিক ভয়েস AI টুলকিট, যার বৈশিষ্ট্য অতি-কম লেটেন্সি, ৪১টি ভাষার সমর্থন এবং সমন্বিত TTS/STT। এটি লাইভ ভয়েস কথোপকথন, বিতর্ক, ভয়েস ক্লোনিং, সেশন এক্সপোর্ট এবং গ্লোবাল শর্টকাটসহ ব্যাকগ্রাউন্ড ডেমন মোড সক্ষম করে।

কৃত্রিম বুদ্ধিমত্তাডেভেলপার টুলAI assistants
opencreatorkrillinai
নতুন

OpenCreator (পূর্বে KrillinAI) একটি ওপেন-সোর্স AI ওয়ার্কস্পেস যা মাল্টিমোডাল কন্টেন্ট ক্রিয়েশন এবং জেনারেল এজেন্ট ওয়ার্কস্পেসকে একত্রিত করে। এটি কোডেক্স CLI ব্যবহার করে ভিডিও অনুবাদ, ডাউনলোড, ইমেজ জেনারেশন, ডাবিং এবং ভিডিও জেনারেশনের মতো টুলস প্রদান করে।

কৃত্রিম বুদ্ধিমত্তাচলচ্চিত্র, ভিডিও ও মিডিয়াAI agents
unslothunslothai
নতুন

Unsloth হলো একটি ডেস্কটপ অ্যাপ্লিকেশন এবং ফ্রেমওয়ার্ক যার মাধ্যমে Windows, macOS এবং Linux-এ লোকালি লার্জ ল্যাঙ্গুয়েজ মডেল (LLMs) এবং ডিফিউশন মডেল চালানো ও ট্রেনিং করা যায়।

সঙ্গীতAudio editing
verbanuvocode
নতুন

Verba একটি offline-first ডেস্কটপ অ্যাপ যা AI কোচের সাথে কথা বলে ভাষা শেখায়। এটি Ollama বা নিজস্ব provider key দিয়ে কাজ করে, ইনলাইন সংশোধনী, ধাপে ধাপে পড়া, spaced repetition vocabulary এবং speech/dictation সুবিধা দেয়।

কৃত্রিম বুদ্ধিমত্তাউৎপাদনশীলতাAI assistants
নতুন

Google Chrome এবং Mozilla Firefox-এর জন্য একটি ব্রাউজার এক্সটেনশন যা YouTube ভিডিওর জন্য রিয়েল-টাইম, দ্বিভাষিক সাবটাইটেল অনুবাদ প্রদান করে।

কৃত্রিম বুদ্ধিমত্তাউৎপাদনশীলতাAI assistants
localaimudler
নতুন

LocalAI একটি ওপেন-সোর্স, স্ব-হোস্টেড AI ইঞ্জিন যা CPU-মাত্র সহ যেকোনো हार्डवेयर पर LLM, visión, voice, image और video मॉडल चलाता है। यह OpenAI, Anthropic और ElevenLabs‑संगत API, ऑन‑डिमांड मॉड्यूलर बैकएंड, मल्टी‑यूजर प्रमाणीकरण, और RAG और MCP सहित बिल्ट‑इन एजेंट प्रदान करता है।

কৃত্রিম বুদ্ধিমত্তাস্ব-হোস্টেডModel runtime
voxcpmOpenBMB
নতুন

VoxCPM2 হলো OpenBMB-এর একটি টোকেনাইজার-মুক্ত টেক্সট-টু-স্পিচ সিস্টেম যা ২ বিলিয়ন প্যারামিটারের ডিফিউশন অটোরেগ্রেসিভ মডেল ব্যবহার করে ৩০টি ভাষা, টেক্সট বর্ণনা থেকে ভয়েস ডিজাইন, নিয়ন্ত্রিত ভয়েস ক্লোনিং এবং ৪৮kHz অডিও আউটপুট সমর্থন করে।

কৃত্রিম বুদ্ধিমত্তাসঙ্গীতMultimodal AI
নতুন

Pixelle-Video একটি ওপেন-সোর্স AI সম্পূর্ণ স্বয়ংক্রিয় সংক্ষিপ্ত ভিডিও তৈরির ইঞ্জিন। ব্যবহারকারী শুধু একটি থিম দিলেই সিস্টেম স্বয়ংক্রিয়ভাবে ভিডিও কপিরাইটি, AI ইমেজ বা ভিডিও তৈরি, ভয়েস ওভার সিন্থেসিস, ব্যাকগ্রাউন্ড মিউজিক যোগ এবং চূড়ান্ত ভিডিও কম্পোজিটিং সম্পন্ন করে, ভিডিও সম্পাদনার অভিজ্ঞতা ছাড়াই।

কৃত্রিম বুদ্ধিমত্তাচলচ্চিত্র, ভিডিও ও মিডিয়াMultimodal AI
python_coursearthurperch
নতুন

একটি টার্মিনাল-ভিত্তিক হাতে-কলমে পাইথন কোর্স: আপনি Neovim-স্টাইল মোডাল এডিটরে কোড লিখবেন এবং অফলাইনে একটি লোকাল TTS ভয়েস আপনাকে কোচিং করবে। এতে ড্রিল, সিমুলেটেড ক্লাউড/DevOps ট্র্যাক এবং প্রগ্রেস সেভ করার সুবিধা রয়েছে।

ডেভেলপার টুলউৎপাদনশীলতাCLI & terminal
chattts2noise
নতুন

ChatTTS একটি ওপেন-সোর্স টেক্সট-টু-স্পিচ মডেল, যা সংवाद পরিস্থিতির জন্য তৈরি করা হয়েছে, ইংরেজি এবং চীনা ভাষা সমর্থন করে, বহু স্পিকার আউটপুট এবং হাসি, বিরাম এবং প্রসোডির উপর সূক্ষ্ম নিয়ন্ত্রণ প্রদান করে।

কৃত্রিম বুদ্ধিমত্তাসঙ্গীতMultimodal AI