OPEN SOURCE, OPEN TO EVERYONE

오픈 소스. 새로운 가능성.

우수한 오픈 소스 프로젝트를 발견하고, 익명으로 프로젝트를 제출하며, 내 프로젝트를 신청해 편집하세요.

편집자 선정 · 좋은 오픈 소스 발견4109발견됨

호기심으로 오픈 소스의 세계를 발견하세요.

THE FIRST COLLECTION
Topic: whisper清除
신규

ChatMonteur는 Claude Code나 Codex로 구동되는 에이전트 오케스트레이션 기반의 AI 비디오 편집기로, 토킹헤드 영상의 전사, 의미 기반 컷 편집, 자막, 모션 그래픽, 사운드 및 색보정을 수행합니다. 두 단계의 품질 게이트를 통해 부실한 계획과 손상된 파일을 걸러내며, 기본적으로 무료 및 로컬 환경에서 작동합니다.

영상·미디어인공지능Video editing
신규

이미 허가받은 YouTube 영상을 한국어 자막이 포함된 하드 자막 영상으로 현지화하고 B站 업로드를 돕는 Python 도구로, 음성 변환, OCR 인식, LLM 번역 및 하드 자막 렌더링을 지원합니다.

음악Audio editing
voiceboxjamiepine
신규

Voicebox는 로컬에서 실행되는 오픈소스 AI 음성 스튜디오로, 음성 클로닝, TTS, 전역 받아쓰기, 오디오 후처리, MCP 기반 에이전트 음성 출력을 지원하며 클라우드 서비스의 무료 대안을 지향한다.

인공지능개발 도구Multimodal AI
Magneticucsandman
신규

Magnetic는 Windows용 무료 오픈소스 비선형 비디오 편집기로, 자기 타임라인 및 AI 지원 편집 도구를 특징으로 합니다.

영상·미디어Video editing
verbanuvocode
신규

Verba는 AI 코치와 대화해 언어를 배울 수 있는 오프라인 우선 데스크톱 앱이다. Ollama나 자체 제공업체 키로 로컬에서 실행되며 실시간 교정, 수준별 읽기, 간격 반복 어휘 기능을 제공한다.

인공지능생산성AI assistants

Soenneker.Libraries.Whisper.CTranslate에서 게시한 Windows 실행 파일을 최신 상태로 유지하는 자동화 러너로, 예약 및 온디맨드 GitHub Actions 워크플로우를 통해 구동됩니다.

자동화개발 도구CI/CD
learnnote-assistanthurry060215-tech
신규

LearnNote는 로컬 우선 AI 학습 도우미로, Bilibili, YouTube 등의 브라우저 영상과 로컬 영상, PDF 자료를 기반으로 자막 또는 전사(Transcription)를 통해 구조화된 노트를 생성하며, 웹 워크벤치에서 읽기, 편집, 추가 질문 및 내보내기를 지원합니다.

인공지능생산성AI assistants
whisper.cppggml-org
신규

OpenAI의 Whisper 자동 음성 인식(ASR) 모델을 위한 고성능 C/C++ 구현체로, 가볍고 교차 플랫폼 배포가 가능하도록 설계되었습니다.

인공지능Model runtime
skyclass-distillRicardo-Ssy
신규

SkyClass Distill은 교육 영상을 구조화된 교육 기술(Teaching Skills)로 변환하는 파이프라인 도구로, 영상 수집, 전사, 증거 추출 및 LLM 증류를 지원합니다.

인공지능생산성AI agents
inferencexorbitsai
신규

Xinference는 언어, 음성, 멀티모달 모델을 제공하는 통합 추론 라이브러리입니다. OpenAI 호환 RESTful API, 이기종 GPU/CPU 활용, 분산 배포를 지원하며 LangChain, LlamaIndex, Dify, Chatbox와 통합됩니다.

인공지능Multimodal AI
tracciauribow-lab
신규

화자별 레인을 갖춘 브라우저 기반 자막 에디터입니다. 전사부터 수정, 내보내기까지의 과정을 효율화합니다.

영상·미디어인공지능Subtitles & animation
by2kbCharlesmpc
신규

by2kb는 Bilibili와 YouTube 같은 플랫폼의 비디오 URL을 대본, 요약, 학습 노트를 포함한 내구성 있는 Markdown 지식 기반 아티팩트로 변환하며, 에이전트 우선 워크플로우와 로컬/클라우드 ASR을 지원합니다.

생산성인공지능Notes & knowledge
ai-video-editorChirayut001
신규

Whisper와 Gemini를 활용하여 태국어와 영어를 지원하는 AI 기반 자동 영상 편집 도구입니다. 주요 구간 컷 편집 및 자막 생성을 지원하며, GPU와 Docker를 통해 성능을 3~4배 향상시켰습니다.

영상·미디어인공지능Video editing
신규

CTranslate2를 사용하여 OpenAI의 Whisper 모델을 빠르게 재구현한 프로젝트로, 전사 속도 향상과 메모리 사용량 감소를 제공합니다.

인공지능Model runtime
book-syncjlafuenti
신규

Tandem은 전자책과 오디오북 간의 읽기 위치를 동기화하는 셀프 호스팅 서버 프로젝트입니다. Whisper를 통해 오디오북을 전사하고 EPUB 텍스트와 문장 단위로 정렬하여, 기기 간에 읽기와 듣기 전환 시 정확한 위치를 유지합니다.

셀프 호스팅인공지능Home & personal services
LazyEditlachlanchen
추천 선정

LazyEdit는 엔드-투-엔드 콘텐츠 제작, 처리 및 선택적 게시를 위한 로컬 우선 AI 지원 비디오 워크플로우입니다.

영상·미디어인공지능Video editing
whisperlivekitQuentinFuxa
신규

WhisperLiveKit(WLK)는 초저지연 실시간 음성 인식 파이프라인입니다. Faster-Whisper, NLLB 등 다양한 백엔드를 지원하며 WebSocket 및 OpenAI/Deepgram 호환 API를 통해 실시간 transcription, 화자 분할, 200개 언어 번역을 제공합니다.

인공지능개발 도구Model runtime