프로젝트 소개

OpenCreator(구 KrillinAI)는 멀티모달 콘텐츠 제작과 일반 Agent 워크스페이스를 결합한 오픈소스 AI 워크스페이스입니다. Codex CLI를 실행 엔진으로 사용하며, 이를 기반으로 로컬 Runtime, 시각적 워크스페이스, 데스크탑 호스트를 추가로 제공합니다. 이 제품은 두 가지 연결된 워크플로우를 통합합니다: 1. AI 콘텐츠 제작: 비디오 번역, 비디오 다운로드, 썸네일 생성, 이미지 생성, 스마트 더빙, 비디오 생성을 위한 전용 크리에이터 도구 2. 일반 Agent 워크스페이스: 프로젝트별 대화 정리, 백그라운드 Runs 실행, 승인/첨부파일/파일/Skills/MCP/일정/알림/메모리/디agnostics 관리 현재 제공되는 Creator Tools는 다음과 같습니다: - Video Translation: 로컬 또는 공개 비디오 가져오기, 클라우드 또는 로컬 Whisper로 자막 생성, LLM을 활용한 자막 분할/정렬/용어/번역, 쌍국어 자막 구성, 더빙, 자막 스타일 설정, SRT/오디오/비디오 내보내기 - Video Downloader: YouTube, Bilibili 및 기타 공개 링크 파싱, 화질 및 형식 옵션 확인, 비디오 또는 오디오 다운로드 - Thumbnail Generator: 주제, 비디오 링크, 선택적 참조 이미지 조합으로 여러 썸네일 변형 생성 - Image Generation: 프롬프트 및 선택적 참조 이미지로 GPT Image로 이미지 생성, 종횡비 및 출력 수 설정 - Smart Dubbing: 선택 가능한 음성, 구조, 감정 제어로 스크립트를 보이스오버로 변환 - Video Generation: 프롬프트 및 참조 이미지로 Seedance를 활용한 비디오 생성 개발 중인 도구에는 Stick Figure Animation, Auto Clips, Digital Avatar가 포함됩니다. 워크스페이스와 Agent 대화는 단일 상태 머신을 공유하여 단계, 진행률, 결과를 동기화합니다. 각 수정은 이전 결과를 덮어쓰지 않고 새 버전을 생성합니다. 이 시스템은 전역, 프로젝트, 스레드 단위의 메모리를 지원하며, 재현 가능한 Run 입력 스냅샷을 제공합니다. 지원 모델은 언어 모델(GPT, DeepSeek, Qwen, Kimi, GLM, Grok, Doubao, ERNIE, Hunyuan), 이미지(GPT Image), 비디오(Seedance), 음성/트랜스크립션(Whisper, OpenAI TTS, MiniMax, Edge TTS, Aliyun Speech)을 포함합니다. 아키텍처는 React 18/Vite/TypeScript 프론트엔드, Fastify 기반 로컬 데몬 Runtime, Electron 데스크탑 호스트, yt-dlp/FFmpeg/Whisper 기반 미디어 툴체인으로 구성됩니다. 데이터는 SQLite와 파일 시스템을 통해 로컬에 저장되며, 자격 증명은 시스템 자격 증명 저장소에 보관됩니다. 본 프로젝트는 Apache 2.0 라이선스로 배포됩니다.