프로젝트 소개

ELI는 클라우드 의존성 없이 완전히 사용자 컴퓨터에서 실행되도록 설계된 프라이버시 우선, 로컬 우선 AI 어시스턴트입니다. 12단계 추론 파이프라인, DAG 오케스트레이터 위의 전문가 에이전트, 계층형 메모리(SQLite, FAISS 벡터 인덱스, 지식 그래프), 로컬 음성 및 비전 기능, 스마트홈 서버를 포함한 인지 런타임과 대화형 인터페이스를 결합합니다. 타이핑이나 음성으로 상호작용할 수 있으며, 데스크톱 제어, 화면 및 문서 읽기, 코드 작성, 세션 간 사용자 선호도 기억이 가능합니다. 핵심 철학은 AI가 벤더가 아닌 사용자에게 속해야 한다는 것입니다. 이는 아키텍처 수준에서 강제됩니다. 네트워크 가드는 소켓 레이어에서 fail-closed로 작동하여 사용자가 웹 검색이나 뉴스 같은 선택적 온라인 기능을 명시적으로 활성화하지 않는 한 아웃바운드 연결을 차단합니다. 대화 이력, 메모리, 모델 등 데이터는 업그레이드 후에도 유지되는 사용자별 폴더에 머무릅니다. ELI는 모델 무관성(model-agnostic)을 채택합니다. 사용자가 제공하는 모든 로컬 GGUF 채팅/ instruct 모델을 로드하고, 채팅 템플릿을 감지하며, 모델의 실제 학습 창에 맞게 컨텍스트 크기를 조정합니다. GPU 가속(NVIDIA용 CUDA, AMD/Intel Arc용 Vulkan, Apple Silicon용 Metal)과 CPU 추론을 지원하며, mmproj 파일을 통한 비전 모델 및 Ollama를 대체 백엔드로 사용할 수 있습니다. 주요 기능: - **컴퓨터 제어**: 앱 열기/닫기/포커스, 창 타일링, 볼륨 조절, 텍스트 입력, 마우스 이동, 클릭. - **미디어 재생**: Spotify 및 YouTube 제어, 재생 중 정보 확인, 광고 건너뛰기. - **화면 및 문서 이해**: 화면 콘텐츠, PDF, 이미지, CSV 요약. - **코딩 지원**: 버그 수정, 코드베이스 검토, 프로젝트 스캐폴딩, 스크립트 작성. - **메모리 및 아이덴티티**: 사실 기억, 시간에 따른 개인 선호도 프라이빗 프로필 구축. - **작업 자동화**: 알람, 타이머, 캘린더 설정, 예약된 작업 실행, 루틴 학습. - **음성 상호작용**: 웨이크 워드, 디크테이션, 스타일 프리셋 및 선택적 음성 클로닝을 포함한 텍스트-투-스피치. - **자기 유지보수**: 실패 분석, 롤백 가능한 자체 패치 적용, 사용자 대화 기반 LoRA/QLoRA 미세 조정. 설치는 Windows, macOS, Linux(AppImage)용 설치 프로그램으로 간단합니다. 첫 실행 설정은 GPU 감지, VRAM에 맞는 모델 선택, 음성 구성을 안내합니다. QR 페어링을 통해 자체 네트워크에서 원격 접근할 수 있는 웹 대시보드가 포함됩니다. 프로젝트는 활발히 개발 중이며(README 기준 v2.4.37), 안정성과 크로스 플랫폼 호환성에 중점을 둡니다. 주로 Linux와 NVIDIA에서 테스트되며, 다른 플랫폼도 지원하지만 버그가 있을 수 있습니다. 기여자에게는 칭찬보다 버그 보고를 장려합니다. 라이선스는 PolyForm Internal Use이며, Ko-fi를 통한 후원을 지원합니다.