À propos du projet
Omi fonctionne comme un « deuxième cerveau » AI personnel en capturant continuellement l'activité à l'écran et les conversations audio ambiantes. Il utilise la transcription en temps réel (via Deepgram), la détection d'activité vocale (VAD), la diarisation des locuteurs et des grands modèles de langage pour générer des résumés, extraire les éléments d'action et maintenir un historique de chat contextualisé. Le système fonctionne sur macOS, Windows, iOS, Android et du matériel wearable personnalisé (Omi Wearable et Omi Glass). Le backend est basé sur Python avec FastAPI, Firebase, Redis et un traitement audio accéléré par GPU. Les applications mobiles sont développées avec Flutter ; l'application macOS combine Swift/SwiftUI avec un backend Python local. Des SDK open-source permettent l'intégration multi-appareils via les protocoles BLE et WebSocket. Les conceptions matérielles sont publiées pour un montage DIY. Le projet inclut une documentation pour le développement, l'utilisation de l'API, la création d'applications et le flash du matériel. Il est sous licence MIT et compte plus de 300 000 professionnels.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.