Sobre el proyecto
Omi funciona como un 'segundo cerebro' de IA personal, capturando continuamente la actividad de pantalla del usuario y las conversaciones de audio ambiental. Utiliza transcripción en tiempo real (vía Deepgram), detección de actividad de voz (VAD), diarización de hablantes y modelos de lenguaje grandes para generar resúmenes, extraer tareas pendientes y mantener un historial de chat consciente del contexto. El sistema funciona en macOS, Windows, iOS, Android y hardware personalizado de uso personal (Omi Wearable y Omi Glass). El backend está desarrollado en Python con FastAPI, Firebase, Redis y procesamiento de audio acelerado por GPU. Las aplicaciones móviles están construidas con Flutter; la aplicación para macOS combina Swift/SwiftUI con un backend local en Python. Los SDKs de código abierto permiten la integración multiplataforma mediante protocolos BLE y WebSocket. Los diseños de hardware están publicados para ensamblaje DIY. El proyecto incluye documentación para desarrollo, uso de la API, construcción de aplicaciones y flasheo de hardware. Está licenciado bajo MIT y es utilizado por más de 300.000 profesionales.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.