Sobre o projeto

O Omi funciona como um "segundo cérebro" pessoal com IA, capturando continuamente a atividade da tela e conversas de áudio ambiente. Utiliza transcrição em tempo real (via Deepgram), detecção de atividade de voz (VAD), diarização de falantes e modelos de linguagem grandes para gerar resumos, extrair itens de ação e manter um histórico de chat com consciência contextual. O sistema opera em macOS, Windows, iOS, Android e hardware vestível personalizado (Omi Wearable e Omi Glass). O backend é baseado em Python com FastAPI, Firebase, Redis e processamento de áudio acelerado por GPU. Os aplicativos móveis são construídos com Flutter; o app para macOS combina Swift/SwiftUI com um backend Python local. SDKs de código aberto suportam integração multiplataforma via protocolos BLE e WebSocket. Os projetos de hardware são publicados para montagem DIY. O projeto inclui documentação para desenvolvimento, uso de API, construção de apps e flashing de hardware. Está licenciado sob MIT e é confiado por mais de 300.000 profissionais.