このプロジェクトについて
Omiは、ユーザーのスクリーン活動と環境音声を継続的にキャプチャすることで、パーソナルAIの「セカンドブレイン」として機能します。Deepgramによるリアルタイム文字起こし、音声活動検出(VAD)、話者分離、大規模言語モデルを活用し、要約の生成、アクションアイテムの抽出、コンテキスト意識のあるチャット履歴の維持を行います。
このシステムはmacOS、Windows、iOS、Android、そしてOmi WearableやOmi Glassといったカスタムウェアラブルハードウェア上で動作します。バックエンドはPythonベースで、FastAPI、Firebase、Redis、GPU加速型オーディオ処理を採用しています。モバイルアプリはFlutterで構築され、macOSアプリはSwift/SwiftUIとローカルPythonバックエンドを組み合わせています。
オープンソースSDKにより、BLEおよびWebSocketプロトコルを介したマルチデバイス統合がサポートされており、ハードウェア設計はDIY組み立て用に公開されています。開発ドキュメント、API利用法、アプリ構築ガイド、ハードウェアフラッシュ手順が含まれ、MITライセンスの下で提供されています。30万人以上のプロフェッショナルに信頼されているプロジェクトです。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.