このプロジェクトについて
Jarvisは、クラウドではなく主にローカルハードウェア上で動作するように設計されたデスクトップ音声アシスタントです。READMEには、あなたのコンピュータ上に存在し、音声認識、言語モデル、音声合成があなたが管理するハードウェア上で実行される、プライベートでローカルファーストなアシスタントとして説明されています。音声ファーストであり、デスクトップ上の存在としてアニメーション化された顔と、タイピング用のコンパニオンチャットウィンドウを備えています。
中心的なアイデアは、会話への参加です。Jarvisは、近くの音声の短い一時的なロールングトランスクリプトを保持し、名前で呼ばれたときに進行中の会話に参加できるようにします。最後の文を単独で扱うのではなく、最近の議論を使用します。READMEでは、ピクニックと天気についての議論中に「Jarvis、どう思う?」と尋ねる例を示しています。
メモリは~/.local/share/jarvisの下にローカルに保存され、READMEには、機密情報はモデルコンテキストや保存された日記エントリに到達する前に編集されると記載されています。メモリビューアを使用すると、保存されたメモリとナレッジグラフを閲覧できます。ウェブ検索、天気、接続されたツールは、要求されたときにネットワークを使用しますが、ローカルでの会話にはクラウドAIアカウントは必要ありません。
インストールは、GitHub ReleasesからmacOS(Apple SiliconおよびIntel)、Windows x64、Linux x64用のプリビルドパッケージを通じて行われます。セットアップウィザードが、音声認識とモデルサーバーの選択をガイドし、OllamaまたはLM Studio、oMLX、llama.cppなどのOpenAI互換のローカルサーバーを選択できます。READMEには、小規模から大規模までのローカルオプションのチャットモデルの例がリストされており、メモリのニーズはモデルサイズ、量子化、コンテキスト長、音声認識に依存することに注意しています。
組み込み機能には、ウェブ検索、天気、時刻、スクリーンショットOCR、ファイルアクセス、栄養追跡、オプションの位置情報認識が含まれます。MCPサーバーは、ブラウザ自動化、スマートホーム制御、その他の統合を追加でき、ツールルーティングがリクエストごとに関連するサブセットを選択します。ディクテーションでは、ホットキーを押しながら話し、ローカルで文字起こしされたテキストを他のアプリケーションに貼り付けることができ、プラットフォーム固有のデフォルトホットキーと、オプションのフィラーワード削除、カスタム辞書、履歴があります。
READMEには既知の制限が記載されています:macOS 26+ではpynputの非互換性によりディクテーションが利用できない、Jarvisが話している間に音声の「停止」がエコーと誤認される可能性がある、モバイルアプリがない、初回実行時のモデルダウンロードが大きい可能性がある、位置情報認識やセマンティックメモリ検索などのオプション機能には独自の依存関係が必要です。また、開発は主にmacOSで行われており、WindowsとLinuxの動作は異なる可能性があることにも注意しています。
設定は、トレイメニューの設定インターフェースから利用でき、~/.config/jarvis/config.jsonの高度な編集が可能です。低電力モードは、LLM起動時のウォームアップをスキップし、Ollamaモデルの常駐時間を短縮します。プライバシードキュメントには、ローカルストレージ、編集、ネットワーク境界が記載されており、オプションのネットワークアクセスを減らすための設定例が含まれています。このプロジェクトは個人使用は無料で、商用利用には連絡が必要であり、サポートチャネルとしてGitHub SponsorsとKo-fiを提供しています。
Comments
0 people shared their preference · Deer Point appears after 10 participants
Sign in to join the discussion.