这个项目能做什么
Jarvis 是一款桌面语音助手,主要设计为在本地硬件而非云端运行。README 将其描述为一款私有、本地优先的助手,驻留在你的电脑上,语音识别、语言模型和语音合成都在你可控的硬件上运行。它以语音优先为定位,桌面上有一个动画面孔作为存在感,并配有可打字的配套聊天窗口。
一个核心理念是对话参与。Jarvis 会保留附近语音的简短临时滚动转录,以便在被叫到名字时加入正在进行的对话,利用最近的讨论内容,而不是孤立地处理最后一句话。README 举了一个例子:在讨论野餐和天气时问“Jarvis,你怎么看?”
记忆存储在本地 ~/.local/share/jarvis 下,README 说明敏感信息在进入模型上下文或保存为日记条目之前会被脱敏。Memory Viewer 让用户可以浏览已存储的记忆和知识图谱。网络搜索、天气和已连接工具在请求时使用网络,但本地对话不需要云端 AI 账户。
安装通过 GitHub Releases 上为 macOS(Apple Silicon 和 Intel)、Windows x64 和 Linux x64 提供的预构建包完成。设置向导会引导用户选择语音识别和模型服务器,可使用 Ollama 或 OpenAI 兼容的本地服务器,如 LM Studio、oMLX 或 llama.cpp。README 列出了从小型到大型本地选项的示例聊天模型,并指出内存需求取决于模型大小、量化、上下文长度和语音识别。
提到的内置能力包括网络搜索、天气、时间、截图 OCR、文件访问、营养追踪和可选的位置感知。MCP 服务器可以添加浏览器自动化、智能家居控制和其他集成,工具路由会按请求选择相关的子集。听写功能让用户可以按住热键、说话,并将本地转录的文本粘贴到其他应用程序中,支持平台特定的默认热键,以及可选的填充词移除、自定义词典和历史记录。
README 记录了已知限制:由于 pynput 不兼容,macOS 26+ 的听写不可用;在 Jarvis 说话时,说出的“stop”可能被误认为回声;没有移动应用;首次运行的模型下载可能很大;位置感知和语义记忆搜索等可选能力需要各自的依赖项。它还指出,开发主要在 macOS 上进行,Windows 和 Linux 的行为可能有所不同。
配置可通过托盘菜单中的 Settings 界面进行,也可高级编辑 ~/.config/jarvis/config.json。低功耗模式会跳过 LLM 启动预热并缩短 Ollama 模型驻留时间。隐私文档描述了本地存储、脱敏和网络边界,并包含一个用于减少可选网络访问的配置示例。该项目个人使用免费,商业使用需要联系,并提供 GitHub Sponsors 和 Ko-fi 作为支持渠道。
评论
0 人表达喜爱 · 满10人后显示 Deer Point
登录后参与讨论。