Sobre el proyecto

Jarvis es un asistente de voz de escritorio diseñado para ejecutarse principalmente en hardware local en lugar de en la nube. El README lo describe como un asistente privado y local-first que vive en tu computadora, con reconocimiento de voz, modelos de lenguaje y síntesis de voz ejecutándose en hardware que tú controlas. Se presenta como voice-first, con una cara animada como presencia de escritorio y una ventana de chat complementaria para escribir. Una idea central es la participación conversacional. Jarvis mantiene una transcripción rodante breve y temporal del habla cercana para poder unirse a una conversación en curso cuando se lo llama por su nombre, usando la discusión reciente en lugar de tratar la última frase de forma aislada. El README da el ejemplo de preguntar "Jarvis, ¿qué opinas?" durante una discusión sobre un picnic y el clima. La memoria se almacena localmente en ~/.local/share/jarvis, y el README afirma que la información sensible se redacta antes de llegar al contexto del modelo o a las entradas de diario guardadas. Un Visor de Memoria permite a los usuarios explorar la memoria almacenada y un grafo de conocimiento. La búsqueda web, el clima y las herramientas conectadas usan la red cuando se solicitan, pero la conversación local no requiere una cuenta de IA en la nube. La instalación se realiza mediante paquetes precompilados para macOS (Apple Silicon e Intel), Windows x64 y Linux x64 desde GitHub Releases. Un asistente de configuración guía a los usuarios a través de la elección del reconocimiento de voz y un servidor de modelos, con Ollama o un servidor local compatible con OpenAI como LM Studio, oMLX o llama.cpp. El README enumera modelos de chat de ejemplo que van desde opciones locales más pequeñas hasta más grandes y señala que las necesidades de memoria dependen del tamaño del modelo, la cuantización, la longitud del contexto y el reconocimiento de voz. Las capacidades integradas mencionadas incluyen búsqueda web, clima, hora, OCR de capturas de pantalla, acceso a archivos, seguimiento de nutrición y conciencia de ubicación opcional. Los servidores MCP pueden añadir automatización del navegador, controles de hogar inteligente y otras integraciones, con enrutamiento de herramientas que selecciona un subconjunto relevante por solicitud. El dictado permite a los usuarios mantener presionada una tecla de acceso rápido, hablar y pegar texto transcrito localmente en otras aplicaciones, con teclas de acceso rápido predeterminadas específicas de la plataforma y eliminación opcional de muletillas, diccionario personalizado e historial. El README documenta limitaciones conocidas: el dictado en macOS 26+ no está disponible debido a una incompatibilidad con pynput, el "stop" hablado puede confundirse con eco mientras Jarvis está hablando, no hay aplicación móvil, las descargas de modelos en la primera ejecución pueden ser grandes, y capacidades opcionales como la conciencia de ubicación y la búsqueda semántica de memoria necesitan sus propias dependencias. También señala que el desarrollo se realiza principalmente en macOS y que el comportamiento en Windows y Linux puede diferir. La configuración está disponible a través de una interfaz de Ajustes en el menú de la bandeja, con edición avanzada de ~/.config/jarvis/config.json. Un Modo de Bajo Consumo omite el calentamiento de inicio del LLM y acorta la residencia del modelo de Ollama. La documentación de privacidad describe el almacenamiento local, la redacción y los límites de red, e incluye un ejemplo de configuración para reducir el acceso opcional a la red. El proyecto es gratuito para uso personal, con uso comercial que requiere contacto, y ofrece GitHub Sponsors y Ko-fi como canales de apoyo.