À propos du projet

Eloquent Notes est un utilitaire de barre système Linux pour une dictée hors ligne rapide vers Obsidian. Il s'exécute en arrière-plan, enregistre de courts clips vocaux et les traite entièrement sur la machine locale à l'aide d'un modèle Gemma 4 servi via Ollama. Flux de travail : cliquez sur l'icône de la barre système (ou déclenchez un raccourci global / une bascule CLI) pour démarrer l'enregistrement, cliquez à nouveau pour arrêter. L'audio est capturé en mémoire, converti en octets WAV et envoyé à travers un pipeline LLM en trois phases : transcription, réécriture en prose de note à la première personne avec un titre, et classification produisant un type de note, des wikiliens et des tags. Le résultat est écrit dans le coffre Obsidian configuré, soit sous forme de fichier autonome, soit ajouté à une note quotidienne. Capacités notables décrites dans le README : - Expérience de barre système avec icônes d'état dessinées dynamiquement (inactif, enregistrement, traitement) et un menu contextuel pour la configuration, le rechargement et la fermeture. - Commandes CLI : basculer l'enregistrement, ouvrir l'interface graphique de configuration et installer une entrée de démarrage automatique. La commande de bascule communique avec le démon en cours d'exécution via un socket Unix local. - Éditeur de configuration graphique couvrant les paramètres généraux, les options du coffre Obsidian, les paramètres IA/Ollama, les paramètres audio, les prompts et les modèles de notes. - Intégration Obsidian : callouts par type de note, injection de wikiliens avec correspondance insensible à la casse aux limites de mots, génération de tags, analyse et fusion du frontmatter YAML sans duplication, et organisation configurable des dossiers (aucune, mois, semaine, mois+semaine). - Dictée multilingue avec une langue de sortie configurable pour les titres, la prose, les wikiliens et les tags. - Prompts Markdown personnalisables pour chaque phase du pipeline et gestion des tentatives, plus trois modèles de notes avec des espaces réservés pour le titre, le texte, les tags, la date et l'heure. - Conception axée sur la confidentialité : aucun fichier audio temporaire n'est écrit sur le disque ; l'audio reste en mémoire. - Logique de nouvelle tentative et de validation pour la sortie JSON structurée du modèle, avec un nombre de tentatives configurable. - Journaux rotatifs conformes à XDG. Exigences et contraintes : Ollama exécuté localement avec un modèle Gemma 4 récupéré (par défaut gemma4:e4b-it-qat), PortAudio installé et un service de notification de bureau. Le README indique que les modèles audio Gemma 4 prennent en charge des clips allant jusqu'à 30 secondes, et l'outil est optimisé pour les dictées dans cette limite. L'installation est proposée via pipx ou uv depuis GitHub, ou en tant qu'installation locale modifiable pour le développement.