Sobre el proyecto

Este repositorio proporciona un conjunto de roles de Ansible para construir una infraestructura de IA/LLM de homelab en VMs y contenedores LXC de Proxmox. Fue extraído de una colección más amplia de ansible-proxmox-apps y se centra específicamente en el stack de IA. Los roles están organizados en varias áreas funcionales: - **LLM serving**: ollama (servidor de modelos), llama_cpp con llama-swap (capa de GPU), llm_router (proxy de LiteLLM como puerta de enlace compatible con OpenAI) y open_webui (frontend de chat). - **RAG**: llamaindex (pipeline de embeddings de Python + Ollama solo para CPU) y qdrant_docker (base de datos vectorial). - **Agents**: hermes_agent (puerta de enlace de agentes de NousResearch), agent_exec (ejecución en sandbox), agentgateway_docker, codex_runner (usuario de Codex CLI aislado). - **LLM app platforms**: Dify, LangFlow, LangGraph, Langfuse y Arize Phoenix (todos basados en Docker). - **Ops**: fabric_watchdog, un temporizador de systemd que sondea el tejido de agentes desde el huésped Hermes y envía alertas a través de Slack. Las herramientas de desarrollo se gestionan mediante un Nix flake y direnv, proporcionando ansible-core, ansible-lint, molecule, sops y utilidades relacionadas. El linting y las pruebas basadas en molecule (con Docker) están disponibles para roles individuales. Actualmente solo se distribuyen los roles; un playbook a nivel de sitio y un cargador de inventario están planeados como pasos siguientes. El proyecto utiliza conventional commits y un modelo de ramificación git-flow (rama develop). Licenciado bajo Apache 2.0.