vtmate es un kit de herramientas de IA de voz basado en terminal, con latencia ultrabaja, soporte para 41 idiomas y TTS/STT integrados. Permite conversaciones de voz en vivo, debates, clonación de voz, exportación de sesiones y modo daemon en segundo plano con atajos globales para una interacción fluida con la IA.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONMoziAI-35B es un LLM multimodal de código abierto desplegable localmente, con arquitectura MoE de 35B comprimida a ~15,9 GB mediante la cuantización MoziSmartBit; ofrece contexto de 256K, visión, llamada de herramientas y un marco de razonamiento orientado a finanzas.
Mimora is a free, fully local pronunciation trainer for English and Spanish. It uses on-device TTS, speech recognition, and a local LLM to generate phrases and score user attempts with word-level feedback, requiring no cloud or API keys.
Xinference es una biblioteca unificada de inferencia para servir modelos de lenguaje, voz y multimodales. Proporciona API RESTful compatible con OpenAI, utilización heterogénea de GPU/CPU, despliegue distribuido e integraciones con LangChain, LlamaIndex, Dify y Chatbox.
SenseVoiceSmall es un modelo fundacional de voz de código abierto para ASR, identificación de idioma, reconocimiento de emociones y detección de eventos de audio, que cubre mandarín, cantonés, inglés, japonés y coreano con inferencia no autorregresiva rápida.
Un plugin de LLM multimodal local para Unreal Engine 5 que proporciona inferencia offline para texto, speech-to-text y text-to-speech.
Jano es un enrutador minimalista y compatible con OpenAI que permite que múltiples LLMs locales compartan una GPU mediante agrupación inteligente de solicitudes y minimización de cambios de modelo.
Lexos es un motor de procesamiento de documentos con IA basado en eventos, que combina una puerta de enlace Go, trabajadores Python, colas Redis y modelos autoalojados para RAG, resumen y transcripción de voz sin conexión.
ELI es un asistente de IA privado y estrictamente local que funciona en su propio hardware. Ofrece voz, visión, memoria y 227 capacidades, incluyendo control de computadora y automatización. Funciona sin conexión por defecto, es agnóstico al modelo, usa GGUF local, soporta GPU y tiene un panel web para LAN.