Un plugin de LLM multimodal local para Unreal Engine 5 que proporciona inferencia offline para texto, speech-to-text y text-to-speech.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONJano es un enrutador minimalista y compatible con OpenAI que permite que múltiples LLMs locales compartan una GPU mediante agrupación inteligente de solicitudes y minimización de cambios de modelo.
Lexos es un motor de procesamiento de documentos con IA basado en eventos, que combina una puerta de enlace Go, trabajadores Python, colas Redis y modelos autoalojados para RAG, resumen y transcripción de voz sin conexión.
ELI es un asistente de IA privado y estrictamente local que funciona en su propio hardware. Ofrece voz, visión, memoria y 227 capacidades, incluyendo control de computadora y automatización. Funciona sin conexión por defecto, es agnóstico al modelo, usa GGUF local, soporta GPU y tiene un panel web para LAN.
vtmate es un kit de herramientas de IA de voz basado en terminal, con latencia ultrabaja, soporte para 41 idiomas y TTS/STT integrados. Permite conversaciones de voz en vivo, debates, clonación de voz, exportación de sesiones y modo daemon en segundo plano con atajos globales para una interacción fluida con la IA.
MoziAI-35B es un LLM multimodal de código abierto desplegable localmente, con arquitectura MoE de 35B comprimida a ~15,9 GB mediante la cuantización MoziSmartBit; ofrece contexto de 256K, visión, llamada de herramientas y un marco de razonamiento orientado a finanzas.
Mimora is a free, fully local pronunciation trainer for English and Spanish. It uses on-device TTS, speech recognition, and a local LLM to generate phrases and score user attempts with word-level feedback, requiring no cloud or API keys.
Xinference es una biblioteca unificada de inferencia para servir modelos de lenguaje, voz y multimodales. Proporciona API RESTful compatible con OpenAI, utilización heterogénea de GPU/CPU, despliegue distribuido e integraciones con LangChain, LlamaIndex, Dify y Chatbox.
SenseVoiceSmall es un modelo fundacional de voz de código abierto para ASR, identificación de idioma, reconocimiento de emociones y detección de eventos de audio, que cubre mandarín, cantonés, inglés, japonés y coreano con inferencia no autorregresiva rápida.