Centro de llamadas nativo de IA de código abierto: la IA de voz atiende primero mediante OpenAI Realtime o Qwen y transfiere a agentes humanos en colas de FreeSWITCH con un softphone en el navegador. Un único binario en Go con API REST, SSE, interfaz React embebida y PostgreSQL.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONVoicebox es un estudio de voz de IA de código abierto y ejecución local que clona voces, genera voz, ofrece dictado global y permite que agentes de IA hablen mediante herramientas MCP.
Premove ITN es una biblioteca de normalización inversa de texto (ITN) de código abierto y consciente del contexto para transcripciones de agentes de voz en inglés. Convierte la salida de ASR en formas escritas canónicas mediante un pipeline de generar-puntuar-decodificar con puntuación contextual DeBERTa. Alcanza un 99,50% de precisión semántica en su subconjunto de prueba.
RunAnywhere es una suite de SDKs multiplataforma para ejecutar modelos de IA de forma local en teléfonos, navegadores, escritorios y servidores. Soporta LLM, visión, voz, agentes de voz, RAG, embeddings e imagen generada con una sola API semántica.
SenseVoiceSmall es un modelo fundacional de voz de código abierto para ASR, identificación de idioma, reconocimiento de emociones y detección de eventos de audio, que cubre mandarín, cantonés, inglés, japonés y coreano con inferencia no autorregresiva rápida.