OPEN SOURCE, OPEN TO EVERYONE

Código abierto. Nuevas posibilidades.

Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.

Selección editorial · Descubre buen código abierto4109descubiertos

Un poco de curiosidad. Un mundo de código abierto.

THE FIRST COLLECTION
Topic: speech-to-text清除

SpeechRecognition es una biblioteca de Python para reconocimiento de voz compatible con múltiples motores y API, tanto en línea como fuera de línea, incluidos CMU Sphinx, Google, Azure, IBM, Vosk, Whisper y OpenAI.

IADesarrolloMultimodal AI
sensevoiceQwenAudio
NUEVO

SenseVoiceSmall es un modelo fundacional de voz de código abierto para ASR, identificación de idioma, reconocimiento de emociones y detección de eventos de audio, que cubre mandarín, cantonés, inglés, japonés y coreano con inferencia no autorregresiva rápida.

IADesarrolloModel runtime
whisperlivekitQuentinFuxa
NUEVO

WhisperLiveKit (WLK) es un sistema de voz a texto de código abierto y autoalojado diseñado para transcripción en tiempo real de ultra baja latencia. Soporta múltiples modelos y provides APIs compatibles con OpenAI y Deepgram.

IADesarrolloModel runtime
speech-to-speechhuggingface
NUEVO

Un pipeline modular de agente de voz de baja latencia (VAD -> STT -> LLM -> TTS) que implementa el conjunto de eventos OpenAI Realtime sobre WebSocket y WebRTC.

IADesarrolloAI assistants