Batchalign3 es un pipeline de audio y ML de TalkBank para producir y enriquecer transcripciones CHAT, que cubre ASR, alineación forzada, morfoetiquetado neuronal, traducción y segmentación de enunciados. Incluye una CLI, paquete de Python, puente PyO3, panel de React y un shell de escritorio Tauri experimental.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONUn plan de estudios de ingeniería de IA gratuito y de código abierto basado en principios fundamentales: 523 lecciones en 20 fases (~342 horas), con cobertura desde las matemáticas hasta la producción en Python, TypeScript, Rust y Julia. Cada lección genera un artefacto reutilizable; incluye un tutor de IA instalable y preparación para la certificación de Claude.
Una plataforma de computación científica en Python puro con 22 módulos que cubren cuántica, ML, estadística, solvers de EDO y más; cero dependencias en tiempo de ejecución, con adaptadores opcionales de NumPy/SciPy para validación y reproducibilidad.
Haqumei es una biblioteca japonesa de grafema a fonema (G2P) escrita en Rust con enlaces para Python, que ofrece conversión precisa de texto a fonemas con información de prosodia, mapeo palabra-fonema y una herramienta CLI para frontends de síntesis de voz.
SpellKit es un gem de Ruby rápido y seguro con implementación Rust de SymSpell. Ofrece latencia submilisegundo, protección de términos mediante regex, diccionarios recargables en caliente y cero dependencias. Admite múltiples instancias, patrones de omisión y está listo para producción en extracción de términos de búsqueda.
Swift Tokenizers es un envoltorio Swift de alto rendimiento sobre el crate Rust de Hugging Face, centrado únicamente en la tokenización sin dependencias del Hub. Compatible con macOS, iOS y Linux, ofrece codificación, decodificación, detokenización en streaming, plantillas de chat y llamadas a herramientas.
HanLP es un kit de procesamiento del lenguaje natural multilingüe para entornos de producción, basado en PyTorch y TensorFlow 2.x. Admite tareas como segmentación, etiquetado de partes de laspeech, reconocimiento de entidades nombradas, análisis sintáctico y semántico, ofreciendo API RESTful y nativas.
Premove ITN es una biblioteca de normalización inversa de texto (ITN) de código abierto y consciente del contexto para transcripciones de agentes de voz en inglés. Convierte la salida de ASR en formas escritas canónicas mediante un pipeline de generar-puntuar-decodificar con puntuación contextual DeBERTa. Alcanza un 99,50% de precisión semántica en su subconjunto de prueba.
Analizadores morfológicos basados en estados finitos y Gramática de Restricciones, herramientas de revisión y recursos lingüísticos para el idioma Tsuut'ina (Sarsi), parte de la infraestructura lingüística de código abierto GiellaLT.
ModelScope es una biblioteca Python de código abierto que implementa Model-as-a-Service, con interfaces unificadas pipeline, Trainer y MsDataset para inferencia, ajuste fino y evaluación de modelos de CV, NLP, audio, multimodal y científicos, además de integración con hubs de modelos y datasets.
Hugging Face Transformers es un marco de definición de modelos para aprendizaje automático en tareas de texto, visión, audio y multimodales. Proporciona una API unificada para inferencia y entrenamiento con más de 1 millón de checkpoints preentrenados.
Este repositorio contiene analizadores morfológicos basados en transductores de estados finitos, herramientas de revisión y recursos lingüísticos para el idioma komi-zyriano, parte del proyecto GiellaLT.
LangExtract es una librería de Python de Google que usa modelos de lenguaje para extraer información estructurada de texto no estructurado, vinculando cada extracción a su ubicación exacta en el texto fuente y generando visualizaciones HTML interactivas.
TextBlob es una biblioteca de Python para procesamiento de lenguaje natural, con API simple para análisis de sentimientos, etiquetado gramatical, extracción de frases nominales, clasificación, tokenización y más, construida sobre NLTK y pattern.