Batchalign3 es un pipeline de audio y ML de TalkBank para producir y enriquecer transcripciones CHAT, que cubre ASR, alineación forzada, morfoetiquetado neuronal, traducción y segmentación de enunciados. Incluye una CLI, paquete de Python, puente PyO3, panel de React y un shell de escritorio Tauri experimental.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONProyecto educativo para entrenar un modelo GPT (≈540M parámetros) desde cero en laptop de consumidor, con preentrenamiento en Fineweb-edu y ajuste de chat.
微舆(BettaFish)是自零构建的多智能体舆情分析系统,通过AI爬虫集群、多模态分析、论坛协作与智能报告生成,打破信息茧房,还原舆情全貌并预测趋势。支持30+国内外社媒、私有数据库接入,纯Python模块化,Docker一键部署。
Un plan de estudios de ingeniería de IA gratuito y de código abierto basado en principios fundamentales: 523 lecciones en 20 fases (~342 horas), con cobertura desde las matemáticas hasta la producción en Python, TypeScript, Rust y Julia. Cada lección genera un artefacto reutilizable; incluye un tutor de IA instalable y preparación para la certificación de Claude.
Una colección curada de 107 artículos fundamentales de investigación en IA generativa con resúmenes completos, rutas de aprendizaje, glosarios y guías de decisión, haciendo accesible la investigación de vanguardia para todos.
Una plataforma de computación científica en Python puro con 22 módulos que cubren cuántica, ML, estadística, solvers de EDO y más; cero dependencias en tiempo de ejecución, con adaptadores opcionales de NumPy/SciPy para validación y reproducibilidad.
Haqumei es una biblioteca japonesa de grafema a fonema (G2P) escrita en Rust con enlaces para Python, que ofrece conversión precisa de texto a fonemas con información de prosodia, mapeo palabra-fonema y una herramienta CLI para frontends de síntesis de voz.
Proyecto de código abierto de modelos de lenguaje grandes chinos LLaMA y Alpaca, que amplía el vocabulario chino sobre la base del LLaMA original y realiza un segundo preentrenamiento, proporcionando modelos ajustados con instrucciones, pesos LoRA, scripts de entrenamiento y cuantificación, con soporte para ejecución local en CPU/GPU.
NLTK es un conjunto exhaustivo de módulos de Python, conjuntos de datos y tutoriales de código abierto diseñados para apoyar la investigación y el desarrollo en el Procesamiento de Lenguaje Natural.
SpellKit es un gem de Ruby rápido y seguro con implementación Rust de SymSpell. Ofrece latencia submilisegundo, protección de términos mediante regex, diccionarios recargables en caliente y cero dependencias. Admite múltiples instancias, patrones de omisión y está listo para producción en extracción de términos de búsqueda.
Un framework de IA todo en uno para búsqueda semántica, orquestación de LLM y flujos de trabajo.
Swift Tokenizers es un envoltorio Swift de alto rendimiento sobre el crate Rust de Hugging Face, centrado únicamente en la tokenización sin dependencias del Hub. Compatible con macOS, iOS y Linux, ofrece codificación, decodificación, detokenización en streaming, plantillas de chat y llamadas a herramientas.
HanLP es un kit de procesamiento del lenguaje natural multilingüe para entornos de producción, basado en PyTorch y TensorFlow 2.x. Admite tareas como segmentación, etiquetado de partes de laspeech, reconocimiento de entidades nombradas, análisis sintáctico y semántico, ofreciendo API RESTful y nativas.
Premove ITN es una biblioteca de normalización inversa de texto (ITN) de código abierto y consciente del contexto para transcripciones de agentes de voz en inglés. Convierte la salida de ASR en formas escritas canónicas mediante un pipeline de generar-puntuar-decodificar con puntuación contextual DeBERTa. Alcanza un 99,50% de precisión semántica en su subconjunto de prueba.
Analizadores morfológicos basados en estados finitos y Gramática de Restricciones, herramientas de revisión y recursos lingüísticos para el idioma Tsuut'ina (Sarsi), parte de la infraestructura lingüística de código abierto GiellaLT.
LlamaFactory es un framework de Python para el ajuste fino eficiente de más de 100 modelos de lenguaje grandes y multimodales, con CLI sin código, interfaz web Gradio, LoRA/QLoRA y múltiples algoritmos de entrenamiento.
ModelScope es una biblioteca Python de código abierto que implementa Model-as-a-Service, con interfaces unificadas pipeline, Trainer y MsDataset para inferencia, ajuste fino y evaluación de modelos de CV, NLP, audio, multimodal y científicos, además de integración con hubs de modelos y datasets.
SDK de Python para la API de AskNews que inyecta contexto de noticias en tiempo real en cualquier LLM con una sola línea de código, ofreciendo endpoints para búsqueda de noticias, seguimiento de eventos, pronósticos, analítica, investigación profunda, grafos de conocimiento y búsqueda web.
Un plan de estudios gratuito de 12 semanas y 24 lecciones de Microsoft para aprender fundamentos de IA: redes neuronales, aprendizaje profundo, visión por computadora, PLN, transformadores y ética, con cuadernos prácticos, cuestionarios y laboratorios.
Hugging Face Transformers es un marco de definición de modelos para aprendizaje automático en tareas de texto, visión, audio y multimodales. Proporciona una API unificada para inferencia y entrenamiento con más de 1 millón de checkpoints preentrenados.