Batchalign3 é uma pipeline de áudio e ML do TalkBank para produzir e enriquecer transcritos CHAT, cobrindo ASR, alinhamento forçado, morfotagging neural, tradução e segmentação de expressões.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONUm pequeno modelo de linguagem GPT (~540M parâmetros) projetado para treinamento do zero em hardware de laptop de consumo, com pré-treinamento em Fineweb-edu e capacidade de ajuste fino para chat.
微舆(BettaFish)是一个从零实现的多智能体舆情分析系统,通过AI爬虫集群、多模态分析、论坛协作机制和智能报告生成,帮助用户打破信息茧房,还原舆情原貌,预测未来走向,辅助决策。支持国内外30+主流社媒分析,可接入私有数据库,纯Python模块化设计,支持Docker一键部署。
Currículo de engenharia de IA gratuito e de código aberto focado em primeiros princípios: 523 lições em 20 fases (~342 horas), com cobertura da matemática à produção em Python, TypeScript, Rust e Julia. Cada lição entrega um prompt, skill, agente ou servidor MCP reutilizável; inclui um tutor de IA instalável e preparação para certificação Claude.
Uma coleção selecionada de 107 artigos fundamentais de pesquisa em IA generativa, com resumos abrangentes, roteiros de aprendizado, glossários e guias de decisão—tornando a pesquisa de IA de ponta acessível a todos.
Plataforma de computação científica em Python puro com 22 módulos cobrindo quântica, ML, estatística, solvers de EDO e mais—zero dependências em runtime, com adaptadores opcionais NumPy/SciPy para validação e reprodutibilidade.
Haqumei é uma biblioteca japonesa Grafema-para-Fonema (G2P) em Rust com bindings para Python, oferecendo conversão texto-fonema precisa com prosódia, mapeamento palavra-fonema e CLI para frontends de síntese de fala.
Projeto de código aberto de modelos de linguagem grandes chineses LLaMA e Alpaca, que expande o vocabulário chinês com base no LLaMA original e realiza pré-treinamento adicional, fornecendo modelos ajustados por instruções, pesos LoRA, scripts de treinamento e implantação quantizada, com suporte para execução local em CPU/GPU.
O NLTK é um conjunto abrangente de módulos Python de código aberto, conjuntos de dados e tutoriais projetados para apoiar a pesquisa e o desenvolvimento em Processamento de Linguagem Natural.
SpellKit é uma gem Ruby rápida e segura com uma implementação Rust SymSpell. Oferece latência de submilissegundo, proteção de termos via regex, dicionários com recarga dinâmica e zero dependências. Suporta múltiplas instâncias, padrões de exclusão e está pronta para produção na extração de termos de pesquisa.
Um framework de IA tudo-em-um para busca semântica, orquestração de LLMs e fluxos de trabalho de modelos de linguagem.
Swift Tokenizers é um wrapper Swift de alto desempenho para a crate Rust tokenizers da Hugging Face, focado apenas em tokenização, sem dependências do Hub. Suporta macOS, iOS e Linux, oferecendo codificação, decodificação, detokenização em streaming, templates de chat e chamada de ferramentas.
HanLP é um kit de ferramentas de processamento de linguagem natural multilíngue para ambientes de produção, baseado em PyTorch e TensorFlow 2.x, com suporte a segmentação de palavras, etiquetagem de classes gramaticais, reconhecimento de entidades nomeadas, análise sintática, análise semântica, e oferece APIs RESTful e local.
Premove ITN é uma biblioteca de normalização inversa de texto (ITN) de código aberto e sensível ao contexto, projetada para transcrições de agentes de voz em inglês. Ela converte saídas de ASR em formas escritas canônicas usando um pipeline de geração, pontuação e decodificação com pontuação contextual DeBERTa.
Este repositório contém analisadores morfológicos baseados em transdutores de estados finitos e Gramática de Restrições, ferramentas de revisão e recursos linguísticos para a língua Tsuut'ina (Sarsi), parte da infraestrutura de código aberto GiellaLT.
O LlamaFactory é um framework Python para ajuste fino eficiente de mais de 100 modelos de linguagem e multimodais, oferecendo CLI sem código, interface Web Gradio, LoRA/QLoRA e vários algoritmos de treinamento.
O ModelScope é uma biblioteca Python de código aberto que implementa Model-as-a-Service, oferecendo interfaces unificadas pipeline, Trainer e MsDataset para inferência, ajuste fino e avaliação de modelos de CV, NLP, áudio, multimodal e científicos, além de integração com hubs de modelos e datasets.
SDK Python para a API AskNews que injeta contexto de notícias em tempo real em qualquer LLM com uma única linha de código, oferecendo endpoints para busca de notícias, rastreamento de eventos, previsões, análises, pesquisa profunda, grafos de conhecimento e busca na web.
Um currículo gratuito de 12 semanas e 24 lições da Microsoft para aprender fundamentos de IA: redes neurais, aprendizado profundo, visão computacional, PNL, transformadores, ética, além de notebooks práticos, questionários e laboratórios.
Hugging Face Transformers é um framework de definição de modelos para aprendizado de máquina em tarefas de texto, visão, áudio e multimodais. Oferece uma API unificada para inferência e treinamento com mais de 1 milhão de checkpoints pré-treinados.