Um toolkit abrangente para visão computacional que fornece blocos de construção agnósticos a modelos para carregamento de dados, visualização e gerenciamento de datasets.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONGradio é uma biblioteca Python de código aberto para criar e compartilhar rapidamente aplicações web para modelos de machine learning, APIs ou qualquer função Python, sem exigir experiência em desenvolvimento web.
Magika é a ferramenta de detecção de tipo de conteúdo de arquivo com IA do Google. Ela usa um pequeno modelo de aprendizado profundo para identificar mais de 200 tipos de arquivo em milissegundos em uma única CPU, com ~99% de precisão. Disponível como CLI em Rust, além de bindings para Python, JavaScript e Go.
Pyro é uma biblioteca de programação probabilística profunda, flexível e escalável, construída sobre PyTorch, que suporta modelos probabilísticos universais e inferência automatizada.
Currículo de engenharia de IA gratuito e de código aberto focado em primeiros princípios: 523 lições em 20 fases (~342 horas), com cobertura da matemática à produção em Python, TypeScript, Rust e Julia. Cada lição entrega um prompt, skill, agente ou servidor MCP reutilizável; inclui um tutor de IA instalável e preparação para certificação Claude.
Sonnet é uma biblioteca de redes neurais da DeepMind construída sobre o TensorFlow 2. Oferece abstrações simples e compostáveis via o conceito snt.Module para pesquisa em aprendizado de máquina, com suporte a módulos personalizados, serialização e treinamento distribuído.
Tesseract.js é uma biblioteca OCR em JavaScript que extrai texto de imagens em mais de 100 idiomas. Executa-se em navegadores via WebAssembly e no Node.js, sem modificar o modelo de reconhecimento.
dlib é um toolkit abrangente em C++ projetado para criar software complexo, oferecendo algoritmos de aprendizado de máquina e análise de dados com suporte a C++ e Python.
EasyOCR é uma biblioteca de reconhecimento óptico de caracteres pronta para uso, com suporte a mais de 80 idiomas e principais sistemas de escrita. Oferece API Python simples e CLI, com modelos de detecção e reconhecimento baseados em PyTorch, além de opções de treinamento personalizado.
Uma coleção abrangente de exemplos de código e tutoriais de machine learning e deep learning, acompanhando cursos online. Abrange tópicos de regressão linear a aprendizado por reforço, PLN, visão computacional e IA generativa.
O Label Studio é uma ferramenta de anotação de dados open-source e multi-tipo, que suporta áudio, texto, imagens, vídeo e séries temporais, com uma interface simples e exportação para vários formatos de modelo.
X-AnyLabeling é uma aplicação desktop multiplataforma e leve para anotação de dados assistida por IA, cobrindo texto, imagem, vídeo e dados multimodais. Oferece ampla variedade de ferramentas de rotulagem, integração com muitos modelos de deep learning, inferência local e remota, além de importação/exportação em diversos formatos.
Um guia prático para entrevistas técnicas de IA/ML em grandes empresas de tecnologia, cobrindo codificação, fundamentos de ML, design de sistemas e comportamento, com tutor opcional baseado em MCP.
Este repositório é uma coleção de recursos open source sobre Agentes de IA, incluindo livros, cursos, repositórios de código e listas de artigos. Ele atualiza automaticamente as contagens de estrelas do GitHub diariamente, classifica por popularidade e oferece rotas de leitura recomendadas, cobrindo desde materiais em chinês e inglês até frameworks e ecossistemas de agentes.
O ModelScope é uma biblioteca Python de código aberto que implementa Model-as-a-Service, oferecendo interfaces unificadas pipeline, Trainer e MsDataset para inferência, ajuste fino e avaliação de modelos de CV, NLP, áudio, multimodal e científicos, além de integração com hubs de modelos e datasets.
einops é uma biblioteca flexível de operações de tensor que usa notação inspirada em Einstein para código legível e confiável em PyTorch, JAX, TensorFlow, NumPy e outros.
Hugging Face Transformers é um framework de definição de modelos para aprendizado de máquina em tarefas de texto, visão, áudio e multimodais. Oferece uma API unificada para inferência e treinamento com mais de 1 milhão de checkpoints pré-treinados.
AutoKeras é uma biblioteca AutoML de código aberto construída sobre o Keras que automatiza a busca de modelos de aprendizado profundo para tarefas de imagem, texto e dados estruturados.
O Apache TVM é um framework de compilação de machine learning aberto, projetado para implantação universal e pipelines de compiladores customizáveis.
Um guia abrangente de código aberto que abrange técnicas de engenharia de prompts, RAG, agentes de IA e otimização de LLM. Inclui tutoriais, artigos de pesquisa, ferramentas e notebooks para trabalhar de forma eficaz com grandes modelos de linguagem.