Qdrant é um mecanismo de busca de similaridade vetorial e banco de dados de alta performance escrito em Rust, projetado para aplicações de IA que exigem busca semântica e gestão de vetores em larga escala.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONMade With ML é um curso e código-base de código aberto que ensina como projetar, desenvolver, implantar e iterar em aplicações de machine learning de nível de produção, abrangendo MLOps, testes, serving, CI/CD e aprendizado contínuo.
Argo Workflows é um mecanismo de fluxo de trabalho nativo de contêiner para orquestrar jobs paralelos no Kubernetes, implementado como uma Custom Resource Definition (CRD).
Taipy é um framework Python projetado para cientistas de dados e engenheiros de ML criarem e implantarem aplicações web de dados e IA prontas para produção sem a necessidade de aprender linguagens de front-end.
Recotem é uma ferramenta de sistema de recomendação baseada em receitas, construída sobre o irspack. Um YAML define dados, treinamento e saída; o comando train produz um artefato assinado, e o serve o monta como uma API REST com troca a quente. Binário único, sem banco de dados.
FairMind é uma plataforma de governança de IA de código aberto que oferece detecção de viés, testes de justiça e rastreamento de conformidade para modelos de ML, LLM e IA multimodal. Ela disponibiliza avaliação com grau de evidência, registro de modelos e ferramentas de remediação.
Great Expectations (GX Core) é uma biblioteca Python de código aberto para qualidade de dados, fornecendo um framework para criar testes unitários de dados para garantir consistência e confiabilidade.
MLflow é uma plataforma de engenharia de IA de código aberto projetada para gerenciar o ciclo de vida de agentes, LLMs e modelos de ML tradicionais, com foco em observabilidade, avaliação e implantação.
NovaFabric é uma CLI auto-hospedada e de código aberto que captura qualquer execução de IA ou HPC — script, agente ou chamada de modelo — como uma cápsula de evidência portátil, com redação de segredos e replicável, sem alterações no código.
O Label Studio é uma ferramenta de anotação de dados open-source e multi-tipo, que suporta áudio, texto, imagens, vídeo e séries temporais, com uma interface simples e exportação para vários formatos de modelo.
Dagster é um orquestrador de pipelines de dados nativo da nuvem, projetado para o desenvolvimento, produção e observação de ativos de dados ao longo de todo o seu ciclo de vida.
Apache Airflow é uma plataforma para criar, agendar e monitorar fluxos de trabalho programaticamente como código, comumente usada para pipelines de dados e orquestração de AI/ML.
PyCaret 4.0 é uma plataforma AutoML open-source e auto-hospedada para Python, com motor sklearn, FastAPI e UI React. Roda localmente via Docker Compose, oferecendo gestão completa de experimentos, modelos e deploy.
Deep Lake é um banco de dados serverless multimodal para IA que combina busca vetorial com armazenamento de embeddings, imagens, vídeo, áudio e documentos. Ele transmite dados diretamente do armazenamento em nuvem para PyTorch/TensorFlow, suporta versionamento e integra-se com LangChain, LlamaIndex e Weights & Biases.