OPEN SOURCE, OPEN TO EVERYONE

Código aberto. Novas possibilidades.

Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.

Seleção editorial · Descubra bons projetos open source4109descobertos

Um pouco de curiosidade. Um mundo de código aberto.

THE FIRST COLLECTION
Topic: llm-evaluation清除
sachncssachncs
NOVO

README do perfil do GitHub de Sachin, um arquiteto e engenheiro de IA aplicada. Apresenta projetos de código aberto sobre agentes, RAG, avaliação e confiabilidade, além de habilidades e contatos.

IADesenvolvimentoAI agents
agentleakyagobski
NOVO

AgentLeak é uma ferramenta de código aberto para testar privacidade em agentes de IA. Detecta vazamentos de dados em chamadas de ferramentas, memória e logs usando SDK Python local, CLI e ferramentas MCP, fornecendo relatórios mascarados e portões de CI sem dependências em nuvem.

DesenvolvimentoIATesting & debugging
mlflowmlflow
NOVO

MLflow é uma plataforma de engenharia de IA de código aberto projetada para gerenciar o ciclo de vida de agentes, LLMs e modelos de ML tradicionais, com foco em observabilidade, avaliação e implantação.

Cinema, vídeo e mídiaVideo editing
sumOtotaO
NOVO

SUM é uma ferramenta de código aberto para verificar transformações de texto por IA com recibos criptográficos. Ela verifica o que mudou, o que foi preservado e o que foi perdido quando a IA reescreve texto, com assinaturas Ed25519 entre runtimes e verificação offline.

IADesenvolvimentoAI assistants
garakNVIDIA
NOVO

garak é um scanner de vulnerabilidades de LLM de código aberto da NVIDIA que testa modelos de IA generativa quanto a alucinação, vazamento de dados, injeção de prompt, toxicidade, jailbreaks e outras fraquezas, semelhante em espírito ao nmap ou Metasploit, mas para LLMs.

IADesenvolvimentoTraining & evaluation
ifixaiifixai-ai
NOVO

O iFixAi é uma ferramenta independente de auditoria para agentes de IA que avalia se um agente segue KPIs de negócios e estruturas organizacionais por meio de um sistema de pontuação estruturado.

IATraining & evaluation
deepevalconfident-ai
NOVO

O DeepEval é uma estrutura de avaliação de LLM de código aberto projetada para testes unitários de aplicações de IA, incluindo pipelines de RAG, agentes e chatbots.

IADesenvolvimentoTraining & evaluation
NOVO

Benchmark aberto de alucinação de LLMs sobre a BNCC (Base Nacional Comum Curricular do Brasil). Mede quanto os modelos inventam códigos e textos oficiais, com metodologia, dados brutos e CI auditáveis.

IATraining & evaluation