README do perfil do GitHub de Sachin, um arquiteto e engenheiro de IA aplicada. Apresenta projetos de código aberto sobre agentes, RAG, avaliação e confiabilidade, além de habilidades e contatos.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONAgentLeak é uma ferramenta de código aberto para testar privacidade em agentes de IA. Detecta vazamentos de dados em chamadas de ferramentas, memória e logs usando SDK Python local, CLI e ferramentas MCP, fornecendo relatórios mascarados e portões de CI sem dependências em nuvem.
MLflow é uma plataforma de engenharia de IA de código aberto projetada para gerenciar o ciclo de vida de agentes, LLMs e modelos de ML tradicionais, com foco em observabilidade, avaliação e implantação.
SUM é uma ferramenta de código aberto para verificar transformações de texto por IA com recibos criptográficos. Ela verifica o que mudou, o que foi preservado e o que foi perdido quando a IA reescreve texto, com assinaturas Ed25519 entre runtimes e verificação offline.
garak é um scanner de vulnerabilidades de LLM de código aberto da NVIDIA que testa modelos de IA generativa quanto a alucinação, vazamento de dados, injeção de prompt, toxicidade, jailbreaks e outras fraquezas, semelhante em espírito ao nmap ou Metasploit, mas para LLMs.
O iFixAi é uma ferramenta independente de auditoria para agentes de IA que avalia se um agente segue KPIs de negócios e estruturas organizacionais por meio de um sistema de pontuação estruturado.
O DeepEval é uma estrutura de avaliação de LLM de código aberto projetada para testes unitários de aplicações de IA, incluindo pipelines de RAG, agentes e chatbots.
Benchmark aberto de alucinação de LLMs sobre a BNCC (Base Nacional Comum Curricular do Brasil). Mede quanto os modelos inventam códigos e textos oficiais, com metodologia, dados brutos e CI auditáveis.