OPEN SOURCE, OPEN TO EVERYONE

好开源,值得被发现。

发现优质开源项目,匿名提交开源项目,认领编辑你的开源项目。

人工精选 · 发现好开源4109已发现

带着好奇心,发现开源世界。

THE FIRST COLLECTION
Topic: llm-evaluation清除
sachncssachncs
新收录

这是 Sachin 的 GitHub 个人资料 README,他将自己定义为一名应用 AI 架构师和工程师。该页面展示了涵盖 Agent、检索 (RAG)、评估及可靠性工具的精选开源项目,并列出了其技能、工作风格、合作条款及联系方式。

人工智能开发工具智能体 Agent
agentleakyagobski
新收录

AgentLeak 是一个面向 AI 代理的开源隐私测试工具。它通过本地 Python SDK、CLI 和 MCP 工具检测工具调用、内存和日志中的数据泄露,提供脱敏报告和 CI 门禁,无需云依赖。

开发工具人工智能测试与调试
sumOtotaO
新收录

SUM 是一个开源工具,用于验证 AI 文本转换并生成加密收据。它检查 AI 改写文本时发生了什么变化、保留了什么、丢失了什么,支持跨运行时 Ed25519 签名和离线验证。

人工智能开发工具AI 助手
garakNVIDIA
新收录

garak 是 NVIDIA 推出的开源 LLM 漏洞扫描器,用于探测生成式 AI 模型的幻觉、数据泄露、提示注入、毒性、越狱等弱点,其定位类似面向 LLM 的 nmap 或 Metasploit。

人工智能开发工具训练 / 微调 / 评测
deepevalconfident-ai
新收录

DeepEval 是一个开源的 LLM 评估框架,专为 AI 应用(如 RAG、智能体和聊天机器人)提供单元测试支持。

人工智能开发工具训练 / 微调 / 评测