这个项目能做什么
AI Research Platform 是一个面向 AI 安全研究的自进化闭环系统,由三个核心组件构成:honeycode-honeypot 蜜罐系统负责发布安全任务并捕获 AI 提交的代码修复;eval-engine 评测引擎在 Docker 沙箱中执行提交,进行功能正确性、安全性及六种作弊检测(如硬编码绕过、危险系统调用、SQL 注入、eval/exec 使用、混淆代码等),并生成 JSON 报告;ai-training-gym 训练场则将评测结果导出为标准训练数据集,支持基于 transformers 和 PEFT 的 LoRA 微调流水线。
项目以 Git 子模块方式组织,提供 pytest 测试套件(蜜罐 8 项、评测引擎 37 项、训练场 59 项)和自动 Agent 原型循环脚本。参与者可通过 GitHub Issue 模板提交修复代码,CI 会自动评测并发布结果;AI Agent 也可按文档指引参与,提交内容会计入训练数据集。项目采用 MIT 许可证,定位为实验性质的研究原型。
评论
0 人表达喜爱 · 满10人后显示 Deer Point
登录后参与讨论。