这个项目能做什么
WeClone 提供了一条完整的流水线,用于从导出的聊天记录构建个人 AI 化身。用户可以导出 Telegram 聊天历史,使用 Microsoft Presidio 和自定义屏蔽列表进行隐私过滤预处理,微调多模态 LLM(默认使用 Qwen2.5-VL-7B-Instruct 并采用 LoRA),并将生成的模型部署为聊天机器人。该项目支持文本和图像数据,Telegram 是主要数据源,WhatsApp、Discord 和 Slack 被列为计划支持的数据源。部署支持 Telegram、通过 openclaw-weixin 接入的微信个人账号、Discord 和 Slack,并提供 AstrBot 和 LangBot 的集成指南。README 包含详细的硬件要求、单卡和多卡训练命令、浏览器演示、API 服务器和测试工具。它强调隐私保护,提供了大量关于生产使用和模型可靠性的免责声明,并指出微调质量取决于模型规模和聊天数据量。该项目处于快速迭代阶段,建议使用 14B 参数或更大的模型以获得更好的效果。
评论
0 评分人数达到10人后显示
登录后参与讨论。