这个项目能做什么

MultiRouter AI 作为一个单一的 API 端点,能够智能地将聊天补全请求路由到多个 AI 提供商账户。它允许用户叠加来自 Groq、Cerebras 和 Gemini 等服务的免费层级 API 密钥,并在某个账户达到速率限制时自动进行故障转移。该系统完全兼容 OpenAI API 规范,使其能够即插即用地应用于 Cursor、Windsurf、Claude Code、Aider 以及其他支持自定义 OpenAI 基础 URL 的 IDE。 配置通过 YAML 文件 (`providers.yaml`) 进行管理,用户在此定义提供商实例、API 密钥、支持的模型和路由优先级。系统会按顺序尝试提供商——通常先尝试免费层级,最后尝试付费层级——并在速率限制过期后自动进入冷却和重新激活状态。系统提供两种路由策略:默认的 'exhaust'(耗尽)模式,即使用每个提供商直到其额度耗尽;以及 'round-robin'(轮询)模式,通过使用特殊的模型名称 `multirouter-auto` 将请求均匀分布在活动实例之间。 该服务器支持通过 OpenAI 格式的服务器发送事件 (SSE) 进行流式响应,并公开了 `/v1/chat/completions`、`/v1/models` 和 `/health` 等标准端点。它运行在 Node.js 20+、Express 5 和 TypeScript 5.9 之上,内置了速率限制和基于 Bearer 令牌的身份验证,并可以通过 `openai-compatible` 提供商类型和自定义 `base_url` 集成本地或自托管模型。 安全最佳实践包括在 git 中忽略 `providers.yaml` 并支持秘密信息的环境变量插值。该项目采用 MIT 许可,旨在为希望通过汇总多个提供商配额以获得不间断 AI 访问且无需修改客户端应用程序的开发人员提供支持。