这个项目能做什么

llm-router-gate 是一个 Python CLI 和 SDK,专为需要对单次 LLM API 调用具备精确可见性的开发者设计。它将请求路由到 Anthropic、OpenRouter 或本地 llama.cpp 服务器,在流式响应的同时暴露完整的 HTTP 层,包括请求头、原始 SSE 事件和最终响应体。它提供带有来源说明的 token 计数和成本估算,帮助用户比较不同提供商、调试空响应,或在部署前验证提示词成本。 该工具有意避免聊天记录、重试或系统提示,功能类似于 LLM 版的 "curl -v" 加上内置计算器。它支持三态推理开关,在流式输出中区分答案和推理通道,并从权威服务器字段或备用启发式方法报告 token 使用情况。 安全须知:该工具会记录所有请求头,包括 API 密钥——分享前请进行脱敏处理。需要 Python ≥3.14,并使用 uv 进行依赖管理。适合在没有抽象层的情况下对跨后端的 LLM 行为进行调试、基准测试或验证。