このプロジェクトについて
llm-failover-proxy は、単一のローカルエンドポイント(OpenAI 互換)を提供し、優先順位付けされた LLM プロバイダーのチェーンを管理します。プライマリモデルがレートリミット、エラー、タイムアウトなどで失敗した場合、プロキシはアプリケーションを中断させることなく、チェーン内の次の利用可能なモデルに透過的に切り替えます。
主な機能は以下の通りです:
- パラレルレース: 優先モデルの応答が遅い場合(デフォルト 5 秒)、プロキシは次のモデルに並行してリクエストを送り、最初に取得できた有効な回答を受け入れ、レイテンシを最小化します。
- モデルリスト: チャット用と埋め込み用など、目的別に複数の名前付きリストをサポートします。
- プロバイダー管理: API キーの設定、モデル優先度の管理、パフォーマンス統計の監視を行うターミナル UI を備えています。
- ヘルスモニタリング: /health、/stats エンドポイントを提供し、サービスの稼働状態を確認し、モデルごとの成功/失敗率を追跡します。
- バックグラウンド動作: Windows、macOS、Linux でシステムログイン時に自動起動するバックグラウンドサービスとしてインストール可能です。
- 互換性: ストリーミング、ツール/関数呼び出し、ビジョン、JSON モードをサポートし、プロバイダーへそのまま転送します。
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.