プロバイダー
ModelMax は、リクエストを上流の AI プロバイダーへルーティングする統合ゲートウェイです。利用者は単一の API とやり取りし、ModelMax がプロバイダー固有の認証、フォーマット変換、レスポンス正規化を処理します。
ルーティングの仕組み
model パラメーター(例: deepseek-v3.2)付きでリクエストを送信すると、ModelMax は次を行います。
- モデルをレジストリで検索します。
- 上流プロバイダーとプロバイダー固有のモデル名を特定します。
- OpenAI 互換リクエストをプロバイダーのネイティブ形式に変換します。
- リクエストを転送し、正規化されたレスポンスをストリーミングで返します。
どのモデルがどのプロバイダーで提供されているかを把握する必要はありません。モデル ID を指定するだけです。
利用可能なプロバイダー
Google Gemini
Google の Gemini API に直接アクセスします。
提供モデル: Gemini チャットモデル、Veo 動画モデル。
機能:
- 完全なマルチモーダル入力(テキスト、画像、音声、動画)
- ストリーミング
- 動画生成(Veo)
- コンテキストキャッシュ
AWS Bedrock
Amazon のマネージド AI サービスで、サードパーティモデルへのアクセスを提供します。
提供モデル: DeepSeek、Qwen、MiniMax、Kimi。
機能:
- ストリーミング対応のテキストチャット
- AWS インフラによる高可用性
OpenAI 互換の国内プロバイダー
OpenAI 互換チャットエンドポイントを提供するプロバイダーへの直接統合です。
提供モデル: Qwen、DeepSeek、Kimi、MiniMax、GLM、Doubao、ERNIE、Hunyuan。
機能:
- ストリーミング対応のテキストチャット
- プロバイダー固有のリクエストフィールドが存在する場合は転送
- API キーとベース URL は ModelMax サーバー側でプロバイダーごとに設定
プロバイダーの透明性
モデル一覧レスポンスの owned_by フィールドで、各モデルを提供するプロバイダーを確認できます。
{
"id": "deepseek-v3.2",
"owned_by": "bedrock"
}
自動フォールバックなし
各モデルは正確に 1 つのプロバイダーから提供されます。ModelMax は、あるプロバイダーが利用できない場合に別プロバイダーへ自動フォールバックしません。プロバイダーに問題がある場合、API は 502 Bad Gateway エラーを返します。
プロバイダーの追加
ModelMax は API 変更なしで新しいプロバイダーを追加できるように設計されています。新しいプロバイダーが追加されると、そのモデルはモデル一覧に表示され、同じエンドポイントで利用できます。クライアント側の変更は不要です。
