Background texture

プロバイダー

ModelMax は、リクエストを上流の AI プロバイダーへルーティングする統合ゲートウェイです。利用者は単一の API とやり取りし、ModelMax がプロバイダー固有の認証、フォーマット変換、レスポンス正規化を処理します。

ルーティングの仕組み

model パラメーター(例: deepseek-v3.2)付きでリクエストを送信すると、ModelMax は次を行います。

  1. モデルをレジストリで検索します。
  2. 上流プロバイダーとプロバイダー固有のモデル名を特定します。
  3. OpenAI 互換リクエストをプロバイダーのネイティブ形式に変換します。
  4. リクエストを転送し、正規化されたレスポンスをストリーミングで返します。

どのモデルがどのプロバイダーで提供されているかを把握する必要はありません。モデル ID を指定するだけです。

利用可能なプロバイダー

Google Gemini

Google の Gemini API に直接アクセスします。

提供モデル: Gemini チャットモデル、Veo 動画モデル。

機能:

  • 完全なマルチモーダル入力(テキスト、画像、音声、動画)
  • ストリーミング
  • 動画生成(Veo)
  • コンテキストキャッシュ

AWS Bedrock

Amazon のマネージド AI サービスで、サードパーティモデルへのアクセスを提供します。

提供モデル: DeepSeek、Qwen、MiniMax、Kimi。

機能:

  • ストリーミング対応のテキストチャット
  • AWS インフラによる高可用性

OpenAI 互換の国内プロバイダー

OpenAI 互換チャットエンドポイントを提供するプロバイダーへの直接統合です。

提供モデル: Qwen、DeepSeek、Kimi、MiniMax、GLM、Doubao、ERNIE、Hunyuan。

機能:

  • ストリーミング対応のテキストチャット
  • プロバイダー固有のリクエストフィールドが存在する場合は転送
  • API キーとベース URL は ModelMax サーバー側でプロバイダーごとに設定

プロバイダーの透明性

モデル一覧レスポンスの owned_by フィールドで、各モデルを提供するプロバイダーを確認できます。

{
  "id": "deepseek-v3.2",
  "owned_by": "bedrock"
}

自動フォールバックなし

各モデルは正確に 1 つのプロバイダーから提供されます。ModelMax は、あるプロバイダーが利用できない場合に別プロバイダーへ自動フォールバックしません。プロバイダーに問題がある場合、API は 502 Bad Gateway エラーを返します。

プロバイダーの追加

ModelMax は API 変更なしで新しいプロバイダーを追加できるように設計されています。新しいプロバイダーが追加されると、そのモデルはモデル一覧に表示され、同じエンドポイントで利用できます。クライアント側の変更は不要です。