ルーティングルールを作成します。
今すぐお試しください
テスト
RAM 認証
|
アクション |
アクセスレベル |
リソースタイプ |
条件キー |
依存アクション |
|
polardb:CreateModelApi |
create |
*すべてのリソース。
|
なし | なし |
リクエスト構文
POST HTTP/1.1
リクエストパラメーター
|
パラメーター |
型 |
必須 / 任意 |
説明 |
例 |
| GwClusterId |
string |
必須 |
ゲートウェイインスタンスの ID。 |
pg-xxxxxxxxxx |
| Name |
string |
必須 |
モデル API の名前。 |
test |
| ModelCategory |
string |
必須 |
カテゴリ。有効な値:
|
text |
| PathPrefix |
string |
必須 |
API パスのプレフィックス。 |
/test |
| Protocol |
string |
必須 |
プロトコル。有効な値:
|
openai |
| RecordInput |
string |
任意 |
入力ポイントの数。 |
10 |
| RecordOutput |
string |
任意 |
出力ポイントの数。 |
10 |
| RouteRules |
string |
必須 |
ルーティングルールのリスト (JSON 配列文字列)。 |
[ { "RuleName": "文字列", "FallbackMode": "failover", "MatchModelListJson": "[]", "providerBalancerAlgorithm": "round-robin", "Providers": [ { "ModelServiceName": "文字列", "Weight": "0", "model_protocol": "vllm" "ModelList": "[]" } ], "FallbackProviders": [ { "ModelServiceName": "文字列", "model_protocol": "anthropic", "Weight": "10", "ModelList": "[]" } ] } ] |
| Config |
string |
任意 |
ゲートウェイのリトライ構成。 |
{ "failover": { "enabled": true, "max_provider_retries": 2, "max_failover_providers": 1, "retryable_status_codes": [429, 500, 502, 503, 504], "retry_delay": 0.5 } } |
| ForceModel |
string |
任意 |
強制モデル。 |
xxx |
| RegionId |
string |
任意 |
リージョン ID。 |
cn-beijing |
レスポンスフィールド
|
フィールド |
型 |
説明 |
例 |
|
object |
レスポンスのスキーマ。 |
||
| RequestId |
string |
リクエスト ID。 |
6BD9CDE4-5E7B-4BF3-9BB8-83C73E****** |
| ModelApiId |
string |
モデル API の ID。 |
mi-xxxxxx |
| InvokeEndpoint |
string |
リクエストエンドポイント。 |
xxx |
| Status |
string |
モデル API のステータス。 |
Enable |
例
成功レスポンス
JSONJSON
{
"RequestId": "6BD9CDE4-5E7B-4BF3-9BB8-83C73E******",
"ModelApiId": "mi-xxxxxx",
"InvokeEndpoint": "xxx",
"Status": "Enable"
}
エラーコード
完全なリストについては、「エラーコード」をご参照ください。
変更履歴
完全なリストについては、「変更履歴」をご参照ください。