すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-max

最終更新日:Aug 26, 2026

Qwen 3 シリーズの Max モデルは、プレビュー版と比較してエージェントプログラミングとツール呼び出しの機能が専門的に強化されました。今回正式にリリースされたモデルは、その分野で最先端 (SOTA) のパフォーマンスを達成しており、より複雑なシナリオで動作するエージェントの要求により適しています。このモデルバージョンは、スナップショットモデルの qwen3-max-2026-01-23 と機能的に同等です。

推論サービスプロバイダー

qwen3-max の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

258048

最大出力長

65536

コンテキストウィンドウ

262144

最大入力長 (思考モード)

258048

最大出力長 (思考モード)

32768

最大思考連鎖長

81920

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.359

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.072

100 万トークンあたり

入力 (バッチファイル)

0.18

100 万トークンあたり

出力 (バッチファイル)

0.717

100 万トークンあたり

明示的キャッシュ作成

0.448

100 万トークンあたり

明示的キャッシュ読み取り

0.036

100 万トークンあたり

入力 (バッチチャット)

0.359

100 万トークンあたり

出力 (バッチチャット)

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.574

100 万トークンあたり

出力

2.294

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.115

100 万トークンあたり

入力 (バッチファイル)

0.287

100 万トークンあたり

出力 (バッチファイル)

1.147

100 万トークンあたり

明示的キャッシュ作成

0.717

100 万トークンあたり

明示的キャッシュ読み取り

0.058

100 万トークンあたり

入力 (バッチチャット)

0.574

100 万トークンあたり

出力 (バッチチャット)

2.294

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

1.004

100 万トークンあたり

出力

4.014

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.201

100 万トークンあたり

入力 (バッチファイル)

0.502

100 万トークンあたり

出力 (バッチファイル)

2.007

100 万トークンあたり

明示的キャッシュ作成

1.255

100 万トークンあたり

明示的キャッシュ読み取り

0.101

100 万トークンあたり

入力 (バッチチャット)

1.004

100 万トークンあたり

出力 (バッチチャット)

4.014

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.48

100 万トークンあたり

明示的キャッシュ作成

3

100 万トークンあたり

明示的キャッシュ読み取り

0.24

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.6

100 万トークンあたり

明示的キャッシュ作成

3.75

100 万トークンあたり

明示的キャッシュ読み取り

0.3

100 万トークンあたり

ドイツ (フランクフルト)

範囲:EU

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.48

100 万トークンあたり

明示的キャッシュ作成

3

100 万トークンあたり

明示的キャッシュ読み取り

0.24

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.6

100 万トークンあたり

明示的キャッシュ作成

3.75

100 万トークンあたり

明示的キャッシュ読み取り

0.3

100 万トークンあたり

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.359

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.072

100 万トークンあたり

明示的キャッシュ作成

0.448

100 万トークンあたり

明示的キャッシュ読み取り

0.036

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.574

100 万トークンあたり

出力

2.294

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.115

100 万トークンあたり

明示的キャッシュ作成

0.717

100 万トークンあたり

明示的キャッシュ読み取り

0.058

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

1.004

100 万トークンあたり

出力

4.014

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.201

100 万トークンあたり

明示的キャッシュ作成

1.255

100 万トークンあたり

明示的キャッシュ読み取り

0.101

100 万トークンあたり

米国 (バージニア)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.359

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.072

100 万トークンあたり

明示的キャッシュ作成

0.448

100 万トークンあたり

明示的キャッシュ読み取り

0.036

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.574

100 万トークンあたり

出力

2.294

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.115

100 万トークンあたり

明示的キャッシュ作成

0.717

100 万トークンあたり

明示的キャッシュ読み取り

0.058

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

1.004

100 万トークンあたり

出力

4.014

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.201

100 万トークンあたり

明示的キャッシュ作成

1.255

100 万トークンあたり

明示的キャッシュ読み取り

0.101

100 万トークンあたり

香港 (中国)

範囲:香港

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.48

100 万トークンあたり

明示的キャッシュ作成

3

100 万トークンあたり

明示的キャッシュ読み取り

0.24

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.6

100 万トークンあたり

明示的キャッシュ作成

3.75

100 万トークンあたり

明示的キャッシュ読み取り

0.3

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

5,000,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲:EU

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

香港 (中国)

範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

スナップショットバージョン

qwen3-max-preview

Qwen 3 シリーズの Max モデルのプレビュー版であり、思考モードとノンシンキングモードの効果的な統合を実現しています。思考モードでは、インテリジェントエージェントプログラミング、常識推論、数学、科学、一般ドメインにわたる推論などの機能が大幅に強化されています。

推論サービスプロバイダー

qwen3-max-preview の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

非サポート

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

非サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

非サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

非サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

258048

最大出力長

65536

コンテキストウィンドウ

262144

最大入力長 (思考モード)

258048

最大出力長 (思考モード)

32768

最大思考連鎖長

81920

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.861

100 万トークンあたり

出力

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.173

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.735

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.287

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.151

100 万トークンあたり

出力

8.602

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.431

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.48

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.6

100 万トークンあたり

ドイツ (フランクフルト)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.861

100 万トークンあたり

出力

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.173

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.735

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.287

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.151

100 万トークンあたり

出力

8.602

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.431

100 万トークンあたり

米国 (バージニア)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.861

100 万トークンあたり

出力

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.173

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.735

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.287

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.151

100 万トークンあたり

出力

8.602

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.431

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

qwen3-max-2026-01-23

2025 年 9 月 23 日時点のスナップショットと比較して、今回のリリースの Qwen-3 シリーズ Max モデルは、思考モードとノンシンキングモードを効果的に統合し、モデル全体のパフォーマンスを包括的かつ大幅に向上させました。思考モードでは、Web 検索、Web 情報抽出、コードインタープリターツールを同時にサポートします。これにより、外部ツールを活用しながら慎重な推論を行うことで、より複雑で困難な問題に高い精度で取り組むことが可能になります。このバージョンは、2026 年 1 月 23 日に取得されたスナップショットに基づいています。

推論サービスプロバイダー

qwen3-max-2026-01-23 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:EU

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

258048

最大出力長

65536

コンテキストウィンドウ

262144

最大入力長 (思考モード)

258048

最大出力長 (思考モード)

32768

最大思考連鎖長

81920

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.359

100 万トークンあたり

出力

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.574

100 万トークンあたり

出力

2.294

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

1.004

100 万トークンあたり

出力

4.014

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

ドイツ (フランクフルト)

範囲:EU

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

香港 (中国)

範囲:香港

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲:EU

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

香港 (中国)

範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

qwen3-max-2025-09-23

Qwen 3 シリーズの Max モデルは、プレビュー版と比較してエージェントプログラミングとツール呼び出しの機能が専門的に強化されました。今回正式にリリースされたモデルは、その分野で最先端 (SOTA) のパフォーマンスを達成しており、より複雑なシナリオで動作するエージェントの要求により適しています。このバージョンは、2025 年 9 月 23 日時点のスナップショットです。

推論サービスプロバイダー

qwen3-max-2025-09-23 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

非サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート

関数呼び出し

非サポート

構造化出力

サポート

Web 検索

サポート

プレフィックス補完

サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

258048

最大出力長

32768

コンテキストウィンドウ

262144

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.86

100 万トークンあたり

出力

3.44

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.734

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.15

100 万トークンあたり

出力

8.601

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

2.4

100 万トークンあたり

出力

12

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

3

100 万トークンあたり

出力

15

100 万トークンあたり

ドイツ (フランクフルト)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.861

100 万トークンあたり

出力

3.441

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.735

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.151

100 万トークンあたり

出力

8.602

100 万トークンあたり

米国 (バージニア)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.861

100 万トークンあたり

出力

3.441

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

1.434

100 万トークンあたり

出力

5.735

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

2.151

100 万トークンあたり

出力

8.602

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

米国 (バージニア)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000