すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-plus

最終更新日:Aug 26, 2026

Qwen-Plus は、Qwen 超大規模言語モデルの拡張バージョンであり、中国語や英語などの複数の入力言語をサポートしています。以前のバージョンと比較して、中国語と英語の両方のコード生成、論理的推論、多言語能力において大幅な改善が見られます。応答スタイルは、人間のプリファレンスに合わせて大幅に調整され、応答の詳細さと明確さが著しく向上しています。クリエイティブライティング、JSON フォーマットの遵守、ロールプレイング能力において、専門的な改善が行われています。このモデルバージョンは、スナップショットモデル qwen-plus-2025-07-28 と機能的に同等です。

推論サービスプロバイダー

qwen-plus の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

適用範囲:EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

香港 (中国)

適用範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

997952

最大出力長

32768

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

995904

最大出力長 (思考モード)

32768

Chain-of-Thought の最大長

81920

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.023

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.023

100 万トークンあたり

思考出力 (バッチファイル)

0.573

100 万トークンあたり

入力 (バッチファイル)

0.057

100 万トークンあたり

出力 (バッチファイル)

0.143

100 万トークンあたり

入力 (思考バッチファイル)

0.057

100 万トークンあたり

明示的キャッシュ作成

0.144

100 万トークンあたり

明示的キャッシュ読み取り

0.012

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.144

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.012

100 万トークンあたり

入力 (バッチチャット)

0.115

100 万トークンあたり

出力 (バッチチャット)

0.287

100 万トークンあたり

入力 (思考モードバッチチャット)

0.115

100 万トークンあたり

出力 (思考モードバッチチャット)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.069

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.069

100 万トークンあたり

思考出力 (バッチファイル)

1.72

100 万トークンあたり

入力 (バッチファイル)

0.172

100 万トークンあたり

出力 (バッチファイル)

1.434

100 万トークンあたり

入力 (思考バッチファイル)

0.172

100 万トークンあたり

明示的キャッシュ作成

0.431

100 万トークンあたり

明示的キャッシュ読み取り

0.035

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.431

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.035

100 万トークンあたり

入力 (バッチチャット)

0.345

100 万トークンあたり

出力 (バッチチャット)

2.868

100 万トークンあたり

入力 (思考モードバッチチャット)

0.345

100 万トークンあたり

出力 (思考モードバッチチャット)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.138

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.138

100 万トークンあたり

思考出力 (バッチファイル)

4.587

100 万トークンあたり

入力 (バッチファイル)

0.344

100 万トークンあたり

出力 (バッチファイル)

3.44

100 万トークンあたり

入力 (思考バッチファイル)

0.344

100 万トークンあたり

明示的キャッシュ作成

0.861

100 万トークンあたり

明示的キャッシュ読み取り

0.069

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.861

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.069

100 万トークンあたり

入力 (バッチチャット)

0.689

100 万トークンあたり

出力 (バッチチャット)

6.881

100 万トークンあたり

入力 (思考モードバッチチャット)

0.689

100 万トークンあたり

出力 (思考モードバッチチャット)

9.175

100 万トークンあたり

シンガポール

適用範囲:国際

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.08

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.08

100 万トークンあたり

思考出力 (バッチファイル)

2

100 万トークンあたり

入力 (バッチファイル)

0.2

100 万トークンあたり

出力 (バッチファイル)

0.6

100 万トークンあたり

入力 (思考バッチファイル)

0.2

100 万トークンあたり

明示的キャッシュ作成

0.5

100 万トークンあたり

明示的キャッシュ読み取り

0.04

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.04

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.24

100 万トークンあたり

思考出力 (バッチファイル)

6

100 万トークンあたり

入力 (バッチファイル)

0.6

100 万トークンあたり

出力 (バッチファイル)

1.8

100 万トークンあたり

入力 (思考バッチファイル)

0.6

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

明示的キャッシュ作成 (思考)

1.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.12

100 万トークンあたり

ドイツ (フランクフルト)

適用範囲:EU

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.08

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.08

100 万トークンあたり

明示的キャッシュ作成

0.5

100 万トークンあたり

明示的キャッシュ読み取り

0.04

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.04

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.24

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

明示的キャッシュ作成 (思考)

1.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.12

100 万トークンあたり

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.023

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.023

100 万トークンあたり

明示的キャッシュ作成

0.144

100 万トークンあたり

明示的キャッシュ読み取り

0.012

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.144

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.012

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.069

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.069

100 万トークンあたり

明示的キャッシュ作成

0.431

100 万トークンあたり

明示的キャッシュ読み取り

0.035

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.431

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.035

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.138

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.138

100 万トークンあたり

明示的キャッシュ作成

0.861

100 万トークンあたり

明示的キャッシュ読み取り

0.069

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.861

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.069

100 万トークンあたり

米国 (バージニア)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.023

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.023

100 万トークンあたり

明示的キャッシュ作成

0.144

100 万トークンあたり

明示的キャッシュ読み取り

0.012

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.144

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.012

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.069

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.069

100 万トークンあたり

明示的キャッシュ作成

0.431

100 万トークンあたり

明示的キャッシュ読み取り

0.035

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.431

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.035

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.138

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.138

100 万トークンあたり

明示的キャッシュ作成

0.861

100 万トークンあたり

明示的キャッシュ読み取り

0.069

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.861

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.069

100 万トークンあたり

香港 (中国)

適用範囲:香港

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.08

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.08

100 万トークンあたり

明示的キャッシュ作成

0.5

100 万トークンあたり

明示的キャッシュ読み取り

0.04

100 万トークンあたり

明示的キャッシュ作成 (思考)

0.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.04

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.24

100 万トークンあたり

入力 (思考暗黙的キャッシュ)

0.24

100 万トークンあたり

明示的キャッシュ作成

1.5

100 万トークンあたり

明示的キャッシュ読み取り

0.12

100 万トークンあたり

明示的キャッシュ作成 (思考)

1.5

100 万トークンあたり

明示的キャッシュ読み取り (思考)

0.12

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

5,000,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

適用範囲:EU

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

香港 (中国)

適用範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

動的更新

qwen-plus-latest

バランスの取れたパフォーマンスに最適化された Qwen シリーズモデルは、Qwen-Max と Qwen-Turbo の中間の推論効率を提供し、中程度の複雑なタスクを効果的に処理するように設計されています。この動的に更新されるバージョンは、事前の通知なしに変更が実装されます。

推論サービスプロバイダー

qwen-plus-latest の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート済み

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

995904

最大出力長

32768

コンテキストウィンドウ

1000000

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

思考出力 (バッチファイル)

0.573

100 万トークンあたり

入力 (バッチファイル)

0.057

100 万トークンあたり

出力 (バッチファイル)

0.143

100 万トークンあたり

入力 (思考バッチファイル)

0.057

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

思考出力 (バッチファイル)

1.72

100 万トークンあたり

入力 (バッチファイル)

0.172

100 万トークンあたり

出力 (バッチファイル)

1.434

100 万トークンあたり

入力 (思考バッチファイル)

0.172

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

思考出力 (バッチファイル)

4.587

100 万トークンあたり

入力 (バッチファイル)

0.344

100 万トークンあたり

出力 (バッチファイル)

3.44

100 万トークンあたり

入力 (思考バッチファイル)

0.344

100 万トークンあたり

シンガポール

適用範囲:国際

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

1,200,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (毎分トークン数)

1,000,000

スナップショットバージョン

qwen-plus-2025-12-01

このバージョンは 2025 年 12 月 1 日時点のスナップショットであり、7 月 28 日のスナップショットと比較して推論能力が向上しています。エージェント機能とマルチターンツール呼び出し能力がさらに強化され、主観的なクリエイティブタスクのパフォーマンスが大幅に向上しました。最大 100 万トークンのコンテキスト長をサポートし、コンテキスト長に基づいた段階的価格設定を採用しています。

推論サービスプロバイダー

qwen-plus-2025-12-01 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート対象外

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

適用範囲:EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート対象外

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート対象外

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

香港 (中国)

適用範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート対象外

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

997952

最大出力長

32768

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

995904

最大出力長 (思考モード)

32768

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

シンガポール

適用範囲:国際

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

ドイツ (フランクフルト)

適用範囲:EU

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

米国 (バージニア)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力(思考)

9.175

100万トークンあたり

香港 (中国)

適用範囲:香港

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

適用範囲:EU

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

香港 (中国)

適用範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

qwen-plus-2025-09-11

2025 年 9 月 11 日のスナップショットでは、このリリースは思考モードでの命令追従性の向上と要約応答の効率化を特徴としています。ノンシンキングモードでは、中国語テキストの理解力が向上し、論理的推論能力が強化されています。このモデルは 1M のコンテキスト長をサポートし、段階的価格設定を採用しています。

推論サービスプロバイダー

qwen-plus-2025-09-11 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート対象外

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

995904

最大出力長

32768

コンテキストウィンドウ

1000000

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

シンガポール

適用範囲:国際

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

ドイツ (フランクフルト)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

米国 (バージニア)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

qwen-plus-2025-07-28

Qwen3 シリーズの Plus モデルは、思考モードとノンシンキングモードを統合し、対話中にモードを切り替えることができます。以前のバージョンと比較して、中国語と英語の能力およびツール呼び出し機能が専用に強化されています。これは 2025 年 7 月 28 日のスナップショットであり、初めて 1M のコンテキスト長をサポートし、段階的価格設定を使用しています。

推論サービスプロバイダー

qwen-plus-2025-07-28 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

適用範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

995904

最大出力長

32768

コンテキストウィンドウ

1000000

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

シンガポール

適用範囲:国際

入力<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1.2

100 万トークンあたり

出力

3.6

100 万トークンあたり

入力 (思考)

1.2

100 万トークンあたり

出力 (思考)

12

100 万トークンあたり

ドイツ (フランクフルト)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

米国 (バージニア)

適用範囲:グローバル

入力<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.345

100 万トークンあたり

出力

2.868

100 万トークンあたり

入力 (思考)

0.345

100 万トークンあたり

出力 (思考)

3.441

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

0.689

100 万トークンあたり

出力

6.881

100 万トークンあたり

入力 (思考)

0.689

100 万トークンあたり

出力 (思考)

9.175

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

適用範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

qwen-plus-2025-07-14

Qwen3 シリーズの Plus モデルは、思考モードとノンシンキングモードを効果的に統合し、会話中にモードを切り替えることができます。これは 2025 年 7 月 14 日のスナップショットです。以前のバージョンと比較して、ノンシンキングモードでの中国語と英語の両方の能力が大幅に向上し、ツール呼び出し能力も強化されています。

推論サービスプロバイダー

qwen-plus-2025-07-14 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

98304

最大出力長

16384

コンテキストウィンドウ

131072

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (思考)

0.115

100 万トークンあたり

出力 (思考)

1.147

100 万トークンあたり

シンガポール

適用範囲:国際

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

入力 (思考)

0.4

100 万トークンあたり

出力 (思考)

4

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

qwen-plus-2025-04-28

Qwen3 シリーズの Plus モデルは、思考モードとノンシンキングモードを効果的に統合し、会話中にモードを切り替えることができます。その推論能力は QwQ を大幅に上回り、一般的な能力は Qwen2.5-Plus を著しく超え、業界の同規模モデルの中で SOTA レベルに達しています。このモデルは 2025 年 4 月 28 日のスナップショットです。

推論サービスプロバイダー

qwen-plus-2025-04-28 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

適用範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

98304

最大出力長

16384

コンテキストウィンドウ

131072

料金

このページには、モデル API 呼び出しの通常価格のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご覧ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.115

100万トークンあたり

出力

0.287

100万トークンあたり

入力 (思考)

0.115

100万トークンあたり

出力 (思考)

1.147

100万トークンあたり

シンガポール

適用範囲:国際

課金項目価格 (USD)単位

入力

0.4

100万トークンあたり

出力

1.2

100万トークンあたり

入力 (思考)

0.4

100万トークンあたり

出力 (思考)

4

100万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

60

TPM (1分あたりのトークン数)

1,000,000

シンガポール

適用範囲:国際

パラメーター値

RPM (1分あたりのリクエスト数)

60

TPM (1分あたりのトークン数)

1,000,000

qwen-plus-2025-01-25

機能のバランスが取れた Qwen シリーズのモデルは、Qwen-Max と Qwen-Turbo の中間に位置する推論性能と速度を提供し、中程度に複雑なタスクに適しています。以前のバージョンと比較して、中国語と英語のコード生成、論理的推論、多言語能力が大幅に向上しています。応答スタイルは、人間の好みに合わせて大幅に調整されており、応答の詳細さと明確さが著しく向上しています。創造的なライティング、JSON フォーマットの遵守、ロールプレイング能力において、専門的な改善がなされています。

推論サービスプロバイダー

qwen-plus-2025-01-25 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

129024

最大出力長

8192

コンテキストウィンドウ

131072

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの元の料金のみが表示されます。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

1.2

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

150,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

qwen-plus-0112

、-Max-Turbo、.-Plus-2024-1220、 、 、 、コードスイッチ、 。

推論サービスプロバイダー

qwen-plus-0112 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

129024

最大出力長

8192

コンテキストウィンドウ

131072

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

150,000

qwen-plus-1220

、-Max-Turbo、.-Plus-1125、 、 、 、コードスイッチ、 。

推論サービスプロバイダー

qwen-plus-1220 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート対象外

構造化出力

サポート対象外

Web 検索

サポート対象外

プレフィックス補完

サポート対象外

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

129024

最大出力長

8192

コンテキストウィンドウ

131072

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションの詳細については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.287

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

150,000