すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-plus

最終更新日:Aug 26, 2026

Qwen3 シリーズ VL モデルは、シンキングモードとノンシンキングモードを効果的に統合し、OS World などの公開ベンチマークデータセットにおいて、視覚エージェント能力で世界トップレベルの性能を達成しています。このバージョンは、視覚コーディング、空間認識、マルチモーダル推論などの分野で包括的なアップグレードが行われ、視覚認識能力が大幅に向上し、超長尺動画の理解もサポートしています。このモデルバージョンは、スナップショットモデル qwen3-vl-plus-2025-12-19 と機能的に同等です。

推論サービスプロバイダー

qwen3-vl-plus の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

260096

最大出力長

32768

コンテキストウィンドウ

262144

最大入力長 (シンキングモード)

258048

最大出力長 (シンキングモード)

32768

最大思考連鎖長

81920

料金

このページでは、モデルの API 呼び出しの正規料金のみを記載しており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.144

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.029

100 万トークンあたり

入力 (バッチファイル)

0.072

100 万トークンあたり

出力 (バッチファイル)

0.717

100 万トークンあたり

明示的キャッシュ作成

0.18

100 万トークンあたり

明示的キャッシュ読み取り

0.014

100 万トークンあたり

入力 (バッチチャット)

0.144

100 万トークンあたり

出力 (バッチチャット)

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.216

100 万トークンあたり

出力

2.151

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.044

100 万トークンあたり

入力 (バッチファイル)

0.108

100 万トークンあたり

出力 (バッチファイル)

1.075

100 万トークンあたり

明示的キャッシュ作成

0.27

100 万トークンあたり

明示的キャッシュ読み取り

0.022

100 万トークンあたり

入力 (バッチチャット)

0.216

100 万トークンあたり

出力 (バッチチャット)

2.151

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.431

100 万トークンあたり

出力

4.301

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.087

100 万トークンあたり

入力 (バッチファイル)

0.215

100 万トークンあたり

出力 (バッチファイル)

2.15

100 万トークンあたり

明示的キャッシュ作成

0.539

100 万トークンあたり

明示的キャッシュ読み取り

0.043

100 万トークンあたり

入力 (バッチチャット)

0.431

100 万トークンあたり

出力 (バッチチャット)

4.301

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.04

100 万トークンあたり

明示的キャッシュ作成

0.25

100 万トークンあたり

明示的キャッシュ読み取り

0.02

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.06

100 万トークンあたり

明示的キャッシュ作成

0.375

100 万トークンあたり

明示的キャッシュ読み取り

0.03

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.12

100 万トークンあたり

明示的キャッシュ作成

0.75

100 万トークンあたり

明示的キャッシュ読み取り

0.06

100 万トークンあたり

ドイツ (フランクフルト)

範囲:EU

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.04

100 万トークンあたり

明示的キャッシュ作成

0.25

100 万トークンあたり

明示的キャッシュ読み取り

0.02

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.06

100 万トークンあたり

明示的キャッシュ作成

0.375

100 万トークンあたり

明示的キャッシュ読み取り

0.03

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.12

100 万トークンあたり

明示的キャッシュ作成

0.75

100 万トークンあたり

明示的キャッシュ読み取り

0.06

100 万トークンあたり

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.144

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.029

100 万トークンあたり

明示的キャッシュ作成

0.18

100 万トークンあたり

明示的キャッシュ読み取り

0.014

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.216

100 万トークンあたり

出力

2.151

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.044

100 万トークンあたり

明示的キャッシュ作成

0.27

100 万トークンあたり

明示的キャッシュ読み取り

0.022

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.431

100 万トークンあたり

出力

4.301

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.087

100 万トークンあたり

明示的キャッシュ作成

0.539

100 万トークンあたり

明示的キャッシュ読み取り

0.043

100 万トークンあたり

米国 (バージニア)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.144

100 万トークンあたり

出力

1.434

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.029

100 万トークンあたり

明示的キャッシュ作成

0.18

100 万トークンあたり

明示的キャッシュ読み取り

0.014

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.216

100 万トークンあたり

出力

2.151

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.044

100 万トークンあたり

明示的キャッシュ作成

0.27

100 万トークンあたり

明示的キャッシュ読み取り

0.022

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.431

100 万トークンあたり

出力

4.301

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.087

100 万トークンあたり

明示的キャッシュ作成

0.539

100 万トークンあたり

明示的キャッシュ読み取り

0.043

100 万トークンあたり

香港 (中国)

範囲:香港

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.04

100 万トークンあたり

明示的キャッシュ作成

0.25

100 万トークンあたり

明示的キャッシュ読み取り

0.02

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.06

100 万トークンあたり

明示的キャッシュ作成

0.375

100 万トークンあたり

明示的キャッシュ読み取り

0.03

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.12

100 万トークンあたり

明示的キャッシュ作成

0.75

100 万トークンあたり

明示的キャッシュ読み取り

0.06

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

3000

TPM (1 分あたりのトークン数)

5,000,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

1200

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲:EU

パラメーター値

RPM (1 分あたりのリクエスト数)

2000

TPM (1 分あたりのトークン数)

1,000,000

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

2000

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

6000

TPM (1 分あたりのトークン数)

10,000,000

香港 (中国)

範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

6000

TPM (1 分あたりのトークン数)

1,000,000

スナップショットバージョン

qwen3-vl-plus-2025-12-19

Qwen3 シリーズの視覚理解モデルは、シンキングモードとノンシンキングモードを効果的に統合しています。9 月 23 日にリリースされたスナップショットと比較して、このバージョンは推論および分析タスク、スタイル制御において優れた性能を発揮し、より低いレイテンシーと高速な応答速度も提供します。このバージョンは、2025 年 12 月 19 日に取得されたスナップショットに基づいています。

推論サービスプロバイダー

qwen3-vl-plus-2025-12-19 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

範囲:香港

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

260096

最大出力長

32768

コンテキストウィンドウ

262144

最大入力長 (シンキングモード)

258048

最大出力長 (シンキングモード)

32768

最大思考連鎖長

81920

料金

このページでは、モデルの API 呼び出しの正規料金のみを記載しており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.144

100 万トークンあたり

出力

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.216

100 万トークンあたり

出力

2.151

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.431

100 万トークンあたり

出力

4.301

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

香港 (中国)

範囲:香港

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

香港 (中国)

範囲:香港

パラメーター値

RPM (1 分あたりのリクエスト数)

6000

TPM (1 分あたりのトークン数)

1,000,000

qwen3-vl-plus-2025-09-23

Qwen3 シリーズ VL モデルは、シンキングモードとノンシンキングモードを効果的に統合し、OS World などの公開ベンチマークデータセットにおいて、視覚エージェント能力で世界トップレベルの性能を達成しています。このバージョンは、視覚コーディング、空間認識、マルチモーダル推論などの分野で包括的なアップグレードが行われ、視覚認識能力が大幅に向上し、超長尺動画の理解もサポートしています。このバージョンは 2025 年 9 月 23 日時点のスナップショットです

推論サービスプロバイダー

qwen3-vl-plus-2025-09-23 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

範囲:国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲:グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト長の制限

パラメーター値パラメーター値

最大入力長

260096

最大出力長

32768

コンテキストウィンドウ

262144

最大入力長 (シンキングモード)

258048

最大出力長 (シンキングモード)

32768

最大思考連鎖長

81920

料金

このページでは、モデルの API 呼び出しの正規料金のみを記載しており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力<=32k

課金項目価格 (USD)単位

入力

0.143

100 万トークンあたり

出力

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.215

100 万トークンあたり

出力

2.15

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.43

100 万トークンあたり

出力

4.301

100 万トークンあたり

シンガポール

範囲:国際

入力<=32k

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

1.6

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.3

100 万トークンあたり

出力

2.4

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.6

100 万トークンあたり

出力

4.8

100 万トークンあたり

ドイツ (フランクフルト)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.143

100 万トークンあたり

出力

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.215

100 万トークンあたり

出力

2.15

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.43

100 万トークンあたり

出力

4.301

100 万トークンあたり

米国 (バージニア)

範囲:グローバル

入力<=32k

課金項目価格 (USD)単位

入力

0.143

100 万トークンあたり

出力

1.434

100 万トークンあたり

32k<入力<=128k

課金項目価格 (USD)単位

入力

0.215

100 万トークンあたり

出力

2.15

100 万トークンあたり

128k<入力<=256k

課金項目価格 (USD)単位

入力

0.43

100 万トークンあたり

出力

4.301

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

シンガポール

範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

120

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

米国 (バージニア)

範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000