すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-32b-thinking

最終更新日:Aug 26, 2026

Qwen3-VL シリーズ最大の密モデルであり、その推論バージョンは Qwen3-VL-235B-Thinking に次ぐマルチモーダル推論能力を誇ります。STEM や数学の問題解決、一般的な画像および動画の理解に優れています。また、マルチモーダルエージェント能力において最先端のパフォーマンスを達成し、複雑なマルチモーダル推論タスクに最適です。

推論サービスプロバイダー

qwen3-vl-32b-thinking の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

サポート済み

構造化出力

サポート済み

ウェブ検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

ウェブ検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

ウェブ検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

ウェブ検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメータ値パラメータ値

最大入力長

—

最大出力長

—

コンテキストウィンドウ

131072

最大入力長 (Thinking モード)

126976

最大出力長 (Thinking モード)

32768

最大 CoT (Chain-of-Thought) 長

81920

料金

このページには、モデルの API 呼び出しの基本料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力 (Thinking)

0.287

出力 (Thinking)

2.868

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力 (Thinking)

0.16

100 万トークンあたり

出力 (Thinking)

0.64

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.16

100 万トークンあたり

出力 (Thinking)

0.64

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.16

100 万トークンあたり

出力 (Thinking)

0.64

100 万トークンあたり

レート制限

中国 (北京)

パラメータ値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメータ値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメータ値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメータ値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000