Qwen3-VL シリーズで 2 番目に大きい MoE モデルである Thinking バージョンは、高速な応答速度、強化されたマルチモーダルな理解と推論能力、ビジュアルエージェント、および長い動画やドキュメントなどの非常に長いコンテキストのサポートを特長としています。また、画像/動画理解、空間認識、物体認識能力も包括的にアップグレードされており、複雑な現実世界のタスクに適しています。
推論サービスプロバイダー
qwen3-vl-30b-a3b-thinking の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
ドイツ (フランクフルト)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
米国 (バージニア)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | [テキスト] [画像] [動画] | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 126976 | 最大出力長 | 32768 |
コンテキストウィンドウ | 131072 |
料金
このページには、モデル API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 (Thinking) | 0.108 | 100 万トークンあたり |
出力 (Thinking) | 1.075 | 100 万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 (Thinking) | 0.2 | 100 万トークンあたり |
出力 (Thinking) | 2.4 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 (Thinking) | 0.108 | 100 万トークンあたり |
出力 (Thinking) | 1.075 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 (Thinking) | 0.108 | 100 万トークンあたり |
出力 (Thinking) | 1.075 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 60 |
TPM (1 分あたりのトークン数) | 100,000 |