すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-30b-a3b-thinking

最終更新日:Aug 26, 2026

Qwen3-VL シリーズで 2 番目に大きい MoE モデルである Thinking バージョンは、高速な応答速度、強化されたマルチモーダルな理解と推論能力、ビジュアルエージェント、および長い動画やドキュメントなどの非常に長いコンテキストのサポートを特長としています。また、画像/動画理解、空間認識、物体認識能力も包括的にアップグレードされており、複雑な現実世界のタスクに適しています。

推論サービスプロバイダー

qwen3-vl-30b-a3b-thinking の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

[テキスト] [画像] [動画]

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

126976

最大出力長

32768

コンテキストウィンドウ

131072

料金

このページには、モデル API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力 (Thinking)

0.108

100 万トークンあたり

出力 (Thinking)

1.075

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力 (Thinking)

0.2

100 万トークンあたり

出力 (Thinking)

2.4

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.108

100 万トークンあたり

出力 (Thinking)

1.075

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.108

100 万トークンあたり

出力 (Thinking)

1.075

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000