すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-30b-a3b-instruct

最終更新日:Aug 26, 2026

Qwen3-VL シリーズで 2 番目に大きい MoE モデルである Instruct バージョンは、高速な応答速度を誇り、長時間の動画や長文ドキュメントといった、非常に長いコンテキストの処理に対応しています。画像/動画理解、空間認識、物体認識の各機能が包括的にアップグレードされており、2D/3D 視覚的ローカライゼーションも搭載しているため、複雑な実世界の課題を処理することが可能です。

推論サービスプロバイダー

qwen3-vl-30b-a3b-instruct の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト イメージ 動画

出力モダリティ

テキスト

モデル体験

対応

Function Calling

対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト イメージ 動画

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ 動画

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ 動画

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト長の制限

パラメータ値パラメータ値

最大入力長

129024

最大出力長

32768

コンテキストウィンドウ

131072

料金

このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.108

100 万トークンあたり

出力

0.43

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力

0.2

100 万トークンあたり

出力

0.8

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

課金項目価格 (USD)単位

入力

0.108

100 万トークンあたり

出力

0.43

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

課金項目価格 (USD)単位

入力

0.108

100 万トークンあたり

出力

0.43

100 万トークンあたり

レート制限

中国 (北京)

パラメータ値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメータ値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメータ値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメータ値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000