すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-8b-instruct

最終更新日:Aug 26, 2026

Qwen3-VL シリーズの 8B Dense モデルの Instruct バージョンは、必要な GPU メモリが少なく、画像/動画の理解、長時間の動画やドキュメントなどの極めて長いコンテキストのサポート、空間認識、物体認識機能が包括的にアップグレードされており、複雑な実世界のタスクに取り組むのに適しています。

推論サービスプロバイダー

qwen3-vl-8b-instruct の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

対応

Function Calling

対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

対応

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

129024

最大出力長

32768

コンテキストウィンドウ

131072

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーションオファーについては、Model Studio コンソールにアクセスしてください。

中国 (北京)

課金項目価格 (米ドル)単位

入力

0.072

100 万トークンあたり

出力

0.287

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (米ドル)単位

入力

0.18

100 万トークンあたり

出力

0.7

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

課金項目価格 (米ドル)単位

入力

0.072

100 万トークンあたり

出力

0.287

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

課金項目価格 (米ドル)単位

入力

0.072

100 万トークンあたり

出力

0.287

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000