すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3-vl-8b-thinking

最終更新日:Aug 26, 2026

Qwen3-VL シリーズの 8B Dense モデルの Thinking バージョンは、GPU メモリの消費量が少なく、マルチモーダルな理解と推論を実行できます。長時間のビデオや長文ドキュメントなどの非常に長いコンテキスト、2D/3D ビジュアルローカライズをサポートし、イメージ/ビデオの理解、空間認識、物体認識の能力が包括的にアップグレードされています。

推論サービスプロバイダー

qwen3-vl-8b-thinking の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

サポート済み

シンガポール

範囲: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

テキスト イメージ ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

非サポート

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

非サポート

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

126976

最大出力長

32768

コンテキストウィンドウ

131072

料金

このページには、モデル API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力 (Thinking)

0.072

100 万トークンあたり

出力 (Thinking)

0.717

100 万トークンあたり

シンガポール

範囲: 国際

課金項目価格 (USD)単位

入力 (Thinking)

0.18

100 万トークンあたり

出力 (Thinking)

2.1

100 万トークンあたり

ドイツ (フランクフルト)

範囲: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.072

100 万トークンあたり

出力 (Thinking)

0.717

100 万トークンあたり

米国 (バージニア)

範囲: グローバル

課金項目価格 (USD)単位

入力 (Thinking)

0.072

100 万トークンあたり

出力 (Thinking)

0.717

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

範囲: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000

ドイツ (フランクフルト)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

100,000