すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.5-flash

最終更新日:Aug 26, 2026

Qwen3.5 ネイティブ視覚言語 Flash モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現します。3 シリーズと比較して、これらのモデルは純粋なテキストタスクとマルチモーダルタスクの両方で性能が飛躍的に向上し、推論速度と全体的なパフォーマンスのバランスを取りながら、高速な応答時間を提供します。このモデルバージョンは、スナップショットモデル qwen3.5-flash-2026-02-23 と機能的に同等です。

推論サービスプロバイダー

qwen3.5-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

非サポート

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

スコープ: EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

スコープ: 香港

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

81920

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

入力 (バッチファイル)

0.014

100 万トークンあたり

出力 (バッチファイル)

0.143

100 万トークンあたり

明示的なキャッシュ作成

0.036

100 万トークンあたり

明示的なキャッシュ読み取り

0.003

100 万トークンあたり

入力 (バッチチャット)

0.029

100 万トークンあたり

出力 (バッチチャット)

0.287

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

入力 (バッチファイル)

0.057

100 万トークンあたり

出力 (バッチファイル)

0.573

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

入力 (バッチチャット)

0.115

100 万トークンあたり

出力 (バッチチャット)

1.147

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

入力 (バッチファイル)

0.086

100 万トークンあたり

出力 (バッチファイル)

0.86

100 万トークンあたり

明示的なキャッシュ作成

0.215

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

入力 (バッチチャット)

0.172

100 万トークンあたり

出力 (バッチチャット)

1.72

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

明示的なキャッシュ作成

0.125

100 万トークンあたり

明示的なキャッシュ読み取り

0.01

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: EU

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

明示的なキャッシュ作成

0.125

100 万トークンあたり

明示的なキャッシュ読み取り

0.01

100 万トークンあたり

スコープ: グローバル

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

明示的なキャッシュ作成

0.036

100 万トークンあたり

明示的なキャッシュ読み取り

0.003

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.215

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

明示的なキャッシュ作成

0.036

100 万トークンあたり

明示的なキャッシュ読み取り

0.003

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.215

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

香港 (中国)

スコープ: 香港

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

明示的なキャッシュ作成

0.13

100 万トークンあたり

明示的なキャッシュ読み取り

0.01

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

10,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

5,000,000

ドイツ (フランクフルト)

スコープ: EU

パラメーター値

RPM (1 分あたりのリクエスト数)

35000

TPM (1 分あたりのトークン数)

10,000,000

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

35000

TPM (1 分あたりのトークン数)

10,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

10,000,000

香港 (中国)

スコープ: 香港

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

10,000,000

スナップショットバージョン

qwen3.5-flash-2026-02-23

Qwen3.5 ネイティブ視覚言語 Flash モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現します。3 シリーズと比較して、これらのモデルは純粋なテキストタスクとマルチモーダルタスクの両方で性能が飛躍的に向上し、推論速度と全体的なパフォーマンスのバランスを取りながら、高速な応答時間を提供します。このバージョンは 2026 年 2 月 23 日時点のスナップショットです。

推論サービスプロバイダー

qwen3.5-flash-2026-02-23 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

サポート済み

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

ドイツ (フランクフルト)

スコープ: EU、グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

対応

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

香港 (中国)

スコープ: 香港

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

非サポート

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

81920

料金

このページには、期間限定のプロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: EU

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

スコープ: グローバル

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

入力 <= 128k

課金項目価格 (USD)単位

入力

0.029

100 万トークンあたり

出力

0.287

100 万トークンあたり

128k < 入力 <= 256k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

1.147

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.172

100 万トークンあたり

出力

1.72

100 万トークンあたり

香港 (中国)

スコープ: 香港

課金項目価格 (USD)単位

入力

0.1

100 万トークンあたり

出力

0.4

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

スコープ: EU

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

香港 (中国)

スコープ: 香港

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000