すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.6-flash

最終更新日:Aug 26, 2026

Qwen3.6 ネイティブ視覚言語 Flash モデルシリーズは、3.5-Flash バージョンと比較してパフォーマンスが大幅に向上しています。このモデルは特にエージェントコーディング機能に優れており、複数のコードエージェントベンチマーク、ならびに数学的およびコードの推論において、前世代のモデルを大幅に上回る性能を発揮します。視覚機能の面では、空間的知性が著しく向上しており、特にオブジェクトのローカライズとオブジェクト検出において顕著な強化がなされています。

推論サービスプロバイダー

qwen3.6-flash の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

サポート対象外

シンガポール

範囲: 国際

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

日本 (東京)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

香港 (中国)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

131072

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの元の料金のみを表示しています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

入力 (バッチファイル)

0.083

100 万トークンあたり

出力 (バッチファイル)

0.495

100 万トークンあたり

明示的なキャッシュ作成

0.206

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

入力 (バッチチャット)

0.165

100 万トークンあたり

出力 (バッチチャット)

0.99

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

入力 (バッチファイル)

0.33

100 万トークンあたり

出力 (バッチファイル)

1.98

100 万トークンあたり

明示的なキャッシュ作成

0.825

100 万トークンあたり

明示的なキャッシュ読み取り

0.066

100 万トークンあたり

入力 (バッチチャット)

0.66

100 万トークンあたり

出力 (バッチチャット)

3.961

100 万トークンあたり

シンガポール

範囲: 国際

入力 <= 256k

課金項目価格 (USD)単位

入力

0.25

100 万トークンあたり

出力

1.5

100 万トークンあたり

明示的なキャッシュ作成

0.3125

100 万トークンあたり

明示的なキャッシュ読み取り

0.025

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

1

100 万トークンあたり

出力

4

100 万トークンあたり

明示的なキャッシュ作成

1.25

100 万トークンあたり

明示的なキャッシュ読み取り

0.1

100 万トークンあたり

ドイツ (フランクフルト)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

明示的なキャッシュ作成

0.206

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

明示的なキャッシュ作成

0.825

100 万トークンあたり

明示的なキャッシュ読み取り

0.066

100 万トークンあたり

米国 (バージニア)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

明示的なキャッシュ作成

0.206

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

明示的なキャッシュ作成

0.825

100 万トークンあたり

明示的なキャッシュ読み取り

0.066

100 万トークンあたり

日本 (東京)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

明示的なキャッシュ作成

0.206

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

明示的なキャッシュ作成

0.825

100 万トークンあたり

明示的なキャッシュ読み取り

0.066

100 万トークンあたり

香港 (中国)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

明示的なキャッシュ作成

0.206

100 万トークンあたり

明示的なキャッシュ読み取り

0.017

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

明示的なキャッシュ作成

0.825

100 万トークンあたり

明示的なキャッシュ読み取り

0.066

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

10,000,000

シンガポール

範囲: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

5,000,000

ドイツ (フランクフルト)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

5,000,000

米国 (バージニア)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

5,000,000

日本 (東京)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

10,000,000

香港 (中国)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

30000

TPM (1 分あたりのトークン数)

10,000,000

スナップショットバージョン

qwen3.6-flash-2026-04-16

Qwen3.6 ネイティブ視覚言語 Flash モデルシリーズは、3.5-Flash バージョンと比較してパフォーマンスが大幅に向上しています。このモデルは特にエージェントコーディング機能に優れており、複数のコードエージェントベンチマーク、ならびに数学的およびコードの推論において、前世代のモデルを大幅に上回る性能を発揮します。視覚機能の面では、空間的知性が著しく向上しており、特にオブジェクトのローカライズとオブジェクト検出において顕著な強化がなされています。このリリースは 2026 年 4 月 16 日に取得されたスナップショットに基づいています。

推論サービスプロバイダー

qwen3.6-flash-2026-04-16 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

画像 テキスト 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート済み

シンガポール

範囲: 国際

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

日本 (東京)

範囲: グローバル

機能サポート機能サポート

入力モダリティ

画像 テキスト 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

131072

料金

このページでは、期間限定のプロモーションを除いた、モデル API 呼び出しの元の料金のみを表示しています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

シンガポール

範囲: 国際

入力 <= 256k

課金項目価格 (USD)単位

入力

0.25

100 万トークンあたり

出力

1.5

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

1

100 万トークンあたり

出力

4

100 万トークンあたり

ドイツ (フランクフルト)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

米国 (バージニア)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

日本 (東京)

範囲: グローバル

入力 <= 256k

課金項目価格 (USD)単位

入力

0.165

100 万トークンあたり

出力

0.99

100 万トークンあたり

256k < 入力 <= 1m

課金項目価格 (USD)単位

入力

0.66

100 万トークンあたり

出力

3.961

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

範囲: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000

日本 (東京)

範囲: グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

60

TPM (1 分あたりのトークン数)

1,000,000