すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.6-flash-us

最終更新日:Oct 01, 2026

Qwen3.6 ネイティブ視覚言語 Flash モデルシリーズは、3.5-Flash バージョンに比べて大幅なパフォーマンス向上を実現しています。このモデルは特にエージェントとしてのコーディング能力に優れており、複数のコードエージェントベンチマーク、ならびに数学的およびコードの推論において、前世代のモデルを大幅に上回っています。視覚面では、空間的知性が著しく向上しており、特にオブジェクトのローカライズとオブジェクト検出において顕著な改善が見られます。

推論サービスプロバイダー

qwen3.6-flash-us の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

関数呼び出し

サポート済み

構造化出力

サポート済み

Web 検索

非サポート

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

非サポート

ファインチューニング

非サポート

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

料金

このページには、モデル API 呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソール をご覧ください。

米国 (バージニア)

範囲: 米国

入力<=256k

課金項目価格 (USD)単位

入力

0.25

100 万トークンあたり

出力

1.5

100 万トークンあたり

明示的なキャッシュ作成

0.3125

100 万トークンあたり

明示的なキャッシュ読み取り

0.025

100 万トークンあたり

256k<入力<=1m

課金項目価格 (USD)単位

入力

1

100 万トークンあたり

出力

4

100 万トークンあたり

明示的なキャッシュ作成

1.25

100 万トークンあたり

明示的なキャッシュ読み取り

0.1

100 万トークンあたり

レート制限

米国 (バージニア)

範囲: 米国

パラメーター値

RPM (1 分あたりのリクエスト数)

15000

TPM (1 分あたりのトークン数)

5,000,000