Qwen3.6 ネイティブ視覚言語 Flash モデルシリーズは、3.5-Flash バージョンに比べて大幅なパフォーマンス向上を実現しています。このモデルは特にエージェントとしてのコーディング能力に優れており、複数のコードエージェントベンチマーク、ならびに数学的およびコードの推論において、前世代のモデルを大幅に上回っています。視覚面では、空間的知性が著しく向上しており、特にオブジェクトのローカライズとオブジェクト検出において顕著な改善が見られます。
推論サービスプロバイダー
qwen3.6-flash-us の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | 関数呼び出し | サポート済み |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 991808 | 最大出力長 | 65536 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 983616 |
最大出力長 (思考モード) | 65536 |
料金
このページには、モデル API 呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソール をご覧ください。
米国 (バージニア)
範囲: 米国
256k<入力<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 1 | 100 万トークンあたり |
出力 | 4 | 100 万トークンあたり |
明示的なキャッシュ作成 | 1.25 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.1 | 100 万トークンあたり |
レート制限
米国 (バージニア)
範囲: 米国
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 15000 |
TPM (1 分あたりのトークン数) | 5,000,000 |