Qwen3.6 35B-A3B は、線形アテンションメカニズムとスパース混合エキスパート (MoE) フレームワークを統合したハイブリッドアーキテクチャ上に構築された、ネイティブの視覚言語モデルであり、より高い推論効率を実現します。3.5-35B-A3B と比較して、このモデルはエージェントコーディング能力、数学およびコードの推論能力、空間的知性、ならびにオブジェクトのローカライズとオブジェクト検出のパフォーマンスが大幅に向上しています。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | 画像 テキスト ビデオ | 出力モダリティ | テキスト |
モデル体験 | 対応 | 関数呼び出し | 対応 |
構造化出力 | 対応 | ウェブ検索 | 対応 |
プレフィックス補完 | 対応 | コンテキストキャッシュ | 非対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 260096 | 最大出力長 | 65536 |
コンテキストウィンドウ | 262144 | 最大入力長 (思考モード) | 258048 |
最大出力長 (思考モード) | 65536 | 最大思考連鎖長 | 131072 |
料金
このページでは、期間限定プロモーションを除いた、モデル API 呼び出しの標準料金のみを記載しています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.248 | 100 万トークンあたり |
出力 | 1.485 | 100 万トークンあたり |
シンガポール
対象範囲:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.375 | 100 万トークンあたり |
出力 | 2.25 | 100 万トークンあたり |
ドイツ (フランクフルト)
対象範囲:グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.248 | 100 万トークンあたり |
出力 | 1.485 | 100 万トークンあたり |
米国 (バージニア)
対象範囲:グローバル
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.248 | 100 万トークンあたり |
出力 | 1.485 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
シンガポール
対象範囲:国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
ドイツ (フランクフルト)
対象範囲:グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
米国 (バージニア)
対象範囲:グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |