すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.6-35b-a3b

最終更新日:Aug 26, 2026

Qwen3.6 35B-A3B は、線形アテンションメカニズムとスパース混合エキスパート (MoE) フレームワークを統合したハイブリッドアーキテクチャ上に構築された、ネイティブの視覚言語モデルであり、より高い推論効率を実現します。3.5-35B-A3B と比較して、このモデルはエージェントコーディング能力、数学およびコードの推論能力、空間的知性、ならびにオブジェクトのローカライズとオブジェクト検出のパフォーマンスが大幅に向上しています。

モデルの機能

機能サポート機能サポート

入力モダリティ

画像 テキスト ビデオ

出力モダリティ

テキスト

モデル体験

対応

関数呼び出し

対応

構造化出力

対応

ウェブ検索

対応

プレフィックス補完

対応

コンテキストキャッシュ

非対応

バッチ推論

非対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

260096

最大出力長

65536

コンテキストウィンドウ

262144

最大入力長 (思考モード)

258048

最大出力長 (思考モード)

65536

最大思考連鎖長

131072

料金

このページでは、期間限定プロモーションを除いた、モデル API 呼び出しの標準料金のみを記載しています。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (USD)単位

入力

0.248

100 万トークンあたり

出力

1.485

100 万トークンあたり

シンガポール

対象範囲:国際

課金項目価格 (USD)単位

入力

0.375

100 万トークンあたり

出力

2.25

100 万トークンあたり

ドイツ (フランクフルト)

対象範囲:グローバル

課金項目価格 (USD)単位

入力

0.248

100 万トークンあたり

出力

1.485

100 万トークンあたり

米国 (バージニア)

対象範囲:グローバル

課金項目価格 (USD)単位

入力

0.248

100 万トークンあたり

出力

1.485

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

対象範囲:国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

対象範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000

米国 (バージニア)

対象範囲:グローバル

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000