Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現しています。さまざまなタスク評価において、3.5 シリーズは一貫して最先端の主要モデルに匹敵するパフォーマンスを示しています。3 シリーズと比較して、これらのモデルは純粋なテキストとマルチモーダル機能の両方で飛躍的な進歩を遂げています。このモデルバージョンは、スナップショットモデル qwen3.5-plus-2026-02-15 と機能的に同等です。
推論サービスプロバイダー
qwen3.5-plus の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデル機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート済み | ファインチューニング | サポート対象外 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
ドイツ (フランクフルト)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | [テキスト] [画像] [動画] | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
米国 (バージニア)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | [テキスト] [画像] [動画] | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 991808 | 最大出力長 | 65536 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 983616 |
最大出力長 (思考モード) | 65536 | 最大思考連鎖長 | 81920 |
料金
このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
入力 (バッチファイル) | 0.143 | 100 万トークンあたり |
出力 (バッチファイル) | 0.86 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.358 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.029 | 100 万トークンあたり |
入力 (バッチチャット) | 0.287 | 100 万トークンあたり |
出力 (バッチチャット) | 1.72 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
入力 (バッチファイル) | 0.287 | 100 万トークンあたり |
出力 (バッチファイル) | 1.72 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.717 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.057 | 100 万トークンあたり |
入力 (バッチチャット) | 0.573 | 100 万トークンあたり |
出力 (バッチチャット) | 3.44 | 100 万トークンあたり |
シンガポール
スコープ: 国際
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.5 | 100 万トークンあたり |
出力 | 3 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.625 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.05 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.358 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.029 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.717 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.057 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.358 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.029 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.717 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.057 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 30000 |
TPM (1分あたりのトークン数) | 5,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 15000 |
TPM (1分あたりのトークン数) | 5,000,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 30000 |
TPM (1分あたりのトークン数) | 5,000,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 30000 |
TPM (1分あたりのトークン数) | 5,000,000 |
スナップショットバージョン
qwen3.5-plus-2026-04-20
Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、2月15日のスナップショットと比較して、エージェントコーディング能力が大幅に向上しました。推論速度も大幅に向上し、知識保持、推論能力、長文コンテキスト処理は高いレベルを維持しており、複雑なエージェントベースのタスクに適しています。コーディングエージェント、本番ワークフロー、高スループットシナリオなどのアプリケーションに最適です。このバージョンは、2026年4月20日に取得されたスナップショットに基づいています。
推論サービスプロバイダー
qwen3.5-plus-2026-04-20 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデル機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | [画像] [テキスト] [動画] | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 991808 | 最大出力長 | 65536 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 983616 |
最大出力長 (思考モード) | 65536 |
料金
このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.35875 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.0287 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.71625 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.0573 | 100 万トークンあたり |
シンガポール
スコープ: 国際
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.5 | 100 万トークンあたり |
出力 | 3 | 100 万トークンあたり |
明示的なキャッシュ作成 | 0.625 | 100 万トークンあたり |
明示的なキャッシュ読み取り | 0.05 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 600 |
TPM (1分あたりのトークン数) | 1,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 600 |
TPM (1分あたりのトークン数) | 1,000,000 |
qwen3.5-plus-2026-02-15
Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現しています。さまざまなタスク評価において、3.5 シリーズは一貫して最先端の主要モデルに匹敵するパフォーマンスを示しています。3 シリーズと比較して、これらのモデルは純粋なテキストとマルチモーダル機能の両方で飛躍的な進歩を遂げています。このバージョンは、2026年2月15日時点のスナップショットです。
推論サービスプロバイダー
qwen3.5-plus-2026-02-15 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデル機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 ビデオ | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
ドイツ (フランクフルト)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
米国 (バージニア)
スコープ: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | サポート済み |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 991808 | 最大出力長 | 65536 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 983616 |
最大出力長 (思考モード) | 65536 | 最大思考連鎖長 | 81920 |
料金
このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
シンガポール
スコープ: 国際
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.5 | 100 万トークンあたり |
出力 | 3 | 100 万トークンあたり |
ドイツ (フランクフルト)
スコープ: グローバル
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
米国 (バージニア)
スコープ: グローバル
128k<Input<=256k
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.72 | 100 万トークンあたり |
256k<Input<=1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.573 | 100 万トークンあたり |
出力 | 3.44 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 600 |
TPM (1分あたりのトークン数) | 1,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 60 |
TPM (1分あたりのトークン数) | 1,000,000 |
ドイツ (フランクフルト)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 600 |
TPM (1分あたりのトークン数) | 1,000,000 |
米国 (バージニア)
スコープ: グローバル
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 600 |
TPM (1分あたりのトークン数) | 1,000,000 |