すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen3.5-plus

最終更新日:Aug 26, 2026

Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現しています。さまざまなタスク評価において、3.5 シリーズは一貫して最先端の主要モデルに匹敵するパフォーマンスを示しています。3 シリーズと比較して、これらのモデルは純粋なテキストとマルチモーダル機能の両方で飛躍的な進歩を遂げています。このモデルバージョンは、スナップショットモデル qwen3.5-plus-2026-02-15 と機能的に同等です。

推論サービスプロバイダー

qwen3.5-plus の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート済み

ファインチューニング

サポート対象外

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

[テキスト] [画像] [動画]

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

[テキスト] [画像] [動画]

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

81920

料金

このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

入力 (バッチファイル)

0.057

100 万トークンあたり

出力 (バッチファイル)

0.344

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

入力 (バッチチャット)

0.115

100 万トークンあたり

出力 (バッチチャット)

0.688

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

入力 (バッチファイル)

0.143

100 万トークンあたり

出力 (バッチファイル)

0.86

100 万トークンあたり

明示的なキャッシュ作成

0.358

100 万トークンあたり

明示的なキャッシュ読み取り

0.029

100 万トークンあたり

入力 (バッチチャット)

0.287

100 万トークンあたり

出力 (バッチチャット)

1.72

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

入力 (バッチファイル)

0.287

100 万トークンあたり

出力 (バッチファイル)

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.717

100 万トークンあたり

明示的なキャッシュ読み取り

0.057

100 万トークンあたり

入力 (バッチチャット)

0.573

100 万トークンあたり

出力 (バッチチャット)

3.44

100 万トークンあたり

シンガポール

スコープ: 国際

Input<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

2.4

100 万トークンあたり

明示的なキャッシュ作成

0.5

100 万トークンあたり

明示的なキャッシュ読み取り

0.04

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.5

100 万トークンあたり

出力

3

100 万トークンあたり

明示的なキャッシュ作成

0.625

100 万トークンあたり

明示的なキャッシュ読み取り

0.05

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.358

100 万トークンあたり

明示的なキャッシュ読み取り

0.029

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

明示的なキャッシュ作成

0.717

100 万トークンあたり

明示的なキャッシュ読み取り

0.057

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

明示的なキャッシュ作成

0.143

100 万トークンあたり

明示的なキャッシュ読み取り

0.012

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.358

100 万トークンあたり

明示的なキャッシュ読み取り

0.029

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

明示的なキャッシュ作成

0.717

100 万トークンあたり

明示的なキャッシュ読み取り

0.057

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

30000

TPM (1分あたりのトークン数)

5,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1分あたりのリクエスト数)

15000

TPM (1分あたりのトークン数)

5,000,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメーター値

RPM (1分あたりのリクエスト数)

30000

TPM (1分あたりのトークン数)

5,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1分あたりのリクエスト数)

30000

TPM (1分あたりのトークン数)

5,000,000

スナップショットバージョン

qwen3.5-plus-2026-04-20

Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、2月15日のスナップショットと比較して、エージェントコーディング能力が大幅に向上しました。推論速度も大幅に向上し、知識保持、推論能力、長文コンテキスト処理は高いレベルを維持しており、複雑なエージェントベースのタスクに適しています。コーディングエージェント、本番ワークフロー、高スループットシナリオなどのアプリケーションに最適です。このバージョンは、2026年4月20日に取得されたスナップショットに基づいています。

推論サービスプロバイダー

qwen3.5-plus-2026-04-20 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

機能サポート機能サポート

入力モダリティ

[画像] [テキスト] [動画]

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート済み

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

料金

このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

明示的なキャッシュ作成

0.14375

100 万トークンあたり

明示的なキャッシュ読み取り

0.0115

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

明示的なキャッシュ作成

0.35875

100 万トークンあたり

明示的なキャッシュ読み取り

0.0287

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

明示的なキャッシュ作成

0.71625

100 万トークンあたり

明示的なキャッシュ読み取り

0.0573

100 万トークンあたり

シンガポール

スコープ: 国際

Input<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

2.4

100 万トークンあたり

明示的なキャッシュ作成

0.5

100 万トークンあたり

明示的なキャッシュ読み取り

0.04

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.5

100 万トークンあたり

出力

3

100 万トークンあたり

明示的なキャッシュ作成

0.625

100 万トークンあたり

明示的なキャッシュ読み取り

0.05

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

600

TPM (1分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1分あたりのリクエスト数)

600

TPM (1分あたりのトークン数)

1,000,000

qwen3.5-plus-2026-02-15

Qwen3.5 ネイティブ視覚言語シリーズ Plus モデルは、線形アテンションメカニズムとスパース混合エキスパートモデルを統合したハイブリッドアーキテクチャに基づいて構築されており、より高い推論効率を実現しています。さまざまなタスク評価において、3.5 シリーズは一貫して最先端の主要モデルに匹敵するパフォーマンスを示しています。3 シリーズと比較して、これらのモデルは純粋なテキストとマルチモーダル機能の両方で飛躍的な進歩を遂げています。このバージョンは、2026年2月15日時点のスナップショットです。

推論サービスプロバイダー

qwen3.5-plus-2026-02-15 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデル機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト 画像 ビデオ

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

ドイツ (フランクフルト)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート対象外

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

米国 (バージニア)

スコープ: グローバル

機能サポート機能サポート

入力モダリティ

テキスト 画像 動画

出力モダリティ

テキスト

モデル体験

サポート済み

Function Calling

サポート済み

構造化出力

サポート済み

Web 検索

サポート済み

プレフィックス補完

サポート済み

コンテキストキャッシュ

サポート対象外

バッチ推論

サポート対象外

ファインチューニング

サポート対象外

コンテキスト制限

パラメーター値パラメーター値

最大入力長

991808

最大出力長

65536

コンテキストウィンドウ

1000000

最大入力長 (思考モード)

983616

最大出力長 (思考モード)

65536

最大思考連鎖長

81920

料金

このページには、モデルの API 呼び出しの元の料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。

中国 (北京)

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

シンガポール

スコープ: 国際

Input<=256k

課金項目価格 (USD)単位

入力

0.4

100 万トークンあたり

出力

2.4

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.5

100 万トークンあたり

出力

3

100 万トークンあたり

ドイツ (フランクフルト)

スコープ: グローバル

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

米国 (バージニア)

スコープ: グローバル

Input<=128k

課金項目価格 (USD)単位

入力

0.115

100 万トークンあたり

出力

0.688

100 万トークンあたり

128k<Input<=256k

課金項目価格 (USD)単位

入力

0.287

100 万トークンあたり

出力

1.72

100 万トークンあたり

256k<Input<=1m

課金項目価格 (USD)単位

入力

0.573

100 万トークンあたり

出力

3.44

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1分あたりのリクエスト数)

600

TPM (1分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1分あたりのリクエスト数)

60

TPM (1分あたりのトークン数)

1,000,000

ドイツ (フランクフルト)

スコープ: グローバル

パラメーター値

RPM (1分あたりのリクエスト数)

600

TPM (1分あたりのトークン数)

1,000,000

米国 (バージニア)

スコープ: グローバル

パラメーター値

RPM (1分あたりのリクエスト数)

600

TPM (1分あたりのトークン数)

1,000,000