すべてのプロダクト
Search
ドキュメントセンター

Alibaba Cloud Model Studio:qwen-max

最終更新日:Aug 26, 2026

Qwen-Max は、数百億規模のパラメータースケールと、中国語や英語などの複数の入力言語をサポートしています。Qwen-Max はローリング方式で更新されます。以前のバージョンと比較して、中国語と英語の両方におけるコード生成、論理的推論、多言語能力が大幅に向上しています。応答スタイルは人間の好みに合わせて大幅に調整され、応答の詳細さと明瞭さが著しく向上しています。創造的なライティング、JSON フォーマットの遵守、ロールプレイング能力において、専門的な改善が施されています。このモデルバージョンは、スナップショットモデルの qwen-max-2025-01-25 と機能的に同等です。

推論サービスプロバイダー

qwen-max の推論サービスプロバイダーは Alibaba Cloud Model Studio です。

モデルの機能

中国 (北京)

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

対応

Function Calling

対応

構造化出力

対応

Web 検索

対応

プレフィックス補完

対応

コンテキストキャッシュ

対応

バッチ推論

対応

ファインチューニング

非対応

シンガポール

スコープ: 国際

機能サポート機能サポート

入力モダリティ

テキスト

出力モダリティ

テキスト

モデル体験

対応

Function Calling

非対応

構造化出力

対応

Web 検索

非対応

プレフィックス補完

対応

コンテキストキャッシュ

対応

バッチ推論

対応

ファインチューニング

非対応

コンテキスト制限

パラメーター値パラメーター値

最大入力長

30720

最大出力長

8192

コンテキストウィンドウ

32768

料金

このページでは、モデル API 呼び出しの通常料金のみを記載しており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。

中国 (北京)

課金項目価格 (米ドル)単位

入力

0.345

100 万トークンあたり

出力

1.377

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.072

100 万トークンあたり

入力 (バッチファイル)

0.172

100 万トークンあたり

出力 (バッチファイル)

0.688

100 万トークンあたり

シンガポール

スコープ: 国際

課金項目価格 (米ドル)単位

入力

1.6

100 万トークンあたり

出力

6.4

100 万トークンあたり

入力 (暗黙的キャッシュ)

0.32

100 万トークンあたり

入力 (バッチファイル)

0.8

100 万トークンあたり

出力 (バッチファイル)

3.2

100 万トークンあたり

レート制限

中国 (北京)

パラメーター値

RPM (1 分あたりのリクエスト数)

1200

TPM (1 分あたりのトークン数)

1,000,000

シンガポール

スコープ: 国際

パラメーター値

RPM (1 分あたりのリクエスト数)

600

TPM (1 分あたりのトークン数)

1,000,000