Qwen-Max は、数百億規模のパラメータースケールと、中国語や英語などの複数の入力言語をサポートしています。Qwen-Max はローリング方式で更新されます。以前のバージョンと比較して、中国語と英語の両方におけるコード生成、論理的推論、多言語能力が大幅に向上しています。応答スタイルは人間の好みに合わせて大幅に調整され、応答の詳細さと明瞭さが著しく向上しています。創造的なライティング、JSON フォーマットの遵守、ロールプレイング能力において、専門的な改善が施されています。このモデルバージョンは、スナップショットモデルの qwen-max-2025-01-25 と機能的に同等です。
推論サービスプロバイダー
qwen-max の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | Function Calling | 対応 |
構造化出力 | 対応 | Web 検索 | 対応 |
プレフィックス補完 | 対応 | コンテキストキャッシュ | 対応 |
バッチ推論 | 対応 | ファインチューニング | 非対応 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | Function Calling | 非対応 |
構造化出力 | 対応 | Web 検索 | 非対応 |
プレフィックス補完 | 対応 | コンテキストキャッシュ | 対応 |
バッチ推論 | 対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 30720 | 最大出力長 | 8192 |
コンテキストウィンドウ | 32768 |
料金
このページでは、モデル API 呼び出しの通常料金のみを記載しており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
入力 | 0.345 | 100 万トークンあたり |
出力 | 1.377 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.072 | 100 万トークンあたり |
入力 (バッチファイル) | 0.172 | 100 万トークンあたり |
出力 (バッチファイル) | 0.688 | 100 万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
入力 | 1.6 | 100 万トークンあたり |
出力 | 6.4 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.32 | 100 万トークンあたり |
入力 (バッチファイル) | 0.8 | 100 万トークンあたり |
出力 (バッチファイル) | 3.2 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 1200 |
TPM (1 分あたりのトークン数) | 1,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |