Qwen-Plus は、中国語や英語などの複数の入力言語をサポートする Qwen 超大規模言語モデルの拡張版です。以前のバージョンと比較して、中国語と英語の両方におけるコード生成、論理的推論、多言語能力が大幅に向上しています。応答スタイルは人間の好みに合わせて大幅に調整されており、応答の詳細さと明瞭さが著しく向上しています。創造的なライティング、JSON フォーマットの遵守、ロールプレイング能力において、専門的な改善がなされています。このモデルバージョンは、スナップショットモデルの qwen-plus-2025-12-01-us と機能的に同等です。
推論サービスプロバイダー
qwen-plus-us の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート対象外 |
構造化出力 | サポート済み | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | サポート済み |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 995904 | 最大出力長 | 32768 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 995904 |
最大出力長 (思考モード) | 32768 | 最大思考チェーン長 | 81920 |
料金
このページでは、期間限定プロモーションを除いた、モデル API 呼び出しの元の料金のみを表示しています。プロモーション情報については、Model Studio コンソールをご参照ください。
米国 (バージニア)
スコープ: US
256k < 入力 <= 1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 1.2 | 100 万トークンあたり |
出力 | 3.6 | 100 万トークンあたり |
入力 (思考) | 1.2 | 100 万トークンあたり |
出力 (思考) | 12 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.24 | 100 万トークンあたり |
入力 (思考暗黙的キャッシュ) | 0.24 | 100 万トークンあたり |
明示的キャッシュ作成 | 1.5 | 100 万トークンあたり |
明示的キャッシュ読み取り | 0.12 | 100 万トークンあたり |
明示的キャッシュ作成 (思考) | 1.5 | 100 万トークンあたり |
明示的キャッシュ読み取り (思考) | 0.12 | 100 万トークンあたり |
レート制限
米国 (バージニア)
スコープ: US
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
スナップショットバージョン
qwen-plus-2025-12-01-us
このバージョンは 2025 年 12 月 1 日時点のスナップショットであり、7 月 28 日のスナップショットと比較して推論能力が向上しています。エージェント機能とマルチターンツール呼び出し能力がさらに強化され、主観的な創造的タスクのパフォーマンスが大幅に向上しました。最大 100 万トークンのコンテキスト長をサポートし、コンテキスト長に基づいた段階的価格設定が適用されます。
推論サービスプロバイダー
qwen-plus-2025-12-01-us の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート対象外 | Function Calling | サポート対象外 |
構造化出力 | サポート対象外 | Web 検索 | サポート対象外 |
プレフィックス補完 | サポート対象外 | コンテキストキャッシュ | サポート対象外 |
バッチ推論 | サポート対象外 | ファインチューニング | サポート対象外 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 997952 | 最大出力長 | 32768 |
コンテキストウィンドウ | 1000000 | 最大入力長 (思考モード) | 995904 |
最大出力長 (思考モード) | 32768 |
料金
このページでは、期間限定プロモーションを除いた、モデル API 呼び出しの元の料金のみを表示しています。プロモーション情報については、Model Studio コンソールをご参照ください。
米国 (バージニア)
スコープ: US
256k < 入力 <= 1m
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 1.2 | 100 万トークンあたり |
出力 | 3.6 | 100 万トークンあたり |
入力 (思考) | 1.2 | 100 万トークンあたり |
出力 (思考) | 12 | 100 万トークンあたり |
レート制限
米国 (バージニア)
スコープ: US
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |