通義千問 QVQ 視覚的推論モデルは、視覚入力と Chain-of-Thought 出力をサポートし、数学、プログラミング、視覚分析、創作、および一般的なタスクにおいて、より強力な能力を発揮します。このモデルバージョンは、機能的にスナップショットモデル qvq-max-2025-03-25 と同等です。
推論サービスプロバイダー
qvq-max の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト 画像 動画 | 出力モダリティ | テキスト |
モデル体験 | サポート済み | 関数呼び出し | 非サポート |
構造化出力 | 非サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキストの制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 106496 | 最大出力長 | 8192 |
コンテキストウィンドウ | 131072 |
料金
このページには、期間限定プロモーションを除いた、モデルの API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 1.147 | 100万トークンあたり |
出力 | 4.588 | 100万トークンあたり |
シンガポール
範囲:国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 1.2 | 100万トークンあたり |
出力 | 4.8 | 100万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 60 |
TPM (1分あたりのトークン数) | 100,000 |
シンガポール
範囲:国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 60 |
TPM (1分あたりのトークン数) | 100,000 |