Qwen3 シリーズの Turbo モデルです。思考モードとノンシンキングモードを効果的に統合し、対話中のモード切り替えを可能にします。その推論能力は、より小さいパラメーターサイズで QwQ-32B に匹敵し、汎用能力は Qwen2.5-Turbo を大幅に上回り、同規模のモデルの中で業界最高水準を達成しています。このモデルバージョンは、スナップショットモデル qwen-turbo-2025-04-28 と機能的に同等です。
推論サービスプロバイダー
qwen-turbo の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート | Function Calling | 非サポート |
構造化出力 | サポート | Web 検索 | 非サポート |
プレフィックス補完 | 非サポート | コンテキストキャッシュ | サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
シンガポール
範囲:国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート | Function Calling | 非サポート |
構造化出力 | サポート | Web 検索 | 非サポート |
プレフィックス補完 | サポート | コンテキストキャッシュ | サポート |
バッチ推論 | サポート | ファインチューニング | 非サポート |
コンテキスト長の制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 98304 | 最大出力長 | 16384 |
コンテキストウィンドウ | 131072 |
料金
このページには、期間限定プロモーションを除いた、モデル API 呼び出しの基本料金のみが表示されています。プロモーション情報については、Model Studio コンソールでご確認ください。
中国 (北京)
| 課金項目 | 料金 (米ドル) | 単位 |
|---|---|---|
入力 | 0.044 | 100 万トークンあたり |
出力 | 0.087 | 100 万トークンあたり |
入力 (思考) | 0.044 | 100 万トークンあたり |
出力 (思考) | 0.431 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.009 | 100 万トークンあたり |
入力 (思考、暗黙的キャッシュ) | 0.009 | 100 万トークンあたり |
シンガポール
範囲:国際
| 課金項目 | 料金 (米ドル) | 単位 |
|---|---|---|
入力 | 0.05 | 100 万トークンあたり |
出力 | 0.2 | 100 万トークンあたり |
入力 (思考) | 0.05 | 100 万トークンあたり |
出力 (思考) | 0.5 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.01 | 100 万トークンあたり |
入力 (思考、暗黙的キャッシュ) | 0.01 | 100 万トークンあたり |
思考出力 (バッチファイル) | 0.25 | 100 万トークンあたり |
入力 (バッチファイル) | 0.025 | 100 万トークンあたり |
出力 (バッチファイル) | 0.1 | 100 万トークンあたり |
入力 (思考、バッチファイル) | 0.025 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 1200 |
TPM (1 分あたりのトークン数) | 5,000,000 |
シンガポール
範囲:国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 5,000,000 |