シンキングモードとノンシンキングモードの効果的な統合を実現し、対話中のモード切り替えが可能です。その推論能力は、同規模の業界で SOTA レベルに達しており、汎用能力は Qwen2.5-14B を大幅に上回っています。
推論サービスプロバイダー
qwen3-14b の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデル機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | サポート済み |
シンガポール
範囲: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | サポート済み |
米国 (バージニア)
範囲: グローバル
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | 非サポート |
構造化出力 | サポート済み | Web 検索 | 非サポート |
プレフィックス補完 | サポート済み | コンテキストキャッシュ | 非サポート |
バッチ推論 | 非サポート | ファインチューニング | 非サポート |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 98304 | 最大出力長 | 8192 |
コンテキストウィンドウ | 131072 |
料金
このページでは、モデル API 呼び出しの元の料金のみを表示しており、期間限定プロモーションは含まれていません。プロモーションオファーについては、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
入力 | 0.144 | 100 万トークンあたり |
出力 | 0.574 | 100 万トークンあたり |
入力 (シンキング) | 0.144 | 100 万トークンあたり |
出力 (シンキング) | 1.434 | 100 万トークンあたり |
シンガポール
範囲: 国際
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
入力 | 0.35 | 100 万トークンあたり |
出力 | 1.4 | 100 万トークンあたり |
入力 (シンキング) | 0.35 | 100 万トークンあたり |
出力 (シンキング) | 4.2 | 100 万トークンあたり |
米国 (バージニア)
範囲: グローバル
| 課金項目 | 価格 (米ドル) | 単位 |
|---|---|---|
入力 | 0.144 | 100 万トークンあたり |
出力 | 0.574 | 100 万トークンあたり |
入力 (シンキング) | 0.144 | 100 万トークンあたり |
出力 (シンキング) | 1.434 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
シンガポール
範囲: 国際
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |
米国 (バージニア)
範囲: グローバル
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 600 |
TPM (1 分あたりのトークン数) | 1,000,000 |