deepseek-v3.2 は、スパースアテンションメカニズムである DeepSeek Sparse Attention を組み込んだモデルの公式リリースです。また、DeepSeek がリリースした初の、推論をツール使用に統合したモデルでもあり、推論を有効にしたツール呼び出しと、推論を有効にしないツール呼び出しの両方をサポートします。
推論サービスプロバイダー
deepseek-v3.2 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
中国 (北京)
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | Function Calling | 対応 |
構造化出力 | 非対応 | Web 検索 | 対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 対応 |
バッチ推論 | 対応 | ファインチューニング | 非対応 |
シンガポール
スコープ: 国際
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | Function Calling | 対応 |
構造化出力 | 非対応 | Web 検索 | 対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 98304 | 最大出力長 | 65536 |
コンテキストウィンドウ | 131072 |
料金
このページには、期間限定プロモーションを除いた、モデル API 呼び出しの定価のみを記載しています。プロモーションオファーについては、Model Studio コンソール をご参照ください。
中国 (北京)
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.287 | 100万トークンあたり |
出力 | 0.431 | 100万トークンあたり |
入力 (暗黙的キャッシュ) | 0.058 | 100万トークンあたり |
入力 (バッチファイル) | 0.144 | 100万トークンあたり |
出力 (バッチファイル) | 0.216 | 100万トークンあたり |
明示的キャッシュ作成 | 0.359 | 100万トークンあたり |
明示的キャッシュ読み取り | 0.029 | 100万トークンあたり |
入力 (バッチチャット) | 0.287 | 100万トークンあたり |
出力 (バッチチャット) | 0.431 | 100万トークンあたり |
シンガポール
スコープ: 国際
| 課金項目 | 価格 (USD) | 単位 |
|---|---|---|
入力 | 0.57 | 100万トークンあたり |
出力 | 1.71 | 100万トークンあたり |
入力 (暗黙的キャッシュ) | 0.114 | 100万トークンあたり |
明示的キャッシュ作成 | 0.713 | 100万トークンあたり |
明示的キャッシュ読み取り | 0.057 | 100万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 15000 |
TPM (1分あたりのトークン数) | 1,000,000 |
シンガポール
スコープ: 国際
| パラメーター | 値 |
|---|---|
RPM (1分あたりのリクエスト数) | 10000 |
TPM (1分あたりのトークン数) | 1,200,000 |