DeepSeek Sparse Attention(スパースアテンション機構)を導入した実験的バージョンであり、長文テキストにおけるトレーニングおよび推論効率の最適化と検証を行っています。
推論サービスプロバイダー
deepseek-v3.2-expの推論サービスプロバイダーはAlibaba Cloud Model Studioです。
モデル機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | サポート済み | Function Calling | サポート済み |
Structured Outputs | 未サポート | Web検索 | サポート済み |
Prefix Completion | 未サポート | コンテキストキャッシュ | 未サポート |
バッチ推論 | 未サポート | ファインチューニング | 未サポート |
コンテキスト制限
| パラメータ | 値 | パラメータ | 値 |
|---|---|---|---|
最大入力長 | 98304 | 最大出力長 | 65536 |
コンテキストウィンドウ | 131072 |
料金
このページには、モデルAPI呼び出しの通常料金のみが表示されており、期間限定のプロモーションは含まれていません。プロモーション情報については、Model Studio Consoleをご覧ください。
中国(北京)
| 課金項目 | 料金(USD) | 単位 |
|---|---|---|
入力 | 0.287 | 1Mトークンあたり |
出力 | 0.43 | 1Mトークンあたり |
レート制限
中国(北京)
| パラメータ | 値 |
|---|---|
RPM(1分あたりのリクエスト数) | 15000 |
TPM(1分あたりのトークン数) | 1,200,000 |