自社開発の混合エキスパート (MoE) モデルで、6710 億のパラメーター (うち 370 億が有効) を持ち、14.8 兆のトークンで事前学習済みです。長文テキスト処理、コーディング、数学、百科事典的知識、中国語タスクにおいて優れた能力を発揮します。
推論サービスプロバイダー
deepseek-v3 の推論サービスプロバイダーは Alibaba Cloud Model Studio です。
モデルの機能
| 機能 | サポート | 機能 | サポート |
|---|---|---|---|
入力モダリティ | テキスト | 出力モダリティ | テキスト |
モデル体験 | 対応 | 関数呼び出し | 対応 |
構造化出力 | 非対応 | Web 検索 | 対応 |
プレフィックス補完 | 非対応 | コンテキストキャッシュ | 対応 |
バッチ推論 | 非対応 | ファインチューニング | 非対応 |
コンテキスト長の制限
| パラメーター | 値 | パラメーター | 値 |
|---|---|---|---|
最大入力長 | 57344 | 最大出力長 | 8192 |
コンテキストウィンドウ | 65536 |
料金
このページには、期間限定プロモーションを除いた、モデル API 呼び出しの基本料金のみを記載しています。プロモーション情報については、Model Studio コンソールをご参照ください。
中国 (北京)
| 課金項目 | 料金 (米ドル) | 単位 |
|---|---|---|
入力 | 0.287 | 100 万トークンあたり |
出力 | 1.147 | 100 万トークンあたり |
入力 (暗黙的キャッシュ) | 0.057 | 100 万トークンあたり |
入力 (バッチファイル) | 0.143 | 100 万トークンあたり |
出力 (バッチファイル) | 0.573 | 100 万トークンあたり |
レート制限
中国 (北京)
| パラメーター | 値 |
|---|---|
RPM (1 分あたりのリクエスト数) | 15000 |
TPM (1 分あたりのトークン数) | 1,200,000 |