全部產品
Search
文件中心

Alibaba Cloud Model Studio:deepseek-v4-pro

更新時間:Aug 26, 2026

旗艦級 MoE 大模型,總參1.6T、啟用 49B,原生支援百萬級超長上下文。依託海量高品質訓練資料,具備頂尖數學邏輯、複雜推理、專業代碼與長文本深度解析能力,適配高階科研、複雜辦公、深度智能代理等高難度情境。

推理服務供應商

deepseek-v4-pro模型的推理服務供應商為阿里雲百鍊。

模型能力

華北2(北京)

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

新加坡

部署範圍:國際

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

德國(法蘭克福)

部署範圍:全球

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

美國(維吉尼亞)

部署範圍:全球

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

日本(東京)

部署範圍:全球

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

1000000

最大輸出長度

393216

上下文長度

1000000

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。

華北2(北京)

計費項目價格(美元)單位

輸入

1.65

每百萬tokens

輸出

3.301

每百萬tokens

輸入(快取命中)

0.138

每百萬tokens

新加坡

部署範圍:國際

計費項目價格(美元)單位

輸入

2.4

每百萬tokens

輸出

4.8

每百萬tokens

輸入(快取命中)

0.2

每百萬tokens

德國(法蘭克福)

部署範圍:全球

計費項目價格(美元)單位

輸入

1.65

每百萬tokens

輸出

3.301

每百萬tokens

輸入(快取命中)

0.138

每百萬tokens

美國(維吉尼亞)

部署範圍:全球

計費項目價格(美元)單位

輸入

1.65

每百萬tokens

輸出

3.301

每百萬tokens

輸入(快取命中)

0.138

每百萬tokens

日本(東京)

部署範圍:全球

計費項目價格(美元)單位

輸入

1.65

每百萬tokens

輸出

3.301

每百萬tokens

輸入(快取命中)

0.138

每百萬tokens

限流

華北2(北京)

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

新加坡

部署範圍:國際

參數

RPM(每分鐘請求數)

10000

TPM(每分鐘tokens)

1,200,000

德國(法蘭克福)

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

美國(維吉尼亞)

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

日本(東京)

部署範圍:全球

參數

RPM(每分鐘請求數)

10000

TPM(每分鐘tokens)

1,200,000

快照版本

deepseek-v4-pro-0813

旗艦級 MoE 大模型,總參1.6T、啟用 49B,原生支援百萬級超長上下文。依託海量高品質訓練資料,具備頂尖數學邏輯、複雜推理、專業代碼與長文本深度解析能力,適配高階科研、複雜辦公、深度智能代理等高難度情境。

推理服務供應商

deepseek-v4-pro-0813模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

1000000

最大輸出長度

393216

上下文長度

1000000

最大輸入長度(思考模式下)

1000000

最大輸出長度(思考模式下)

393216

最大思維鏈長度

393216

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。

華北2(北京)

計費項目價格(美元)單位

輸入

0.636

每百萬tokens

輸入

1.272

每百萬tokens

輸出

1.908

每百萬tokens

輸出

3.816

每百萬tokens

輸入(快取命中)

0.064

每百萬tokens

輸入(快取命中)

0.127

每百萬tokens

新加坡

部署範圍:國際

計費項目價格(美元)單位

輸入

0.66

每百萬tokens

輸入

1.32

每百萬tokens

輸出

1.98

每百萬tokens

輸出

3.96

每百萬tokens

輸入(快取命中)

0.066

每百萬tokens

輸入(快取命中)

0.132

每百萬tokens

德國(法蘭克福)

部署範圍:全球

計費項目價格(美元)單位

輸入

0.636

每百萬tokens

輸入

1.272

每百萬tokens

輸出

1.908

每百萬tokens

輸出

3.816

每百萬tokens

輸入(快取命中)

0.064

每百萬tokens

輸入(快取命中)

0.127

每百萬tokens

美國(維吉尼亞)

部署範圍:全球

計費項目價格(美元)單位

輸入

0.636

每百萬tokens

輸入

1.272

每百萬tokens

輸出

1.908

每百萬tokens

輸出

3.816

每百萬tokens

輸入(快取命中)

0.064

每百萬tokens

輸入(快取命中)

0.127

每百萬tokens

日本(東京)

部署範圍:全球

計費項目價格(美元)單位

輸入

0.636

每百萬tokens

輸入

1.272

每百萬tokens

輸出

1.908

每百萬tokens

輸出

3.816

每百萬tokens

輸入(快取命中)

0.064

每百萬tokens

輸入(快取命中)

0.127

每百萬tokens

中國香港

部署範圍:全球

計費項目價格(美元)單位

輸入

0.636

每百萬tokens

輸入

1.272

每百萬tokens

輸出

1.908

每百萬tokens

輸出

3.816

每百萬tokens

輸入(快取命中)

0.064

每百萬tokens

輸入(快取命中)

0.127

每百萬tokens

限流

華北2(北京)

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

新加坡

部署範圍:國際

參數

RPM(每分鐘請求數)

10000

TPM(每分鐘tokens)

1,200,000

德國(法蘭克福)

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

美國(維吉尼亞)

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

日本(東京)

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

中國香港

部署範圍:全球

參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000