全部產品
Search
文件中心

Dataphin:建立標籤專案

更新時間:Jun 06, 2026

專案是Dataphin的基主要組織單元,是進行多使用者隔離和存取控制的主要邊界。在進列標籤開發前,您需要建立對應標籤專案。本文為您介紹如何建立標籤專案。

前提條件

  • 若您需進行規範建模研發,在建立標籤專案前您需建立對應的資料板塊。若不建立,則只可進行通用研發。資料板塊建立詳情請參見:建立資料板塊

  • 建立標籤專案前,您需完成對應的計算源建立。詳情請參見:計算源

使用限制

  • Dataphin僅支援超級管理員、系統管理員、板塊架構師角色的帳號建立標籤專案。

  • Dataphin僅支援專案超級管理員、系統管理員、板塊架構師角色的帳號,具備關閉和開啟資料表讀寫的許可權申請。

步驟一:選擇項目類型

  1. 在Dataphin首頁,單擊頂部功能表列的規劃

  2. 數倉規劃頁面,按照下圖操作指引,進入建立標籤專案對話方塊。

    image

步驟二:設定項目的歸屬板塊和基本資料

  1. 建立專案對話方塊中配置標籤專案的歸屬板塊基本資料商務資訊參數。

    說明

    標籤專案為Prod環境,等價於Prod專案,因資料研發流程差異,稱為Basic標籤專案。專案內可以編輯開發並提交資料對象、提交即可更新至生產調度及監控營運。

    地區

    參數名稱

    描述

    歸屬板塊

    資料板塊

    選擇專案所屬的資料板塊。選擇歸屬板塊後,即可進行規範建模研發工作。若不選擇,則只可進行通用研發工作。

    說明

    若資料板塊為Dev-Prod模式,歸屬Prod業務板塊的Basic專案中不可以構建規範建模對象,僅可以構建基礎層、應用程式層資料,以免公用層資料標準規範性受影響、資料生產異常。

    基本資料

    專案英文名

    填寫專案的英文名。命名規則如下:

    • 包含字母、數字、底線(_)

    • 不支援以LD_開頭。

    • 不能超過64個字元。

    專案名稱

    填寫專案的名稱。命名規則如下:

    • 包含漢字、數字、字母、底線(_)或短劃線(-)。

    • 不能超過64字元。

    計算源類型

    選擇計算源類型後選擇對應的計算源。

    重要
    • 已繫結項目的計算源,無法被其他專案再次綁定。

    Dataphin對接了人工智慧平台PAI,為您提供了PAI基礎的演算法調度能力。在Machine Learning Platform for AI中,建立可視化建模的工作空間時,資源選擇為基於MaxCompute的計算資源群組,詳情請參見資源管理概述。如果您開啟了機器學習,需要配置以下參數。

    • PAI地區:選擇Dataphin執行個體所在地區。

    • AccessKey IDAccessKey Secret:配置成需要訪問PAI帳號的AccessKey ID、AccessKey Secret。

    • PAI專案名稱:選擇PAI專案。

    • 建議當前Dataphin專案綁定的MaxCompute專案與PAI綁定的MaxCompute專案保持一致。

    描述資訊

    填寫對專案的簡單描述。

    商務資訊

    空間類型

    區分專案開發工作單位及產出資料特徵,預設為應用程式層。空間類型包括4種:

    • 中介層:通常用於儲存資料進行加工後,一致的、準確的、乾淨的資料。

    • 貼源層:通常用來儲存從業務系統中整合的未經處理資料,為後續的加工與開發作為資料的來源。

    • 應用程式層:面向業務需求,定義產生可應用於不同情境的個人化、多樣化的資料指標。

    • 通用層:通常用來儲存通用的摘要資料。如某個主題域下某個維度摘要資料。

    安全設定

    全域安全設定

    安全設定是您可以對資料安全及訪問進行精細化控制、對Spark任務的開關及鑒權模式的設定,來保障資料的安全性。更多資訊,請參見安全設定

    資料結果下載(下載審批)

    Dataphin支援業務資料下載,您可對專案級資料是否可下載進行配置;資料在下載後脫離系統的管控,您可設定浮水印,以提醒注意資料安全,避免隨意分享。更多資訊,請參見資料下載配置

    重要

    系統僅支援非訪客角色的使用者下載資料結果至本地。

    資料許可權審批

    資料許可權審批策略可根據不同的資料等級指定不同的審批規則,能使審批人員著重於高敏感性資料,對於公開的資料,可免除審批,從而降低許可權審批的負擔。更多資訊,請參見資料許可權配置

    資產安全性原則

    安裝後可使用資料安全性原則,保護敏感性資料。可於治理 > 資料安全 > 專案安全性原則模組進行修改。更多資訊,請參見專案安全性原則

    提交設定

    代碼審核

    預設關閉,開啟後還需配置代碼審核人。代碼審核開啟後,該專案下的計算任務在提交時需進行代碼審核。

    代碼審核人預設選中專案系統管理員,並支援自訂選擇多個成員進行審批。

    任務參數配置

    Flink任務預設參數配置

    開啟即時引擎後,您可在文字框輸入Flink相關參數配置。後續建立該專案下的Flink任務時,將預設配置該參數資訊。參數格式必須為索引值對格式:key:value。如:taskmanager.numberOfTaskSlots:1

  2. 單擊確定,即可完成標籤專案的建立。

單租戶多引擎

多引擎模式下專案英文名、專案名稱、板塊空間、安全設定、提交設定、任務參數配置同單引擎模式,詳情請參見上文。同時還需配置引擎設定

參數

描述

引擎設定

離線計算

可開啟或關閉離線計算,開啟後需選擇離線引擎類型離線計算源,關閉後此專案不支援建立離線計算任務。

  • 離線引擎類型:可選擇已建立的離線計算源對應叢集的類型,共包含以下類型:

    • MaxCompute

    • CDH 5.x

    • CDH 6.x

    • Cloudera Data Platform 7.x

    • 華為FusionInsight 8.x

    • Aliyun EMR 5.x

    • 星環TDH 6.x

    • 星環TDH 9.3.x

    • 星環ArgoDB

    • Lindorm(計算引擎)

    編輯專案時,不可修改離線引擎類型。

  • 離線計算源:可選擇所選離線引擎類型相同的離線計算源。

Realtime Compute

可開啟或關閉Realtime Compute,開啟後需選擇Realtime Compute引擎,可選項中包含已建立的Realtime Compute源對應叢集的類型,關閉後專案不支援建立Realtime Compute任務。編輯專案時,不可修改即時引擎類型。

  • 選擇Flink或FusionInsight Flink:還需選擇流處理計算源。

  • 選擇Ververica Flink:可選中批處理可選擇其他計算源,流批一體任務預設為同一計算源,開啟後可為流處理任務和批處理任務配置不同計算源。

專案預設資源群組

該專案下建立的任務預設使用此處配置的專案預設資源群組進行調度,僅在專案已開啟離線計算引擎時支援配置。您也可以在任務配置時自訂修改單個任務對應的資源群組。

  • 僅支援選擇資源群組狀態為正常、使用情境包含任務日常調度且和當前專案有關聯關係的資源群組

  • 此處修改了預設資源群組之後,調度資源群組配置為專案預設資源群組的任務,會自動跟隨更新所使用的資源群組。如果您不希望自動更新,請為任務指定單獨的自訂資源群組,請參見計算任務資源配置

說明
  • 僅在租戶已開啟自訂資源群組功能時支援配置。詳情請參見資源群組概述

  • 使用當前租戶的公用調度資源群組,即租戶預設資源群組。調度高峰期可能出現資源搶佔的情況。

描述資訊

填寫對專案的簡單描述,不超過128個字元。

後續步驟

完成標籤專案的建立後,在建立市場時您可將該專案綁定到對應的市場。詳情請參見:建立市場