Todos os produtos
Search
Central de documentação

DataWorks:Ecossistema de produtos

Última atualização: Jun 27, 2026

O DataWorks é uma plataforma completa para desenvolvimento e governança de big data. Ele se integra a mecanismos de computação para executar tarefas de processamento de dados e se conecta a fontes de dados para mover informações para dentro e para fora desses mecanismos. Este tópico lista os mecanismos de computação e as fontes de dados compatíveis com o DataWorks.

Ecossistema de mecanismos de computação

O DataWorks não executa tarefas de computação diretamente. Em vez disso, utiliza um mecanismo de vinculação: vincular recursos de computação para registrar um mecanismo na plataforma e, em seguida, crie, orquestrar e gerencie tarefas de processamento de dados a partir de uma interface unificada.

Os seguintes mecanismos de computação são compatíveis:

Mecanismo

Caso de uso típico

MaxCompute

Processamento em lote offline em grande escala

Hologres

Consultas interativas em tempo real em grandes conjuntos de dados

Flink

Processamento de fluxo em tempo real

EMR on ECS

Cargas de trabalho de big data open source (Hadoop, Spark, Hive) no ECS

EMR on ACK

Cargas de trabalho de big data open source baseadas em contêineres

EMR Serverless StarRocks

Análises em tempo real serverless com StarRocks

EMR Serverless Spark

Jobs Spark serverless sem gerenciamento de cluster

CDH

Clusters Hadoop Cloudera on-premises

AnalyticDB for MySQL

Data warehousing nativo da nuvem compatível com MySQL

AnalyticDB for PostgreSQL

Análises com processamento massivamente paralelo (MPP)

AnalyticDB for Spark

Cargas de trabalho Spark integradas ao AnalyticDB

OpenSearch

Pesquisa de texto completo e pesquisa inteligente

ClickHouse

OLAP de alto desempenho e relatórios em tempo real

Lindorm

Armazenamento multimodelo para IoT e dados de séries temporais

Ecossistema de fontes de dados

A fonte de dados funciona como ponto de entrada unificado no DataWorks para conexão com sistemas externos. Configure as informações de conexão e as definições de rede uma única vez no Management Center e reutilize essa conexão no Data Integration, Data Studio, Data Map, DataAnalysis e DataService Studio, sem repetir a configuração. No modo padrão, também é possível configure o isolamento de fontes de dados para manter os ambientes de desenvolvimento e produção fisicamente separados.

As subseções abaixo listam as fontes de dados compatíveis com cada módulo do DataWorks.

Visão geral da compatibilidade dos módulos

Utilize esta matriz para verificar quais módulos oferecem suporte a uma fonte de dados específica. Consulte as subseções relevantes abaixo para acessar os links dos guias de configuração.

Fonte de dados

Data Integration

Data Studio

Data Map

DataAnalysis

DataService Studio

MaxCompute

Hologres

MySQL

PostgreSQL

Oracle

SQL Server

AnalyticDB for MySQL

AnalyticDB for PostgreSQL

StarRocks

ClickHouse

Doris

PolarDB

SelectDB

OceanBase

Tablestore

Tablestore Stream

Lindorm

HBase

Kafka

Object Storage Service (OSS)

Simple Log Service (SLS) / LogHub

DataHub

HDFS

Amazon S3

Azure Blob Storage

BigQuery

Amazon Redshift

Elasticsearch

MongoDB

Redis

Maxgraph

EMR (Hive, Spark SQL, Impala, Presto, Trino)

CDH (Hive, Spark SQL)

Data Lake Formation (DLF)

SAP HANA

DB2

DM

DRDS (PolarDB-X 1.0)

PolarDB-X 2.0

MariaDB

KingbaseES

Vertica

GBase8a

Milvus

TiDB

FTP

HttpFile

RestAPI (HTTP)

Salesforce

Sensors Data

Memcache (OCS)

MetaQ

OSS-HDFS

TOS

TSDB

Graph Database (GDB)

AnalyticDB for Spark

E-MapReduce HIVE

A tabela acima abrange as fontes de dados listadas neste tópico. Para obter a lista completa de fontes de dados e métodos de sincronização compatíveis, consulte Fontes de dados e soluções de sincronização compatíveis .

Data Integration

O Data Integration é o módulo principal para movimentar dados entre sistemas. Configure uma fonte de dados uma única vez no Management Center e utilize-a para definir tarefas de sincronização, escolhendo o escopo de tabela única ou banco de dados completo, além do modo offline ou em tempo real. Os padrões de sincronização compatíveis incluem migração completa, captura incremental (CDC) e sincronização automática completa e incremental.

Para obter instruções de configuração, consulte Gerenciamento de fontes de dados e Fontes de dados e soluções de sincronização compatíveis.

Armazenamento em nuvem

Fonte de dados do OSS

Fonte de dados do Amazon S3

Fonte de dados do Azure Blob Storage

Fonte de dados FTP

Fonte de dados HDFS

Fonte de dados OSS-HDFS

Fonte de dados HttpFile

Fonte de dados TOS

Bancos de dados

Fonte de dados MySQL

Fonte de dados PostgreSQL

Fonte de dados Oracle

Fonte de dados SQL Server

Fonte de dados PolarDB

Fonte de dados PolarDB-X 2.0

Fonte de dados DRDS (PolarDB-X 1.0)

Fonte de dados MariaDB

Fonte de dados Vertica

Fonte de dados DB2

Fonte de dados DM

Fonte de dados GBase8a

Fonte de dados KingbaseES

Fonte de dados TiDB

Fonte de dados ApsaraDB for OceanBase

Fonte de dados Amazon Redshift

Fonte de dados BigQuery

Armazenamentos de dados da Alibaba Cloud

Fonte de dados MaxCompute

Fonte de dados Hologres

Fonte de dados AnalyticDB for MySQL 2.0

Fonte de dados AnalyticDB for MySQL 3.0

Fonte de dados AnalyticDB for PostgreSQL

Fonte de dados ClickHouse

Fonte de dados Lindorm

Fonte de dados Tablestore

Fonte de dados Tablestore Stream

Fonte de dados LogHub (SLS)

Fonte de dados DataHub

Fonte de dados Maxgraph

Fonte de dados OpenSearch

Fonte de dados Data Lake Formation

Fonte de dados Memcache (OCS)

Fonte de dados MetaQ

Fonte de dados SelectDB

Fonte de dados Graph Database (GDB)

Sistemas de big data e open source

Fonte de dados Hive

Fonte de dados HBase

Fonte de dados Kafka

Fonte de dados StarRocks

Fonte de dados Doris

Fonte de dados Milvus

NoSQL, APIs e SaaS

Fonte de dados MongoDB

Fonte de dados Redis

Fonte de dados SAP HANA

Fonte de dados Elasticsearch

Fonte de dados RestAPI (HTTP)

Fonte de dados Salesforce

Fonte de dados Sensors Data

Fonte de dados TSDB

Data Studio

O Data Studio oferece suporte à orquestração e ao agendamento híbridos em mecanismos de computação e bancos de dados. Além de mecanismos como MaxCompute, E-MapReduce (EMR) e AnalyticDB, conecte bancos de dados diretamente como nós no pipeline de desenvolvimento. Configure as conexões de fontes de dados e as políticas de agendamento uma única vez e chame-as nos módulos de desenvolvimento e O&M.

Para mais informações, consulte Nós de banco de dados.

Fonte de dados MySQL

Fonte de dados PolarDB MySQL

Fonte de dados SAP HANA

Fonte de dados SQL Server

Fonte de dados PolarDB PostgreSQL

Fonte de dados Vertica

Fonte de dados Oracle

Fonte de dados Doris

Fonte de dados DM

Fonte de dados PostgreSQL

Fonte de dados MariaDB

Fonte de dados KingbaseES

Fonte de dados StarRocks

Fonte de dados SelectDB

Fonte de dados OceanBase

Fonte de dados DRDS

Fonte de dados Amazon Redshift

Fonte de dados DB2

Fonte de dados GBase8a

Fonte de dados MySQL

PolarDB-X 2.0

SAP HANA

Fonte de dados SQL Server

PolarDB PostgreSQL

Vertica

Fonte de dados Oracle

Doris

Fonte de dados MongoDB

Fonte de dados PostgreSQL

MariaDB

KingbaseES

Fonte de dados StarRocks

Fonte de dados SelectDB

Fonte de dados ApsaraDB For OceanBase

DRDS (PolarDB-X 1.0)

Fonte de dados Amazon Redshift

Fonte de dados DB2

Fonte de dados GBase8a

Data Map

O Data Map utiliza conexões de fontes de dados pré-configuradas para coletar metadados automaticamente. O coletor integrado recupera esquemas de tabelas de banco de dados, informações de partição e linhagem de dados entre sistemas. Após a coleta, visualize os detalhes das tabelas e o gráfico de linhagem no Data Map para rastrear a origem e o fluxo dos seus ativos de dados.

Para mais informações, consulte Aquisição de metadados.

Fonte de dados AnalyticDB for PostgreSQL

Fonte de dados MySQL

Fonte de dados Hologres

Fonte de dados AnalyticDB for MySQL

Fonte de dados PostgreSQL

Fonte de dados Lindorm

Fonte de dados AnalyticDB for Spark

Fonte de dados SQL Server

Fonte de dados MaxCompute

Fonte de dados CDH Hive

Fonte de dados Oracle

Fonte de dados StarRocks

Data Lake Formation (DLF)

Fonte de dados Tablestore (OTS)

Fonte de dados ClickHouse

Fonte de dados E-MapReduce HIVE

DataAnalysis

O DataAnalysis permite consultar, analisar, transformar e visualizar dados de forma interativa usando os mecanismos e fontes de dados registrados no DataWorks.

Para mais informações, consulte Consulta e análise SQL.

Fonte de dados MaxCompute

Fonte de dados Hologres

Fonte de dados EMR Hive

Fonte de dados EMR Spark SQL

Fonte de dados EMR Impala

Fonte de dados EMR Presto

Fonte de dados EMR Trino

Fonte de dados CDH Hive

Fonte de dados CDH Spark SQL

Fonte de dados StarRocks

Fonte de dados ClickHouse

Fonte de dados SelectDB

Fonte de dados Doris

Fonte de dados AnalyticDB for MySQL 3.0

Fonte de dados AnalyticDB for PostgreSQL

Fonte de dados Tablestore (OTS)

Fonte de dados MySQL

Fonte de dados PostgreSQL

Fonte de dados Oracle

Fonte de dados SQL Server

DataService Studio

O DataService Studio gera APIs a partir de fontes de dados, expondo informações como endpoints de serviço padrão para compartilhamento entre equipes e aplicações.

Para mais informações, consulte Gerar uma API.

Fonte de dados AnalyticDB for MySQL 2.0

Fonte de dados StarRocks

Fonte de dados MaxCompute

Fonte de dados AnalyticDB for MySQL 3.0

Fonte de dados Doris

Fonte de dados HBase

Fonte de dados AnalyticDB for PostgreSQL

Fonte de dados PolarDB

Fonte de dados DB2

Fonte de dados Tablestore Stream

Fonte de dados ApsaraDB for OceanBase

Fonte de dados DM

Fonte de dados MongoDB

Fonte de dados SAP HANA