Metode ini menyediakan cara hemat biaya untuk mencadangkan data atau mengekspornya sebagai file. File yang diekspor kemudian dapat diunduh ke mesin lokal Anda.
Prasyarat
Sebelum memulai, lakukan persiapan berikut:
Dapatkan informasi tentang tabel Tablestore sumber, termasuk nama instans, titik akhir instans, dan ID wilayah.
Buat AccessKey untuk Akun Alibaba Cloud atau Pengguna RAM yang memiliki izin pada Tablestore dan OSS.
Aktifkan DataWorks dan buat ruang kerja di wilayah yang sama dengan bucket OSS atau instans Tablestore Anda.
Buat kelompok sumber daya Serverless dan bind ke ruang kerja. Untuk detail penagihan, lihat penagihan kelompok sumber daya Serverless.
Jika ruang kerja DataWorks dan instans Tablestore Anda berada di wilayah yang berbeda, Anda harus membuat koneksi peering VPC untuk mengaktifkan konektivitas jaringan lintas wilayah.
Prosedur
Ikuti langkah-langkah berikut untuk mengonfigurasi dan menjalankan tugas ekspor data.
Langkah 1: Tambahkan Tablestore sebagai sumber data
Konfigurasikan sumber data Tablestore di DataWorks untuk menghubungkan ke data sumber Anda.
Login ke Konsol DataWorks. Ganti ke wilayah target. Di panel navigasi kiri, pilih . Di daftar drop-down, pilih ruang kerja yang diinginkan dan klik Go to Data Integration.
Di panel navigasi kiri, klik Data Source.
Di halaman Data Sources, klik Add Data Source.
Di dialog Add Data Source, cari dan pilih Tablestore sebagai tipe sumber data.
Di dialog Add OTS Data Source, konfigurasikan parameter sumber data seperti dijelaskan dalam tabel berikut.
Parameter
Deskripsi
Data source name
Nama sumber data. Nama dapat berisi huruf, angka, dan garis bawah (_), tetapi tidak boleh dimulai dengan angka atau garis bawah (_).
Data source description
Deskripsi singkat sumber data. Panjang deskripsi maksimal 80 karakter.
Region
Pilih wilayah tempat instans Tablestore berada.
Tablestore Instance Name
Nama instans Tablestore.
Endpoint
Titik akhir instans Tablestore. Disarankan untuk menggunakan VPC Address.
AccessKey ID
ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM Anda.
AccessKey Secret
Uji konektivitas kelompok sumber daya.
Anda harus menguji konektivitas kelompok sumber daya ke sumber data. Tugas sinkronisasi tidak dapat dijalankan jika kelompok sumber daya tidak dapat terhubung ke sumber data.
Di bagian Connection Configuration, klik Test Network Connectivity di kolom Connection Status untuk kelompok sumber daya.
Setelah uji konektivitas berhasil, Connection Status berubah menjadi Connected. Klik Complete. Anda dapat melihat sumber data baru di daftar sumber data.
Jika hasil uji konektivitas adalah Failed, Anda dapat menggunakan Network Connectivity Diagnostic Tool untuk menyelesaikan masalah tersebut sendiri.
Langkah 2: Tambahkan sumber data OSS
Konfigurasikan sumber data OSS sebagai tujuan ekspor data.
Klik Add Data Source lagi. Di dialog tersebut, cari dan pilih OSS sebagai tipe sumber data, lalu konfigurasikan parameter-parameter berikut.
Parameter
Deskripsi
Data source name
Nama hanya boleh berisi huruf, angka, dan garis bawah (_), dan tidak boleh dimulai dengan angka atau garis bawah.
Data source description
Masukkan deskripsi singkat sumber data, maksimal 80 karakter.
Access Mode
RAM Role Authorization Mode: Akun layanan DataWorks mengakses sumber data dengan mengasumsikan peran RAM. Jika ini pertama kalinya Anda memilih mode ini, ikuti petunjuk di layar untuk memberikan izin yang diperlukan.
Access Key Mode: Akses sumber data dengan menggunakan ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM.
Select Role
Anda hanya perlu memilih peran RAM ketika Access Mode diatur ke RAM Role Authorization Mode.
AccessKey ID
ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM hanya diperlukan ketika Access Mode diatur ke AccessKey Mode.
AccessKey secret
Region
Wilayah tempat bucket berada.
Endpoint
Untuk nama domain akses OSS, lihat Regions and Endpoints.
Bucket
Nama bucket.
Setelah Anda mengonfigurasi parameter dan uji konektivitas berhasil, klik Complete.
Langkah 3: Konfigurasikan tugas sinkronisasi batch
Buat dan konfigurasikan tugas sinkronisasi batch untuk menentukan transfer data dari Tablestore ke OSS.
Buat node tugas
Buka halaman Data Development.
Login ke Konsol DataWorks.
Di bilah navigasi atas, pilih kelompok sumber daya dan wilayah.
Di panel navigasi kiri, klik Data Development and O&M > Data Development.
Pilih ruang kerja yang sesuai dan klik Go To Data Studio.
Di Konsol Data Studio, di halaman Data Development, klik ikon
di sebelah kanan Workspace Directory dan pilih New Node > Data integration > Batch Synchronization.Di dialog New Node, pilih Path. Atur sumber data ke Tablestore dan tujuan data ke OSS. Masukkan Name lalu klik Confirm.
Konfigurasikan tugas sinkronisasi
Di bawah Workspace Directory, klik node tugas sinkronisasi batch baru untuk membukanya. Konfigurasikan tugas sinkronisasi menggunakan Antarmuka tanpa kode atau editor kode.
Antarmuka tanpa kode
Konfigurasikan item-item berikut:
Data source: Pilih sumber dan tujuan sumber data.
Runtime Resource: Pilih kelompok sumber daya. Sistem kemudian secara otomatis menguji konektivitas sumber data.
Data Source:
Table: Pilih tabel data sumber dari daftar drop-down.
Primary Key Range (Start): Awal rentang kunci primer yang akan dibaca, ditentukan sebagai array JSON. Nilai
inf_minmerepresentasikan negatif tak hingga.Jika kunci primer terdiri dari kolom kunci primer
intbernamaiddan kolom kunci primerstringbernamaname, lihat contoh konfigurasi berikut:Rentang kunci primer
Data lengkap
[ { "type": "int", "value": "000" }, { "type": "string", "value": "aaa" } ][ { "type": "inf_min" }, { "type": "inf_min" } ]Primary Key Range (End): Akhir rentang kunci primer yang akan dibaca, ditentukan sebagai array JSON. Nilai
inf_maxmerepresentasikan positif tak hingga.Jika kunci primer terdiri dari kolom kunci primer
intbernamaiddan kolom kunci primerstringbernamaname, lihat contoh konfigurasi berikut:Rentang kunci primer
Data lengkap
[ { "type": "int", "value": "999" }, { "type": "string", "value": "zzz" } ][ { "type": "inf_max" }, { "type": "inf_max" } ]Splitting Configuration: Parameter ini biasanya tidak diperlukan. Atur ke
[].Jika hotspot pada data Tablestore Anda membuat kebijakan pemisahan otomatis tidak efektif, gunakan aturan pemisahan kustom. Aturan ini mendefinisikan titik pemisahan dalam rentang kunci primer. Anda hanya perlu mengonfigurasi kunci pemisah, bukan setiap kolom kunci primer.
Destination: Pilih Text Type target dan konfigurasikan parameter terkait.
Text Type: Opsi termasuk csv, text, orc, dan parquet.
Object Name (Path Included): Jalur dan nama file tujuan di bucket OSS. Contoh:
tablestore/resource_table.csv.Column Delimiter: Default-nya adalah
,. Jika delimiter adalah karakter non-printable, masukkan encoding Unicode-nya, seperti\u001batau\u007c.Object Path: Hanya diperlukan untuk tipe teks parquet. Menentukan jalur file dalam bucket OSS.
File Name: Hanya diperlukan untuk tipe teks parquet. Menentukan nama file dalam bucket OSS.
Destination Field Mapping: Memetakan bidang dari tabel sumber ke file tujuan. Setiap baris, yang ditentukan dalam format JSON, merepresentasikan satu bidang.
Source Field: Termasuk bidang kunci primer dan kolom atribut dari tabel sumber.
Jika kunci primer terdiri dari kolom kunci primer
intbernamaiddan kolom kunci primerstringbernamaname, serta terdapat kolom atributintbernamaage, lihat contoh berikut:{"name":"id","type":"int"} {"name":"name","type":"string"} {"name":"age","type":"int"}Target Field: Termasuk bidang kunci primer dan kolom atribut dari tabel sumber.
Jika kunci primer terdiri dari kolom kunci primer
intbernamaiddan kolom kunci primerstringbernamaname, serta terdapat kolom atributintbernamaage, lihat contoh berikut:{"name":"id","type":"int"} {"name":"name","type":"string"} {"name":"age","type":"int"}
Setelah menyelesaikan konfigurasi, klik Save di bagian atas halaman.
Mode skrip
Di bagian atas halaman, klik Code Editor untuk beralih ke tampilan pengeditan skrip.
Skrip contoh berikut digunakan untuk mengekspor ke file CSV. Kunci primer tabel sumber terdiri dari kolomintbernamaiddan kolomstringbernamaname. Tabel ini juga mencakup kolom atributintbernamaage. Saat menggunakan skrip ini, ganti nilaidatasource,table, danobjectdengan nilai Anda sendiri.
{
"type": "job",
"version": "2.0",
"steps": [
{
"stepType": "ots",
"parameter": {
"datasource": "source_data",
"column": [
{
"name": "id",
"type": "int"
},
{
"name": "name",
"type": "string"
},
{
"name": "age",
"type": "int"
}
],
"range": {
"begin": [
{
"type": "inf_min"
},
{
"type": "inf_min"
}
],
"end": [
{
"type": "inf_max"
},
{
"type": "inf_max"
}
],
"split": []
},
"table": "source_table",
"newVersion": "true"
},
"name": "Reader",
"category": "reader"
},
{
"stepType": "oss",
"parameter": {
"dateFormat": "yyyy-MM-dd HH:mm:ss",
"datasource": "target_data",
"writeSingleObject": false,
"column": [
{
"name": "id",
"type": "int"
},
{
"name": "name",
"type": "string"
},
{
"name": "age",
"type": "int"
}
],
"writeMode": "truncate",
"encoding": "UTF-8",
"fieldDelimiter": ",",
"fileFormat": "csv",
"object": "tablestore/source_table.csv"
},
"name": "Writer",
"category": "writer"
}
],
"setting": {
"errorLimit": {
"record": "0"
},
"speed": {
"concurrent": 2,
"throttle": false
}
},
"order": {
"hops": [
{
"from": "Reader",
"to": "Writer"
}
]
}
}Setelah selesai mengedit skrip, klik Save di bagian atas halaman.
Jalankan tugas sinkronisasi
Klik Run di bagian atas halaman untuk memulai tugas sinkronisasi. Saat menjalankan tugas untuk pertama kali, Anda harus mengonfirmasi Debug Configuration.
Langkah 4: Lihat hasil sinkronisasi
Setelah tugas selesai, Anda dapat memeriksa status eksekusinya di log dan melihat file hasil di bucket OSS Anda.
Lihat status eksekusi dan hasil tugas di bagian bawah halaman. Informasi log berikut menunjukkan bahwa tugas sinkronisasi berhasil.
2025-11-18 11:16:23 INFO Shell run successfully! 2025-11-18 11:16:23 INFO Current task status: FINISH 2025-11-18 11:16:23 INFO Cost time is: 77.208sLihat file di bucket tujuan.
Buka Daftar Bucket, klik bucket tujuan, lalu lihat atau unduh file hasilnya.