All Products
Search
Document Center

Tablestore:Ekspor data lengkap ke OSS

Last Updated:Sep 09, 2026

Metode ini menyediakan cara hemat biaya untuk mencadangkan data atau mengekspornya sebagai file. File yang diekspor kemudian dapat diunduh ke mesin lokal Anda.

Prasyarat

Sebelum memulai, lakukan persiapan berikut:

Catatan

Jika ruang kerja DataWorks dan instans Tablestore Anda berada di wilayah yang berbeda, Anda harus membuat koneksi peering VPC untuk mengaktifkan konektivitas jaringan lintas wilayah.

Membuat koneksi peering VPC untuk konektivitas jaringan lintas wilayah

Contoh berikut menunjukkan cara mengonfigurasi koneksi ketika instans tabel sumber berada di wilayah China (Shanghai) dan ruang kerja DataWorks berada di wilayah China (Hangzhou).

  1. Bind VPC ke instans Tablestore.

    1. Login ke Konsol Tablestore. Di bilah navigasi atas, pilih wilayah tempat tabel target berada.

    2. Klik alias instans untuk membuka halaman Instance Management.

    3. Di tab Network Management, klik Bind VPC, pilih VPC dan vSwitch, masukkan nama untuk VPC tersebut, lalu klik OK.

    4. Tunggu hingga VPC ter-bind. Halaman akan otomatis merefresh dan menampilkan VPC ID dan VPC Address yang telah ter-bind dalam daftar VPC.

      Catatan

      Saat menambahkan sumber data Tablestore di Konsol DataWorks, Anda harus menggunakan alamat VPC ini.

  2. Dapatkan informasi VPC dari kelompok sumber daya untuk ruang kerja DataWorks.

    1. Login ke Konsol DataWorks. Di bilah navigasi atas, pilih wilayah tempat ruang kerja Anda berada. Di panel navigasi kiri, klik Workspaces untuk membuka halaman Workspace list.

    2. Klik nama ruang kerja untuk membuka halaman Detail Ruang Kerja. Di panel navigasi kiri, klik Resource Group untuk melihat daftar kelompok sumber daya yang ter-bind ke ruang kerja.

    3. Pada baris kelompok sumber daya target, klik Network Settings. Di bagian Resource Scheduling & Data Integration, lihat VPC ID dari VPC yang ter-bind.

  3. Buat koneksi peering VPC dan konfigurasikan entri rute.

    1. Login ke Konsol VPC. Di panel navigasi kiri, klik VPC Peering Connection, lalu klik Create VPC Peering Connection.

    2. Di halaman Create VPC Peering Connection, masukkan nama untuk koneksi peering, pilih instans VPC peminta, tipe akun penerima, wilayah penerima, dan instans VPC penerima, lalu klik OK.

    3. Di halaman VPC Peering Connection, temukan koneksi peering VPC yang telah Anda buat dan klik Configure route di kolom Requester VPC dan Accepter.

      Blok CIDR tujuan harus merupakan blok CIDR dari VPC peer. Saat mengonfigurasi entri rute untuk VPC peminta, masukkan blok CIDR penerima. Saat mengonfigurasi entri rute untuk penerima, masukkan blok CIDR peminta.

Prosedur

Ikuti langkah-langkah berikut untuk mengonfigurasi dan menjalankan tugas ekspor data.

Langkah 1: Tambahkan Tablestore sebagai sumber data

Konfigurasikan sumber data Tablestore di DataWorks untuk menghubungkan ke data sumber Anda.

  1. Login ke Konsol DataWorks. Ganti ke wilayah target. Di panel navigasi kiri, pilih Data integration > Data integration. Di daftar drop-down, pilih ruang kerja yang diinginkan dan klik Go to Data Integration.

  2. Di panel navigasi kiri, klik Data Source.

  3. Di halaman Data Sources, klik Add Data Source.

  4. Di dialog Add Data Source, cari dan pilih Tablestore sebagai tipe sumber data.

  5. Di dialog Add OTS Data Source, konfigurasikan parameter sumber data seperti dijelaskan dalam tabel berikut.

    Parameter

    Deskripsi

    Data source name

    Nama sumber data. Nama dapat berisi huruf, angka, dan garis bawah (_), tetapi tidak boleh dimulai dengan angka atau garis bawah (_).

    Data source description

    Deskripsi singkat sumber data. Panjang deskripsi maksimal 80 karakter.

    Region

    Pilih wilayah tempat instans Tablestore berada.

    Tablestore Instance Name

    Nama instans Tablestore.

    Endpoint

    Titik akhir instans Tablestore. Disarankan untuk menggunakan VPC Address.

    AccessKey ID

    ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM Anda.

    AccessKey Secret

  6. Uji konektivitas kelompok sumber daya.

    Anda harus menguji konektivitas kelompok sumber daya ke sumber data. Tugas sinkronisasi tidak dapat dijalankan jika kelompok sumber daya tidak dapat terhubung ke sumber data.

    1. Di bagian Connection Configuration, klik Test Network Connectivity di kolom Connection Status untuk kelompok sumber daya.

    2. Setelah uji konektivitas berhasil, Connection Status berubah menjadi Connected. Klik Complete. Anda dapat melihat sumber data baru di daftar sumber data.

      Jika hasil uji konektivitas adalah Failed, Anda dapat menggunakan Network Connectivity Diagnostic Tool untuk menyelesaikan masalah tersebut sendiri.

Langkah 2: Tambahkan sumber data OSS

Konfigurasikan sumber data OSS sebagai tujuan ekspor data.

  1. Klik Add Data Source lagi. Di dialog tersebut, cari dan pilih OSS sebagai tipe sumber data, lalu konfigurasikan parameter-parameter berikut.

    Parameter

    Deskripsi

    Data source name

    Nama hanya boleh berisi huruf, angka, dan garis bawah (_), dan tidak boleh dimulai dengan angka atau garis bawah.

    Data source description

    Masukkan deskripsi singkat sumber data, maksimal 80 karakter.

    Access Mode

    • RAM Role Authorization Mode: Akun layanan DataWorks mengakses sumber data dengan mengasumsikan peran RAM. Jika ini pertama kalinya Anda memilih mode ini, ikuti petunjuk di layar untuk memberikan izin yang diperlukan.

    • Access Key Mode: Akses sumber data dengan menggunakan ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM.

    Select Role

    Anda hanya perlu memilih peran RAM ketika Access Mode diatur ke RAM Role Authorization Mode.

    AccessKey ID

    ID AccessKey dan Rahasia AccessKey dari Akun Alibaba Cloud atau Pengguna RAM hanya diperlukan ketika Access Mode diatur ke AccessKey Mode.

    AccessKey secret

    Region

    Wilayah tempat bucket berada.

    Endpoint

    Untuk nama domain akses OSS, lihat Regions and Endpoints.

    Bucket

    Nama bucket.

  2. Setelah Anda mengonfigurasi parameter dan uji konektivitas berhasil, klik Complete.

Langkah 3: Konfigurasikan tugas sinkronisasi batch

Buat dan konfigurasikan tugas sinkronisasi batch untuk menentukan transfer data dari Tablestore ke OSS.

Buat node tugas

  1. Buka halaman Data Development.

    1. Login ke Konsol DataWorks.

    2. Di bilah navigasi atas, pilih kelompok sumber daya dan wilayah.

    3. Di panel navigasi kiri, klik Data Development and O&M > Data Development.

    4. Pilih ruang kerja yang sesuai dan klik Go To Data Studio.

  2. Di Konsol Data Studio, di halaman Data Development, klik ikon image di sebelah kanan Workspace Directory dan pilih New Node > Data integration > Batch Synchronization.

  3. Di dialog New Node, pilih Path. Atur sumber data ke Tablestore dan tujuan data ke OSS. Masukkan Name lalu klik Confirm.

Konfigurasikan tugas sinkronisasi

Di bawah Workspace Directory, klik node tugas sinkronisasi batch baru untuk membukanya. Konfigurasikan tugas sinkronisasi menggunakan Antarmuka tanpa kode atau editor kode.

Antarmuka tanpa kode

Konfigurasikan item-item berikut:

  • Data source: Pilih sumber dan tujuan sumber data.

  • Runtime Resource: Pilih kelompok sumber daya. Sistem kemudian secara otomatis menguji konektivitas sumber data.

  • Data Source:

    • Table: Pilih tabel data sumber dari daftar drop-down.

    • Primary Key Range (Start): Awal rentang kunci primer yang akan dibaca, ditentukan sebagai array JSON. Nilai inf_min merepresentasikan negatif tak hingga.

      Jika kunci primer terdiri dari kolom kunci primer int bernama id dan kolom kunci primer string bernama name, lihat contoh konfigurasi berikut:

      Rentang kunci primer

      Data lengkap

      [
        {
          "type": "int",
          "value": "000"
        },
        {
          "type": "string",
          "value": "aaa"
        }
      ]
      [
        {
          "type": "inf_min"
        },
        {
          "type": "inf_min"
        }
      ]
    • Primary Key Range (End): Akhir rentang kunci primer yang akan dibaca, ditentukan sebagai array JSON. Nilai inf_max merepresentasikan positif tak hingga.

      Jika kunci primer terdiri dari kolom kunci primer int bernama id dan kolom kunci primer string bernama name, lihat contoh konfigurasi berikut:

      Rentang kunci primer

      Data lengkap

      [
        {
          "type": "int",
          "value": "999"
        },
        {
          "type": "string",
          "value": "zzz"
        }
      ]
      [
        {
          "type": "inf_max"
        },
        {
          "type": "inf_max"
        }
      ]
    • Splitting Configuration: Parameter ini biasanya tidak diperlukan. Atur ke [].

      Jika hotspot pada data Tablestore Anda membuat kebijakan pemisahan otomatis tidak efektif, gunakan aturan pemisahan kustom. Aturan ini mendefinisikan titik pemisahan dalam rentang kunci primer. Anda hanya perlu mengonfigurasi kunci pemisah, bukan setiap kolom kunci primer.

  • Destination: Pilih Text Type target dan konfigurasikan parameter terkait.

    • Text Type: Opsi termasuk csv, text, orc, dan parquet.

    • Object Name (Path Included): Jalur dan nama file tujuan di bucket OSS. Contoh: tablestore/resource_table.csv.

    • Column Delimiter: Default-nya adalah ,. Jika delimiter adalah karakter non-printable, masukkan encoding Unicode-nya, seperti \u001b atau \u007c.

    • Object Path: Hanya diperlukan untuk tipe teks parquet. Menentukan jalur file dalam bucket OSS.

    • File Name: Hanya diperlukan untuk tipe teks parquet. Menentukan nama file dalam bucket OSS.

  • Destination Field Mapping: Memetakan bidang dari tabel sumber ke file tujuan. Setiap baris, yang ditentukan dalam format JSON, merepresentasikan satu bidang.

    • Source Field: Termasuk bidang kunci primer dan kolom atribut dari tabel sumber.

      Jika kunci primer terdiri dari kolom kunci primer int bernama id dan kolom kunci primer string bernama name, serta terdapat kolom atribut int bernama age, lihat contoh berikut:

      {"name":"id","type":"int"}
      {"name":"name","type":"string"}
      {"name":"age","type":"int"}
    • Target Field: Termasuk bidang kunci primer dan kolom atribut dari tabel sumber.

      Jika kunci primer terdiri dari kolom kunci primer int bernama id dan kolom kunci primer string bernama name, serta terdapat kolom atribut int bernama age, lihat contoh berikut:

      {"name":"id","type":"int"}
      {"name":"name","type":"string"}
      {"name":"age","type":"int"}

Setelah menyelesaikan konfigurasi, klik Save di bagian atas halaman.

Mode skrip

Di bagian atas halaman, klik Code Editor untuk beralih ke tampilan pengeditan skrip.

Skrip contoh berikut digunakan untuk mengekspor ke file CSV. Kunci primer tabel sumber terdiri dari kolom int bernama id dan kolom string bernama name. Tabel ini juga mencakup kolom atribut int bernama age. Saat menggunakan skrip ini, ganti nilai datasource, table, dan object dengan nilai Anda sendiri.
{
    "type": "job",
    "version": "2.0",
    "steps": [
        {
            "stepType": "ots",
            "parameter": {
                "datasource": "source_data",
                "column": [
                    {
                        "name": "id",
                        "type": "int"
                    },
                    {
                        "name": "name",
                        "type": "string"
                    },
                    {
                        "name": "age",
                        "type": "int"
                    }
                ],
                "range": {
                    "begin": [
                        {
                            "type": "inf_min"
                        },
                        {
                            "type": "inf_min"
                        }
                    ],
                    "end": [
                        {
                            "type": "inf_max"
                        },
                        {
                            "type": "inf_max"
                        }
                    ],
                    "split": []
                },
                "table": "source_table",
                "newVersion": "true"
            },
            "name": "Reader",
            "category": "reader"
        },
        {
            "stepType": "oss",
            "parameter": {
                "dateFormat": "yyyy-MM-dd HH:mm:ss",
                "datasource": "target_data",
                "writeSingleObject": false,
                "column": [
                    {
                        "name": "id",
                        "type": "int"
                    },
                    {
                        "name": "name",
                        "type": "string"
                    },
                    {
                        "name": "age",
                        "type": "int"
                    }
                ],
                "writeMode": "truncate",
                "encoding": "UTF-8",
                "fieldDelimiter": ",",
                "fileFormat": "csv",
                "object": "tablestore/source_table.csv"
            },
            "name": "Writer",
            "category": "writer"
        }
    ],
    "setting": {
        "errorLimit": {
            "record": "0"
        },
        "speed": {
            "concurrent": 2,
            "throttle": false
        }
    },
    "order": {
        "hops": [
            {
                "from": "Reader",
                "to": "Writer"
            }
        ]
    }
}

Setelah selesai mengedit skrip, klik Save di bagian atas halaman.

Jalankan tugas sinkronisasi

Klik Run di bagian atas halaman untuk memulai tugas sinkronisasi. Saat menjalankan tugas untuk pertama kali, Anda harus mengonfirmasi Debug Configuration.

Langkah 4: Lihat hasil sinkronisasi

Setelah tugas selesai, Anda dapat memeriksa status eksekusinya di log dan melihat file hasil di bucket OSS Anda.

  1. Lihat status eksekusi dan hasil tugas di bagian bawah halaman. Informasi log berikut menunjukkan bahwa tugas sinkronisasi berhasil.

    2025-11-18 11:16:23 INFO Shell run successfully!
    2025-11-18 11:16:23 INFO Current task status: FINISH
    2025-11-18 11:16:23 INFO Cost time is: 77.208s
  2. Lihat file di bucket tujuan.

    Buka Daftar Bucket, klik bucket tujuan, lalu lihat atau unduh file hasilnya.

FAQ

Topik terkait