All Products
Search
Document Center

E-MapReduce:Buat kluster

Last Updated:Jun 26, 2026

Alibaba Cloud E-MapReduce (EMR) memungkinkan Anda membangun dan menjalankan framework open-source untuk data besar seperti Hadoop, Spark, Hive, dan Presto guna pemrosesan dan analisis data skala besar. Topik ini menjelaskan langkah-langkah serta opsi konfigurasi untuk membuat kluster EMR di atas ECS agar Anda dapat dengan cepat menyiapkan dan mengelola kluster data besar Anda.

Catatan

Jika Anda membuat kluster EMR untuk pertama kalinya setelah pukul 17.00 (UTC+8) pada 19 Desember 2022, Anda tidak dapat memilih tipe kluster Hadoop, Data Science, Presto, atau ZooKeeper.

Prasyarat

Anda telah menyelesaikan otorisasi RAM. Untuk informasi selengkapnya, lihat Otorisasi role untuk Akun Alibaba Cloud.

Catatan penggunaan

Untuk kluster DataLake, DataFlow, DataServing, dan Custom pada EMR V5.12.1, EMR V3.46.1, atau versi yang lebih baru, jika layanan yang dipilih tidak memerlukan node Core, Anda dapat mengklik Remove Node Group di kolom Actions pada bagian Node Group.

Langkah-langkah

  1. Login ke Konsol E-MapReduce.

  2. Pada bilah navigasi atas, pilih wilayah dan kelompok sumber daya sesuai kebutuhan Anda.

    • Wilayah: Kluster dibuat di wilayah yang dipilih. Anda tidak dapat mengubah wilayah setelah kluster dibuat.

    • Kelompok Sumber Daya: Secara default, semua resource dalam akun Anda akan ditampilkan.

  3. Klik Create Cluster.

  4. Konfigurasikan kluster berdasarkan petunjuk di layar.

    Saat membuat kluster, Anda harus mengonfigurasi perangkat lunak, perangkat keras, dan pengaturan dasarnya, lalu mengonfirmasi pesanan.

    Catatan

    Setelah kluster dibuat, Anda tidak dapat mengubah pengaturan konfigurasinya, kecuali nama kluster. Tinjau kembali semua pengaturan dengan cermat sebelum membuat kluster.

  5. Setelah memverifikasi bahwa semua pengaturan sudah benar, klik Confirm.

    Penting
    • Kluster pay-as-you-go: Pembuatan dimulai segera. Setelah kluster dibuat, statusnya berubah menjadi Running.

    • Kluster subscription: Pesanan dibuat terlebih dahulu. Kluster akan dibuat setelah Anda menyelesaikan pembayaran.

Parameter

Konfigurasi perangkat lunak

Parameter

Deskripsi

Region

Wilayah adalah area geografis tempat pusat data berada. Memilih wilayah yang lebih dekat dengan lokasi Anda dapat mengurangi latensi jaringan. Anda tidak dapat mengubah wilayah setelah kluster dibuat.

Business Scenario

Pilih skenario berdasarkan kebutuhan bisnis Anda:

  • Data Lake (DataLake): Menyediakan kluster terkelola yang fleksibel, andal, dan efisien untuk menjalankan mesin komputasi data besar dan melakukan analitik data.

    • Mendukung pembangunan arsitektur data lake dan menggunakan JindoFS untuk mempercepat operasi data lake.

    • Mendukung OSS-HDFS (HDFS terkelola penuh) untuk penyimpanan, sehingga mengurangi biaya O&M Anda dengan model penagihan berbasis penggunaan.

    Untuk informasi selengkapnya, lihat Kluster DataLake.

  • Data Analytics (OLAP): Mengimpor dataset dalam jumlah besar ke mesin analitik OLAP, seperti ClickHouse atau StarRocks, menggunakan metode seperti impor data atau tabel eksternal. Solusi ini menyediakan analitik data yang efisien, real-time, dan fleksibel untuk skenario bisnis seperti profil pengguna, segmentasi audiens, pelaporan BI, dan analisis bisnis.

  • Real-time Data Streaming (DataFlow): Solusi komputasi real-time all-in-one di platform EMR. Solusi ini memiliki dua komponen utama: Kafka, sistem perpesanan terdistribusi dengan throughput tinggi dan sangat scalable, serta kernel komersial Flink dari Ververica (berbasis Apache Flink). Solusi ini berfokus pada menangani tantangan komputasi real-time end-to-end dan banyak digunakan untuk ETL data real-time serta pengumpulan dan analisis log. Anda juga dapat menggunakan salah satu komponen secara terpisah.

  • Data Service (DataServing):

    • Menyediakan kluster layanan data yang fleksibel, andal, dan efisien.

    • Menyediakan kluster HBase semi-terkelola dan memisahkan kluster komputasi dari penyimpanan data dengan menggunakan OSS-HDFS (layanan JindoFS).

    • Mendukung caching lokal JindoData untuk lebih meningkatkan kinerja baca-tulis kluster layanan data.

    Untuk informasi selengkapnya, lihat Kluster DataServing.

  • Custom Cluster (Custom): Menyediakan berbagai pilihan layanan. Anda dapat memilih layanan yang dibutuhkan sesuai kebutuhan Anda.

    Catatan

    Dalam lingkungan produksi, kami menyarankan agar Anda tidak men-deploy beberapa layanan penyimpanan pada kelompok node yang sama.

Product Version

Versi rilis produk EMR. Untuk informasi selengkapnya, lihat Versi rilis.

High Service Availability

Fitur ini dinonaktifkan secara default. Saat Anda mengaktifkan ketersediaan tinggi, EMR membuat beberapa node Master untuk mendukung high availability bagi ResourceManager dan NameNode. Node-node tersebut didistribusikan di perangkat keras dasar yang berbeda untuk mengurangi risiko kegagalan.

Optional Services (Select One At Least)

Pilih layanan lain berdasarkan kebutuhan bisnis Anda. Layanan yang dipilih akan secara otomatis menjalankan proses terkaitnya.

Penting
  • Menambahkan lebih banyak layanan akan meningkatkan kebutuhan perangkat keras. Pada langkah berikutnya, pilih spesifikasi instans yang sesuai dengan layanan yang Anda pilih untuk memastikan sumber daya yang cukup.

  • Layanan yang telah diinstal tidak dapat di-uninstall.

  • Parameter yang diperlukan bervariasi tergantung pada versi produk dan layanan yang dipilih.

Collect Service Operational Logs

Pengaturan ini, yang diaktifkan secara default, mengontrol pengumpulan log untuk semua layanan. Log-log tersebut hanya digunakan untuk diagnostik kluster.

Setelah kluster dibuat, Anda dapat membuka halaman Basic Information untuk mengubah Collection Status of Service Operational Logs.

Penting

Jika Anda menonaktifkan pengumpulan log, pemeriksaan kesehatan EMR dan dukungan teknis akan terbatas, tetapi fitur lain tetap berfungsi normal. Untuk detail cara menonaktifkan fitur ini dan dampaknya, lihat Bagaimana cara menghentikan pengumpulan log layanan?.

Metadata

Metode berikut didukung untuk menyimpan dan mengelola metadata:

  • DLF Unified Metadata (Direkomendasikan): Menyimpan metadata di Data Lake Formation (DLF).

    Setelah mengaktifkan DLF, sistem akan memilih DLF Catalog default untuk Anda (biasanya UID Anda). Untuk menggunakan katalog berbeda pada kluster yang berbeda, buat yang baru:

    1. Klik Create Catalog. Pada kotak dialog yang muncul, masukkan ID katalog dan klik OK.

    2. Dari daftar drop-down DLF Catalog, pilih katalog yang telah Anda buat.

  • Self-managed RDS: Menggunakan instance RDS milik Anda sendiri atau Alibaba Cloud sebagai penyimpanan metadata.

    Jika Anda memilih metode ini, Anda harus mengonfigurasi parameter terkait RDS. Untuk informasi selengkapnya, lihat Konfigurasi database RDS yang dikelola sendiri.

  • Built-in MySQL (Tidak Direkomendasikan): Menyimpan metadata di database MySQL pada node Master kluster.

    Catatan
    • Untuk skenario pengujian: Kami merekomendasikan menggunakan DLF Unified Metadata.

    • Untuk skenario produksi: Anda dapat menggunakan DLF Unified Metadata atau Self-managed RDS.

Root Storage Directory of Cluster

Parameter ini hanya diperlukan saat Anda memilih layanan OSS-HDFS. Tidak diperlukan jika Anda memilih layanan HDFS.

Penting

Bucket yang dibuat dengan mengklik tombol Create OSS-HDFS Bucket di konsol EMR hanya mendukung operasi baca dan tulis melalui EMR. Operasi dari konsol atau API tidak didukung.

Saat pertama kali menggunakan layanan OSS-HDFS, Akun Alibaba Cloud Anda (akun utama) harus mengklik here dan mengikuti petunjuk untuk menyelesaikan otorisasi. Jika Anda adalah Pengguna RAM, Akun Alibaba Cloud Anda harus memberi otorisasi kepada Anda untuk mengaktifkan layanan dan memberikan kebijakan AliyunEMRDlsFullAccess serta role AliyunOSSDlsDefaultRole dan AliyunEMRDlsDefaultRole. Untuk informasi selengkapnya, lihat Berikan izin kepada Pengguna RAM. Pilih bucket di wilayah yang sama tempat layanan OSS-HDFS telah diaktifkan, atau klik Create OSS-HDFS Bucket untuk membuat instance OSS-HDFS baru sebagai jalur penyimpanan root untuk kluster.

Catatan
  • Sebelum menggunakan layanan OSS-HDFS, pastikan layanan tersebut tersedia di wilayah yang Anda pilih. Jika tidak, Anda dapat beralih ke wilayah lain atau menggunakan layanan HDFS sebagai gantinya. Untuk informasi tentang wilayah yang mendukung layanan OSS-HDFS, lihat Aktifkan OSS-HDFS dan berikan izin akses.

  • Layanan OSS-HDFS didukung untuk kluster DataLake, DataFlow, DataServing, dan Custom pada EMR V5.12.1, EMR V3.46.1, atau versi yang lebih baru.

Parameter layanan dan versi

Parameter berikut terkait dengan versi produk dan layanan yang dipilih.

  • Parameter berikut hanya diperlukan untuk EMR V5.12.0 dan versi sebelumnya, atau EMR V3.46.0 dan versi sebelumnya, saat layanan Hive dipilih.

    Parameter

    Deskripsi

    Hive Storage Mode

    Menentukan apakah akan menggunakan OSS-HDFS atau OSS sebagai direktori penyimpanan untuk gudang data. Jika Anda tidak memilih opsi ini, HDFS lokal kluster yang akan digunakan.

    Saat ini dipilih secara default, Anda juga harus mengonfigurasi Hive Data Warehouse Path. Kami merekomendasikan agar Anda memilih bucket dengan layanan HDFS yang diaktifkan.

    Catatan

    Pastikan Anda memiliki izin yang diperlukan untuk mengakses bucket OSS atau OSS-HDFS.

  • Parameter berikut hanya diperlukan untuk EMR V5.12.0 dan versi sebelumnya, atau EMR V3.46.0 dan versi sebelumnya, saat layanan HBase dipilih.

    Parameter

    Deskripsi

    HBase Storage Mode

    Menentukan mode penyimpanan untuk file data HBase. Mode berikut didukung: OSS-HDFS dan OSS.

    Jika Anda memilih mode OSS-HDFS, Anda juga harus mengonfigurasi HBase Storage Path. Kami merekomendasikan agar Anda memilih bucket yang telah diaktifkan layanan HDFS-nya.

  • Parameter berikut hanya diperlukan untuk EMR V5.12.1 dan versi yang lebih baru, atau EMR V3.46.1 dan versi yang lebih baru, setelah Anda memilih layanan OSS-HDFS dan HBase. Setelah kluster dibuat, layanan HBase-HDFS akan dihasilkan. Untuk informasi selengkapnya, lihat HBASE-HDFS.

    Parameter

    Deskripsi

    HBase Log Storage

    Ini dipilih secara default, yang berarti HBase menyimpan file HLog di HDFS.

Skema lainnya

Penting

Jika Anda membuat kluster EMR untuk pertama kalinya setelah pukul 17.00 (UTC+8) pada 19 Desember 2022, Anda tidak dapat memilih tipe kluster berikut.

  • Machine Learning (Data Science): Terutama untuk skenario Big Data + AI.

    • Menyediakan framework pembelajaran mendalam terdistribusi.

    • Menyediakan lebih dari 200 paket algoritma pembelajaran mesin klasik.

    • Menyediakan kemampuan AutoML dan lebih dari 10 algoritma pembelajaran mendalam yang mencakup skenario seperti rekomendasi dan periklanan.

  • Old Data Lake: Digunakan untuk membangun framework dan pipeline pemrosesan data skala besar, cocok untuk analitik data besar. Mendukung framework open-source seperti Apache Hive, Spark, dan Presto. Tipe kluster berikut didukung:

    • Hadoop:

      • Menyediakan daftar komponen open-source paling lengkap, sepenuhnya kompatibel dengan ekosistem Hadoop.

      • Dapat digunakan untuk berbagai skenario seperti pemrosesan offline data besar, pemrosesan real-time, dan kueri interaktif.

      • Mendukung pembangunan arsitektur data lake dan menggunakan JindoFS untuk akselerasi data lake.

    • ZooKeeper: Menyediakan layanan koordinasi terdistribusi independen untuk kluster Hadoop, HBase, dan Kafka skala besar.

    • Presto: Mesin SQL terdistribusi berbasis memori untuk kueri interaktif. Mendukung berbagai sumber data dan cocok untuk analisis kompleks data skala petabyte serta kueri lintas sumber data.

Pengaturan lanjutan (opsional)

Parameter

Deskripsi

Kerberos Authentication

Fitur ini dinonaktifkan secara default. Kerberos adalah protokol autentikasi jaringan berbasis kriptografi kunci simetris yang menyediakan autentikasi untuk layanan lain. Untuk informasi selengkapnya, lihat Kerberos.

Penting
  • Knox: Autentikasi Kerberos tidak didukung.

  • Kudu: Bahkan jika Kerberos diaktifkan, layanan Kudu memerlukan konfigurasi tambahan untuk mendukung dan mengaktifkan autentikasi Kerberos. Untuk informasi selengkapnya, lihat dokumentasi Apache Kudu tentang Authentication.

Custom Software Configuration

Anda dapat menentukan file JSON untuk mengonfigurasi perangkat lunak dasar di kluster, seperti Hadoop, Spark, dan Hive. Fitur ini dinonaktifkan secara default. Untuk informasi selengkapnya, lihat Konfigurasi perangkat lunak kustom.

Catatan

Untuk informasi tentang cara mengatur tingkat konkurensi untuk pekerjaan Hive, lihat FAQ.

Konfigurasi perangkat keras

Parameter

Deskripsi

Billing Method

Subscription dipilih secara default. Metode penagihan berikut didukung:

  • Pay-as-you-go: Model pascabayar di mana Anda ditagih per jam berdasarkan penggunaan aktual. Metode ini cocok untuk pengujian jangka pendek atau tugas dinamis yang fleksibel.

  • Subscription: Model prabayar di mana Anda membayar sebelum menggunakan.

    Catatan
    • Kami merekomendasikan menggunakan metode Pay-as-you-go untuk skenario pengujian. Setelah pengujian berhasil, buat kluster Subscription untuk penggunaan produksi.

    • Untuk instans subscription, Anda juga harus memilih Subscription Duration dan memutuskan apakah akan mengaktifkan Auto-renewal. Periode perpanjangan default adalah enam bulan, dengan auto-renewal diaktifkan. Saat auto-renewal diaktifkan, instans akan diperpanjang secara otomatis tujuh hari sebelum masa berlakunya habis. Untuk informasi selengkapnya, lihat Perpanjangan.

Zone

Zona ketersediaan adalah lokasi fisik yang berbeda dalam suatu wilayah, saling terhubung oleh jaringan pribadi berlatensi rendah. Anda biasanya dapat menggunakan zona ketersediaan default.

VPC

VPC adalah lingkungan jaringan yang terisolasi secara logis di Alibaba Cloud yang memberi Anda kontrol penuh atas konfigurasi jaringan Anda.

Pilih VPC yang sudah ada, atau klik Create VPC untuk membuatnya langsung di konsol VPC. Untuk informasi selengkapnya, lihat Buat dan kelola VPC.

Catatan

Anda tidak dapat mengubah Alamat IP pribadi setelah kluster dibuat karena Alamat IP pribadi terikat pada Virtual Private Cloud (VPC).

vSwitch

vSwitch adalah subdivisi jaringan dasar dari VPC yang digunakan untuk menghubungkan berbagai sumber daya cloud.

Pilih vSwitch yang sudah ada, atau klik . Create vSwitch untuk membuatnya langsung di konsol VPC. Untuk informasi selengkapnya, lihat Buat dan kelola vSwitch.

Ukuran blok CIDR vSwitch menentukan jumlah Alamat IPv4 yang tersedia. Misalnya, blok CIDR /24 menyediakan sekitar 250 alamat IP yang tersedia, blok /20 menyediakan sekitar 4.090, dan blok /17 menyediakan sekitar 32.764. Jika kluster Anda memerlukan banyak node, pilih vSwitch dengan blok CIDR yang lebih besar untuk memastikan cukup alamat IP dapat dialokasikan ke semua node kluster.

Anda tidak dapat mengubah blok CIDR vSwitch setelah dibuat. Jika Anda memerlukan rentang alamat IP yang lebih besar, Anda harus membuat vSwitch baru dengan blok CIDR yang lebih besar, lalu membuat kluster baru berdasarkan vSwitch tersebut. Saat membuat vSwitch, konsol akan menampilkan jumlah alamat IP yang tersedia untuk blok CIDR yang dipilih, yang membantu Anda menilai apakah memenuhi kebutuhan ukuran kluster Anda.

Default Security Group

Grup keamanan adalah firewall virtual yang mengontrol lalu lintas arah masuk dan lalu lintas keluar untuk instans dalam grup tersebut. Untuk informasi selengkapnya, lihat Ikhtisar grup keamanan.

Pilih grup keamanan yang sudah ada, atau klik create a new security group. untuk membuatnya di konsol ECS. Untuk informasi selengkapnya, lihat Buat grup keamanan.

Penting

Jangan gunakan grup keamanan enterprise yang dibuat di ECS.

Node Group

Anda dapat memilih tipe instans sesuai kebutuhan Anda. Untuk informasi selengkapnya, lihat Keluarga instans.

  • Master: Menjalankan layanan lapisan kontrol seperti ResourceManager dan NameNode.

  • Core: Menyimpan data di sistem file terdistribusi kluster (HDFS). Anda juga dapat melakukan penskalaan node Core sesuai kebutuhan setelah kluster dibuat.

  • Task: Menyediakan kapasitas komputasi tambahan dan tidak menyimpan data. Kelompok node ini bersifat opsional dan dapat ditambahkan untuk menskalakan sumber daya komputasi.

    Penting

    Kelompok node Task mendukung metode penagihan pay-as-you-go, instans preemptible, dan subscription.

  • Add to Deployment Set: Saat ketersediaan tinggi diaktifkan, node Master secara default ditambahkan ke set penyebaran. Set penyebaran adalah kebijakan yang mengontrol distribusi instans. Untuk informasi selengkapnya, lihat Set penyebaran.

  • System Disk: Pilih SSD standar, SSD yang disempurnakan (ESSD), atau disk ultra sesuai kebutuhan. Sesuaikan ukuran disk sistem sesuai kebutuhan.

  • Data Disk: Pilih SSD standar, SSD yang disempurnakan (ESSD), atau disk ultra sesuai kebutuhan. Sesuaikan ukuran disk data sesuai kebutuhan.

    Catatan

    Saat Anda memilih SSD yang disempurnakan (ESSD), Anda dapat mengatur tingkat kinerja (PL) yang berbeda berdasarkan kapasitas disk untuk memenuhi berbagai kebutuhan kinerja kluster. Tingkat kinerja default adalah PL1. Bergantung pada kapasitas disk, disk sistem mendukung PL0, PL1, dan PL2, sedangkan disk data mendukung PL0, PL1, PL2, dan PL3. Untuk informasi selengkapnya tentang disk cloud, lihat Ikhtisar disk cloud.

  • Instances: Kelompok node Master memiliki satu instans secara default. Jika ketersediaan tinggi diaktifkan, Anda dapat memiliki beberapa instans Master.

    Kelompok node Core memiliki dua instans secara default. Anda dapat menyesuaikan jumlah ini sesuai kebutuhan.

  • Additional Security Group: Grup keamanan tambahan memungkinkan kontrol akses fleksibel antara berbagai sumber daya atau aplikasi eksternal. Anda dapat mengaitkan hingga dua grup keamanan tambahan dengan kelompok node ini.

  • Assign Public Network IP: Menentukan apakah akan menetapkan alamat Elastic IP (EIP) ke kluster. Ini dinonaktifkan secara default. Hanya kluster DataLake yang mendukung penetapan IP publik di tingkat kelompok node.

    Catatan

    Jika Anda tidak mengaktifkan fitur ini tetapi ingin menggunakan alamat IP publik untuk mengakses kluster setelah dibuat, Anda harus mengajukan permohonan di konsol ECS. Untuk informasi selengkapnya, lihat Ajukan EIP.

Cluster Scaling

Anda dapat memilih aturan penskalaan otomatis sesuai kebutuhan:

  • Do Not Use Auto Scaling Rules (Default).

  • Custom Auto Scaling Rule: Anda dapat menentukan aturan kustom untuk penskalaan otomatis berbasis waktu atau beban. Untuk informasi selengkapnya, lihat Buat aturan penskalaan otomatis kustom.

  • Managed Auto Scaling Rule: Saat Anda memulai kluster, EMR melakukan provisioning jumlah node Task berdasarkan aturan penskalaan terkelola. Untuk informasi selengkapnya, lihat Buat aturan penskalaan otomatis terkelola.

Catatan
  • Anda hanya dapat mengonfigurasi aturan penskalaan otomatis saat metode penagihan untuk kelompok node Task adalah pay-as-you-go atau instans preemptible.

  • Jika kluster berisi komponen Trino, Presto, StarRocks, Impala, atau ClickHouse, Anda tidak dapat beralih ke aturan penskalaan otomatis terkelola.

Konfigurasi dasar

Parameter

Deskripsi

Cluster Name

Nama kluster. Nama harus terdiri dari 1 hingga 64 karakter dan hanya boleh berisi karakter Tionghoa, huruf, angka, tanda hubung (-), dan garis bawah (_).

Identity Credentials

Identity Credentials menyediakan akses aman ke node Master kluster. Untuk instruksi login, lihat Login ke kluster. Jenis kredensial berikut didukung:

  • Key Pair (Default): Pilih pasangan kunci yang sudah ada atau klik Create Key Pair untuk membuatnya langsung.

    Pasangan kunci, yang terdiri dari kunci publik dan kunci privat, adalah metode autentikasi yang aman dan praktis untuk login ke instans Linux. Untuk informasi selengkapnya tentang penggunaan pasangan kunci, lihat Pasangan kunci SSH.

  • Password: Tetapkan kata sandi logon untuk node Master dan konfirmasikan. Username default adalah root.

    • Persyaratan kata sandi: Panjang 8 hingga 30 karakter dan harus berisi huruf besar, huruf kecil, angka, dan karakter khusus.

    • Karakter khusus yang didukung meliputi: tanda seru (!), tanda at (@), tanda pagar (#), tanda dolar ($), tanda persen (%), tanda sisipan (^), tanda ampersand (&), dan tanda bintang (*).

Pengaturan lanjutan (opsional)

Parameter

Deskripsi

ECS Application Role

Saat program Anda berjalan di node komputasi EMR, Anda tidak perlu menentukan AccessKey Alibaba Cloud untuk mengakses layanan cloud terkait seperti OSS. EMR secara otomatis memperoleh AccessKey sementara untuk akses tersebut, dan izin kunci ini dikontrol oleh ECS Application Role.

Bootstrap Actions

Skrip yang dijalankan di node kluster sebelum layanan dimulai. Gunakan untuk menginstal perangkat lunak atau menyesuaikan lingkungan. Untuk informasi selengkapnya, lihat Jalankan skrip menggunakan tindakan bootstrap.

Release Protection

Fitur ini mencegah penghapusan tidak sengaja kluster pay-as-you-go. Jika diaktifkan, Anda harus menonaktifkannya sebelum dapat melepas kluster. Untuk informasi selengkapnya, lihat Aktifkan dan nonaktifkan perlindungan pelepasan.

Tags

Anda dapat menambahkan tag saat membuat kluster atau setelah kluster dibuat. Tag membantu Anda mengidentifikasi dan mengelola sumber daya kluster Anda. Untuk informasi selengkapnya, lihat Kelola tag.

Resource Group

Kelompok sumber daya memungkinkan Anda mengelompokkan sumber daya cloud berdasarkan tujuan, izin, atau kepemilikan. Untuk informasi selengkapnya, lihat Gunakan kelompok sumber daya.

Data Disk Encryption

Fitur ini hanya dapat diaktifkan saat Anda membuat kluster. Saat diaktifkan, data yang disimpan di disk data akan dienkripsi. Untuk informasi selengkapnya, lihat Aktifkan enkripsi disk data.

System Disk Encryption

Fitur ini hanya dapat diaktifkan saat Anda membuat kluster. Saat diaktifkan, sistem operasi, file program, dan data lain yang disimpan di disk sistem akan dienkripsi. Untuk informasi selengkapnya, lihat Aktifkan enkripsi disk sistem.

Remarks

Digunakan untuk mencatat informasi penting tentang kluster. Anda dapat menambahkan atau mengubah catatan di halaman Basic Information setelah kluster dibuat.

Konfirmasi pesanan

(Opsional) Save as Cluster Template: Jika Anda memilih Key Pair untuk kredensial logon, Anda dapat mengklik Save as Cluster Template untuk menyimpan konfigurasi kluster saat ini sebagai templat kluster.

  1. Pada kotak dialog Save as Cluster Template, masukkan Cluster Template Name dan pilih Cluster Template Resource Group.

    Parameter

    Deskripsi

    Cluster Template Name

    Masukkan nama untuk templat kluster guna memudahkan pengelolaan. Nama harus terdiri dari 1 hingga 64 karakter dan hanya boleh berisi karakter Tionghoa, huruf, angka, tanda hubung (-), dan garis bawah (_).

    Cluster Template Resource Group

    Pilih kelompok sumber daya yang sudah ada untuk mengatur templat Anda.

    Jika Anda perlu membuat kelompok sumber daya baru, Anda dapat mengklik Create Resource Group. di bawah ini. Untuk informasi selengkapnya, lihat Buat kelompok sumber daya.

  2. Klik OK.

    Templat kluster baru ditambahkan ke panel Manage Cluster Templates. Untuk informasi selengkapnya tentang templat kluster, lihat Buat templat kluster.

FAQ

Error EntityNotExist.Role

  • Penyebab: Akun saat ini tidak memiliki izin yang diperlukan untuk membuat kluster.

  • Solusi:

    Pilih solusi yang sesuai berdasarkan apakah Anda menggunakan Akun Alibaba Cloud atau Pengguna RAM.

    • Akun Alibaba Cloud: Saat membuat kluster, akun Anda harus memiliki izin untuk mengakses sumber daya Alibaba Cloud lain dan melakukan operasi terkait. Anda dapat mengklik RAM Quick Authorization untuk memberi otorisasi pada akun Anda. Setelah otorisasi berhasil, Anda dapat membuat kluster. Untuk informasi selengkapnya tentang otorisasi role, lihat Otorisasi role untuk Akun Alibaba Cloud.

    • Pengguna RAM: Akun Anda tidak memiliki izin untuk membuat kluster EMR. Kami menyarankan agar Anda menggunakan Akun Alibaba Cloud untuk memberikan kebijakan AliyunEMRFullAccess kepada Pengguna RAM. Untuk informasi selengkapnya, lihat Berikan izin kepada Pengguna RAM.

Dokumentasi terkait