Grafik sebaran adalah komponen untuk memvisualisasikan distribusi data. Grafik ini umumnya digunakan dalam analisis regresi guna menampilkan distribusi titik data pada bidang Kartesius. Dengan memetakan koordinat setiap titik data, grafik sebaran membantu mengidentifikasi korelasi, tren, dan outlier antar variabel.
Konfigurasikan komponen
Metode 1: Gunakan GUI
Pada halaman alur kerja Designer, tambahkan komponen Scatter Chart, lalu konfigurasikan parameternya di panel sebelah kanan.
|
Parameter |
Deskripsi |
|
Feature columns |
Pilih kolom yang merepresentasikan fitur dari data pelatihan. |
|
Classification label column |
Bidang label. |
|
Number of samples |
Jumlah sampel yang akan diambil. |
Metode 2: Gunakan perintah PAI
Konfigurasikan parameter komponen Scatter Chart menggunakan perintah PAI. Anda dapat memanggil perintah PAI dari komponen SQL Script. Untuk informasi lebih lanjut, lihat SQL Script.
PAI -name scatter_diagram -project algo_public
-DselectedCols=emp_var_rate,cons_price_rate,cons_conf_idx,euribor3m
-DlabelCol=y
-DmapTable=pai_temp_2447_22859_2
-DinputTable=scatter_diagram
-DoutputTable=pai_temp_2447_22859_1;
|
Parameter |
Wajib |
Nilai default |
Deskripsi |
|
inputTable |
Yes |
None |
Nama tabel input. |
|
inputTablePartitions |
No |
None |
Partisi dalam tabel input yang akan digunakan untuk pelatihan. Format berikut didukung:
Catatan
Jika Anda menentukan beberapa partisi, pisahkan dengan koma (,). |
|
outputTable |
Yes |
None |
Nama tabel output. |
|
mapTable |
Yes |
None |
Tabel informasi output. Tabel ini menyimpan nilai minimum, maksimum, dan nilai enumerasi untuk setiap fitur. |
|
selectedCols |
Yes |
None |
Pilih kolom yang akan digunakan untuk membuat grafik sebaran antar pasangan fitur. Anda dapat memilih maksimal lima fitur. |
|
labelCol |
Yes |
Empty |
Gunakan bidang bertipe INT atau STRING sebagai kolom label enumerasi. |
|
lifecycle |
Yes |
28 |
Siklus hidup tabel output, dalam satuan hari. |
Contoh
-
Data input
create table scatter_diagram as select emp_var_rate,cons_price_rate, cons_conf_idx,euribor3m,y from pai_bank_data limit 10emp_var_rate
cons_price_rate
cons_conf_idx
euribor3m
y
1.4
93.918
-42.7
4.962
0
-0.1
93.2
-42.0
4.021
0
-1.7
94.055
-39.8
0.729
1
-1.8
93.075
-47.1
1.405
0
-2.9
92.201
31.4
0.869
1
1.4
93.918
-42.7
4.961
0
-1.8
92.893
-46.2
1.327
0
-1.8
92.893
92.893
1.313
0
-2.9
92.963
-40.8
1.266
1
-1.8
93.075
-47.1
1.41
0
1.1
93.994
-36.4
4.864
0
1.4
93.444
-36.1
4.964
0
1.4
93.444
-36.1
4.965
1
-1.8
92.893
-46.2
1.291
0
1.4
94.465
-41.8
4.96
0
1.4
93.918
-42.7
4.962
0
-1.8
93.075
-47.1
1.365
1
-0.1
93.798
-40.4
4.86
1
1.1
93.994
-36.4
4.86
0
1.4
93.918
-42.7
4.96
0
-1.8
93.075
-47.1
1.405
0
1.4
94.465
-41.8
4.967
0
1.4
93.918
-42.7
4.963
0
1.4
93.918
-42.7
4.968
0
1.4
93.918
-42.7
4.962
0
-1.8
92.893
-46.2
1.344
0
-3.4
92.431
-26.9
0.754
0
-1.8
93.075
-47.1
1.365
0
-1.8
92.893
-46.2
1.313
0
1.4
93.918
-42.7
4.961
0
1.4
94.465
-41.8
4.961
0
-1.8
92.893
-46.2
1.327
0
-1.8
92.893
-46.2
1.299
0
-2.9
92.963
-40.8
1.268
1
1.4
93.918
-42.7
4.963
0
-1.8
92.893
-46.2
1.334
0
1.4
93.918
-42.7
4.96
0
-1.8
93.075
-47.1
1.405
0
1.4
94.465
-41.8
4.96
0
1.4
93.444
-36.1
4.962
0
1.1
93.994
-36.4
4.86
0
1.1
93.994
-36.4
4.857
0
1.4
93.918
-42.7
4.961
0
-3.4
92.649
-30.1
0.715
1
1.4
93.444
-36.1
4.966
0
-0.1
93.2
-42.0
4.076
0
1.4
93.444
-36.1
4.965
0
-1.8
92.893
-46.2
1.354
0
1.4
93.444
-36.1
4.967
0
1.4
94.465
-41.8
4.959
0
-1.8
92.893
-46.2
1.354
0
1.4
94.465
-41.8
4.958
0
-1.8
92.893
-46.2
1.354
0
1.4
94.465
-41.8
4.864
0
1.1
93.994
-36.4
4.859
0
1.1
93.994
-36.4
4.857
0
-1.8
92.893
-46.2
1.27
0
1.1
93.994
-36.4
4.857
0
1.1
93.994
-36.4
4.859
0
1.4
94.465
-41.8
4.959
0
1.1
93.994
-36.4
4.856
0
-1.8
93.075
-47.1
1.405
0
-1.8
92.843
-50.0
1.811
1
-0.1
93.2
-42.0
4.021
0
-2.9
92.469
-33.6
1.029
0
1.4
93.918
-42.7
4.962
0
-1.8
93.075
-47.1
1.365
0
1.1
93.994
-36.4
4.857
0
-1.8
92.893
-46.2
1.259
0
1.1
93.994
-36.4
4.857
0
1.4
94.465
-41.8
4.866
0
-2.9
92.201
-31.4
0.883
0
-0.1
93.2
-42.0
4.076
0
1.1
93.994
-36.4
4.857
0
1.4
93.918
-42.7
4.96
0
1.4
93.444
-36.1
4.962
0
1.1
93.994
-36.4
4.858
0
1.1
93.994
-36.4
4.857
0
1.1
93.994
-36.4
4.856
0
1.4
93.918
-42.7
4.968
0
1.4
93.444
-36.1
4.966
0
1.4
94.465
-41.8
4.962
0
1.4
93.444
-36.1
4.963
0
-1.8
92.843
-50.0
1.56
1
1.4
93.918
-42.7
4.96
0
1.4
93.444
-36.1
4.963
0
-3.4
92.431
-26.9
0.74
0
1.1
93.994
-36.4
4.856
0
1.4
93.918
-42.7
4.962
0
1.1
93.994
-36.4
4.856
0
-0.1
93.2
-42.0
4.245
1
1.1
93.994
-36.4
4.857
0
-1.8
93.075
-47.1
1.405
0
-1.8
92.893
-46.2
1.327
0
-0.1
93.2
-42.0
4.12
0
1.4
94.465
-41.8
4.958
0
-1.8
93.749
-34.6
0.659
1
1.1
93.994
-36.4
4.858
0
1.1
93.994
-36.4
4.858
0
1.4
93.444
-36.1
4.963
0
-
Pengaturan parameter
Tetapkan kolom label ke y. Pilih emp_var_rate, cons_price_rate, cons_conf_idx, dan euribor3m sebagai kolom fitur.
-
Hasil
Grafik menunjukkan distribusi label klasifikasi di antara fitur-fitur tersebut.
