All Products
Search
Document Center

OpenSearch:Glosarium

Last Updated:Apr 01, 2026

Glosarium ini mendefinisikan konsep-konsep inti dalam OpenSearch Industry Algorithm Edition, dikelompokkan berdasarkan area fungsional.

Manajemen instans

TermDescription
instanceKontainer tingkat teratas untuk layanan pencarian. Sebuah instance menyimpan seluruh konfigurasi data — skema sumber data, skema indeks, dan atribut data — serta berfungsi sebagai satu titik akhir layanan pencarian. Instance ini analog dengan database dalam sistem database relasional.
documentUnit dasar data yang dapat dicari, analog dengan baris dalam tabel database relasional. Sebuah dokumen berisi satu atau lebih bidang dan harus memiliki bidang kunci primary. OpenSearch menggunakan kunci primary tersebut untuk mengidentifikasi setiap dokumen secara unik. Jika Anda mendorong dokumen baru dengan kunci primary yang sama dengan dokumen yang sudah ada, dokumen yang ada akan ditimpa.
fieldPasangan nama–nilai tunggal dalam sebuah dokumen. Bidang merupakan blok penyusun dokumen dan menentukan data apa yang disimpan serta bagaimana data tersebut dapat dicari atau difilter.
pluginsPlugin pemrosesan data bawaan yang disediakan OpenSearch untuk mentransformasi data Anda selama proses impor. Pilih plugin saat Anda mendefinisikan skema atau mengonfigurasi sumber data.
source dataData mentah yang Anda dorong ke OpenSearch sebelum diproses. Data sumber berisi satu atau lebih bidang sumber.
source fieldUnit terkecil dari data sumber — pasangan nama–nilai tunggal. Untuk tipe data yang didukung, lihat Application schema and index schema.
indexStruktur data yang mempercepat pengambilan. Sebuah instance dapat memiliki beberapa indeks. OpenSearch secara internal menggunakan dua jenis indeks: inverted indexes dan forward indexes.
composite indexIndeks yang dibangun melintasi beberapa bidang bertipe TEXT atau SHORT_TEXT. Misalnya, layanan pencarian forum mungkin menggunakan indeks title_search hanya untuk pencarian judul, dan indeks komposit default yang mencakup judul dan isi untuk pencarian menyeluruh.
index fieldBidang yang didefinisikan untuk berpartisipasi dalam query clauses. Mendefinisikan bidang indeks wajib dilakukan untuk pengambilan teks penuh berkinerja-tinggi.
attribute fieldBidang yang digunakan dalam klausa FILTER, SORT, AGGREGATE, dan DISTINCT. Bidang atribut memungkinkan penyaringan, pengurutan, dan statistik pada hasil pencarian tanpa berpartisipasi dalam pengambilan teks penuh.
default display fieldSekumpulan bidang yang dikembalikan dalam hasil pencarian secara default. Timpa pengaturan default ini per permintaan menggunakan parameter API fetch_fields. Saat fetch_fields diatur, konfigurasi bidang tampilan default diabaikan dan hanya bidang yang ditentukan yang dikembalikan.
tokenizationProses memecah nilai bidang teks menjadi kata kunci individual untuk pengindeksan. Cara teks dipecah bergantung pada tipe bidang: bidang TEXT dipecah menjadi kata kunci tingkat kata yang bermakna, sedangkan bidang SHORT_TEXT dipecah karakter per karakter. Misalnya, frasa bahasa Tionghoa "浙江大学" menjadi "浙江" dan "大学" untuk bidang TEXT, tetapi "浙", "江", "大", dan "学" untuk bidang SHORT_TEXT. Tanpa tokenisasi, hanya pencocokan string eksak yang berfungsi — tokenisasi adalah yang memungkinkan pencarian teks penuh.
termSatu token yang dihasilkan oleh tokenisasi. Kata kunci digunakan untuk membangun inverted index.
index buildingProses membangun indeks dari kata kunci setelah tokenisasi. OpenSearch membangun dua jenis indeks: inverted indexes (digunakan untuk pengambilan) dan forward indexes (digunakan untuk penyaringan).
inverted indexStruktur data yang memetakan setiap kata kunci ke dokumen yang memuatnya. Inverted indexes mendukung pencarian berdasarkan query clause. Misalnya, diberikan dua dokumen — "quick brown fox" dan "quick fox jumps" — inverted index memetakan: quick → doc1, doc2 / brown → doc1 / fox → doc1, doc2 / jumps → doc2.
forward indexStruktur data yang memetakan setiap dokumen ke nilai-nilai bidangnya. Forward indexes mendukung operasi FILTER clause. Indeks ini kurang efisien untuk pengambilan dibandingkan inverted indexes, tetapi diperlukan untuk operasi yang membaca nilai bidang per dokumen — misalnya: doc1 → id, type, create_time.
retrievalProses menemukan dokumen yang sesuai dengan permintaan pencarian. OpenSearch mengonversi kata kunci kueri menjadi kata kunci, lalu mencari inverted index untuk menemukan semua dokumen yang cocok.
retrieval amountJumlah dokumen yang diambil.
Bidang indeks, bidang atribut, bidang sumber, dan bidang tampilan default memiliki tujuan yang berbeda. Bidang indeks digunakan untuk pengambilan teks penuh. Bidang atribut digunakan untuk penyaringan, pengurutan, dan agregasi. Bidang sumber merupakan bidang input mentah dari sumber data Anda. Bidang tampilan default mengontrol data yang dikembalikan dalam hasil pencarian. Memahami perbedaan ini membantu Anda merancang skema dengan tepat.

Sinkronisasi data

TermDescription
data sourceSistem eksternal tempat data didorong ke OpenSearch. Sumber yang didukung adalah ApsaraDB for RDS, MaxCompute, dan PolarDB.
reindexingProses membangun ulang semua indeks dari awal. Pengindeksan ulang diperlukan setelah Anda mengonfigurasi atau mengubah application schema dan sumber data.

Manajemen kuota

TermDescription
document capacityUkuran penyimpanan kumulatif dari semua dokumen dalam sebuah instans, dihitung dengan mengonversi setiap nilai bidang menjadi string dan menjumlahkan ukurannya.
QPSQueries per second (QPS) — jumlah permintaan pencarian yang diproses oleh sebuah instans per detik.
LCULogical computing unit (LCU) — satuan yang digunakan untuk mengukur daya komputasi layanan pencarian. Satu LCU menunjukkan daya komputasi 10 millicore dalam kluster pencarian. Satu millicore adalah seperseribu core CPU.
scalingMenyesuaikan konfigurasi komputasi dan kapasitas sebuah instans. Perubahan spesifikasi kecil berlaku segera. Perubahan yang melibatkan pergantian tipe instans — misalnya, dari instans shared ke instans exclusive — hanya berlaku setelah disetujui.

Pencarian

TermDescription
sort expressionEkspresi yang ditentukan pengguna untuk mengatur peringkat hasil pencarian. Ekspresi pengurutan mendukung operasi matematika dasar, fungsi matematika, dan fungsi bawaan.
rough sort expressionEkspresi peringkat tahap pertama. OpenSearch menghitung skor kecocokan untuk setiap dokumen yang diambil menggunakan ekspresi ini dan mengurutkan hasil berdasarkan skor tersebut. Hasil N teratas kemudian diteruskan ke tahap fine sort.
fine sort expressionEkspresi peringkat tahap kedua yang diterapkan pada N hasil teratas dari rough sort. Ekspresi pengurutan presisi menerapkan penilaian yang lebih akurat — dengan biaya komputasi lebih tinggi — untuk menyempurnakan peringkat akhir.
search result summaryKutipan singkat dari konten teks dokumen yang ditampilkan bersama setiap hasil pencarian, membantu pengguna menilai relevansi tanpa membaca seluruh dokumen.
query analysisSekumpulan fitur pra-pengambilan yang diterapkan pada kueri pencarian mentah. Fitur yang didukung mencakup ekspansi sinonim, koreksi ejaan, penyaringan stop words, dan penyesuaian bobot kata kunci. Fitur-fitur ini meningkatkan kualitas pencarian dengan menafsirkan maksud pengguna, bukan hanya mencocokkan kata kunci secara harfiah.