| Term | Description |
|---|
| instance | Kontainer tingkat teratas untuk layanan pencarian. Sebuah instance menyimpan seluruh konfigurasi data — skema sumber data, skema indeks, dan atribut data — serta berfungsi sebagai satu titik akhir layanan pencarian. Instance ini analog dengan database dalam sistem database relasional. |
| document | Unit dasar data yang dapat dicari, analog dengan baris dalam tabel database relasional. Sebuah dokumen berisi satu atau lebih bidang dan harus memiliki bidang kunci primary. OpenSearch menggunakan kunci primary tersebut untuk mengidentifikasi setiap dokumen secara unik. Jika Anda mendorong dokumen baru dengan kunci primary yang sama dengan dokumen yang sudah ada, dokumen yang ada akan ditimpa. |
| field | Pasangan nama–nilai tunggal dalam sebuah dokumen. Bidang merupakan blok penyusun dokumen dan menentukan data apa yang disimpan serta bagaimana data tersebut dapat dicari atau difilter. |
| plugins | Plugin pemrosesan data bawaan yang disediakan OpenSearch untuk mentransformasi data Anda selama proses impor. Pilih plugin saat Anda mendefinisikan skema atau mengonfigurasi sumber data. |
| source data | Data mentah yang Anda dorong ke OpenSearch sebelum diproses. Data sumber berisi satu atau lebih bidang sumber. |
| source field | Unit terkecil dari data sumber — pasangan nama–nilai tunggal. Untuk tipe data yang didukung, lihat Application schema and index schema. |
| index | Struktur data yang mempercepat pengambilan. Sebuah instance dapat memiliki beberapa indeks. OpenSearch secara internal menggunakan dua jenis indeks: inverted indexes dan forward indexes. |
| composite index | Indeks yang dibangun melintasi beberapa bidang bertipe TEXT atau SHORT_TEXT. Misalnya, layanan pencarian forum mungkin menggunakan indeks title_search hanya untuk pencarian judul, dan indeks komposit default yang mencakup judul dan isi untuk pencarian menyeluruh. |
| index field | Bidang yang didefinisikan untuk berpartisipasi dalam query clauses. Mendefinisikan bidang indeks wajib dilakukan untuk pengambilan teks penuh berkinerja-tinggi. |
| attribute field | Bidang yang digunakan dalam klausa FILTER, SORT, AGGREGATE, dan DISTINCT. Bidang atribut memungkinkan penyaringan, pengurutan, dan statistik pada hasil pencarian tanpa berpartisipasi dalam pengambilan teks penuh. |
| default display field | Sekumpulan bidang yang dikembalikan dalam hasil pencarian secara default. Timpa pengaturan default ini per permintaan menggunakan parameter API fetch_fields. Saat fetch_fields diatur, konfigurasi bidang tampilan default diabaikan dan hanya bidang yang ditentukan yang dikembalikan. |
| tokenization | Proses memecah nilai bidang teks menjadi kata kunci individual untuk pengindeksan. Cara teks dipecah bergantung pada tipe bidang: bidang TEXT dipecah menjadi kata kunci tingkat kata yang bermakna, sedangkan bidang SHORT_TEXT dipecah karakter per karakter. Misalnya, frasa bahasa Tionghoa "浙江大学" menjadi "浙江" dan "大学" untuk bidang TEXT, tetapi "浙", "江", "大", dan "学" untuk bidang SHORT_TEXT. Tanpa tokenisasi, hanya pencocokan string eksak yang berfungsi — tokenisasi adalah yang memungkinkan pencarian teks penuh. |
| term | Satu token yang dihasilkan oleh tokenisasi. Kata kunci digunakan untuk membangun inverted index. |
| index building | Proses membangun indeks dari kata kunci setelah tokenisasi. OpenSearch membangun dua jenis indeks: inverted indexes (digunakan untuk pengambilan) dan forward indexes (digunakan untuk penyaringan). |
| inverted index | Struktur data yang memetakan setiap kata kunci ke dokumen yang memuatnya. Inverted indexes mendukung pencarian berdasarkan query clause. Misalnya, diberikan dua dokumen — "quick brown fox" dan "quick fox jumps" — inverted index memetakan: quick → doc1, doc2 / brown → doc1 / fox → doc1, doc2 / jumps → doc2. |
| forward index | Struktur data yang memetakan setiap dokumen ke nilai-nilai bidangnya. Forward indexes mendukung operasi FILTER clause. Indeks ini kurang efisien untuk pengambilan dibandingkan inverted indexes, tetapi diperlukan untuk operasi yang membaca nilai bidang per dokumen — misalnya: doc1 → id, type, create_time. |
| retrieval | Proses menemukan dokumen yang sesuai dengan permintaan pencarian. OpenSearch mengonversi kata kunci kueri menjadi kata kunci, lalu mencari inverted index untuk menemukan semua dokumen yang cocok. |
| retrieval amount | Jumlah dokumen yang diambil. |