All Products
Search
Document Center

OpenSearch:Konfigurasi QGraph (Quantized Graph)

Last Updated:Apr 02, 2026

QGraph (Quantized Graph) menggunakan struktur graf Hierarchical Navigable Small World (HNSW) dengan kuantisasi opsional. Konfigurasikan parameter pembuatan dan pencarian berikut untuk menyeimbangkan performa, tingkat recall, dan ukuran indeks sesuai beban kerja Anda.

Parameter pembuatan indeks

Parameter pembuatan ditetapkan saat pembuatan indeks. Perubahan pada parameter ini memerlukan pembuatan ulang indeks.

ParameterTipeBawaanDeskripsi
proxima.hnsw.builder.max_neighbor_countuint32100Jumlah maksimum tetangga per node graf. Nilai yang lebih tinggi meningkatkan konektivitas graf tetapi memperpanjang waktu konstruksi dan memperbesar ukuran indeks.
proxima.hnsw.builder.efconstructionuint32500Ukuran area pemindaian tetangga selama konstruksi graf. Nilai yang lebih tinggi menghasilkan graf berkualitas lebih baik tetapi memperlambat pembuatan indeks. Mulailah dengan nilai 400.
proxima.hnsw.builder.thread_countuint320Jumlah thread yang digunakan selama konstruksi. 0 menggunakan jumlah core CPU yang tersedia.
proxima.qgraph.builder.quantizer_classstringNoneKuantisasi yang diterapkan pada indeks. Opsi: Int4QuantizerConverter, Int8QuantizerConverter, HalfFloatConverter. Lihat Pilih kuantisasi.

Parameter pencarian indeks

Parameter pencarian dapat disesuaikan tanpa perlu membangun ulang indeks.

ParameterTipeBawaanDeskripsi
proxima.hnsw.searcher.efuint32500Jumlah kandidat tetangga terdekat yang dipindai selama pencarian online. Nilai yang lebih tinggi meningkatkan tingkat recall tetapi mengurangi performa pencarian. Atur dalam rentang [100, 1000].
proxima.hnsw.searcher.max_scan_ratiofloatNoneProporsi titik yang dipindai selama pencarian online. Nilai yang lebih tinggi meningkatkan tingkat recall tetapi mengurangi performa pencarian.
proxima.hnsw.searcher.brute_force_thresholduint32NoneJumlah minimum titik yang dipindai selama pencarian online. Ketika nilai ini melebihi jumlah dokumen dalam satu shard, pencarian beralih ke brute force.

Pilih quantizer

Kuantisasi mengurangi ukuran indeks dan meningkatkan performa pencarian dengan mengorbankan tingkat recall. Pilih opsi yang sesuai berdasarkan anggaran memori dan persyaratan akurasi Anda.

Kelas QuantizerUkuran indeksPerforma pencarianTingkat recall
Int4QuantizerConverterTerkecilTertinggiTerendah
Int8QuantizerConverterSedangSedangSedang
HalfFloatConverterMendekati versi tanpa kuantisasiMendekati versi tanpa kuantisasiMendekati versi tanpa kuantisasi
Catatan: Karena keterbatasan set instruksi CPU, HalfFloatConverter memberikan performa dan tingkat recall yang hampir identik dengan tanpa kuantisasi. Gunakan Int8QuantizerConverter untuk pengurangan ukuran yang signifikan atau Int4QuantizerConverter untuk indeks terkecil.

Panduan penyetelan

Konfigurasi yang tepat bergantung pada throughput kueri, frekuensi penulisan, dan target recall Anda. Gunakan tabel berikut sebagai titik awal.

Throughput kueriFrekuensi penulisanTarget recallKonfigurasi yang direkomendasikan
RendahRendahRendahPertahankan efconstruction dan ef rendah. Mesin yang lebih kecil sudah cukup.
RendahRendahTinggiTingkatkan efconstruction dan ef hingga tingkat recall memenuhi target Anda.
RendahTinggiRendahPertahankan efconstruction rendah. Tingkatkan ef untuk mencapai tingkat recall yang diinginkan.
RendahTinggiTinggiPertahankan efconstruction rendah. Tingkatkan ef secara signifikan.
TinggiRendahRendahThroughput kueri tinggi memerlukan ef yang rendah. Recall rendah memungkinkan efconstruction tetap rendah.
TinggiApa punTinggiSkenario paling menuntut. Pertahankan efconstruction dan ef serendah mungkin sambil tetap memenuhi target recall Anda.

Prinsip umum:

  • ef adalah parameter utama untuk penyetelan selama pencarian. Tingkatkan nilainya untuk meningkatkan tingkat recall; turunkan untuk meningkatkan performa pencarian.

  • max_scan_ratio dan brute_force_threshold menyediakan kontrol pemindaian tambahan untuk kasus penggunaan lanjutan.