فناوری · دیتابیس
جستجوی برداری در دزکوب
ذخیره و جستجوی بردار برای بارهای کاری هوش مصنوعی
- لایسنس
- Apache 2.0
- گروه در استک
- دیتابیس
جستجوی برداری چیست
برای کاربردهایی مثل جستجوی معنایی و بازیابی مبتنی بر شباهت، متن به بردار عددی تبدیل میشود و جستجو بر اساس نزدیکی بردارها انجام میگیرد.
دو گزینه، دو کاربرد
| گزینه | مناسب برای |
|---|---|
| pgvector روی PostgreSQL | وقتی داده و بردار کنار هماند و نمیخواهید سامانهٔ جدا اضافه کنید |
| Qdrant | وقتی حجم بردارها بالاست و به قابلیتهای تخصصی جستجوی برداری نیاز دارید |
ما دقیقاً چطور استفادهاش میکنیم
- provisioning هر دو از همان مسیر دیتابیسهای مدیریتشده.
- HNSW بهعنوان ایندکس پیشفرض — چون افزایشی ساخته میشود و از حالت خالی هم درست است.
- شناسههای SQL در DDL تولیدشده اعتبارسنجی میشوند، نه escape — برای پیکربندیای که اپراتور مینویسد، فهرست مجاز تنها وضعیت امن است.
برای شما چه چیزی عوض میشود
- سرویس برداری جدا و مدیریت دستیprovisioning از همان پنل
- ایندکس دستسازHNSW پیشفرض با دلیل مشخص
مرزها و محدودیتها
این سکشن در هر صفحهٔ فناوری اجباری است. هر ابزاری مرزی دارد؛ صفحهای که مرزش را نگوید، بقیهاش هم قابل اتکا نیست.
- سقف ۲۰۰۰ بُعد برای ایندکس در pgvector. بالاتر از آن، ذخیره ممکن است ولی ایندکس نه — و این در زمان ساخت اعلام میشود.
- چرا IVFFlat را پیشفرض نکردیم: باید بعد از بارگذاری داده ساخته شود تا خوشههایش را انتخاب کند. تنها لحظهای که در اختیار داریم جدول خالی است، و ایندکس روی جدول خالی از نبودِ ایندکس بدتر است.
اینها را هم ببینید
این را روی زیرساخت خودتان ببینید.
همین مؤلفه را در کلاستر شما پیکربندی میکنیم و نشان میدهیم.