Dezkubeدزکوب

فناوری · دیتابیس

جستجوی برداری در دزکوب

ذخیره و جستجوی بردار برای بارهای کاری هوش مصنوعی

لایسنس
Apache 2.0
گروه در استک
دیتابیس

جستجوی برداری چیست

برای کاربردهایی مثل جستجوی معنایی و بازیابی مبتنی بر شباهت، متن به بردار عددی تبدیل می‌شود و جستجو بر اساس نزدیکی بردارها انجام می‌گیرد.

دو گزینه، دو کاربرد

دو گزینه، دو کاربرد
گزینهمناسب برای
pgvector روی PostgreSQLوقتی داده و بردار کنار هم‌اند و نمی‌خواهید سامانهٔ جدا اضافه کنید
Qdrantوقتی حجم بردارها بالاست و به قابلیت‌های تخصصی جستجوی برداری نیاز دارید

ما دقیقاً چطور استفاده‌اش می‌کنیم

  • provisioning هر دو از همان مسیر دیتابیس‌های مدیریت‌شده.
  • HNSW به‌عنوان ایندکس پیش‌فرض — چون افزایشی ساخته می‌شود و از حالت خالی هم درست است.
  • شناسه‌های SQL در DDL تولیدشده اعتبارسنجی می‌شوند، نه escape — برای پیکربندی‌ای که اپراتور می‌نویسد، فهرست مجاز تنها وضعیت امن است.

برای شما چه چیزی عوض می‌شود

  • سرویس برداری جدا و مدیریت دستیprovisioning از همان پنل
  • ایندکس دست‌سازHNSW پیش‌فرض با دلیل مشخص

مرزها و محدودیت‌ها

این سکشن در هر صفحهٔ فناوری اجباری است. هر ابزاری مرزی دارد؛ صفحه‌ای که مرزش را نگوید، بقیه‌اش هم قابل اتکا نیست.

  • سقف ۲۰۰۰ بُعد برای ایندکس در pgvector. بالاتر از آن، ذخیره ممکن است ولی ایندکس نه — و این در زمان ساخت اعلام می‌شود.
  • چرا IVFFlat را پیش‌فرض نکردیم: باید بعد از بارگذاری داده ساخته شود تا خوشه‌هایش را انتخاب کند. تنها لحظه‌ای که در اختیار داریم جدول خالی است، و ایندکس روی جدول خالی از نبودِ ایندکس بدتر است.

این را روی زیرساخت خودتان ببینید.

همین مؤلفه را در کلاستر شما پیکربندی می‌کنیم و نشان می‌دهیم.