Hibrit arama
Kelime tabanlı ve anlamsal aramayı aynı sorguda birleştirerek tam eşleşmeyi ve anlam kapsamasını birlikte kullanan yaklaşım.
Özet
Kelime ve vektör aramasını birleştirir.
Hızlı bilgiler
- Kategori
- AI ve bilgi yönetimi
- Ürün
- KobiGPT RAG
- İlgili
- Karşılaştırma ve araçlar
- Dil
- TR ve EN
Neden KobiGPT?
- Satın alma öncesi ortak dil oluşturun.
- Kavramları KobiGPT özelliklerine bağlayın.
- Hukuk ve BT ile paylaşın.
- Kullanım alanlarına geçin.
Ürün verileri
- Ücretsiz plan
- 100 doküman · 2 departman · 120 Kobi/ay(PLAN_CONFIG)
- Starter
- 1000 doküman · 5 departman · 1000 Kobi/ay(PLAN_CONFIG)
- Pro
- 12500 doküman · 25 departman · 12500 Kobi/ay(PLAN_CONFIG)
- Fusion query
- Dense and sparse prefetch with RRF fusion(apps/api/src/rag/qdrant.service.ts → searchHybrid)
İki sinyal neden birleştirilir?
Kelime tabanlı arama, ürün kodu ve özel isim gibi birebir yazılması gereken ifadelerde güçlüdür. Anlamsal arama ise kullanıcı dokümandaki ifadeyi farklı kurduğunda yakın anlamı bulur.
Hibrit arama bu sinyalleri ortak bir sıralamada buluşturur. Böylece yalnızca kelime eşleşmesine veya yalnızca vektör yakınlığına güvenmek yerine iki kanıt türünün avantajı korunur.
KobiGPT’de uygulama
KobiGPT’nin Qdrant koleksiyonları dense ve sparse vektör alanlarını birlikte tutar. Sorgu, her iki alanda departman filtresiyle çalıştırılır ve sonuçlar Reciprocal Rank Fusion yaklaşımıyla birleştirilir.
Bu teknik ayrıntı kullanıcıya şunu söyler: iyi sonuç için yalnızca model değil, doğru kapsam da gerekir. Asistanına bağlanmayan dosya benzer görünse bile aramaya girmemelidir.
Kaliteyi nasıl kontrol etmeli?
Hibrit skor mutlak doğruluk puanı değildir. Üst sıradaki parça sorudaki istisnayı kaçırabilir veya güncel olmayan bir sürümden gelebilir; gösterilen kaynağı okumak gerekir.
Arşivi iyileştirmenin yolları doğru dosya seçimi, anlaşılır başlıklar ve sürüm disiplinidir. Kapsamı düzenlemeden dosya eklemek, hibrit aramayı da gürültülü hale getirir.
Hibrit kurulumun maliyeti ve ne zaman değdiği
Hibrit arama iki ayrı indeks tutmayı ve sonuçları birleştirmeyi gerektirir; bu, hem altyapı hem bakım maliyeti demektir. Küçük ve homojen bir arşivde bu ek karmaşıklık genelde karşılığını vermez, tek yöntem yeterli kalır.
Değdiği senaryo, sorgu tiplerinin gerçekten karışık olduğu durumdur: aynı asistana hem "izin prosedürü nedir" gibi kavramsal, hem "TS-4471 numaralı talimat" gibi tam eşleşme soruları geliyorsa tek yöntem her iki tarafta da taviz verir. Karar, sorgu kayıtlarına bakılarak verilmelidir.
Karar vermeden önce ucuz bir ön test yapılabilir: son üç ayın gerçek sorgularından elli tanesini alıp kaçının tam eşleşme gerektirdiğini sayın. Oran yüzde yirminin altındaysa tek yöntem yeterlidir ve hibrit kurulumun ek karmaşıklığı karşılığını vermez. Yüzde kırkın üzerindeyse hibrit yaklaşım ciddi biçimde değerlendirilmelidir. Bu ölçüm birkaç saat sürer ve aylarca sürebilecek bir mimari tartışmayı veriyle sonlandırır.
Ölçüm sonucu ara bölgede kalırsa üçüncü bir yol vardır: tam eşleşme gerektiren içeriği ayrı bir asistana almak. Bu, hibrit altyapı kurmadan aynı sorunu kapsam ayrımıyla çözer ve bakım yükü getirmez.
FAQ
Pratikte ne anlama gelir?
Kelime ve vektör aramasını birleştirir.
KobiGPT kullanıyor mu?
Uygulama için ürün sayfalarına bakın.
Daha fazla okuma?
Blog ve SSS.
Sorumluluk?
Eğitim amaçlı; uyum kararları için doğrulayın.
Hibrit arama iki sonuç listesi mi gösterir?
Kullanıcıya genellikle birleşik bir sıralama sunulur; dense ve sparse sinyalleri arka planda birlikte hesaplanır.
Hibrit arama doğru belgeyi garanti eder mi?
Hayır. Sıralamayı iyileştirir, fakat kaynak metin ve belge güncelliği yine kontrol edilmelidir.
Karşılaştırma
| Özellik | KobiGPT | Alternatif |
|---|---|---|
| KOBİ | Evet | Yok |
| Kaynak | RAG ile | Yok |
| Sözlük | Genişliyor | Yok |
| Araçlar | İnteraktif | Yok |