Getirilen Sonuçları Yeniden Sıralama
Bağlamı LLM'ye aktarmadan önce ilk vektör araması adaylarını çapraz kodlayıcı modellerle yeniden sıralayarak RAG doğruluğunu artırın.
Getirilen Sonuçları Yeniden Sıralama, CoddyKit'te ücretsiz bir Vector Databases: Pinecone, Weaviate & pgvector dersidir. Bu, 4 dersinin 4. dersidir. Aşağıdan dersin tamamını ücretsiz okuyabilir, sonra tarayıcıda yerleşik kod editörü ve 7/24 yapay zeka koçu ile uygulamalı olarak pratik yapabilirsin. Bu, Vector Databases: Pinecone, Weaviate & pgvector öğrenme yolunun bir parçasıdır ve ilerlemeniz web ve CoddyKit uygulaması arasında senkronize olur. Vector Databases: Pinecone, Weaviate & pgvector kursu toplamda 4 dersten oluşur.
Bu dersin bazı bölümleri henüz çevrilmemiş olup İngilizce olarak gösterilmektedir.
The Reranking Idea
Vector search is fast but approximate. Reranking takes the top candidates and reorders them with a more accurate, slower model — the two-stage retrieve-then-rerank pattern.
Bi-Encoder vs Cross-Encoder
Bi-encoders embed query and document separately (fast, used for retrieval). Cross-encoders score query+document together (slow, far more accurate) — ideal for reranking a small set.
Two-Stage Pipeline
Step 1: retrieve top 50 with the vector DB. Step 2: rerank those 50, keep the top 5. You get cross-encoder quality at near vector-search speed.
candidates = vector_db.search(query, k=50)
ranked = reranker.rank(query, candidates)
top = ranked[:5]Using a Cross-Encoder
A cross-encoder takes pairs and outputs a relevance score. Higher means more relevant.
from sentence_transformers import CrossEncoder
model = CrossEncoder('cross-encoder/ms-marco-MiniLM-L-6-v2')
scores = model.predict([(query, doc) for doc in candidates])Sorting by Score
Pair each document with its score and sort descending to produce the final order.
ranked = sorted(zip(candidates, scores), key=lambda x: x[1], reverse=True)
for doc, score in ranked[:5]:
print(round(score, 3), doc[:40])Hosted Reranking APIs
Services like Cohere Rerank and Jina offer hosted rerankers via API, removing the need to self-host a model.
POST /v1/rerank
{ "query": "...", "documents": [...], "top_n": 5 }Choosing Candidate Count
Retrieve enough candidates that the true best answer is in the set (high recall), but not so many that reranking gets slow. 20-100 is typical.
Latency Trade-offs
Reranking adds latency proportional to candidate count. Cache results, batch the cross-encoder calls, and tune the candidate count to your SLA.
Reranking + Filters
Apply metadata filters during retrieval, then rerank only the filtered set. This keeps the reranker focused on valid candidates.
Measuring the Gain
Compare nDCG or hit rate with and without reranking on a labeled set. Reranking commonly delivers a large accuracy boost on noisy corpora.
When to Skip It
If your corpus is small and clean, or latency is critical, plain vector search may suffice. Reranking pays off most on large, diverse datasets.
Quick Check
Test your reranking knowledge.
Recap
You learned the retrieve-then-rerank pattern, the difference between bi- and cross-encoders, how to score and sort candidates, and when reranking is worth its latency cost.
Sıkça Sorulan Sorular
“Getirilen Sonuçları Yeniden Sıralama” dersi ücretsiz mi?
Evet — “Getirilen Sonuçları Yeniden Sıralama” dersin tüm metni burada web'de ücretsiz olarak okunabilir. Etkileşimli olarak pratik yapmak (yerleşik kod editörü ve 7/24 yapay zeka koçu) ve Vector Databases: Pinecone, Weaviate & pgvector kursunun geri kalanını açmak için CoddyKit PRO'ya yükselt. Vector Databases: Pinecone, Weaviate & pgvector kursu toplamda 4 dersten oluşur.
“Getirilen Sonuçları Yeniden Sıralama” dersinde ne öğreneceğim?
Bağlamı LLM'ye aktarmadan önce ilk vektör araması adaylarını çapraz kodlayıcı modellerle yeniden sıralayarak RAG doğruluğunu artırın. Vector Databases: Pinecone, Weaviate & pgvector ile uygulamalı kodu tarayıcıda doğrudan çalıştırarak pratik yaparsın ve 7/24 yapay zeka koçu dersi çalışırken sorularını yanıtlar.
Vector Databases: Pinecone, Weaviate & pgvector öğrenmeye başlamak için deneyim gerekli mi?
Önceden deneyim gerekmez. CoddyKit'te Vector Databases: Pinecone, Weaviate & pgvector, başlangıçtan ileri seviyeye kadar yapılandırıldığı için buradan başlayabilir veya başından başlayıp kendi hızında ilerleme yapabilirsin. Bu, 4 dersinin 4. dersidir.
“Getirilen Sonuçları Yeniden Sıralama” dersi ne kadar sürer?
Çoğu CoddyKit dersi yaklaşık 5–10 dakika sürer. Her biri kısa ve etkileşimli olduğu için sabit ilerleme yaparsın ve web ile uygulama arasında tam olarak bıraktığın yerden devam edebilirsin.
Bu Vector Databases: Pinecone, Weaviate & pgvector dersinde kod yazıp çalıştırabilir miyim?
Evet. Her Vector Databases: Pinecone, Weaviate & pgvector dersi yerleşik bir kod editörü içerir, bu sayede tarayıcıda gerçek kod yazıp çalıştırabilir ve anlık yapay zeka geri bildirimi alırsın — yerel kurulum gerekli değildir.
Bu kursun tüm dersleri
- Sorgu Dönüştürme Teknikleri
- Çok Aşamalı RAG İşlem Hatları
- RAG Sistemi Performansını Değerlendirme
- Getirilen Sonuçları Yeniden Sıralama