Vector Databases: Pinecone, Weaviate & pgvector · Lezione

Strategie di suddivisione dei chunk per RAG

Imparate a dividere i documenti in chunk efficaci per l’embedding, così che il vostro sistema RAG recuperi un contesto preciso e pertinente.

Lezione 4 di 413 passaggi

Strategie di suddivisione dei chunk per RAG è una lezione Vector Databases: Pinecone, Weaviate & pgvector gratuita su CoddyKit. Questa è la lezione 4 di 4. Puoi leggere la lezione completa qui gratuitamente — poi esercitati direttamente nel browser con un editor di codice integrato e un tutor IA disponibile 24/7. Fa parte del percorso di apprendimento Vector Databases: Pinecone, Weaviate & pgvector, e i tuoi progressi si sincronizzano tra il web e l'app CoddyKit. Il corso Vector Databases: Pinecone, Weaviate & pgvector include 4 lezioni in totale.

Parti di questa lezione non sono ancora state tradotte e vengono mostrate in inglese.

Why Chunking Matters

Before embedding, documents are split into chunks. Chunk quality directly determines retrieval quality — too large dilutes relevance, too small loses context.

Fixed-Size Chunking

The simplest method splits text every N characters or tokens. Fast but can cut sentences mid-thought.

def fixed_chunks(text, size=500):
    return [text[i:i+size] for i in range(0, len(text), size)]

Overlapping Windows

Add overlap between chunks so context spanning a boundary is not lost. A 10-20% overlap is common.

def overlap_chunks(text, size=500, overlap=100):
    step = size - overlap
    return [text[i:i+size] for i in range(0, len(text), step)]

Sentence-Aware Splitting

Split on sentence boundaries so each chunk stays grammatically whole. This usually improves embedding quality over raw character splits.

import re
sentences = re.split(r'(?<=[.!?])\s+', document_text)

Recursive Chunking

Recursive splitting tries large separators first (paragraphs), then smaller ones (sentences, words) until chunks fit the size limit. It respects natural structure.

Semantic Chunking

Semantic chunking groups sentences by meaning similarity, starting a new chunk when topic shifts. More expensive but very precise.

Chunk Size vs Model

Match chunk size to your embedding model's context window and your LLM's prompt budget.

  • Small chunks: precise but fragmented
  • Large chunks: rich but noisy

Keeping Metadata

Store source, page, and position metadata with each chunk so you can cite sources and reconstruct context later.

chunk = {
  'text': part,
  'source': 'guide.pdf',
  'page': 4,
  'position': idx
}

Parent-Child Chunks

Embed small child chunks for precise matching, but return their larger parent chunk to the LLM for full context. Best of both worlds.

Evaluating Chunking

Test different chunking configs with the same queries and measure retrieval hit rate. There is no universal best — measure for your data.

Practical Defaults

A solid starting point:

  • Recursive splitting
  • ~500 tokens per chunk
  • ~50-100 token overlap
  • Attach source metadata

Quick Check

Test your chunking knowledge.

Recap

You learned fixed, overlapping, sentence-aware, recursive, and semantic chunking, plus parent-child retrieval and metadata. Good chunking is the foundation of accurate RAG retrieval.

Gratis per iniziare

Impara Vector Databases: Pinecone, Weaviate & pgvector con un tutor IA — gratis

Scrivi ed esegui vero codice nel tuo browser, ricevi aiuto istantaneo da un tutor IA disponibile 24/7, e riprendi da dove hai lasciato sul web o nell'app.

Corsi
12
Lezioni
48

Domande Frequenti

La lezione «Strategie di suddivisione dei chunk per RAG» è gratuita?

Sì — il testo completo di «Strategie di suddivisione dei chunk per RAG» è gratuito qui sul web. Per esercitarvi in modo interattivo (un editor di codice integrato e un tutor IA 24/7) e sbloccare il resto del corso Vector Databases: Pinecone, Weaviate & pgvector, passa a CoddyKit PRO. Il corso Vector Databases: Pinecone, Weaviate & pgvector include 4 lezioni in totale.

Cosa imparerò in «Strategie di suddivisione dei chunk per RAG»?

Imparate a dividere i documenti in chunk efficaci per l’embedding, così che il vostro sistema RAG recuperi un contesto preciso e pertinente. Eserciti Vector Databases: Pinecone, Weaviate & pgvector con codice pratico che esegui direttamente nel browser, e un tutor IA 24/7 risponde alle tue domande mentre lavori sulla lezione.

Ho bisogno di esperienza per iniziare Vector Databases: Pinecone, Weaviate & pgvector?

Non è richiesta alcuna esperienza precedente. Vector Databases: Pinecone, Weaviate & pgvector su CoddyKit è strutturato per principianti e studenti avanzati, quindi puoi iniziare da qui o dall'inizio e procedere al tuo ritmo. Questa è la lezione 4 di 4.

Quanto tempo richiede la lezione «Strategie di suddivisione dei chunk per RAG»?

La maggior parte delle lezioni CoddyKit richiede circa 5–10 minuti. Ogni lezione è breve e interattiva, quindi fai progressi costanti e riprendi esattamente da dove hai lasciato su web e app.

Posso scrivere ed eseguire codice in questa lezione Vector Databases: Pinecone, Weaviate & pgvector?

Sì. Ogni lezione Vector Databases: Pinecone, Weaviate & pgvector include un editor di codice integrato, quindi scrivi ed esegui codice reale direttamente nel tuo browser e ricevi feedback istantaneo dall'IA — nessuna configurazione locale necessaria.

Tutte le lezioni di questo corso

  1. Panoramica dell'architettura di un sistema RAG
  2. Integrare i framework LLM
  3. Recupero di informazioni contestuali
  4. Strategie di suddivisione dei chunk per RAG
← Torna a Vector Databases: Pinecone, Weaviate & pgvector