Estratégias de divisão em partes para RAG
Aprenda a dividir documentos em partes eficazes para gerar embeddings, para que seu sistema RAG recupere contexto preciso e relevante.
Estratégias de divisão em partes para RAG é uma aula grátis de Vector Databases: Pinecone, Weaviate & pgvector no CoddyKit. Esta é a aula 4 de 4. Você pode ler a aula completa abaixo gratuitamente — depois pratica ao vivo no navegador com um editor de código integrado e um tutor de IA 24/7. Faz parte do caminho de aprendizado de Vector Databases: Pinecone, Weaviate & pgvector, e seu progresso é sincronizado entre a web e o app CoddyKit. O curso de Vector Databases: Pinecone, Weaviate & pgvector inclui 4 aulas no total.
Partes desta aula ainda não foram traduzidas e aparecem em inglês.
Why Chunking Matters
Before embedding, documents are split into chunks. Chunk quality directly determines retrieval quality — too large dilutes relevance, too small loses context.
Fixed-Size Chunking
The simplest method splits text every N characters or tokens. Fast but can cut sentences mid-thought.
def fixed_chunks(text, size=500):
return [text[i:i+size] for i in range(0, len(text), size)]Overlapping Windows
Add overlap between chunks so context spanning a boundary is not lost. A 10-20% overlap is common.
def overlap_chunks(text, size=500, overlap=100):
step = size - overlap
return [text[i:i+size] for i in range(0, len(text), step)]Sentence-Aware Splitting
Split on sentence boundaries so each chunk stays grammatically whole. This usually improves embedding quality over raw character splits.
import re
sentences = re.split(r'(?<=[.!?])\s+', document_text)Recursive Chunking
Recursive splitting tries large separators first (paragraphs), then smaller ones (sentences, words) until chunks fit the size limit. It respects natural structure.
Semantic Chunking
Semantic chunking groups sentences by meaning similarity, starting a new chunk when topic shifts. More expensive but very precise.
Chunk Size vs Model
Match chunk size to your embedding model's context window and your LLM's prompt budget.
- Small chunks: precise but fragmented
- Large chunks: rich but noisy
Keeping Metadata
Store source, page, and position metadata with each chunk so you can cite sources and reconstruct context later.
chunk = {
'text': part,
'source': 'guide.pdf',
'page': 4,
'position': idx
}Parent-Child Chunks
Embed small child chunks for precise matching, but return their larger parent chunk to the LLM for full context. Best of both worlds.
Evaluating Chunking
Test different chunking configs with the same queries and measure retrieval hit rate. There is no universal best — measure for your data.
Practical Defaults
A solid starting point:
- Recursive splitting
- ~500 tokens per chunk
- ~50-100 token overlap
- Attach source metadata
Quick Check
Test your chunking knowledge.
Recap
You learned fixed, overlapping, sentence-aware, recursive, and semantic chunking, plus parent-child retrieval and metadata. Good chunking is the foundation of accurate RAG retrieval.
Aprenda Vector Databases: Pinecone, Weaviate & pgvector com um tutor de IA — grátis
Escreva e execute código real no seu navegador, obtenha ajuda instantânea de um tutor de IA 24/7 e continue de onde parou na web ou no app.
- Cursos
- 12
- Aulas
- 48
Perguntas Frequentes
A aula “Estratégias de divisão em partes para RAG” é grátis?
Sim — o texto completo de “Estratégias de divisão em partes para RAG” é grátis para ler aqui na web. Para praticá-la interativamente (um editor de código integrado e um tutor de IA 24/7) e desbloquear o restante do curso de Vector Databases: Pinecone, Weaviate & pgvector, atualize para CoddyKit PRO. O curso de Vector Databases: Pinecone, Weaviate & pgvector inclui 4 aulas no total.
O que vou aprender em “Estratégias de divisão em partes para RAG”?
Aprenda a dividir documentos em partes eficazes para gerar embeddings, para que seu sistema RAG recupere contexto preciso e relevante. Você pratica Vector Databases: Pinecone, Weaviate & pgvector com código prático que executa diretamente no navegador, e um tutor de IA 24/7 responde suas dúvidas enquanto trabalha na aula.
Preciso ter experiência prévia para começar Vector Databases: Pinecone, Weaviate & pgvector?
Nenhuma experiência prévia é necessária. Vector Databases: Pinecone, Weaviate & pgvector no CoddyKit é estruturado para alunos iniciantes até avançados, então você pode começar aqui ou desde o início e aprender no seu ritmo. Esta é a aula 4 de 4.
Quanto tempo leva a aula “Estratégias de divisão em partes para RAG”?
A maioria das aulas CoddyKit leva cerca de 5–10 minutos. Cada uma é compacta e interativa, então você faz progresso constante e retoma exatamente de onde parou entre web e app.
Posso escrever e executar código nesta aula de Vector Databases: Pinecone, Weaviate & pgvector?
Sim. Cada aula de Vector Databases: Pinecone, Weaviate & pgvector inclui um editor de código integrado, então você escreve e executa código real direto no navegador e recebe feedback de IA instantaneamente — nenhuma configuração local necessária.
Todas as aulas deste curso
- Visão Geral da Arquitetura de um Sistema RAG
- Integração com Estruturas de LLM
- Recuperação de Informações Contextuais
- Estratégias de divisão em partes para RAG