Módulos vectorizer y generación automática de embeddings
Aprenda cómo los módulos vectorizer de Weaviate convierten automáticamente sus objetos de datos en vectores durante la importación y cómo configurarlos por clase y propiedad.
Módulos vectorizer y generación automática de embeddings es una lección gratuita de Vector Databases: Pinecone, Weaviate & pgvector en CoddyKit. Esta es la lección 4 de 4. Puedes leer la lección completa abajo gratuitamente — luego la practicas en el navegador con un editor de código integrado y un tutor de IA 24/7. Forma parte de la ruta de aprendizaje de Vector Databases: Pinecone, Weaviate & pgvector, y tu progreso se sincroniza en la web y la app de CoddyKit. El curso de Vector Databases: Pinecone, Weaviate & pgvector incluye 4 lecciones en total.
Partes de esta lección aún no han sido traducidas y se muestran en inglés.
Who Creates the Vectors?
Vector search needs every object to have a vector. You can compute embeddings yourself, or let Weaviate do it via a vectorizer module that embeds objects automatically on import.
What Is a Vectorizer Module?
A vectorizer is a pluggable module (e.g. text2vec-openai, text2vec-cohere, text2vec-huggingface) that Weaviate calls to convert text into vectors. You choose it when defining a class.
Configuring a Vectorizer
The vectorizer is set in the class schema.
class_def = {
'class': 'Article',
'vectorizer': 'text2vec-openai',
'properties': [
{'name': 'title', 'dataType': ['text']},
{'name': 'body', 'dataType': ['text']}
]
}
print(class_def['vectorizer'])Auto-Embedding on Import
With a vectorizer set, you import plain objects and Weaviate embeds them for you. No need to call an embedding API yourself.
- Send object properties
- Module generates the vector
- Object stored with its vector
Choosing Which Properties to Embed
Not every property should influence the vector. You can skip properties (like IDs or timestamps) so only meaningful text contributes to the embedding.
prop = {
'name': 'sku',
'dataType': ['text'],
'moduleConfig': {'text2vec-openai': {'skip': True}}
}
print('skip embedding:', prop['moduleConfig']['text2vec-openai']['skip'])Including Property Names
By default Weaviate can prepend the property name to its value before embedding. Disabling 'vectorizePropertyName' keeps the vector focused on content rather than field labels.
Bring Your Own Vectors
You can also set vectorizer to 'none' and supply precomputed vectors at import. Useful when you already run a custom embedding pipeline or need a model Weaviate does not host.
Module Configuration
Each vectorizer accepts options in moduleConfig, such as the model name or dimensions. Set them at the class level to control how embeddings are produced.
module_config = {
'text2vec-openai': {'model': 'text-embedding-3-small', 'type': 'text'}
}
print(module_config['text2vec-openai']['model'])Consistency at Query Time
The same vectorizer embeds your query so it lives in the same space as stored objects. This is why mixing models or changing the vectorizer after import breaks search consistency.
Auto vs Manual Trade-offs
When to use each:
- Auto-embedding — simplest, less code, Weaviate manages calls
- Manual vectors — full control, custom models, batch pre-processing
Putting It Together
Pick a vectorizer per class, skip irrelevant properties, configure the model, and let Weaviate auto-embed on import. Or set 'none' to bring your own vectors. Keep the vectorizer consistent between import and query.
Quick Check
Test your understanding of vectorizers.
Recap
You learned that Weaviate vectorizer modules auto-embed objects on import. Configure the module per class, skip non-meaningful properties, set the model in moduleConfig, or use 'none' to bring your own vectors. Keep the vectorizer consistent between import and query for valid search.
Preguntas frecuentes
¿La lección «Módulos vectorizer y generación automática de embeddings» es gratis?
Sí — el texto completo de «Módulos vectorizer y generación automática de embeddings» es gratis para leer aquí en la web. Para practicarla de forma interactiva (editor de código integrado y tutor de IA 24/7) y desbloquear el resto del curso de Vector Databases: Pinecone, Weaviate & pgvector, actualiza a CoddyKit PRO. El curso de Vector Databases: Pinecone, Weaviate & pgvector incluye 4 lecciones en total.
¿Qué aprenderé en «Módulos vectorizer y generación automática de embeddings»?
Aprenda cómo los módulos vectorizer de Weaviate convierten automáticamente sus objetos de datos en vectores durante la importación y cómo configurarlos por clase y propiedad. Practicas Vector Databases: Pinecone, Weaviate & pgvector con código real que ejecutas directamente en el navegador, y un tutor de IA 24/7 responde tus preguntas mientras trabajas en la lección.
¿Necesito experiencia previa para empezar Vector Databases: Pinecone, Weaviate & pgvector?
No se requiere experiencia previa. Vector Databases: Pinecone, Weaviate & pgvector en CoddyKit está estructurado para principiantes hasta estudiantes avanzados, así que puedes empezar aquí o desde el inicio y avanzar a tu ritmo. Esta es la lección 4 de 4.
¿Cuánto tiempo toma la lección «Módulos vectorizer y generación automática de embeddings»?
La mayoría de las lecciones de CoddyKit toman alrededor de 5–10 minutos. Cada una es compacta e interactiva, así que avanzas constantemente y retomas exactamente por donde dejaste en la web y la app.
¿Puedo escribir y ejecutar código en esta lección de Vector Databases: Pinecone, Weaviate & pgvector?
Sí. Cada lección de Vector Databases: Pinecone, Weaviate & pgvector incluye un editor de código integrado, así que escribes y ejecutas código real directamente en tu navegador y obtienes retroalimentación instantánea de IA — sin configuración local necesaria.
Todas las lecciones de este curso
- Definición de esquemas en Weaviate
- Importación de objetos de datos
- Consultas GraphQL en Weaviate
- Módulos vectorizer y generación automática de embeddings