Análisis y validación de salidas estructuradas
Obligue a los LLM a devolver datos estructurados fiables mediante analizadores de salida y esquemas, y valide o reintente cuando el modelo produzca una salida con formato incorrecto.
Análisis y validación de salidas estructuradas es una lección gratuita de AI Agents with LangChain & Autonomous Workflows en CoddyKit. Esta es la lección 4 de 4. Puedes leer la lección completa abajo gratuitamente — luego la practicas en el navegador con un editor de código integrado y un tutor de IA 24/7. Forma parte de la ruta de aprendizaje de AI Agents with LangChain & Autonomous Workflows, y tu progreso se sincroniza en la web y la app de CoddyKit. El curso de AI Agents with LangChain & Autonomous Workflows incluye 4 lecciones en total.
Partes de esta lección aún no han sido traducidas y se muestran en inglés.
The Problem with Free Text
LLMs return prose by default, but your code needs structured data: JSON, a list, a typed object. Parsing free text with regex is fragile.
This lesson covers getting reliable structured output from models.
Asking for a Format
The first step is simply instructing the model to produce a specific format. But instruction alone is not enough; models drift, add prose, or wrap output in markdown.
prompt = 'Extract name and age as JSON: "Lena is 30"'
# model might reply: 'Sure! {"name":"Lena","age":30}'Output Parsers
LangChain output parsers do two jobs: they generate format instructions to inject into the prompt, and they parse the model's response back into a structured object.
from langchain.output_parsers import CommaSeparatedListOutputParser
parser = CommaSeparatedListOutputParser()
print(parser.get_format_instructions())Schema-Based Parsing
Define the shape you want with a schema (e.g. a Pydantic model). The parser turns it into instructions and validates the result against the fields and types.
from pydantic import BaseModel
class Person(BaseModel):
name: str
age: intInjecting Format Instructions
Add the parser's instructions into your prompt template so the model knows exactly what structure to emit.
template = 'Extract info.\n{format_instructions}\nText: {text}'
prompt = template.format(
format_instructions=parser.get_format_instructions(),
text='Lena is 30')Parsing the Response
After the model replies, the parser converts the text into your typed object, raising an error if it does not match the schema.
result = parser.parse(model_output)
print(result.name, result.age)Handling Malformed Output
Models occasionally produce invalid JSON. A retry/fixing parser detects the failure and asks the model to correct its own output, turning a hard crash into a recoverable step.
from langchain.output_parsers import RetryOutputParser
robust = RetryOutputParser.from_llm(parser=parser, llm=llm)Native JSON / Tool Modes
Many modern models support a JSON mode or function/tool calling that constrains output to valid structured data at the API level. When available, this is far more reliable than prompt instructions alone.
Validation Beyond Types
A value can be the right type but still wrong: a negative age, an empty required field. Add validators so business rules are enforced, not just the data shape.
if result.age < 0 or result.age > 130:
raise ValueError('age out of range')Why It Matters for Agents
Agents chain steps together, feeding one output into the next. If a step emits malformed data, the whole chain breaks. Structured, validated output is what makes multi-step agents dependable.
A Reliable Output Workflow
Putting it together:
- Define a schema for the data you need
- Inject format instructions into the prompt
- Prefer native JSON/tool mode when available
- Parse and validate, with a retry parser as a safety net
Quick Check
Test your understanding of structured output.
Recap
You learned to get reliable structured data from LLMs.
- Output parsers generate instructions and parse responses
- Schemas validate shape and types
- Retry parsers recover from malformed output
- Native JSON/tool modes are most reliable when available
Aprende AI Agents with LangChain & Autonomous Workflows con un tutor de IA — gratis
Escribe y ejecuta código real en tu navegador, obtén ayuda instantánea de un tutor de IA disponible 24/7 y continúa donde lo dejaste en la web o en la aplicación.
- Cursos
- 12
- Lecciones
- 50
Preguntas frecuentes
¿La lección «Análisis y validación de salidas estructuradas» es gratis?
Sí — el texto completo de «Análisis y validación de salidas estructuradas» es gratis para leer aquí en la web. Para practicarla de forma interactiva (editor de código integrado y tutor de IA 24/7) y desbloquear el resto del curso de AI Agents with LangChain & Autonomous Workflows, actualiza a CoddyKit PRO. El curso de AI Agents with LangChain & Autonomous Workflows incluye 4 lecciones en total.
¿Qué aprenderé en «Análisis y validación de salidas estructuradas»?
Obligue a los LLM a devolver datos estructurados fiables mediante analizadores de salida y esquemas, y valide o reintente cuando el modelo produzca una salida con formato incorrecto. Practicas AI Agents with LangChain & Autonomous Workflows con código real que ejecutas directamente en el navegador, y un tutor de IA 24/7 responde tus preguntas mientras trabajas en la lección.
¿Necesito experiencia previa para empezar AI Agents with LangChain & Autonomous Workflows?
No se requiere experiencia previa. AI Agents with LangChain & Autonomous Workflows en CoddyKit está estructurado para principiantes hasta estudiantes avanzados, así que puedes empezar aquí o desde el inicio y avanzar a tu ritmo. Esta es la lección 4 de 4.
¿Cuánto tiempo toma la lección «Análisis y validación de salidas estructuradas»?
La mayoría de las lecciones de CoddyKit toman alrededor de 5–10 minutos. Cada una es compacta e interactiva, así que avanzas constantemente y retomas exactamente por donde dejaste en la web y la app.
¿Puedo escribir y ejecutar código en esta lección de AI Agents with LangChain & Autonomous Workflows?
Sí. Cada lección de AI Agents with LangChain & Autonomous Workflows incluye un editor de código integrado, así que escribes y ejecutas código real directamente en tu navegador y obtienes retroalimentación instantánea de IA — sin configuración local necesaria.
Todas las lecciones de este curso
- Técnicas eficaces de diseño de prompts
- Integración de LLM con LangChain
- Gestión de parámetros y costes de los modelos
- Análisis y validación de salidas estructuradas