Solicitar una finalización al host
Llame al cliente para ejecutar un prompt de un LLM.
Solicitar una finalización al host es una lección gratuita de MCP Academy en CoddyKit. Esta es la lección 2 de 4. Puedes leer la lección completa abajo gratuitamente — luego la practicas en el navegador con un editor de código integrado y un tutor de IA 24/7. Forma parte de la ruta de aprendizaje de MCP Academy, y tu progreso se sincroniza en la web y la app de CoddyKit. El curso de MCP Academy incluye 4 lecciones en total.
Partes de esta lección aún no han sido traducidas y se muestran en inglés.
The Request Method
To ask for a generation, your server sends a sampling/createMessage request to the client over the protocol.
{ "method": "sampling/createMessage" }Reach the Client via Context
Inside a tool you get a Context object. Its session is your line back to the client that can run sampling.
async def tool(topic: str, ctx: Context) -> str:
...Call create_message
The Python SDK exposes ctx.session.create_message. Await it, pass your messages, and you get the model’s reply back.
result = await ctx.session.create_message(
messages=[...],
max_tokens=100,
)Build a SamplingMessage
Each turn you send is a SamplingMessage with a role like user and a content block holding the actual text.
SamplingMessage(role="user",
content=TextContent(type="text", text=prompt))Wrap Text in TextContent
Plain text goes inside TextContent with type set to text. That typed wrapper is how MCP carries the message body.
TextContent(type="text", text="Summarize this report")Always Set max_tokens
Give the model a ceiling with max_tokens. It caps how long the generated reply can be and keeps cost predictable.
max_tokens=200Read the Result
The reply’s content is a typed block. Check its type, and if it is text, read result.content.text for the answer.
if result.content.type == "text":
return result.content.textInspect Which Model Ran
The result also reports the model the client chose, so you can log exactly which model produced your output.
print(result.model) # e.g. claude-3-sonnet-20240307Know Why It Stopped
A stopReason field tells you why generation ended — like endTurn or hitting your max token limit.
result.stopReason # "endTurn"A Whole Tool, Briefly
So a sampling tool is: build a message, await create_message, then return the text — just a few lines.
r = await ctx.session.create_message(
messages=[msg], max_tokens=100)
return r.content.textIt Can Be Rejected
Remember the request may be denied by the user. Treat a rejection like any failure and handle it gracefully.
Quick Check
One detail about making the call from your tool.
Recap
Send sampling/createMessage via ctx.session, wrap prompts in SamplingMessage and TextContent, set max_tokens, then read result.content.text. 💬
Preguntas frecuentes
¿La lección «Solicitar una finalización al host» es gratis?
Sí — el texto completo de «Solicitar una finalización al host» es gratis para leer aquí en la web. Para practicarla de forma interactiva (editor de código integrado y tutor de IA 24/7) y desbloquear el resto del curso de MCP Academy, actualiza a CoddyKit PRO. El curso de MCP Academy incluye 4 lecciones en total.
¿Qué aprenderé en «Solicitar una finalización al host»?
Llame al cliente para ejecutar un prompt de un LLM. Practicas MCP Academy con código real que ejecutas directamente en el navegador, y un tutor de IA 24/7 responde tus preguntas mientras trabajas en la lección.
¿Necesito experiencia previa para empezar MCP Academy?
No se requiere experiencia previa. MCP Academy en CoddyKit está estructurado para principiantes hasta estudiantes avanzados, así que puedes empezar aquí o desde el inicio y avanzar a tu ritmo. Esta es la lección 2 de 4.
¿Cuánto tiempo toma la lección «Solicitar una finalización al host»?
La mayoría de las lecciones de CoddyKit toman alrededor de 5–10 minutos. Cada una es compacta e interactiva, así que avanzas constantemente y retomas exactamente por donde dejaste en la web y la app.
¿Puedo escribir y ejecutar código en esta lección de MCP Academy?
Sí. Cada lección de MCP Academy incluye un editor de código integrado, así que escribes y ejecutas código real directamente en tu navegador y obtienes retroalimentación instantánea de IA — sin configuración local necesaria.
Todas las lecciones de este curso
- Qué permite el muestreo
- Solicitar una finalización al host
- Definir mensajes y preferencias
- Aprobación con una persona en el circuito