0Pricing
Prompt Engineering & LLM Optimization for Developers · Урок

Рефлексия агента и циклы самокоррекции

Сделайте агентов умнее, позволив им критиковать и исправлять собственную работу. Изучите шаблон рефлексии, узнайте, когда его применять и как ограничивать его в рабочей среде.

«Рефлексия агента и циклы самокоррекции» — бесплатный урок Prompt Engineering & LLM Optimization for Developers на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Prompt Engineering & LLM Optimization for Developers, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Prompt Engineering & LLM Optimization for Developers содержит 4 уроков всего.

Части этого урока еще не переведены и отображаются на английском.

What is Reflection?

Reflection is an agent pattern where the model reviews its own output, identifies flaws, and produces an improved version — without a human in the loop.

It turns a one-shot answer into an iterative draft-then-revise process.

The Generator-Critic Pattern

Two roles drive reflection:

  • Generator: produces a candidate answer
  • Critic: evaluates it against criteria and suggests fixes

They can be the same model with different prompts.

A Basic Reflection Loop

Generate, critique, then regenerate using the critique. Repeat until the critic is satisfied or a limit is hit.

let draft = generate(task);
for (let i = 0; i < maxIters; i++) {
  const fb = critique(task, draft);
  if (fb.ok) break;
  draft = revise(task, draft, fb.notes);
}

Writing the Critic Prompt

A good critic is specific. Give it explicit checklist criteria so feedback is actionable rather than vague praise.

Review the answer for:
1. Correctness
2. Completeness
3. Following the format spec
List concrete problems, or reply DONE.

Reflexion with Memory

The Reflexion technique stores past mistakes as text memory. The agent reads its prior reflections before the next attempt, so it does not repeat errors.

Tool-Grounded Reflection

Reflection is far stronger when the critic can run tests, compile code, or query data — replacing opinion with evidence.

const result = runTests(draft);
if (!result.passed) {
  draft = revise(task, draft, result.failures);
}

Bounding the Loop

Unbounded reflection can loop forever or burn tokens. Always cap iterations and add an early exit when the critic approves.

const MAX_ITERS = 3;
let iters = 0;
while (!approved && iters++ < MAX_ITERS) { /* ... */ }

Diminishing Returns

Quality usually plateaus after 2-3 cycles. Track whether each revision actually improves a measurable score; stop reflecting once gains stall.

Cost vs Quality

Each reflection cycle is extra LLM calls. Reserve reflection for high-value or error-prone tasks (code, planning) and skip it for simple ones.

Avoiding Self-Reinforcing Errors

A model can confidently approve its own wrong answer. Use a different model or external tools as the critic when correctness is critical.

Combining with Planning

In a larger agent, reflection sits after each major step: act, observe, reflect, adjust the plan. This makes long autonomous workflows far more robust.

Quick Check

Test your understanding.

Recap

You learned the reflection pattern: a generator-critic loop where the agent critiques and revises its own work. Use specific critic criteria, ground critiques in tools, store reflections as memory, bound iterations, and use an independent critic for high-stakes correctness.

Часто задаваемые вопросы

Урок «Рефлексия агента и циклы самокоррекции» бесплатный?

Да — полный текст урока «Рефлексия агента и циклы самокоррекции» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Prompt Engineering & LLM Optimization for Developers, подпишись на CoddyKit PRO. Курс Prompt Engineering & LLM Optimization for Developers содержит 4 уроков всего.

Чему я научусь в уроке «Рефлексия агента и циклы самокоррекции»?

Сделайте агентов умнее, позволив им критиковать и исправлять собственную работу. Изучите шаблон рефлексии, узнайте, когда его применять и как ограничивать его в рабочей среде. Ты практикуешь Prompt Engineering & LLM Optimization for Developers с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.

Нужен ли мне опыт, чтобы начать Prompt Engineering & LLM Optimization for Developers?

Предыдущий опыт не требуется. Prompt Engineering & LLM Optimization for Developers на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.

Сколько времени занимает урок «Рефлексия агента и циклы самокоррекции»?

Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.

Можно ли писать и запускать код в этом уроке Prompt Engineering & LLM Optimization for Developers?

Да. Каждый урок Prompt Engineering & LLM Optimization for Developers включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.

Все уроки этого курса

  1. Проектирование мультиагентных систем
  2. Управление памятью и состоянием агентов
  3. Автономная автоматизация рабочих процессов
  4. Рефлексия агента и циклы самокоррекции
← Назад к Prompt Engineering & LLM Optimization for Developers