Refleksi Agen dan Putaran Koreksi Mandiri
Buat agen lebih cerdas dengan membiarkannya mengkritik dan merevisi pekerjaannya sendiri. Pelajari pola refleksi, kapan menggunakannya, dan cara membatasinya untuk produksi.
Refleksi Agen dan Putaran Koreksi Mandiri adalah pelajaran Prompt Engineering & LLM Optimization for Developers gratis di CoddyKit. Ini adalah pelajaran 4 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar Prompt Engineering & LLM Optimization for Developers, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus Prompt Engineering & LLM Optimization for Developers mencakup 4 pelajaran total.
Bagian dari pelajaran ini belum diterjemahkan dan ditampilkan dalam bahasa Inggris.
What is Reflection?
Reflection is an agent pattern where the model reviews its own output, identifies flaws, and produces an improved version — without a human in the loop.
It turns a one-shot answer into an iterative draft-then-revise process.
The Generator-Critic Pattern
Two roles drive reflection:
- Generator: produces a candidate answer
- Critic: evaluates it against criteria and suggests fixes
They can be the same model with different prompts.
A Basic Reflection Loop
Generate, critique, then regenerate using the critique. Repeat until the critic is satisfied or a limit is hit.
let draft = generate(task);
for (let i = 0; i < maxIters; i++) {
const fb = critique(task, draft);
if (fb.ok) break;
draft = revise(task, draft, fb.notes);
}Writing the Critic Prompt
A good critic is specific. Give it explicit checklist criteria so feedback is actionable rather than vague praise.
Review the answer for:
1. Correctness
2. Completeness
3. Following the format spec
List concrete problems, or reply DONE.Reflexion with Memory
The Reflexion technique stores past mistakes as text memory. The agent reads its prior reflections before the next attempt, so it does not repeat errors.
Tool-Grounded Reflection
Reflection is far stronger when the critic can run tests, compile code, or query data — replacing opinion with evidence.
const result = runTests(draft);
if (!result.passed) {
draft = revise(task, draft, result.failures);
}Bounding the Loop
Unbounded reflection can loop forever or burn tokens. Always cap iterations and add an early exit when the critic approves.
const MAX_ITERS = 3;
let iters = 0;
while (!approved && iters++ < MAX_ITERS) { /* ... */ }Diminishing Returns
Quality usually plateaus after 2-3 cycles. Track whether each revision actually improves a measurable score; stop reflecting once gains stall.
Cost vs Quality
Each reflection cycle is extra LLM calls. Reserve reflection for high-value or error-prone tasks (code, planning) and skip it for simple ones.
Avoiding Self-Reinforcing Errors
A model can confidently approve its own wrong answer. Use a different model or external tools as the critic when correctness is critical.
Combining with Planning
In a larger agent, reflection sits after each major step: act, observe, reflect, adjust the plan. This makes long autonomous workflows far more robust.
Quick Check
Test your understanding.
Recap
You learned the reflection pattern: a generator-critic loop where the agent critiques and revises its own work. Use specific critic criteria, ground critiques in tools, store reflections as memory, bound iterations, and use an independent critic for high-stakes correctness.
Belajar Prompt Engineering & LLM Optimization for Developers dengan tutor AI — gratis
Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.
- Kursus
- 12
- Pelajaran
- 48
Pertanyaan yang Sering Diajukan
Apakah pelajaran “Refleksi Agen dan Putaran Koreksi Mandiri” gratis?
Ya — teks lengkap “Refleksi Agen dan Putaran Koreksi Mandiri” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus Prompt Engineering & LLM Optimization for Developers, upgrade ke CoddyKit PRO. Kursus Prompt Engineering & LLM Optimization for Developers mencakup 4 pelajaran total.
Apa yang akan aku pelajari di “Refleksi Agen dan Putaran Koreksi Mandiri”?
Buat agen lebih cerdas dengan membiarkannya mengkritik dan merevisi pekerjaannya sendiri. Pelajari pola refleksi, kapan menggunakannya, dan cara membatasinya untuk produksi. Kamu berlatih Prompt Engineering & LLM Optimization for Developers dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.
Apakah aku perlu pengalaman untuk memulai Prompt Engineering & LLM Optimization for Developers?
Tidak diperlukan pengalaman sebelumnya. Prompt Engineering & LLM Optimization for Developers di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 4 dari 4.
Berapa lama pelajaran “Refleksi Agen dan Putaran Koreksi Mandiri” memakan waktu?
Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.
Bisakah aku menulis dan menjalankan kode dalam pelajaran Prompt Engineering & LLM Optimization for Developers ini?
Ya. Setiap pelajaran Prompt Engineering & LLM Optimization for Developers menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.
Semua pelajaran dalam kursus ini
- Merancang Sistem Multi-Agen
- Pengelolaan Memori dan Status untuk Agen
- Otomatisasi Alur Kerja Otonom
- Refleksi Agen dan Putaran Koreksi Mandiri