AI एजेंट · पाठ

दोहरावदार स्व-सुधार चक्र

tests चलाइए, विफलताओं को पार्स कीजिए और मॉडल से सुधार करने को कहिए — यही हर आधुनिक कोड एजेंट का आंतरिक चक्र है।

पाठ 3, कुल 4 में से14 चरण

दोहरावदार स्व-सुधार चक्र, CoddyKit पर AI एजेंट का एक निःशुल्क पाठ है। यह 4 में से 3वाँ पाठ है। आप नीचे पूरा पाठ निःशुल्क पढ़ सकते हैं—फिर अंतर्निहित कोड संपादक और 24/7 एआई ट्यूटर के साथ ब्राउज़र में इसका व्यावहारिक अभ्यास कर सकते हैं। यह AI एजेंट सीखने के मार्ग का हिस्सा है और आपकी प्रगति वेब तथा CoddyKit ऐप पर सिंक होती रहती है। AI एजेंट पाठ्यक्रम में कुल 4 पाठ शामिल हैं।

इस पाठ के कुछ हिस्सों का अभी तक अनुवाद नहीं हुआ है और वे अंग्रेज़ी में दिखाए गए हैं।

स्व-सुधार क्यों

पहले प्रयास अक्सर विफल होते हैं। कोडिंग एजेंट की परिभाषित विशेषता यह है कि वह:

  1. कोड चलाए
  2. त्रुटि पढ़े
  3. कोड ठीक करे
  4. दोहराए

यही आंतरिक चक्र वास्तविक कोडिंग एजेंटों को केवल पाठ-पूर्णता वाले प्रदर्शनों से अलग करता है।

The Loop

def code_until_pass(task, max_iters=10):
    write_initial_code(task)
    for i in range(max_iters):
        result = run_tests()
        if result.passed:
            return 'success'
        fix_prompt = f'Tests failed:\n{result.stderr}\nRead the code, identify the bug, and fix it with edit_file.'
        agent.run(fix_prompt)
    return 'gave up'

उपयोगी प्रतिक्रिया दें

सामान्य "परीक्षण विफल हुए" जैसी सूचना से कोई कार्रवाई तय नहीं की जा सकती। पूरी त्रुटि सामग्री, स्टैक ट्रेस और अपेक्षित-बनाम-वास्तविक परिणाम भेजें:

fix_prompt = f'''
The tests failed with this output:

FAILED tests/test_utils.py::test_add
  AssertionError: expected 4, got 5
  at line 42

Fix the code by editing the file.
'''

दोबारा सुधारने से पहले फिर पढ़ें

मॉडल बातें भूल जाते हैं। हर पुनरावृत्ति में उन्हें फ़ाइल की वर्तमान स्थिति फिर से पढ़ने के लिए बाध्य करें:

fix_prompt = 'First, read_file the failing module. Then edit it.'

दोहराई गई विफलताओं का पता लगाएँ

यदि समान त्रुटियों के साथ वही परीक्षण लगातार 3 पुनरावृत्तियों में विफल हो, तो एजेंट अटक गया है। फिर से योजना बनाएँ या मामला आगे भेजें:

if same_error_count >= 3:
    return 'stuck — replanning needed'

Replan When Stuck

replan_prompt = f'''
The current approach is not working. The repeated error is:
{error}

Describe ONE alternative approach to solving the task.
'''

अधिक सक्षम मॉडल तक भेजें

यदि सस्ता मॉडल अटक जाए, तो अधिक सक्षम मॉडल के साथ SAME सुधार-निर्देश का फिर से प्रयास करें:

if iter > 3 and using_cheap_model:
    switch_to_big_model()
    # often unblocks 50% of stuck cases

हर संपादन के बाद सत्यापित करें

बहुत सारे संपादन एक साथ करके फिर सत्यापन न करें — इससे विफलताओं का कारण पता लगाना बहुत कठिन होता है। एक चीज़ संपादित करें, सत्यापित करें, फिर अगली चीज़ संपादित करें।

संदर्भ में परीक्षण का परिणाम शामिल करें

हालिया परीक्षण-परिणाम एजेंट के संदर्भ में रखें। इसके बिना एजेंट नहीं जानता कि उसने अभी क्या किया:

messages.append({'role': 'tool', 'content': f'After your edit, tests now: {test_summary}'})

अनंत "सुधार" चक्रों से बचें

पुनरावृत्तियों की निश्चित अधिकतम सीमा रखें। यदि अधिकतम पुनरावृत्तियों की सीमा तक पहुँचने पर कार्य पूरा न हो, तो मामला किसी मानव तक भेजें:

if iter == MAX_ITERS - 1:
    notify_human(task, current_state, error_history)
    break

स्व-सुधार के मापदंडों पर नज़र रखें

  • सफलता तक पहुँचने के लिए औसत पुनरावृत्तियाँ
  • अधिकतम पुनरावृत्ति सीमा पर हार मानने वाले कार्य
  • 1 पुनरावृत्ति में सफल होने वाले कार्य बनाम 5 पुनरावृत्तियों में सफल होने वाले कार्य

ये मापदंड निर्देशों और उपकरणों में सुधार लाने में मदद करते हैं।

परीक्षणों के बिना स्व-आलोचना

जिन कार्यों के लिए स्पष्ट परीक्षण-संग्रह नहीं है, उनमें आलोचक चरण जोड़ें: जमा करने से पहले एजेंट से अपने अंतर की समीक्षा करवाएँ:

critique_prompt = '''
Review your changes for:
- Off-by-one errors
- Missing error handling
- Breaking other tests
Return FIX LATER or DONE.
'''

स्व-सुधार के आदान

एजेंट के "सुधार चक्र" के लिए सबसे महत्वपूर्ण एकल आदान क्या है?

पुनरावलोकन

चलाएँ -> त्रुटि -> सुधारें -> दोहराएँ। ठोस त्रुटियाँ दें। दोबारा सुधारने से पहले फिर पढ़ें। रुकावटों का पता लगाएँ। अटकने पर अधिक सक्षम मॉडल या मानव तक मामला भेजें।

शुरुआत निःशुल्क

एआई शिक्षक के साथ AI एजेंट सीखें — निःशुल्क

अपने ब्राउज़र में वास्तविक कोड लिखें और चलाएँ, चौबीसों घंटे एआई शिक्षक से तुरंत सहायता पाएँ, और वेब या ऐप पर वहीं से शुरू करें जहाँ आपने छोड़ा था।

पाठ्यक्रम
60
पाठ
239

अक्सर पूछे जाने वाले प्रश्न

क्या “दोहरावदार स्व-सुधार चक्र” पाठ निःशुल्क है?

हाँ—“दोहरावदार स्व-सुधार चक्र” का पूरा पाठ यहाँ वेब पर निःशुल्क पढ़ा जा सकता है। इंटरैक्टिव अभ्यास (अंतर्निहित कोड संपादक और 24/7 एआई ट्यूटर) करने और AI एजेंट पाठ्यक्रम का बाकी हिस्सा अनलॉक करने के लिए CoddyKit PRO लें। AI एजेंट पाठ्यक्रम में कुल 4 पाठ शामिल हैं।

“दोहरावदार स्व-सुधार चक्र” में मैं क्या सीखूँगा?

tests चलाइए, विफलताओं को पार्स कीजिए और मॉडल से सुधार करने को कहिए — यही हर आधुनिक कोड एजेंट का आंतरिक चक्र है। आप ब्राउज़र में सीधे चलाए जाने वाले व्यावहारिक कोड के साथ AI एजेंट का अभ्यास करते हैं, और पाठ पूरा करते समय 24/7 एआई ट्यूटर आपके प्रश्नों के उत्तर देता है।

क्या AI एजेंट शुरू करने के लिए मुझे किसी अनुभव की आवश्यकता है?

पहले के अनुभव की आवश्यकता नहीं है। CoddyKit पर AI एजेंट शुरुआती से लेकर उन्नत शिक्षार्थियों तक सभी के लिए व्यवस्थित किया गया है, इसलिए आप यहीं से या शुरुआत से सीखना शुरू कर सकते हैं और अपनी गति से आगे बढ़ सकते हैं। यह 4 में से 3वाँ पाठ है।

“दोहरावदार स्व-सुधार चक्र” पाठ पूरा करने में कितना समय लगता है?

CoddyKit का अधिकांश पाठ लगभग 5–10 मिनट में पूरा हो जाता है। हर पाठ छोटा और संवादात्मक है, इसलिए आप लगातार प्रगति करते हैं और वेब या ऐप पर वहीं से सीखना जारी रख सकते हैं जहाँ आपने छोड़ा था।

क्या मैं इस AI एजेंट पाठ में कोड लिख और चला सकता हूँ?

हाँ। हर AI एजेंट पाठ में एक अंतर्निर्मित कोड संपादक शामिल है, जिससे आप सीधे अपने ब्राउज़र में वास्तविक कोड लिख और चला सकते हैं और तुरंत एआई प्रतिक्रिया पा सकते हैं—स्थानीय सेटअप की आवश्यकता नहीं है।

इस पाठ्यक्रम के सभी पाठ

  1. एजेंटिक पैटर्न: योजना-बनाना-क्रियान्वित करना-सत्यापित करना
  2. कोडिंग के लिए उपकरण सतहें (Read, Edit, Bash)
  3. दोहरावदार स्व-सुधार चक्र
  4. SWE-Agent और OpenDevin की संरचनाएँ
← AI एजेंट पर वापस जाएँ