الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)
نماذج «تفكّر» قبل الإجابة — سلاسل التفكير الداخلية، والحوسبة أثناء الاختبار، والتصحيح الذاتي.
الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال) درس مجاني في AI Agents على CoddyKit. هذا هو الدرس 1 من أصل 4. يمكنك قراءة الدرس كاملاً أدناه مجاناً — ثم تمرن عليه مباشرة في المتصفح باستخدام محرر أكواد مدمج ومدرس ذكاء اصطناعي متاح 24/7. هذا الدرس جزء من مسار التعلم في AI Agents، وتقدمك يتزامن عبر الويب وتطبيق CoddyKit. تتضمن دورة AI Agents 4 دروس في المجموع.
بعض أجزاء هذا الدرس لم تُترجم بعد وتظهر باللغة الإنجليزية.
فئة جديدة من النماذج
قدّم OpenAI o1 (سبتمبر 2024) «نماذج الاستدلال» — وهي نماذج LLM تستدل صراحةً خطوة بخطوة قبل إنتاج الإجابة الظاهرة. وتشمل النماذج اللاحقة o3 وDeepSeek R1 وClaude مع التفكير الممتد وGemini 2.5 thinking وغيرها الكثير.
آلية عملها
بدلًا من إنشاء الإجابة فورًا، يقوم النموذج بما يلي:
- ينتج سلسلة داخلية طويلة من «التفكير» (على نمط CoT)
- يستكشف أساليب متعددة
- يصحّح نفسه
- ثم يصدر الإجابة النهائية الظاهرة
الحوسبة وقت الاختبار
يمكنكم اختيار مقدار «التفكير» الذي ينفذه النموذج. فكلما زادت الرموز المنفقة على التفكير، تحسنت الإجابات في المسائل الصعبة. والمقابل هو زمن الاستجابة والتكلفة.
OpenAI o-Series API
response = client.chat.completions.create(
model='o3-mini',
messages=[{'role': 'user', 'content': 'Solve this puzzle...'}],
reasoning_effort='high' # low / medium / high
)
print(response.choices[0].message.content)
print(response.usage.reasoning_tokens) # how many 'thinking' tokens were usedAnthropic Extended Thinking
response = client.messages.create(
model='claude-sonnet-4-5',
max_tokens=8192,
thinking={'type': 'enabled', 'budget_tokens': 4096},
messages=[{'role': 'user', 'content': 'Hard reasoning problem'}]
)
# response.content includes 'thinking' blocks + 'text' final answerمتى تتألق نماذج الاستدلال
- الرياضيات متعددة الخطوات
- إنشاء التعليمات البرمجية ذات المنطق المعقد
- الاستدلال القانوني أو العلمي
- التخطيط الذي يتطلب استشراف الخطوات التالية
في الاختبارات: يحقق o3 أكثر من 90% في AIME ونتائج مرتفعة في GPQA — متفوقًا بفارق كبير على النماذج غير الاستدلالية.
متى تكون النماذج القياسية أفضل
- المحادثة أو الأسئلة والأجوبة البسيطة — التفكير هنا مهدَر
- المسارات الحساسة لزمن الاستجابة — التفكير يضيف ثواني
- المهام المجمّعة الحساسة للتكلفة — التفكير يضاعف التكلفة
- مهام الأسلوب أو التنسيق — لا تقدم فائدة
هيكل التكلفة
تُحتسب رموز الاستدلال ضمن التسعير. وقد يستخدم o3-mini بأعلى مستوى من الجهد بين 10 آلاف و100 ألف رمز تفكير لكل سؤال. وقد تبلغ التكلفة من 0.10 إلى 1 دولار لكل سؤال في نماذج الاستدلال الأكبر.
داخل حلقات الوكلاء
استخدام نموذج استدلال بوصفه المخطّط داخل وكيل أكبر:
- نموذج الاستدلال: يخطط ويقرر ويقيّم
- النموذج القياسي: ينفّذ الخطوات
- استدعاءات الأدوات: تعمل كالمعتاد
تحصلون على أفضل ما في العالمين: استدلال عميق حيث تكون الحاجة إليه، وتنفيذ منخفض التكلفة في المواضع الأخرى.
لا تفرضوا CoT من الخارج
لم تعودوا بحاجة إلى مطالبات مثل «لنفكر خطوة بخطوة» مع نماذج الاستدلال، فهي تنفذ CoT داخليًا بالفعل. بل إن إضافتها قد تضر فعليًا.
الاستدلال مفتوح المصدر
تجلب DeepSeek R1 وR1-Distill وغيرهما الاستدلال إلى النماذج ذات الأوزان المفتوحة. وهي متاحة على HuggingFace وTogether AI وغيرهما.
آفاق البحث
- الضبط بالتأمل — تدريب النماذج على نقد نفسها
- الاستدلال القائم على البحث — Tree-of-Thoughts وMCTS أثناء الاستدلال
- التدريب وقت الاختبار — تكييف الأوزان لكل استعلام
تنبيه: التفكير الصندوقي الأسود
تكون «أفكار» نماذج الاستدلال مخفية عنكم عادةً (OpenAI) أو ملخّصة (Anthropic). وتزيد الشفافية المحدودة صعوبة تصحيح الأخطاء؛ لذا اعتمدوا بدلًا من ذلك على تقييمات المدخلات والمخرجات.
متى تستخدمون نماذج الاستدلال
لأي مهمة تستحق نماذج الاستدلال التكلفة الإضافية أكثر من غيرها؟
مراجعة سريعة
تبادل نماذج الاستدلال (o1 وo3 وR1 وClaude مع التفكير الممتد) الوقت والتكلفة مقابل الجودة في المهام الصعبة. استخدموها كمخطّط أو حَكَم داخل الوكلاء. وتجاوزوها في المحادثات البسيطة.
الأسئلة الشائعة
هل درس «الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)» مجاني؟
نعم — نص درس «الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)» كامل متاح مجاناً هنا على الويب. لتمرينه بشكل تفاعلي (محرر أكواد مدمج ومدرس ذكاء اصطناعي متاح 24/7) وفتح باقي دورة AI Agents، انتقل إلى CoddyKit PRO. تتضمن دورة AI Agents 4 دروس في المجموع.
ماذا ستتعلم في «الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)»؟
نماذج «تفكّر» قبل الإجابة — سلاسل التفكير الداخلية، والحوسبة أثناء الاختبار، والتصحيح الذاتي. تتمرن على AI Agents مع أكواد عملية تشغلها مباشرة في المتصفح، ومدرس ذكاء اصطناعي متاح 24/7 يجيب على أسئلتك أثناء عملك.
هل أحتاج إلى خبرة سابقة لأبدأ AI Agents؟
لا تُشترط خبرة سابقة. AI Agents على CoddyKit منظم للمبتدئين حتى المتقدمين، لذا يمكنك البدء من هنا أو من البداية والتقدم بسرعتك الخاصة. هذا هو الدرس 1 من أصل 4.
كم من الوقت يستغرق درس «الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)»؟
معظم دروس CoddyKit تستغرق حوالي 5–10 دقائق. كل منها موجز وتفاعلي، لذا تحرز تقدماً مستمراً وتستأنف من حيث توقفت عبر الويب والتطبيق.
هل يمكنني كتابة وتشغيل أكواد في درس AI Agents هذا؟
نعم. كل درس في AI Agents يتضمن محرر أكواد مدمج، لذا تكتب وتشغل أكواداً حقيقية مباشرة في متصفحك وتحصل على تعليقات فورية من الذكاء الاصطناعي — بدون إعداد محلي.
جميع الدروس في هذه الدورة
- الاستدلال الوكيلي (o1 وo3 ونماذج الاستدلال)
- الوكلاء الهجينون الرمزيون والعصبيون
- الوكلاء متعددو الوسائط (الرؤية والصوت والإجراء)
- مسائل مفتوحة: المتانة والمواءمة والذاكرة طويلة الأمد