لقد تغيّرت الطريقة التي «يفكّر» بها Claude تغيّرًا جذريًا خلال العام الماضي. كان التفكير الموسع (extended thinking) القديم يعمل بأن يحدد الإنسان عدد التوكنات التي يمكن للنموذج إنفاقها على الاستدلال. أما الجيل الحالي فيستبدل به التفكير التكيفي (adaptive thinking) — إذ يقرر النموذج بنفسه ما إذا كان سيفكّر ومدى عمق تفكيره. ومع Claude Opus 5 أصبح التفكير مفعّلًا افتراضيًا، فحتى الافتراض القديم القائل إن «غياب الإعداد يعني غياب التفكير» بات من الماضي.

يستعرض هذا المقال ما يفصل فعليًا بين التفكير الموسع والتفكير التكيفي، وكيف يختلف السلوك من نموذج إلى آخر، والمصائد التي يقع فيها من يُرحّلون شيفرتهم — أخطاء 400، ومخرجات مبتورة، وفواتير ترتفع بصمت. وكل ذلك مستند إلى وثائق Anthropic الرسمية.

التفكير: من الموسع إلى التكيفي

من «الإنسان يحدد العمق» إلى «النموذج هو من يقرر»

التغيير الجيلي في ثلاث خطوات

التفكير الموسع (القديم)
budget_tokens: 10000
الإنسان هو من يحدد ميزانية التفكير
التفكير التكيفي (الحالي)
type: "adaptive"
قرار التفكير ومقداره بيد النموذج
Opus 5 وما بعده
التفكير مفعّل افتراضيًا
العمق يُضبط الآن عبر effort
المصدر: وثائق Anthropic، «Thinking» و«Extended thinking» (حتى أغسطس 2026)

1. ما المقصود بالتفكير

التفكير هو المرحلة التي يعالج فيها Claude المشكلة بكلماته الخاصة قبل أن يبدأ كتابة الإجابة النهائية. فهو يعيد صياغة السؤال، ويجرّب عدة مقاربات، ويتحقق من النتائج الوسيطة، ويتخلى عن المسارات التي لا تصمد — ويُولَّد هذا كله على هيئة كتل محتوى thinking قبل الاستجابة. ويكون المردود أكبر ما يكون في المهام التي تحدد فيها جودةُ العمل الوسيط جودةَ الإجابة: الرياضيات، والبرمجة، والتحليل، ومهام الوكلاء طويلة الأمد.

غير أنه ليس مجانيًا. فكما تنص وثيقة Anthropic «Thinking» بوضوح، تُحتسب التوكنات التي ينفقها Claude على الاستدلال ضمن توكنات المخرجات في الفوترة وتُحسب ضمن max_tokens — والفوترة هي نفسها حتى في الإعدادات التي لا يُعاد فيها نص التفكير إليك إطلاقًا (انظر القسم 6). لذا فإن تصميم إعدادات التفكير لديك مسألة تكلفة وزمن استجابة بقدر ما هو مسألة جودة.

2. عصر التفكير الموسع — أنت من يحدد budget_tokens

كان التجسيد الأول هو التفكير الموسع. تُرفق thinking: {"type": "enabled", "budget_tokens": N} بالطلب، فيستدل Claude ضمن تلك الميزانية قبل أن يجيب. الإنسان هو من يحدد مقدار التفكير، في كل طلب. ووفقًا للوثائق الرسمية، القواعد هي:

  • الحد الأدنى 1,024 توكنًا. ترفض واجهة API القيم الأصغر من ذلك
  • يجب أن تكون أقل من max_tokens — فالتفكير يُحسب ضمنها، لذا لا بد من ترك مساحة للإجابة
  • الميزانية هدف تقريبي لا سقف صارم. يتفاوت الاستهلاك الفعلي بحسب المهمة، وكثيرًا ما ينهي Claude تفكيره قبل نفاد الميزانية بكثير
  • لميزانيات التفكير التي تتجاوز 32,000، توصي Anthropic بالمعالجة الدفعية لتجنّب انتهاء المهلة

مشكلة هذا التصميم واضحة: الميزانية المناسبة تختلف من مهمة إلى أخرى، ولا يستطيع الإنسان تخمينها مسبقًا. فالأسئلة البسيطة قد تحرق الميزانية التي خصصتها، والمشكلات الصعبة قد تختنق بها. كما أن تغيير قيمة الميزانية يُبطل ذاكرة التخزين المؤقت للموجّه (prompt cache) — وتبيّن الوثائق ذلك بمثال مُقاس.

3. التحول إلى التفكير التكيفي — النموذج هو من يقرر

هذا بالضبط ما جاء التفكير التكيفي، المقدَّم في 2026، ليحل محله. الإعداد سطر واحد: thinking: {"type": "adaptive"}. قرارُ التفكير من عدمه، ومدى عمقه، قرارٌ يتخذه Claude بنفسه بناءً على مدى صعوبة الطلب في نظره. فالمدخلات السهلة تحصل على إجابة فورية مع تخطي التفكير، والمشكلات الصعبة تحظى باستدلال عميق.

جرى الترحيل وفق الجدول الزمني المبيَّن في وثيقة Anthropic «Extended thinking»: أُهمل budget_tokens في Claude Opus 4.6 / Sonnet 4.6 (ما يزال يعمل هناك)، بينما ترفضه النماذج من Claude Opus 4.7 فصاعدًا بخطأ 400. وجّه شيفرة قديمة إلى نموذج جديد فتتوقف هكذا:

# القديم: التفكير الموسع (خطأ 400 على Opus 4.7 وما بعده)
"thinking": {"type": "enabled", "budget_tokens": 10000}
→ 400: "thinking.type.enabled" is not supported ...

# الجديد: التفكير التكيفي (العمق يُضبط عبر effort)
"thinking": {"type": "adaptive"},
"output_config": {"effort": "high"}

إعادة الكتابة نفسها صغيرة — احذف budget_tokens، وانتقل إلى adaptive، وسلّم التحكم في العمق إلى effort. لكن كما تحذّر الوثائق، هذا تغيير في السلوك لا تغيير في الصياغة فحسب. فمع الميزانية الثابتة كان Claude يفكّر في كل طلب؛ أما مع التفكير التكيفي فقد يتخطى التفكير كليًا على المدخلات السهلة عند مستويات effort المنخفضة.

4. كيف يتعامل كل نموذج مع التفكير: نظرة سريعة

الجزء المخادع هو أن سؤالَي «هل هو مفعّل افتراضيًا؟» و«هل يمكن إيقافه؟» يختلف جوابهما من نموذج إلى آخر. إليك الوثائق الرسمية مكثّفة في جدول واحد.

النموذج إذا لم تضبط شيئًا إيقاف التفكير budget_tokens
Claude Fable 5 / Mythos 5 التفكير مفعّل (دائمًا) غير ممكن (400) غير ممكن (400)
Claude Opus 5 التفكير مفعّل (تكيفي) فقط عند effort بمستوى high أو أدنى
مع الجمع بينه وبين xhigh / max: خطأ 400
غير ممكن (400)
Claude Sonnet 5 التفكير مفعّل (تكيفي) مسموح غير ممكن (400)
Claude Opus 4.8 / 4.7 لا تفكير (فعّله صراحةً بضبط adaptive) مسموح غير ممكن (400)
Claude Opus 4.6 / Sonnet 4.6 لا تفكير (فعّله صراحةً بضبط adaptive) مسموح مُهمل (ما يزال يعمل)
Sonnet 4.5 / Haiku 4.5 وما قبلهما لا تفكير — (الإيقاف هو الوضع الافتراضي أصلًا) مطلوب (وضع التفكير الوحيد؛ يعيد adaptive خطأ 400)

المصدر: Anthropic، «Thinking» و«Extended thinking» (حتى أغسطس 2026)

أمران مهمان عمليًا. أولًا، انقلب الوضع الافتراضي إلى «التفكير مفعّل» مع جيل Opus 5 — فإن كنت تشغّل مهمة بتكلفة منخفضة على Opus 4.8 مع إيقاف التفكير ثم غيّرت معرّف النموذج فقط، فستنمو توكنات المخرجات بمقدار حصة التفكير، وتُبتر الإجابات عند max_tokens أو ترتفع الفاتورة (نشرح ذلك بالتفصيل في دليلنا إلى التغييرات الجذرية في Opus 5). ثانيًا، النماذج القديمة وحدها هي التي ما تزال تستخدم budget_tokens — فما دمت على Sonnet 4.5 أو ما قبله فليس هناك ما يستدعي الترحيل؛ وأعد الكتابة عند انتقالك إلى نموذج أحدث.

5. العمق يُضبط الآن عبر effort

مع زوال «الميزانية»، يُضبط عمق التفكير عبر output_config: {"effort": ...} — خمسة مستويات هي low / medium / high / xhigh / max، مع high بوصفه الافتراضي في واجهة API. ويشكّل effort أكثر من عمق التفكير: فهو يؤثر أيضًا في مدى دمج استدعاءات الأدوات ومقدار التمهيد الذي تحصل عليه، أي في إجمالي إنفاق التوكنات.

low / medium

المهام الروتينية والتصنيف والوكلاء الفرعيون. قد يتخطى التفكير على المدخلات السهلة = سرعة وتكلفة أقل

من high (الافتراضي) إلى xhigh

high للعمل العام؛ وxhigh نقطة البداية التي توصي بها Anthropic للبرمجة والوكلاء

max

للمشكلات التي تتقدّم فيها صحة الإجابة على التكلفة. ليس الأفضل نتيجةً دائمًا، فلا تثبّته بشكل دائم

ما تعنيه المستويات الخمسة، ومنزلق Claude Code، وكيفية ثبات الإعدادات، كل ذلك مشروح في دليلنا إلى إعداد effort. وثمة ملاحظة واحدة عن التخزين المؤقت من الوثائق: في الوضع التكيفي تُدرج قيمة effort في الموجّه، لذا فإن تغييرها يُبطل ذاكرة التخزين المؤقت للموجّه — وهو الشكل نفسه لقاعدة «تغيير الميزانية يُبطل الذاكرة المؤقتة» في عصر التفكير الموسع. فلا تقلّبها ذهابًا وإيابًا في منتصف المحادثة.

6. تدفع ثمن التفكير حتى وإن لم تره

يتحكّم حقل display في الصورة التي يظهر بها التفكير من الخارج. وهو يقبل قيمتين:

  • "summarized" — تحمل كتلة thinking ملخصًا مقروءًا للاستدلال. وهو الافتراضي على Claude Opus 4.6 / Sonnet 4.6 وما قبلهما
  • "omitted" — تعود كتلة thinking وبداخلها سلسلة فارغة. وهو الافتراضي على Fable 5 / Mythos 5 / Opus 5 / Sonnet 5 / Opus 4.8 / 4.7

هنا يكمن مصيدان. أولًا، كلما كان النموذج أحدث مال الافتراضي أكثر نحو «لا تُظهره» — فانقل تطبيقًا كان يبث الاستدلال للمستخدمين إلى نموذج جديد، وستتحول التجربة إلى صمت طويل يليه جواب مفاجئ. إن أردته ظاهرًا فاطلبه صراحةً: thinking: {"type": "adaptive", "display": "summarized"}. ثانيًا، لا يغيّر display سوى الرؤية — أما الفوترة فمتطابقة. والوثائق صريحة: مع omitted تُحاسَب رغم ذلك على كامل توكنات التفكير؛ وما توفّره هو زمن الاستجابة لا التكلفة. ولا تحصل في أي إعداد على سلسلة الأفكار الخام — فما يعرضه summarized هو ملخص.

قياس ما يكلّفك التفكير: يبيّن حقل الاستجابة usage.output_tokens_details.thinking_tokens عدد توكنات المخرجات المفوترة التي كانت استدلالًا داخليًا. وعند البث لا يظهر إلا في حدث message_delta الأخير. عبارة «لا أرى التفكير» لا تعني أبدًا «أنه لا يحدث» — تحقق من هذا الحقل بعد الترحيل.

وثمة أمر آخر مهم عمليًا: التعامل مع كتل التفكير. في المحادثات متعددة الأدوار وعند استخدام الأدوات، أعد تمرير كتل التفكير من الاستجابة السابقة كما هي دون أي تعديل. فتحريرها يستدعي خطأ 400 — وخطأ «invalid signature in thinking block» الذي يصادفه مستخدمو Claude Code ينبع من هذه الآلية بالضبط.

7. مصائد إيقاف التفكير

«السرعة تهمّنا، فلنوقف التفكير» قرارٌ مشروع — لكنه يأتي بشروط على Opus 5. فوفقًا للوثائق الرسمية:

✅ مسموح

إيقاف التفكير + effort بمستوى low / medium / high

❌ خطأ 400

إيقاف التفكير + effort بمستوى xhigh / max (يُتحقّق منه في كل طلب)

🔧 الموصى به

لا توقفه — بل اخفض effort إلى low / medium بدلًا من ذلك

وحتى عندما يمر الطلب، هناك آثار جانبية. توثّق Anthropic أن Opus 5 مع تعطيل التفكير قد يكتب استدعاءات الأدوات نصًا في متن الإجابة (فلا تعمل الأداة أبدًا بينما يبدو الدور ناجحًا) وقد يسرّب وسوم XML داخلية إلى المخرجات. إن كنت تبني وكلاء، فإن إبقاء التفكير مفعّلًا وخفض effort هو المسار الآمن — وهو يخفض التكلفة في الاتجاه نفسه تقريبًا على أي حال.

8. التفكير بين استدعاءات الأدوات — التفكير المتداخل

ليس التفكير «مرة واحدة قبل الإجابة» فحسب. فمع التفكير المتداخل (interleaved thinking) يستدل Claude أيضًا بين استدعاءات الأدوات، فيزن نتيجة كل أداة قبل أن يقرر خطوته التالية — يراجع الخطة بعد قراءة نتائج البحث، ويختار الأمر التالي بعد قراءة مخرجات الأمر السابق. إنها الآلية الكامنة وراء السلوك الوكيلي الجيد.

وهنا أيضًا فرق بين الجيلين. في عالم التفكير الموسع القديم كان هذا يتطلب ترويسة beta هي interleaved-thinking-2025-05-14؛ أما مع التفكير التكيفي فهو تلقائي ولا حاجة إلى الترويسة (تنص الوثائق على أن «التفكير التكيفي يتداخل تلقائيًا» وتقول إن بإمكانك إسقاط الترويسة بعد الترحيل). فالانتقال إلى التفكير التكيفي يبسّط شيفرتك بإعداد إضافي واحد.

9. عندما تحتاج إلى السرعة: الوضع السريع

إن أردت جودة التفكير بانتظار أقل، فالخيار هو الوضع السريع (fast mode). فوفقًا لـوثائق Claude Code عن الوضع السريع، ليس هذا تخفيضًا إلى نموذج مختلف: بل هو Claude Opus نفسه يعمل بتهيئة تضع السرعة أولًا. تصبح المخرجات أسرع بما يصل إلى نحو 2.5 مرة بينما يتضاعف السعر (10 دولارات للمدخلات / 50 دولارًا للمخرجات لكل مليون توكن على كلٍّ من Opus 5 وOpus 4.8). وهو متاح على Opus 5 وOpus 4.8 فقط؛ أما الوضع السريع لنموذج Opus 4.7 فقد أُزيل في 24 يوليو 2026.

في Claude Code: /fast

اكتب /fast في سطر الأوامر لتبديله (امتداد VS Code لا يدعمه). والإرشاد الرسمي: فعّله للتكرار السريع التفاعلي، وأوقفه عندما تكون التكلفة أهم من زمن الاستجابة.

عبر API: معاينة بحثية

واجهة Claude API فقط — غير متاح على Amazon Bedrock أو Google Cloud أو Microsoft Foundry. ولاحظ أيضًا أن تبديل السرعة يُبطل ذاكرة التخزين المؤقت للموجّه.

للتفكير وeffort والوضع السريع أدوار مختلفة: التفكير = آلية تحديد ما إذا كان سيجري استدلال، وeffort = مدى عمق الاستدلال، والوضع السريع = مدى سرعة تسليم الاستدلال نفسه. فقبل أن تلجأ إلى «إنه بطيء، فلنقتل التفكير»، تذكّر أن بيدك ورقتين أخريين: اخفض effort، أو فعّل الوضع السريع.

الخلاصة

  • التفكير الموسع (budget_tokens) هو الطريقة القديمة. أُهمل في Opus 4.6 / Sonnet 4.6، ويعيد خطأ 400 من Opus 4.7 فصاعدًا — ويبقى مع ذلك وضع التفكير الوحيد على النماذج القديمة (Sonnet 4.5 / Haiku 4.5 وغيرهما)
  • التفكير التكيفي هو الطريقة الحالية. النموذج يقرر ما إذا كان سيفكّر ومقدار تفكيره؛ والعمق يُضبط عبر effort (خمسة مستويات، الافتراضي high)
  • Opus 5 / Sonnet 5 / Fable 5 تأتي والتفكير مفعّل افتراضيًا. Fable 5 لا يمكنه إيقافه؛ وOpus 5 لا يستطيع ذلك إلا عند effort بمستوى high أو أدنى
  • تدفع ثمن التفكير حتى وهو غير مرئي. افتراضي الجيل الجديد هو display: "omitted" (كتل تفكير فارغة). قِسه عبر usage.output_tokens_details.thinking_tokens
  • لإيقاف التفكير آثار جانبية (استدعاءات أدوات نصًا عاديًا، وتسرّب وسوم). خفض effort أسلم من التعطيل
  • التفكير المتداخل تلقائي مع الوضع التكيفي — لم تعد ترويسة beta لازمة
  • تحتاج إلى السرعة؟ الوضع السريع (نحو 2.5 مرة، وضعف السعر، على Opus 5/4.8؛ بدّله عبر /fast في Claude Code)

الأسئلة الشائعة

س. ضبطتُ budget_tokens فحصلت على خطأ 400.

ج. النماذج من Opus 4.7 فصاعدًا (بما فيها Opus 5 / Sonnet 5 / Fable 5) لا تقبل thinking: {"type": "enabled", "budget_tokens": N}. أعد كتابتها على هيئة thinking: {"type": "adaptive"} وتحكّم في العمق عبر output_config: {"effort": ...}. وإن بقيت على نماذج قديمة مثل Sonnet 4.5 / Haiku 4.5 فلا حاجة إلى أي إعادة كتابة.

س. بعد الانتقال إلى التفكير التكيفي صارت الإجابات تنقطع في منتصف الجملة.

ج. توكنات التفكير تُحسب ضمن max_tokens. وOpus 5 خصوصًا يأتي والتفكير مفعّل افتراضيًا، لذا فإن الشيفرة التي ضبطت max_tokens بإحكام لنموذج أقدم تفقد الآن جزءًا من الميزانية للتفكير فتُبتر الإجابة. أعطِ max_tokens هامشًا أكبر، أو اخفض مستوى effort.

س. كتل التفكير تعود فارغة. هل هناك عطل ما؟

ج. هذه هي المواصفات. فعلى Opus 5 / Sonnet 5 / Fable 5 / Opus 4.8 / 4.7 يكون افتراضي display هو "omitted" (كتل تفكير فارغة). لرؤية الملخص، اضبط thinking: {"type": "adaptive", "display": "summarized"} صراحةً. والفوترة متطابقة في الحالتين.

س. إذا أوقفت التفكير، فهل أوفّر ذلك المال؟

ج. توفّر توكنات التفكير نفسها. لكن على Opus 5 لا يمكن الجمع بينه وبين effort بمستوى xhigh/max (خطأ 400)، وحتى عندما ينجح، توثّق Anthropic آثارًا جانبية: استدعاءات أدوات تُكتب نصًا عاديًا ووسوم داخلية تتسرب إلى المخرجات. لأحمال الوكلاء، إبقاء التفكير مفعّلًا وخفض effort إلى low / medium يخفض التكلفة بأمان أكبر.

س. هل أحتاج إلى ضبط التفكير في Claude Code (أو تطبيقات الدردشة)؟

ج. لا — فكل من Claude Code وclaude.ai يدير التفكير نيابة عنك، فليس هناك معاملات API تضبطها. ما يمكنك لمسه هو إعداد effort و/fast (مفتاح الوضع السريع)؛ أما آليات تشغيل التفكير وإيقافه فلا تظهر لك أبدًا.

ملاحظة: تستند المواصفات والأرقام الواردة في هذا المقال إلى وثيقة Anthropic «Thinking» و«Extended thinking» ووثيقة Claude Code «Fast mode» (جميعها حتى أغسطس 2026). المواصفات تتغير؛ فراجع الوثائق الرسمية للاطلاع على الصياغة الحالية قبل أن تبني عليها.