المحتويات
- 1. ما المقصود بالتفكير
- 2. عصر التفكير الموسع — أنت من يحدد budget_tokens
- 3. التحول إلى التفكير التكيفي — النموذج هو من يقرر
- 4. كيف يتعامل كل نموذج مع التفكير: نظرة سريعة
- 5. العمق يُضبط الآن عبر effort
- 6. تدفع ثمن التفكير حتى وإن لم تره
- 7. مصائد إيقاف التفكير
- 8. التفكير بين استدعاءات الأدوات — التفكير المتداخل
- 9. عندما تحتاج إلى السرعة: الوضع السريع
- الخلاصة
- الأسئلة الشائعة
لقد تغيّرت الطريقة التي «يفكّر» بها Claude تغيّرًا جذريًا خلال العام الماضي. كان التفكير الموسع (extended thinking) القديم يعمل بأن يحدد الإنسان عدد التوكنات التي يمكن للنموذج إنفاقها على الاستدلال. أما الجيل الحالي فيستبدل به التفكير التكيفي (adaptive thinking) — إذ يقرر النموذج بنفسه ما إذا كان سيفكّر ومدى عمق تفكيره. ومع Claude Opus 5 أصبح التفكير مفعّلًا افتراضيًا، فحتى الافتراض القديم القائل إن «غياب الإعداد يعني غياب التفكير» بات من الماضي. أما في Claude Opus 5.5 الذي صدر بعده وفي نماذج Fable، فلا يمكن إيقاف التفكير أصلًا.
يستعرض هذا المقال ما يفصل فعليًا بين التفكير الموسع والتفكير التكيفي، وكيف يختلف السلوك من نموذج إلى آخر، والمصائد التي يقع فيها من يُرحّلون شيفرتهم — أخطاء 400، ومخرجات مبتورة، وفواتير ترتفع بصمت. وكل ذلك مستند إلى وثائق Anthropic الرسمية.
من «الإنسان يحدد العمق» إلى «النموذج هو من يقرر»
التغيير الجيلي في ثلاث خطوات
1. ما المقصود بالتفكير
التفكير هو المرحلة التي يعالج فيها Claude المشكلة بكلماته الخاصة قبل أن يبدأ كتابة الإجابة النهائية. فهو يعيد صياغة السؤال، ويجرّب عدة مقاربات، ويتحقق من النتائج الوسيطة، ويتخلى عن المسارات التي لا تصمد — ويُولَّد هذا كله على هيئة كتل محتوى thinking قبل الاستجابة. ويكون المردود أكبر ما يكون في المهام التي تحدد فيها جودةُ العمل الوسيط جودةَ الإجابة: الرياضيات، والبرمجة، والتحليل، ومهام الوكلاء طويلة الأمد.
غير أنه ليس مجانيًا. فكما تنص وثيقة Anthropic «Thinking» بوضوح، تُحتسب التوكنات التي ينفقها Claude على الاستدلال ضمن توكنات المخرجات في الفوترة وتُحسب ضمن max_tokens — والفوترة هي نفسها حتى في الإعدادات التي لا يُعاد فيها نص التفكير إليك إطلاقًا (انظر القسم 6). لذا فإن تصميم إعدادات التفكير لديك مسألة تكلفة وزمن استجابة بقدر ما هو مسألة جودة.
2. عصر التفكير الموسع — أنت من يحدد budget_tokens
كان التجسيد الأول هو التفكير الموسع. تُرفق thinking: {"type": "enabled", "budget_tokens": N} بالطلب، فيستدل Claude ضمن تلك الميزانية قبل أن يجيب. الإنسان هو من يحدد مقدار التفكير، في كل طلب. ووفقًا للوثائق الرسمية، القواعد هي:
- الحد الأدنى 1,024 توكنًا. ترفض واجهة API القيم الأصغر من ذلك
- يجب أن تكون أقل من
max_tokens— فالتفكير يُحسب ضمنها، لذا لا بد من ترك مساحة للإجابة - الميزانية هدف تقريبي لا سقف صارم. يتفاوت الاستهلاك الفعلي بحسب المهمة، وكثيرًا ما ينهي Claude تفكيره قبل نفاد الميزانية بكثير
- لميزانيات التفكير التي تتجاوز 32,000، توصي Anthropic بالمعالجة الدفعية لتجنّب انتهاء المهلة
مشكلة هذا التصميم واضحة: الميزانية المناسبة تختلف من مهمة إلى أخرى، ولا يستطيع الإنسان تخمينها مسبقًا. فالأسئلة البسيطة قد تحرق الميزانية التي خصصتها، والمشكلات الصعبة قد تختنق بها. كما أن تغيير قيمة الميزانية يُبطل ذاكرة التخزين المؤقت للموجّه (prompt cache) — وتبيّن الوثائق ذلك بمثال مُقاس.
3. التحول إلى التفكير التكيفي — النموذج هو من يقرر
هذا بالضبط ما جاء التفكير التكيفي، المقدَّم في 2026، ليحل محله. الإعداد سطر واحد: thinking: {"type": "adaptive"}. قرارُ التفكير من عدمه، ومدى عمقه، قرارٌ يتخذه Claude بنفسه بناءً على مدى صعوبة الطلب في نظره. فالمدخلات السهلة تحصل على إجابة فورية مع تخطي التفكير، والمشكلات الصعبة تحظى باستدلال عميق.
جرى الترحيل وفق الجدول الزمني المبيَّن في وثيقة Anthropic «Extended thinking»: أُهمل budget_tokens في Claude Opus 4.6 / Sonnet 4.6 (ما يزال يعمل هناك)، بينما ترفضه النماذج من Claude Opus 4.7 فصاعدًا بخطأ 400. وجّه شيفرة قديمة إلى نموذج جديد فتتوقف هكذا:
# القديم: التفكير الموسع (خطأ 400 على Opus 4.7 وما بعده) "thinking": {"type": "enabled", "budget_tokens": 10000} → 400: "thinking.type.enabled" is not supported ... # الجديد: التفكير التكيفي (العمق يُضبط عبر effort) "thinking": {"type": "adaptive"}, "output_config": {"effort": "high"}
إعادة الكتابة نفسها صغيرة — احذف budget_tokens، وانتقل إلى adaptive، وسلّم التحكم في العمق إلى effort. لكن كما تحذّر الوثائق، هذا تغيير في السلوك لا تغيير في الصياغة فحسب. فمع الميزانية الثابتة كان Claude يفكّر في كل طلب؛ أما مع التفكير التكيفي فقد يتخطى التفكير كليًا على المدخلات السهلة عند مستويات effort المنخفضة.
4. كيف يتعامل كل نموذج مع التفكير: نظرة سريعة
الجزء المخادع هو أن سؤالَي «هل هو مفعّل افتراضيًا؟» و«هل يمكن إيقافه؟» يختلف جوابهما من نموذج إلى آخر. إليك الوثائق الرسمية مكثّفة في جدول واحد. وحتى 29 سبتمبر 2026، يتصدّر القائمة الرسمية لدى Anthropic أربعة نماذج هي Fable 5.1 وOpus 5.5 وSonnet 5.5 وHaiku 4.5، ويبقى Opus 5 وSonnet 5 متاحَين بوصفهما Legacy. وعند صدور نموذج جديد، تحقّق من النقاط الثلاث نفسها في الجدول الخاص بكل نموذج في صفحة «Troubleshooting thinking» الرسمية.
| النموذج | إذا لم تضبط شيئًا | إيقاف التفكير | budget_tokens |
|---|---|---|---|
| Claude Fable 5.1 / Fable 5 / Mythos 5.1 / Mythos 5 | التفكير مفعّل (دائمًا) | غير ممكن (400) | غير ممكن (400) |
| Claude Opus 5.5 | التفكير مفعّل (دائمًا) | غير ممكن (400) | غير ممكن (400) |
| Claude Sonnet 5.5 | التفكير مفعّل (تكيفي) | غير ممكن (400) بدلًا من ذلك يوقف between_tools التفكير المسبق وحده (effort بمستوى high أو أدنى) |
غير ممكن (400) |
| Claude Opus 5 (Legacy) | التفكير مفعّل (تكيفي) | فقط عند effort بمستوى high أو أدنى مع الجمع بينه وبين xhigh / max: خطأ 400 |
غير ممكن (400) |
| Claude Sonnet 5 (Legacy) | التفكير مفعّل (تكيفي) | مسموح | غير ممكن (400) |
| Claude Opus 4.8 / 4.7 | لا تفكير (فعّله صراحةً بضبط adaptive) |
مسموح | غير ممكن (400) |
| Claude Opus 4.6 / Sonnet 4.6 | لا تفكير (فعّله صراحةً بضبط adaptive) |
مسموح | مُهمل (ما يزال يعمل) |
| Haiku 4.5 / Sonnet 4.5 / Opus 4.5 | لا تفكير | — (الإيقاف هو الوضع الافتراضي أصلًا) | مطلوب (وضع التفكير الوحيد؛ يعيد adaptive خطأ 400) |
المصدر: Anthropic، «Thinking» و«Extended thinking» و«Troubleshooting thinking» (حتى 29 سبتمبر 2026)
أمران مهمان عمليًا. أولًا، انقلب الوضع الافتراضي إلى «التفكير مفعّل» مع جيل Opus 5، وفي Opus 5.5 لم يعد إيقافه ممكنًا أصلًا — فإن كنت تشغّل مهمة بتكلفة منخفضة على Opus 4.8 مع إيقاف التفكير ثم غيّرت معرّف النموذج فقط، فستنمو توكنات المخرجات بمقدار حصة التفكير، وتُبتر الإجابات عند max_tokens أو ترتفع الفاتورة (نشرح ذلك بالتفصيل في دليلنا إلى التغييرات الجذرية في Opus 5). وفي Opus 5.5 يبقى effort الوسيلة الوحيدة للحد من مقدار التفكير. ثانيًا، النماذج التي لا تدعم إلا التفكير الموسع ما تزال تستخدم budget_tokens — وهي Haiku 4.5 وSonnet 4.5 وOpus 4.5. فما دمت عليها فلا حاجة إلى إعادة الكتابة، لكن سيتوقف توفير Sonnet 4.5 على Claude API في 30 نوفمبر 2026 (أُعلن ذلك في 30 سبتمبر، والبديل هو Sonnet 5.5؛ انظر القائمة الرسمية لإيقاف النماذج). انقل ما يعمل على Sonnet 4.5 إلى Sonnet 5.5 قبل ذلك الموعد، وأعد كتابته للتفكير التكيفي في الخطوة نفسها.
5. العمق يُضبط الآن عبر effort
مع زوال «الميزانية»، يُضبط عمق التفكير عبر output_config: {"effort": ...} — خمسة مستويات هي low / medium / high / xhigh / max، مع high بوصفه الافتراضي في واجهة API لمعظم النماذج، وmedium في Opus 5.5 (فإذا لم تحدد effort عمل Opus 5.5 بمستوى أدنى بدرجة من Opus 5). ويشكّل effort أكثر من عمق التفكير: فهو يؤثر أيضًا في مدى دمج استدعاءات الأدوات ومقدار التمهيد الذي تحصل عليه، أي في إجمالي إنفاق التوكنات.
المهام الروتينية والتصنيف والوكلاء الفرعيون. قد يتخطى التفكير على المدخلات السهلة = سرعة وتكلفة أقل
للاستدلال الصعب والبرمجة والوكلاء. ونقطة البداية تختلف من نموذج إلى آخر؛ وتنصح Anthropic بعدم نقل الإعدادات عند تغيير النموذج، وتجربة المستويات على تقييماتك الخاصة
للمشكلات التي تتقدّم فيها صحة الإجابة على التكلفة. ليس الأفضل نتيجةً دائمًا، فلا تثبّته بشكل دائم
ما تعنيه المستويات الخمسة، ومنزلق Claude Code، وكيفية ثبات الإعدادات، كل ذلك مشروح في دليلنا إلى إعداد effort. وثمة ملاحظة واحدة عن التخزين المؤقت من الوثائق: في الوضع التكيفي تُدرج قيمة effort في الموجّه، لذا فإن تغييرها يُبطل ذاكرة التخزين المؤقت للموجّه — وهو الشكل نفسه لقاعدة «تغيير الميزانية يُبطل الذاكرة المؤقتة» في عصر التفكير الموسع. فلا تقلّبها ذهابًا وإيابًا في منتصف المحادثة. والاستثناء: في Fable 5.1 وOpus 5.5 وOpus 5 وبعض النماذج الأخرى، يحافظ تغيير effort برسالة في منتصف المحادثة (ميزة تجريبية) على الذاكرة المؤقتة لكل ما قبلها.
6. تدفع ثمن التفكير حتى وإن لم تره
يتحكّم حقل display في الصورة التي يظهر بها التفكير من الخارج. وهو يقبل قيمتين:
"summarized"— تحمل كتلةthinkingملخصًا مقروءًا للاستدلال. وهو الافتراضي على Claude Opus 4.6 / Sonnet 4.6 وما قبلهما"omitted"— تعود كتلةthinkingوبداخلها سلسلة فارغة. وهو الافتراضي على Fable 5.1 / Fable 5 / Mythos 5.1 / Mythos 5 / Opus 5.5 / Opus 5 / Sonnet 5.5 / Sonnet 5 / Opus 4.8 / 4.7
هنا يكمن مصيدان. أولًا، كلما كان النموذج أحدث مال الافتراضي أكثر نحو «لا تُظهره» — فانقل تطبيقًا كان يبث الاستدلال للمستخدمين إلى نموذج جديد، وستتحول التجربة إلى صمت طويل يليه جواب مفاجئ. إن أردته ظاهرًا فاطلبه صراحةً: thinking: {"type": "adaptive", "display": "summarized"}. ثانيًا، لا يغيّر display سوى الرؤية — أما الفوترة فمتطابقة. والوثائق صريحة: مع omitted تُحاسَب رغم ذلك على كامل توكنات التفكير؛ وما توفّره هو زمن الاستجابة لا التكلفة. ولا تحصل في أي إعداد على سلسلة الأفكار الخام — فما يعرضه summarized هو ملخص.
قياس ما يكلّفك التفكير: يبيّن حقل الاستجابة usage.output_tokens_details.thinking_tokens عدد توكنات المخرجات المفوترة التي كانت استدلالًا داخليًا. وعند البث لا يظهر إلا في حدث message_delta الأخير. عبارة «لا أرى التفكير» لا تعني أبدًا «أنه لا يحدث» — تحقق من هذا الحقل بعد الترحيل.
وثمة أمر آخر مهم عمليًا: التعامل مع كتل التفكير. في المحادثات متعددة الأدوار وعند استخدام الأدوات، أعد تمرير كتل التفكير من الاستجابة السابقة كما هي دون أي تعديل. فتحريرها يستدعي خطأ 400 — وخطأ «invalid signature in thinking block» الذي يصادفه مستخدمو Claude Code ينبع من هذه الآلية بالضبط.
7. مصائد إيقاف التفكير
«السرعة تهمّنا، فلنوقف التفكير» قرارٌ مشروع — لكن Opus 5.5 ونماذج Fable لا تسمح بإيقاف التفكير أصلًا (يعيد disabled خطأ 400). ويمكن إيقافه في Sonnet 5 وفي Opus 4.8 وما قبله وغيرها، أما على Opus 5 فيأتي بشروط. فوفقًا للوثائق الرسمية، على Opus 5:
إيقاف التفكير + effort بمستوى low / medium / high
إيقاف التفكير + effort بمستوى xhigh / max (يُتحقّق منه في كل طلب)
لا توقفه — بل اخفض effort إلى low / medium بدلًا من ذلك
وحتى عندما يمر الطلب، هناك آثار جانبية. توثّق Anthropic أن Opus 5 مع تعطيل التفكير قد يكتب استدعاءات الأدوات نصًا في متن الإجابة (فلا تعمل الأداة أبدًا بينما يبدو الدور ناجحًا) وقد يسرّب وسوم XML داخلية إلى المخرجات. إن كنت تبني وكلاء، فإن إبقاء التفكير مفعّلًا وخفض effort هو المسار الآمن — وهو يخفض التكلفة في الاتجاه نفسه تقريبًا على أي حال.
لا يقبل Sonnet 5.5 القيمة disabled (خطأ 400). وأدنى إعداد لديه هو thinking: {"type": "between_tools"}، الذي يوقف التفكير المسبق وحده، أي التفكير الذي يسبق الرد. وتظل ملاحظات التقدّم القصيرة التي يكتبها بين استدعاءات الأدوات تعود في كتل تفكير، أما الطلب الذي لا يستخدم أدوات فيعيد نصًا فقط، كما يفعل disabled على Sonnet 5. ولا يعمل إلا عند effort بمستوى high أو أدنى؛ ومع xhigh / max يعيد خطأ 400 (وثيقة Anthropic «What's new in Claude Sonnet 5.5»).
8. التفكير بين استدعاءات الأدوات — التفكير المتداخل
ليس التفكير «مرة واحدة قبل الإجابة» فحسب. فمع التفكير المتداخل (interleaved thinking) يستدل Claude أيضًا بين استدعاءات الأدوات، فيزن نتيجة كل أداة قبل أن يقرر خطوته التالية — يراجع الخطة بعد قراءة نتائج البحث، ويختار الأمر التالي بعد قراءة مخرجات الأمر السابق. إنها الآلية الكامنة وراء السلوك الوكيلي الجيد.
وهنا أيضًا فرق بين الجيلين. في عالم التفكير الموسع القديم كان هذا يتطلب ترويسة beta هي interleaved-thinking-2025-05-14؛ أما مع التفكير التكيفي فهو تلقائي ولا حاجة إلى الترويسة (تنص الوثائق على أن «التفكير التكيفي يتداخل تلقائيًا» وتقول إن بإمكانك إسقاط الترويسة بعد الترحيل). فالانتقال إلى التفكير التكيفي يبسّط شيفرتك بإعداد إضافي واحد.
9. عندما تحتاج إلى السرعة: الوضع السريع
إن أردت جودة التفكير بانتظار أقل، فالخيار هو الوضع السريع (fast mode). فوفقًا لـوثائق Claude Code عن الوضع السريع، ليس هذا تخفيضًا إلى نموذج مختلف: بل هو Claude Opus نفسه يعمل بتهيئة تضع السرعة أولًا. تصبح المخرجات أسرع بما يصل إلى نحو 2.5 مرة بينما يتضاعف السعر (حتى 25 سبتمبر 2026: 8 دولارات للمدخلات / 40 دولارًا للمخرجات لكل مليون توكن على Opus 5.5، و10 / 50 دولارًا على Opus 5 وOpus 4.8). وهو متاح على Opus 5.5 وOpus 5 وOpus 4.8 فقط؛ أما الوضع السريع لنموذج Opus 4.7 فقد أُزيل في 24 يوليو 2026.
اكتب /fast في سطر الأوامر لتبديله (وفي امتداد VS Code يظهر الأمر «Toggle fast mode» عندما يدعمه النموذج المختار). والإرشاد الرسمي: فعّله للتكرار السريع التفاعلي، وأوقفه عندما تكون التكلفة أهم من زمن الاستجابة.
واجهة Claude API فقط — غير متاح على Amazon Bedrock أو Google Cloud أو Microsoft Foundry. ولاحظ أيضًا أن تبديل السرعة يُبطل ذاكرة التخزين المؤقت للموجّه.
للتفكير وeffort والوضع السريع أدوار مختلفة: التفكير = آلية تحديد ما إذا كان سيجري استدلال، وeffort = مدى عمق الاستدلال، والوضع السريع = مدى سرعة تسليم الاستدلال نفسه. فقبل أن تلجأ إلى «إنه بطيء، فلنقتل التفكير»، تذكّر أن بيدك ورقتين أخريين: اخفض effort، أو فعّل الوضع السريع.
الخلاصة
- التفكير الموسع (budget_tokens) هو الطريقة القديمة. أُهمل في Opus 4.6 / Sonnet 4.6، ويعيد خطأ 400 من Opus 4.7 فصاعدًا — ويبقى مع ذلك وضع التفكير الوحيد على النماذج التي لا تدعم إلا التفكير الموسع (Haiku 4.5 / Sonnet 4.5 / Opus 4.5)
- التفكير التكيفي هو الطريقة الحالية. النموذج يقرر ما إذا كان سيفكّر ومقدار تفكيره؛ والعمق يُضبط عبر
effort(خمسة مستويات؛ الافتراضي high في معظم النماذج وmedium في Opus 5.5) - Opus 5 وما بعده وSonnet 5 وما بعده ونماذج Fable تأتي والتفكير مفعّل افتراضيًا. Opus 5.5 وFable لا يمكنهما إيقافه؛ وOpus 5 لا يستطيع ذلك إلا عند effort بمستوى high أو أدنى؛ وSonnet 5 يستطيع؛ أما Sonnet 5.5 فيستخدم
between_toolsبدلًا منdisabled(يوقف التفكير المسبق وحده، عند effort بمستوى high أو أدنى) - تدفع ثمن التفكير حتى وهو غير مرئي. افتراضي الجيل الجديد هو
display: "omitted"(كتل تفكير فارغة). قِسه عبرusage.output_tokens_details.thinking_tokens - لإيقاف التفكير آثار جانبية (استدعاءات أدوات نصًا عاديًا، وتسرّب وسوم). خفض effort أسلم من التعطيل
- التفكير المتداخل تلقائي مع الوضع التكيفي — لم تعد ترويسة beta لازمة
- تحتاج إلى السرعة؟ الوضع السريع (نحو 2.5 مرة، وضعف السعر، على Opus 5.5/5/4.8؛ بدّله عبر
/fastفي Claude Code)
الأسئلة الشائعة
س. ضبطتُ budget_tokens فحصلت على خطأ 400.
ج. النماذج من Opus 4.7 فصاعدًا (بما فيها Opus 5.5 / Opus 5 / Sonnet 5.5 / Sonnet 5 / Fable) لا تقبل thinking: {"type": "enabled", "budget_tokens": N}. أعد كتابتها على هيئة thinking: {"type": "adaptive"} وتحكّم في العمق عبر output_config: {"effort": ...}. أما في النماذج التي لا تدعم إلا التفكير الموسع، مثل Haiku 4.5 وSonnet 4.5، فإن adaptive هو الذي يعيد خطأ 400، فلا تُعِد الكتابة هناك.
س. بعد الانتقال إلى التفكير التكيفي صارت الإجابات تنقطع في منتصف الجملة.
ج. توكنات التفكير تُحسب ضمن max_tokens. وOpus 5 وما بعده خصوصًا تأتي والتفكير مفعّل افتراضيًا، لذا فإن الشيفرة التي ضبطت max_tokens بإحكام لنموذج أقدم تفقد الآن جزءًا من الميزانية للتفكير فتُبتر الإجابة. أعطِ max_tokens هامشًا أكبر، أو اخفض مستوى effort.
س. كتل التفكير تعود فارغة. هل هناك عطل ما؟
ج. هذه هي المواصفات. فعلى Opus 5.5 / Opus 5 / Sonnet 5.5 / Sonnet 5 / Fable / Opus 4.8 / 4.7 يكون افتراضي display هو "omitted" (كتل تفكير فارغة). لرؤية الملخص، اضبط thinking: {"type": "adaptive", "display": "summarized"} صراحةً. والفوترة متطابقة في الحالتين.
س. إذا أوقفت التفكير، فهل أوفّر ذلك المال؟
ج. توفّر توكنات التفكير نفسها. لكن Opus 5.5 وFable لا تسمح بإيقاف التفكير أصلًا (خطأ 400)، وعلى Opus 5 لا يمكن الجمع بينه وبين effort بمستوى xhigh/max (خطأ 400)، وحتى عندما ينجح، توثّق Anthropic آثارًا جانبية: استدعاءات أدوات تُكتب نصًا عاديًا ووسوم داخلية تتسرب إلى المخرجات. لأحمال الوكلاء، إبقاء التفكير مفعّلًا وخفض effort إلى low / medium يخفض التكلفة بأمان أكبر.
س. هل أحتاج إلى ضبط التفكير في Claude Code (أو تطبيقات الدردشة)؟
ج. لا — فكل من Claude Code وclaude.ai يدير التفكير نيابة عنك، فليس هناك معاملات API تضبطها. ما يمكنك لمسه هو إعداد effort و/fast (مفتاح الوضع السريع)؛ أما آليات تشغيل التفكير وإيقافه فلا تظهر لك أبدًا.
ملاحظة: تستند المواصفات والأرقام الواردة في هذا المقال إلى وثيقة Anthropic «Thinking» و«Extended thinking» ووثيقة Claude Code «Fast mode» (جميعها حتى أغسطس 2026). المواصفات تتغير؛ فراجع الوثائق الرسمية للاطلاع على الصياغة الحالية قبل أن تبني عليها.