التفكير التكيفي مقابل التفكير الموسع في Claude: ما الذي تغيّر
مرّت طريقة تفكير Claude بتغيير جيلي كامل. كان التفكير الموسع القديم يفرض عليك تحديد ميزانية توكنات في كل طلب — thinking: {"type": "enabled", "budget_tokens": N} — لكن الميزانية المناسبة تختلف من مهمة إلى أخرى ولا يمكن تخمينها مسبقًا، وتغييرها يُبطل ذاكرة التخزين المؤقت للموجّه. أما التفكير التكيفي الحالي فسطر واحد، type: "adaptive": قرار التفكير من عدمه ومدى عمقه قرار يتخذه النموذج بنفسه بحسب صعوبة الطلب. وقد جرى الترحيل على مراحل: أُهمل budget_tokens في Opus 4.6 / Sonnet 4.6 ويُرفض بخطأ 400 من Opus 4.7 فصاعدًا. يكثّف هذا المقال قواعد كل نموذج في جدول واحد — Fable 5 يفكّر دائمًا (لا يمكن تعطيله)، وOpus 5 وSonnet 5 يأتيان والتفكير مفعّل افتراضيًا (على Opus 5 لا يُسمح بالتعطيل إلا عند effort بمستوى high أو أدنى)، وOpus 4.8 / 4.7 يتطلبان ضبط adaptive صراحةً، والنماذج القديمة مثل Sonnet 4.5 / Haiku 4.5 ما تزال تستخدم budget_tokens وضعًا وحيدًا. انتقل التحكم في العمق إلى output_config: {"effort": ...} بخمسة مستويات (الافتراضي high)، وتغيير effort يُبطل الذاكرة المؤقتة كما كان يفعل تغيير الميزانية. وتحكم الرؤيةَ قيمةُ display: افتراضي الجيل الجديد هو "omitted" (كتل تفكير فارغة)، وتُحاسَب على كامل توكنات التفكير في الحالتين — قِسها عبر usage.output_tokens_details.thinking_tokens؛ ولا يعيد أي إعداد سلسلة الأفكار الخام. ولتعطيل التفكير على Opus 5 آثار جانبية موثقة (استدعاءات أدوات تُكتب نصًا عاديًا، وتسرّب وسوم داخلية)، لذا فإن خفض effort هو رافعة التكلفة الأكثر أمانًا. والتفكير المتداخل — الاستدلال بين استدعاءات الأدوات — تلقائي في الوضع التكيفي دون الحاجة إلى ترويسة beta القديمة. وعند الحاجة إلى السرعة، يشغّل الوضع السريع نموذج Opus نفسه بسرعة تصل إلى نحو 2.5 مرة مقابل ضعف السعر (Opus 5/4.8 فقط، ويُبدّل عبر /fast في Claude Code). وكل ذلك مستند إلى وثائق Anthropic الرسمية Thinking وExtended thinking وFast mode.