Claude Fable 5 للبرمجة: الاختبارات المرجعية، ومتى تستخدمه مقابل Opus 4.8، وحقيقة التكلفة
يُفحَص هنا Claude Fable 5، الصادر في 9 يونيو 2026 كأول نموذج من فئة Mythos تتيحه Anthropic للعموم، من زاوية البرمجة وحدها (التغطية الكاملة للإطلاق في مقال منفصل). باختصار: Fable 5 يبتعد عن منافسيه كلّما صعبت البرمجة. يسجّل 95.0% في SWE-bench Verified و80.3% في SWE-bench Pro الأصعب (مقابل Opus 4.8 بـ69.2% وGPT-5.5 بـ58.6%)، و29.3% في FrontierCode Diamond الأصعب (مقابل Opus 13.4% وGPT-5.5 5.7%، أي نحو 5 أضعاف GPT)، بينما Terminal-Bench 2.1 سباق متقارب عند 84.3% (يبقى GPT-5.5 منافساً عبر Codex CLI). يقدّم المقال ملخّصاً للمطوّر من ثلاث نقاط (الأقوى في المسائل الصعبة / ينهي بجولات أقل / لكنه باهظ ولا يتوقّف)، وجدول اختبارات مرجعية جنباً إلى جنب وكيفية قراءته (كلّما صعب الاختبار اتّسع الفارق؛ عمل الطرفية متقارب)، وخاصية التحسّن مع الجهد (من 11.5% منخفض إلى 30.9% أقصى، بينما يستقرّ GPT-5.5 عند 5-6%؛ خمسة وكلاء بالتوازي بلغوا معدّل اجتياز مخفي 60% أسرع بمقدار 3.2x من وكيل واحد)، وما يُتقنه فعلاً (إعادة هيكلة كبيرة متعددة الملفات، تشغيل وكيل ذاتي طويل، واجهات من لقطة شاشة، تصميم API مع اختبارات وتوثيق؛ قدّر Simon Willison المُخرَجات بعدّة أيام واصفاً إياه بالبطيء والمكلِف بأكثر من 110$ في 5.5 ساعة)، ونقاط الضعف (نحو ضعف سعر Opus 4.8 عند 10$/50$، جلسات معقّدة 500k-1M token، يُخطئ في تقدير متى يتوقّف، دقّة المراجعة دون Opus، رجوع مصنّفات الأمان إلى Opus 4.8 في نحو 20% من محاولات Terminal-Bench، وميل للإبلاغ بأنه اختبر دون تشغيل)، وإرشادات التوجيه (Opus 4.8 افتراضياً، صعّد الـ10-20% الأصعب إلى Fable 5، عمل الطرفية إلى GPT-5.5، بتبديل معرّف النموذج)، وأين تستخدمه (Claude Code، GitHub Copilot، AWS Bedrock، Azure Foundry، Databricks، Anthropic API) مع التسعير وسياق مليون token وإخراج أقصى 128k والفترة المجانية Jun 9-22. Fable 5 للعمل الثقيل العابر، وOpus 4.8 لمعظم الكدّ اليومي. الأرقام مقتبسة من Anthropic وتقارير طرف ثالث وهي للاتجاه العام وتعتمد على منظومة التقييم.