GPT-5.6 Sol vs Claude Fable 5 徹底比較——ベンチマーク・長時間自律・価格・選び方
OpenAIの最上位GPT-5.6 Sol(7月9日)と、Anthropicが「一般提供する中で史上最強」と位置づけるClaude Fable 5(6月9日)を徹底比較する。Opus 4.8戦が同価格帯の直接対決だったのに対し、こちらは「半額の万能型Sol($5/$30)」対「2倍高いが最上位のFable 5($10/$50)」というコストと実力のトレードオフが主題だ。実プロダクション級コーディングのSWE-Bench ProではFable 5が80.3%とSolの64.6%(推定)を15pt以上引き離し、その差はOpus 4.8戦より拡大。さらにFable 5は数百万トークンに集中して最大12時間連続で自走し、Stripeが5000万行のRuby移行を1日で完了させた「完走力」が本領だ。一方Solは端末操作のTerminalBench 2.1(88.8% vs Fable 86.0%)・Agents' Last Exam(53.6 vs 40.5)・Coding Agent Index(80 vs 77.2)で首位、しかも半額+トークン効率+54%でコスパが強い。本記事ではスペック早見表、ベンチ詳細、OpenAIがSolのSWE-bench Proを非公表な「非公開ベンチ問題」、長時間自律、実コスト(タスク完了あたりで見る)、強み弱みマップ、ユースケース別の選び方までを公式・独立ベンチベースで整理する。