「safeguards flagged this message」は、Claudeのモデルに付いている安全対策の分類器(classifier)が会話の内容に反応し、そのモデルでの応答を止めたことを知らせる表示です。Claude Codeの不具合でも、通信の失敗でもありません。サイバーセキュリティや生物学の作業だけでなく、あいさつや計画づくりのような普通の依頼でも出ることがあり、公式も誤検知がありうると認めています。

表示は、先頭に止めたモデルの名前が入る形です。2026年9月22日〜29日にGitHubのIssueで報告された画面の文言は、主に次の2つでした(改行は画面のとおりではありません)。

API Error: Opus 5.5's safeguards flagged this message (https://www.anthropic.com/legal/aup). This sometimes happens with safe, normal conversations. Claude Code can't respond to this message with Opus 5.5.

Double press esc to edit your last message, or try a different model with /model.

Send feedback with /feedback or learn more: https://support.claude.com/en/articles/8106465

Details: `[reasoning_extraction]`
API Error: Opus 5.5's safeguards flagged this session (https://www.anthropic.com/legal/aup). You may be seeing this for the first time on an Opus model: Opus 5.5 is more capable and has stronger safeguards as a result, which can sometimes flag non-cybersecurity work. We're improving these safeguards to reduce the amount of incorrectly flagged messages. Claude Code can't respond to your last message with Opus 5.5.

Double press esc to edit your last message, or try a different model with /model.

Send feedback with /feedback or learn more: https://support.claude.com/en/articles/8106465

Details: `[cyber]`

Issueの題では「Message flagged by safeguards」と書かれることが多いのですが、画面に出るのは上の文言です。Opus 5.5の部分は、使っていたモデルに応じてFable 5.1・Opus 5・Opus 4.8などに変わります。

最初に見るのは、最後の行の「Details:」

どの分類器が止めたかで、効く手が違う

[reasoning_extraction]
モデルの内部の推論を取り出そうとしている、と判定された
→ 言い換えて送り直す
別のモデルへの自動切り替えは無い
[cyber]
サイバー攻撃に使える作業かもしれない、と判定された
→ 切り替え先のモデルで続ける
仕事ならCVPの対象か確かめる
[bio]
生物学の危険な用途に当たるかもしれない、と判定された
→ モデルごとの扱いを見る
研究組織向けの審査制度がある
[general_harms]・[frontier_llm]
利用規約のほかの分野、または先端のAI開発に当たると判定された
→ 分類の意味を見る
誤検知なら/feedbackで報告
Claude APIの公式ドキュメント「Refusals and fallback」の分類と、Claude Codeのモデル設定ドキュメント・ヘルプセンターの説明をもとにした図です。

1. この表示の意味——会話を読んだ分類器が止めた

Claude APIの公式ドキュメント「Refusals and fallback」によると、Fable 5.1・Fable 5・Opus 5.5・Opus 5・Sonnet 5.5には、リクエストを断ることのある安全対策の分類器が付いています。断るとき、APIはエラーではなく普通の応答(HTTP 200)を返し、停止理由をstop_reason: "refusal"にして、どの分野で断ったかをstop_details.categoryに入れます。Claude Codeはこれを受け取って、「API Error:」から始まる表示にしています。

大事なのは、分類器が見ているのは最後に送った1文だけではないという点です。Opus 5.5の安全対策を説明したヘルプセンターの記事は、分類器が「モデルが読むものすべて」を見ると書いています。記憶(メモリ)、コネクタの内容、ウェブ検索の結果、ファイルも含まれるので、自分が打っていない内容で止まることがあります。

自分の指示

最後に送ったメッセージと、それより前のやり取りのすべて。

Claudeが読んだもの

開いたファイル、コマンドの出力、ウェブ検索の結果、MCPやコネクタから来た内容。

最初から付く情報

CLAUDE.mdの中身やgit statusなど、Claude Codeが最初のリクエストに添える作業場所の情報。

モデル自身の出力

応答の途中で止まることもある。その場合は、それまでに流れた部分も不完全として扱う。

3つ目については、Claude Codeのモデル設定のドキュメントが「セッションの最初のリクエストで、まだ何も変わったことを送っていないのに反応することがある」と明記しています。最初のリクエストにはCLAUDE.mdの内容やgit statusが入るので、セキュリティや生物学の資料を含むリポジトリでは、その情報だけで分類器が反応しうるという説明です。4つ目は、APIのドキュメントが「断りは出力の前にも、途中にも来る。どちらでも途中までの出力は不完全として捨てる」と書いていることに対応します。

2. 文言はモデルと版で違う

同じ仕組みの表示でも、文言はいくつかあります。公式のエラーリファレンスが載せている現在の例は、次の形です。

API Error: Opus 4.8's safeguards flagged this message. Our intentionally broad safeguards allow us to deliver more capabilities faster, but can sometimes flag legitimate cybersecurity work. Apply to the Cyber Verification Program to reduce these interruptions. Send feedback with /feedback or learn more: https://support.claude.com/en/articles/14604842-real-time-cyber-safeguards-on-claude

エラーリファレンスは続けて、「Opus 5.5とSonnet 5.5では、表示が<model>'s safeguards flagged this sessionで始まる」と書いています。冒頭で紹介した2つの表示は、2026年9月22日以降のIssueに貼られていたものです。当サイトが読んだ範囲では、flagged this sessionの表示には[cyber]か[bio]が、This sometimes happens with safe, normal conversationsの表示には主に[reasoning_extraction]が付いていました。

文言の書き出しどこで確認したか続きの内容
<model>'s safeguards flagged this message. Our intentionally broad safeguards…公式エラーリファレンス(Issueでは[cyber]とともに報告)CVPへの申請の案内(切り替えが起きたときはSwitched to Opus 4.8.のように切り替え先も入る)
<model>'s safeguards flagged this session公式エラーリファレンス(Opus 5.5とSonnet 5.5)と、v2.1.280〜2.1.283のIssue「Opusのモデルでは初めて見るかもしれない——能力が高い分、安全対策も強い」という説明
<model>'s safeguards flagged this message (…aup). This sometimes happens…v2.1.278〜2.1.284のIssue(公式リファレンスには例が無い)「安全で普通の会話でも起きることがある」と書き、Escでの編集か/modelを勧める
<model> has safety measures that flagged this message for a cybersecurity topic公式エラーリファレンス(v2.1.203〜2.1.218の旧文言)ヘルプセンターへのリンク(v2.1.203より前は例外申請のフォームへのリンク)
<model> can't help with this. Start a new session to continue.公式エラーリファレンス(Usage Policy refusal)利用規約(Usage Policy)の検査による拒否(Amazon Bedrock・Google CloudのAgent Platform・Microsoft Foundryでは、サイバーの判定もこの文言)

エラーリファレンスは、分類器そのものはサーバー側にあってv2.1.203より前から存在し、それ以降のClaude Codeの更新で変わったのは表示の文言だけだと書いています。Claude Codeを更新したから止まるようになった、という関係ではありません。

v2.1.284で変わったこと

2026年9月28日公開のv2.1.284のCHANGELOGには、この表示に関わる項目が2つあります。

  • Sonnetのモデルの安全対策がメッセージに反応したときの通知を、「なぜ起きたのかを説明し、編集して送り直す選択肢を出す」形に変えた。
  • ANTHROPIC_DEFAULT_OPUS_MODELやmodelOverridesでOpusのモデルを固定しているセッションの、安全対策によるモデルの切り替えを変えた。Anthropic APIでは、固定したモデルではなく、APIが判定の種類ごとに切り替え先を選ぶ。

Sonnet向けの新しい通知の文言は、9月29日の時点で公式エラーリファレンスに載っておらず、当サイトが読んだIssueにも貼られていませんでした。

3. Detailsの分類と、モデルが切り替わるかどうか

表示の最後のDetails:に入る語は、APIが返すstop_details.categoryの値と一致します。APIのドキュメントは5つの分類を載せています。どの分類でも「無害な作業でも反応することがある」と注記されている点に注意してください(reasoning_extractionを除く)。

Details公式の説明(要旨)Claude Codeでの扱い
cyberマルウェアやエクスプロイトの開発など、サイバー攻撃に使える可能性があるFable 5.1・Fable 5・Opus 5.5・Opus 5はOpus 4.8へ、Sonnet 5.5はSonnet 5へ切り替えて同じリクエストを送り直す
bio危険な実験の手法など、生物学的な害につながる可能性があるFable 5.1・Fable 5・Opus 5.5はOpus 5へ切り替え、Opus 5とSonnet 5.5は切り替え先が無く拒否で終わる
frontier_llm競合するAIモデルの開発を助ける可能性がある(商用規約で制限)ヘルプセンターによるとOpus 5.5からOpus 5へ切り替わる(Opus 5はこの分類で切り替わらない)
reasoning_extractionモデルの内部の推論を、応答の文章として再現させようとしているヘルプセンターの「蒸留(distillation)」の分類で、別のモデルへは切り替わらず、その場で止まる
general_harms上の4つ以外の、利用規約の分野に当たるClaude Codeのドキュメントに、切り替え先の記載は無い

出典:Claude API「Refusals and fallback」の分類表、Claude Code「Model configuration」のAutomatic model fallback、ヘルプセンター「Why Claude switched models in your conversation with Opus 5 or Opus 5.5」(いずれも2026年9月29日に確認)。

切り替えが起きたとき

Claude Codeは初期設定で、切り替え先のある分類で止められると、同じリクエストを切り替え先のモデルで自動的に送り直し、会話の中に通知を出します。その後のセッションは切り替え先のモデルのまま続きます。元のモデルに戻すには/modelで選び直します。

ただし、ヘルプセンターは「元のモデルに戻しても、止められた依頼が会話に残っていれば、同じ安全対策でまた切り替わることがある。送り直す前に前のメッセージを編集すると効くことが多い」と注意しています。切り替えが効かず冒頭のような表示で止まる代表的な場面は、reasoning_extractionのように切り替え先の無い分類で止められたとき、切り替え先のモデルでも止められたとき、切り替え先がavailableModelsで許可されていないとき、そして-pなどの非対話モードで「切り替える前に確認する」設定にしているときです。

4. 自分の作業が悪いのか——誤検知について公式が書いていること

「悪いことはしていないのに止められた」と感じたら、それは十分ありうることです。公式の文書は、誤検知があることを何か所かではっきり認めています。

✅ 公式の文書に書かれていること

  • 表示の文言:「This sometimes happens with safe, normal conversations(安全で普通の会話でも起きることがある)」「intentionally broad safeguards(意図的に広く取った安全対策)」
  • APIのドキュメント:cyber・bio・frontier_llm・general_harmsのそれぞれに「無害な作業でも反応することがある」と注記
  • Claude Codeのドキュメント:攻撃的なセキュリティや生物学の作業では、最初のリクエストから切り替えがよく起きる。「これらの分野では想定どおりの振り分けで、アカウントへの印(account flag)ではない」
  • ヘルプセンター:誤検知を減らすために分類器を調整し、アカウントの信頼度を示すさまざまな情報も考慮していく
  • CVPの説明:承認された利用者でも、正当な作業が止められることがある

一方で、表示のリンク先のヘルプセンター記事(Our Approach to User Safety)は、方針への違反を繰り返す利用者に、検出を敏感にした安全フィルターを一時的にかけることがあると書いています。誤検知で止められた回数がこれに数えられるのかは、公式に書かれていません。止められた後は、同じ依頼を言い回しだけ変えて何度もぶつけるより、6章の手順で会話を切り替えるほうが無難です。

reasoning_extractionで止まったときの考え方

ヘルプセンターは、この分類が止める例として「推論を一字一句くり返させる」「思考の過程(chain of thought)をすべて外部の出力に書き出させる」依頼を挙げています。一方で「推論を説明させる」「概念を教えさせる」「コードレビューを順に説明させる」ことはでき、「なぜそうしたの?」のような会話的な質問は影響を受けないとしています。

Issueの報告を読むと、次のような依頼の直後に止まった例がありました。いずれも利用者の報告で、なぜ反応したのかをAnthropicは説明していません。

  • 画面に、ツールの呼び出しの代わりに「思考」を表示できないかと相談した(#96118)
  • サブエージェントに、自分が動いているモデル名の行を文脈から引用させた(#96139)
  • 長い作業の終わりに、セッションのまとめをファイルに書かせた(#96874)
  • 設計の図に、判断ごとの「検討した案と退けた理由」を書き込むよう頼んだ(#98108)

共通するのは、「考えた過程」や「自分の文脈」をそのまま書き出させる形です。成果物として必要なら、「結論と、採用した理由を3行で」のように、結果を短くまとめさせる言い方に替えると、公式の挙げる「推論を説明させる」側に寄せられます。ただし、#96118への追加の報告のように、ドイツ語の短い質問だけで止まった例もあり、言い換えで必ず避けられるとは限りません。

5. 9月22日以降に報告されている事例

Opus 5.5が公開された2026年9月22日から、anthropics/claude-codeのIssueにこの種の報告が集中しています。当サイトが9月29日にGitHubの検索で数えたところ、題か本文に「safeguards」を含み、9月22日〜28日に作られたIssueは67件ありました(1日7〜12件。検索語の選び方で件数は変わります)。当サイトが読んだ9月22日以降のIssueには、Anthropicの担当者の回答は見当たらず、「duplicate」のラベルが付いたものが目立ちます。

🟡 GitHubで報告されているが、原因が確定していない事例(2026年9月29日に確認)

  • あいさつだけで止まった:「hi」で[cyber]と判定されOpus 4.8へ切り替わった(#96298)、「ola」で止まった(#96495)、「hi」で[reasoning_extraction](#97560)。#96495の報告者は、Kali Linuxをrootで使っていたことが影響したのではと推測している。
  • /compactで止まった:会話の圧縮の途中で[reasoning_extraction]の表示が出た(#96648、v2.1.281)。
  • 一度止まると会話ごと使えなくなる:同じセッションの後のメッセージがすべて止められた(#96874)、止められた語句が会話の記録に残り、それを読む後のセッションも止まった(#97452)。
  • サブエージェントが止まる:Opus 5のサブエージェント866件のうち14件(1.62%)が[reasoning_extraction]で止まったという、1台の端末での集計。止まったのはすべてレビュー型の依頼だった(#97492)。
  • CVPの承認者でも止まる:承認済みなのにOpus 5.5で[cyber]と判定された(#96090・#96298・#96592・#97946)。これは7章のとおり、公式の説明と合っている。
  • 自分の機器や自分のコードの作業で止まる:自社のSSHの「Permission denied」の調査(#97373)、自社製品のバイナリの逆アセンブル(#97891)、ソースに直書きされた資格情報を取り除く作業(#97605)。

あいさつだけで止まった例は、1章の「分類器は会話全体と作業場所の情報を見る」という公式の説明で説明がつく可能性があります。最後のメッセージが無害でも、CLAUDE.mdやそれまでのやり取り、読み込んだファイルに反応した、という筋です。ただし、どの報告でも何に反応したのかは示されておらず、確かめる方法は公開されていません。

6. 止まったときの対処手順

公式エラーリファレンスとモデル設定のドキュメントが挙げる手を、手間の小さい順に並べました。1回だけなら手順3で終わることが多いはずです。

01

Detailsと、切り替わったかどうかを見る

Switched toや切り替えの通知が出ていれば、作業はすでに別のモデルで続いています。止まったままなら、Details:の分類を3章の表と照らし合わせます。

02

途中だったファイル操作を確かめる

応答の途中で止められた場合、それまでの出力は不完全です。git statusとgit diffで、書きかけの変更が残っていないかを先に見ます(8章)。

03

Escを2回押して戻り、別の言い方で送る

入力欄が空の状態でEscを2回押すか/rewindを実行すると、巻き戻しのメニューが開きます。止められたターンより前を選び、依頼の書き方ややり方を変えて送り直します。公式がこの表示の対処として最初に挙げている手です。

04

どのターンが原因か分からなければ、新しい会話にする

/clearで同じプロジェクトのまま新しい会話を始めます。元の会話は消えず、/resumeから開けます。ただし、--continueや--resumeで元の会話を再開すると、止められた内容も一緒に戻るので、同じように止まりやすくなります。

05

/modelで別のモデルに替える

表示自身が「try a different model with /model」と勧めています。モデルによって付いている分類器が違うためです。たとえばSonnet 5.5の発表は、推論の取り出しを防ぐ分類器を付けて出た最初のSonnetだと書いており、前の世代のSonnet 5にはこの分類器がありません。

06

CLAUDE.mdなどが原因かを切り分ける

最初のメッセージから止まるなら、claude --safe-modeで起動します。CLAUDE.md・スキル・MCPサーバー・フックを読み込まずに始まるので、それで止まらなければ、読み込んでいたものの中に反応した内容があります。git statusとディレクトリ名は、この状態でも送られます。

07

誤検知なら/feedbackで報告する

公式は「サイバーセキュリティの話題でなかったなら、/feedbackで誤検知を報告する」よう案内しています。表示にあるRequest IDとMessage IDは、報告のときに役立ちます。会話の記録には作業中のコードやファイルのパスが含まれるので、GitHubのような公開の場に貼るのは必要な行だけにしてください。

自動で切り替えず、毎回選びたいとき

切り替え先のモデルでは作業の質が落ちる、と感じるなら、/configで「Switch models when a message is flagged」をオフにするか、設定ファイルに次のように書きます。止められるたびにセッションが一時停止し、「切り替え先のモデルに替える」か「プロンプトを編集して今のモデルで送り直す」かを選べるようになります。

{
  "switchModelsOnFlag": false
}

ただし、切り替え先の無い分類(Sonnet 5.5やOpus 5でのbioなど)では選択肢が出ず、拒否で終わります。-pの非対話モードや、確認を表示できないSDKの組み込みでも、止められたターンは拒否で終わります。スマートフォンのアプリから使うクラウドセッションでは「編集して送り直す」が使えません。

/compactで止まったとき

会話の圧縮も、会話全体をモデルに読ませる処理なので止められることがあります(#96648)。v2.1.282のCHANGELOGに「要約のリクエストが断られると圧縮が失敗していた問題を修正し、切り替え先のモデルで再試行するようにした」とあります。claude --versionが2.1.282より古いなら、まずclaude updateで更新してください。圧縮の使いどころは/compactを実行するタイミングの記事にまとめています。

7. Cyber Verification Program(CVP)は効くのか

CVPは、正当な防御目的でサイバーセキュリティの作業をする人が、安全対策に止められにくくするための無料の申請制度です。ヘルプセンターのCVPの記事は、止められる作業を2つに分けています。

禁止される利用(Prohibited use)

大量のデータの持ち出しやランサムウェアの開発のように、ほぼ悪用にしか使われない作業。CVPの承認があっても止められる。

リスクの高い両用(High Risk Dual use)

脆弱性の悪用や攻撃用ツールの開発のように、防御にも使える作業。初期設定では止められるが、CVPで緩和を申請できる。

ここで重要なのは、2026年9月29日時点で、CVPはOpus 5.5とSonnet 5.5には適用されていないことです。CVPの記事は冒頭で「この記事はOpusとSonnetのモデルに適用されるが、Opus 5.5とSonnet 5.5には適用されない。近くOpus 5.5・Sonnet 5.5・Mythos級のモデルにも広げる」と書いています。Opus 5.5の発表も、Sonnet 5.5の発表も、CVPの拡大は「近く」としています。5章で見た「CVPの承認者なのにOpus 5.5で止まる」という報告は、この説明と一致します。

Opus 5.5のヘルプセンター記事には、もう1つ手がかりがあります。「すでにCVPでOpus 4.8を使っている組織は、サイバーの制限が少ないOpus 5を今すぐ使える」という一文です。承認済みでOpus 5.5に止められるなら、当面は/modelでOpus 5かOpus 4.8を選ぶのが、公式の説明に沿った回避策になります。

確かめることヘルプセンターの説明
誰が申請できるかVerification Portalから申請(Claude.ai・Claude Code・Anthropic API)/申請の画面が表示されるのは権限のある管理者だけ/本人確認が必要/審査の結果は2営業日以内のメール通知が目標
使えない環境Zero Data Retention(ZDR)の組織は現時点で対象外/Amazon Bedrockでは未提供
承認後も止まるとき承認は特定の組織IDに結びつくので、個人のワークスペースなど別の組織で使っていないかを承認メールの組織IDと見比べる/禁止される利用は承認後も止まる
それでもおかしいとき記事内のフォームから、誤検知の報告か不承認への異議を送れる

生物学の研究で[bio]に止められる組織向けには、Life Sciences Verification Program(LSVP)という別の審査制度があります。Opus 5.5の発表は、審査を通った組織が研究にOpus 5.5を使えると書いています。

8. 止められたリクエストの課金と、途中の作業

課金は分類と止まった時点で変わる

APIのドキュメントとヘルプセンターによると、止められたリクエストの課金は次のとおりです。どの場合も、レート制限(利用上限)には数えられます。

出力の前に止まった:課金される

bio・frontier_llm・reasoning_extraction。誤検知の少ない分類だから、というのが公式の説明(2026年9月時点)。

出力の前に止まった:課金されない

cyber・general_harms、または分類が無い(null)場合。

応答の途中で止まった

入力と、止まるまでに流れた出力が、通常の料金で課金される。

切り替え先での応答

切り替え先のモデルの料金で別に課金される。キャッシュが使えなくなる分は、クレジットで補う。

サブスクリプションで使っている場合、利用上限の減り方として影響が出ます。#97335の報告者は、止められたリクエストが書き込んだプロンプトのキャッシュが次のリクエストで使われず、約70万トークンの長い会話では、止められるたびに会話全体を書き直すことになったと書いています。Proプランの5時間の枠を4回の拒否で使い切ったという観測です。公式には確認されていない報告ですが、長い会話で止まり続けるなら、同じ会話で粘るより/clearで切り替えたほうが、枠の面でも損が小さくなります。

書きかけのファイル操作が残ることがある

APIのドキュメントは、途中で止まった応答の出力を「不完全として捨てる」よう求めています。Claude Codeが止められた後に会話へ添える注記も、#97335に貼られた文面では「終わっていなかったツール呼び出しは実行されていない」となっています。

ところが#97311は、ファイル編集(Edit)やファイルの書き込み(Write)、Bashの呼び出しを書いている途中で止められ、途中で切れた内容のまま実行された例を4件報告しています(v2.1.219〜2.1.280、1台のLinux機)。EditとWriteでは「成功」と表示され、書き込んだファイルや書き換えた行が途中で切れていた、という内容です。公式の回答はまだありませんが、止められた直後は6章の手順2のとおり、git diffで変更を確かめてから次へ進むのが安全です。

# 変更のあったファイルを一覧する
git status

# 途中で切れた編集が無いか、中身を見る
git diff

# 1つのファイルを直前のコミットの状態に戻す(確かめてから)
git restore path/to/file

Claude Codeのファイル編集ツールで変えた内容なら、チェックポイントの巻き戻しでも戻せます。ただし、Bashで書き換えたファイルは巻き戻しの対象外です。

9. 確定していること/していないこと

✅ 公式に確認できること

  • 分類器はサーバー側にあり、Claude Codeの更新で変わったのは文言だけ
  • 最後の1文ではなく、会話・ファイル・CLAUDE.mdなど読んだものすべてを見る
  • 安全で普通の会話でも止まることがある
  • reasoning_extractionは別のモデルへ切り替わらない
  • CVPは、9月29日時点でOpus 5.5とSonnet 5.5に未対応
  • v2.1.282で、/compactが拒否されたら切り替え先で再試行するようになった

🟡 報告はあるが未確定

  • 「hi」「ola」だけで止まる(#96298・#96495・#97560)
  • 一度止まると、その会話を読むセッションも止まり続ける(#96874・#97452)
  • 途中で切れたファイル操作が実行される(#97311)
  • 止められたリクエストのキャッシュが再利用されない(#97335)

🔴 公表されていないこと

  • 個々の表示で、何に反応したのか
  • 誤検知で止められた回数がアカウントの扱いに影響するか
  • CVPをOpus 5.5とSonnet 5.5に広げる日付
  • v2.1.284で変わったSonnet向けの通知の文言

10. まとめ

「safeguards flagged this message」は、モデルの安全対策の分類器が会話の内容に反応し、そのモデルでの応答を止めたという表示です。分類器はサーバー側にあり、最後のメッセージだけでなく、会話全体・読み込んだファイル・CLAUDE.mdまで見ています。普通の会話でも止まることがあると、表示自身も公式の文書も認めています。

止まったら、まずDetails:の分類を見て、ファイル操作の途中だったならgit diffで確かめます。そのうえでEsc2回で戻って言い換える、/clearで新しい会話にする、/modelでモデルを替える、の順に試してください。[cyber]で仕事が止まるならCVPが選択肢ですが、9月29日時点でOpus 5.5とSonnet 5.5はまだ対象外です。モデル側の安全対策の全体像はOpus 5.5の解説記事、「フィルターに止められた」系のほかの文言はThe model returned no contentの記事、そのほかのエラーはClaude Codeのよくあるエラーと解決法まとめにまとめています。

FAQ

Q. 「safeguards flagged this message」はどういう意味ですか?
A. 使っていたモデル(Opus 5.5やFable 5.1など)の安全対策の分類器が、会話の内容に反応して応答を止めたという意味です。Claude Codeの故障や通信のエラーではありません。最後の行のDetails:に、反応した分類の名前が入っています。

Q. 「hi」と送っただけで止まりました。自分の何が悪かったのですか?
A. あなたの最後のメッセージが原因とは限りません。分類器は会話全体、読み込んだファイル、CLAUDE.mdやgit statusまで見ています。claude --safe-modeで起動して止まらなければ、読み込んでいた設定やファイルの内容に反応した可能性があります。誤検知だと思うなら/feedbackで報告してください。

Q. アカウントが停止されることはありますか?
A. Claude Codeのドキュメントは、セキュリティや生物学の作業でモデルが切り替わるのは想定どおりの振り分けで、アカウントへの印ではないと書いています。一方で、方針への違反を繰り返す利用者に強めのフィルターを一時的にかけることがある、とするヘルプセンター記事もあり、誤検知がそれに数えられるかは公表されていません。

Q. CVPの承認を受けているのに止まるのはなぜですか?
A. 2026年9月29日時点で、CVPはOpus 5.5とSonnet 5.5に適用されていないためです。公式は近く広げるとしています。すでにCVPでOpus 4.8を使っている組織は、Opus 5をサイバーの制限が少ない状態で使えると公式は書いているので、当面は/modelでOpus 5かOpus 4.8を選ぶのが回避策です。承認に結びついた組織IDと、使っている組織が同じかも確かめてください。

Q. 同じ会話で何度送っても止まります。どうすればいいですか?
A. 止められた内容が会話に残っていると、何を送っても同じ判定になりやすくなります。Escを2回押して止まる前のターンまで戻るか、/clearで新しい会話を始めてください。元の会話は/resumeで開けますが、再開すると止められた内容も一緒に戻ります。

参考にした一次情報