Claude Opus 5.5 のプロンプトガイドが 2026 年 9 月 28 日、Anthropic の公式プラットフォームドキュメントに公開された。このガイドはモデルの強さを語らない。扱うのは一点だけだ。Opus 5 から持ち込んだプロンプトやエンジニアリング設定のうち、何を変えるべきか。核心の変更は一つ——Opus 5.5 では thinking をオフにできなくなった。
最大の変化:effort が第一の制御つまみに
Opus 5 は high 以下の effort で thinking の無効化を許したが、Opus 5.5 はそのオプションを受け付けない。代わりにあるのが effort 設定だ。5.5 のデフォルトは medium、Opus 5 のデフォルトは high。Anthropic のテストでは、5.5 は medium でコーディングとナレッジワークにおいて Opus 5 の high に匹敵または上回り、一部のコーディング評価では low も肉薄する一方、コストは大幅に低い。
移行時に古い effort 値をそのまま持ち込んではいけない。同じレベルでも 5.5 は 1 ターンあたりの思考量が多く、特に xhigh と max ではターンが長くなりトークンも増える。Anthropic は medium から始め、Opus 5 の設定を流用せず自前の評価で各レベルを実測するよう推奨する。さらに落とし穴が二つ。thinking も max_tokens にカウントされるため、Opus 5 の thinking オフ時代の上限のままでは応答が途中で切れる。長いエージェント作業には 128,000 が有効だったという。トップレベルの effort を変えると prompt cache が無効化されるため、単一ターンの調整にはベータ版の per-message effort change を使ってキャッシュを維持する。
「thinking オフ」からの移行で変える 4 点
元のインテグレーションが thinking disabled で動いていた場合、ガイドは 4 つの変更点を挙げる。low effort から実測を始め、品質が落ちれば medium に上げる。thinking の代わりに推論を応答文に書かせる指示を削除し、summarized thinking ブロックから読む。Opus 5 の thinking オフ時代の緩和策を再テストし、不要になったものは削除する。応答は block type で読む。最初のブロックがテキストとは限らない——thinking ブロックはデフォルトの display では内容が空だ。
安全面にも新要素がある。生物学、サイバーセキュリティに加え、新しい reasoning_extraction 拒否カテゴリが追加された。モデルに内部推論を応答文に復唱させるプロンプトは拒否され、stop_reason は refusal となる。
無人エージェントの 2 つの落とし穴
Opus 5.5 は長い作業で能動的に進捗を報告し、報告の中にはプレーンテキストでターンを終えるものがある。「テキストで終わった=完了」と見なすと、無人ループが早々に停止する。ガイドはそれを完了の証拠ではなく報告として扱うよう推奨する。タスクの内訳をチェックリストやファイルで追跡し、未完了の項目があり、詰まりも宣言されていなければ、その項目を名指しする短いユーザーメッセージを送る。同じタスクで 2〜3 回の自動継続でも詰まったままなら止めて人手で確認する。
もう一つの落とし穴は「沈黙」だ。進捗更新は thinking ブロック内にあり、デフォルトの display ではテキストが空のため、text ブロックだけを描画するクライアントには長いターンが無言に感じられる。ベータ版の display: "updates" をオンにすれば、各更新の要約を受け取れる。
Opus 5.5 は今回、新しいパラメータを追加しなかった。入れ替えたのはコストモデルだ。thinking 常時オンの後は、トークン節約は思考を切ることではなく、effort をタスクに本当に必要な档位に合わせることで得られる。移行の本質はモデル名の交換ではなく、「thinking を切れる」時代に書かれたエンジニアリングの前提を一つずつ検証し直すことだ。