AIエージェント開発

Claude Opus 5.5 API|料金・変更点・移行手順【2026年9月】

Claude Opus 5.5 API|料金・変更点・移行手順【2026年9月】

この記事の結論

Claude Opus 5.5 APIの料金($4/$20・キャッシュ読み取り$0.20)とOpus 5から壊れる変更4点(thinking無効化不可・tool_choice・computer use)、公式順の移行手順を整理。

2026年9月23日時点で、Claude Opus 5.5(モデル ID claude-opus-5-5)は Claude API・Amazon Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundry の 5 経路で使えます。料金は 100万トークンあたり入力 $4/出力 $20(Opus 5 は $5/$25)、キャッシュ読み取りは $0.20(Opus 5 は $0.50)です。Opus 5 で動いているコードをそのまま向けると、thinking の無効化tool_choice の any/toolClaude API と Google Cloud での computer_20251124 の 3 か所が 400 エラーになり、thinking ブロックの扱いツール呼び出しの合間の文章の返り方が静かに変わります。この記事は公式ドキュメントに書かれている範囲だけで、料金・変更点・移行手順を整理します。

公開は米国時間 2026年9月22日。Anthropic は「ほとんどの仕事で Claude Fable 5.1 と同水準の性能で、Opus 5 より 40% 低いコスト(既定設定・典型的なワークロードでの同社テスト)」と説明しています。開発者に効くのは性能の話より API の仕様変更のほうなので、先にそこから見ていきます。

結論|Opus 5 から移す前に、400 を返す 3 点と静かに変わる 1 点を先に潰す

公式の「What’s new in Claude Opus 5.5」は、Opus 5 で動いているコードに影響する破壊的変更を 4 つ挙げています。うち 3 つは Claude Fable 5.1 と同じ内容で、残り 1 つは computer use の型指定です。

変更 何が起きるか 直し方(公式)
thinking を無効化できない thinking: {"type": "disabled"}{"type": "enabled", "budget_tokens": N} も 400 thinking を送らず output_config.effort で深さを決める
強制ツール指定が使えない tool_choiceanytool が 400(トークン数カウントの endpoint も同じ) auto+strict tool use、または structured outputs
thinking ブロックがモデルと会話に紐づく 別モデルへ切り替えるとブロックは捨てられる。2026年8月31日以降に作った API アカウントは、過去ターンを編集した後の再送が既定で 400 会話は追記だけにする(append-only)
computer_20251124 が使えない(Claude API・Google Cloud) 旧 computer use ツールの型指定が 400 computer_toolset_20260801 に置き換える。Bedrock は旧型のまま動く

加えて、リクエストは失敗しないのに挙動が変わる点が 1 つあります。Opus 5 では text ブロックで返っていた「ツール呼び出しの合間の短い進捗の文」が、Opus 5.5 では progress-update 用の thinking ブロックで返り、既定の display: "omitted" ではその中身が空になります。ユーザーに進捗を流していたアプリは、設定を変えない限りツール実行中に黙り込みます。

破壊的変更のうち 3 点は Claude Fable 5.1 のときと同じなので、既に Fable 5.1 へ移した人は差分が computer use の 1 点だけです。Fable 5.1 側の直し方はClaude Fable 5.1 API 移行ガイド|破壊的変更 3 点の直し方にまとめてあります。

モデル ID と提供先|claude-opus-5-5 は 5 経路と GitHub Copilot で同日提供

claude-opus-5-5 は日付サフィックスの無い固定 ID で、Opus 5(claude-opus-5)と同じ方式です。エイリアスではなく、それ自体がピン留めされたスナップショットとして扱われます。プラットフォーム別の ID は次のとおりです(公式の models overview・参照日 2026年9月23日)。

Claude Opus 5.5の提供先5経路とモデルID。Claude API(claude-opus-5-5・fast modeはここだけ)、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS・Google Cloud・Microsoft Foundry(いずれもclaude-opus-5-5)を横並びにした図

提供先 モデル ID 備考
Claude API claude-opus-5-5 全顧客に提供。fast mode はここだけ
Amazon Bedrock anthropic.claude-opus-5-5 旧 computer_20251124 ツールがそのまま動く唯一の経路
Claude Platform on AWS claude-opus-5-5 Bedrock 形式ではなく Claude API と同じ ID
Google Cloud claude-opus-5-5 computer use は toolset 必須
Microsoft Foundry claude-opus-5-5 送るのはデプロイ名。既定はモデル ID と同名
  • コンテキストは 1M トークンが既定で、200k を超えても追加料金はありません(Claude 4.6 以降のモデル共通)。
  • 最大出力は 128k トークン。Message Batches API では output-300k-2026-03-24 ベータヘッダーで 300k まで伸ばせます。
  • 信頼できる知識のカットオフは 2026年6月。提供終了は 2027年9月22日より前にはならないと明記されています。
  • GitHub Copilot でも同日から Pro+・Max・Business・Enterprise の各プランで選べます(VS Code・Visual Studio・Copilot CLI・coding agent・JetBrains・Xcode・Eclipse など。段階的な展開で、使用量課金ではプロバイダの定価で請求)。

クラウド 3 社経由の設定手順(リージョン・デプロイ名・ベータヘッダーの可否)は Fable 5.1 の時点と同じ考え方で、Fable 5.1 を Bedrock/Vertex/Foundry で使う手順の ID を claude-opus-5-5 に読み替えれば流用できます。同日の GitHub Copilot 側の追加モデル(GPT-6 Sol/Luna との並び)は別記事で扱います。

料金|Opus 5 比で入出力 20% 減・キャッシュ読み取り 60% 減

公式の料金ページから、Opus 5.5 と Opus 5 の単価を並べます。すべて 100万トークンあたりの米ドルです。

Claude Opus 5.5とClaude Opus 5の100万トークンあたり単価の比較。Opus 5.5は入力$4・出力$20・キャッシュ読み取り$0.20・5分キャッシュ書き込み$5、Opus 5は入力$5・出力$25・キャッシュ読み取り$0.50・5分キャッシュ書き込み$6.25

項目 Claude Opus 5.5 Claude Opus 5
入力 $4 $5
出力 $20 $25
5分キャッシュ書き込み $5 $6.25
1時間キャッシュ書き込み $8 $10
キャッシュ読み取り $0.20(入力の 0.05 倍) $0.50(入力の 0.1 倍)
Batch API(入力/出力) $2/$10 $2.50/$12.50
fast mode(入力/出力) $8/$40 $10/$50

見落としやすいのはキャッシュ読み取りの倍率が 0.1 倍から 0.05 倍に下がった点です。Anthropic は発表文で「エージェント・コーディング用途のコストの大半はキャッシュ読み取り」と書いており、単価の 20% 減より、この 60% 減のほうが実際の請求に効きます。キャッシュできる最小長は 512 トークンです。キャッシュの張り方そのものはAnthropic Prompt Caching 完全実装ガイドを参照してください。

試算例(実測値ではありません・前提と計算式を明示): 1 リクエストあたり未キャッシュ入力 20万トークン、キャッシュ読み取り 80万トークン、出力 10万トークンとすると、公式単価の掛け算だけで次の差になります。

内訳(計算式) Claude Opus 5 Claude Opus 5.5
未キャッシュ入力 20万 × 単価 $1.00 $0.80
キャッシュ読み取り 80万 × 単価 $0.40 $0.16
出力 10万 × 単価 $2.50 $2.00
合計 $3.90 $2.96

トークン数が同じでも約 24% 下がります。Anthropic の「40% 減」は、これに加えて同じタスクを少ないトークンで終える分を含めた同社テストの値です。自分のワークロードで何割になるかは、effort の段階ごとに測り直す必要があります。

fast mode は Claude API 限定・研究プレビュー

fast mode は同じ重みを速い推論構成で動かすもので、出力トークン毎秒が最大 2.5 倍(最初のトークンまでの時間ではなく、出力速度の改善)とされています。Opus 5.5 では入力 $8/出力 $40 で、Opus 5・Opus 4.8 の $10/$50 より安くなりました。使えるのは Claude API(Managed Agents 含む)だけで、Bedrock・Claude Platform on AWS・Google Cloud・Foundry では使えません。Batch API との併用も不可、レート制限は通常の Opus とは別枠、アクセスは順番待ち(waitlist)です。公式の例は次のとおりです。

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "anthropic-beta: fast-mode-2026-02-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 4096,
    "speed": "fast",
    "messages": [{"role": "user", "content": "..."}]
  }'

応答の usage.speed"fast""standard" かで、どちらの速度で処理されたかが分かります。

API の変更点 4 つ|thinking・tool_choice・thinking ブロック・computer use

ここからは公式の「Breaking changes」の順に、エラーメッセージまで含めて確認します。

Claude Opus 5.5でOpus 5のコードが壊れる4か所。thinkingを切れない(disabledもenabledも400)、強制ツール指定が400(anyとtoolは不可・autoとnone)、thinkingブロックが会話に紐づく(8月31日以降の新規アカウントは既定で検査)、computer_20251124が使えない(computer_toolset_20260801へ)

thinkingを切れない

Opus 5 では effort が high 以下なら thinking: {"type": "disabled"} を受け付けました。Opus 5.5 では adaptive thinking が常時 ON で、disabledもenabledも400invalid_request_error)です。thinking を省略するか {"type": "adaptive"} を送るのが正しく、ベータヘッダーは要りません。返ってくるエラー文は次の 2 種類です。

"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

応答は 1 つ以上の thinking ブロックから始まり得るので、コンテンツブロックは位置ではなく type で選び、ツール使用のループでは thinking ブロックをそのまま返す必要があります。Opus 5 で thinking を ON のまま動かしていたコードは変更不要です。

強制ツール指定が400

tool_choice{"type": "any"} または {"type": "tool", "name": "..."} にすると 400 になります。anyとtoolは不可・autoとnoneは使えます。エラー文は tool_choice: type "tool" and "any" are not supported for this model. で、トークン数カウントの endpoint にも同じ検証がかかります。スキーマどおりの JSON が欲しい場合は auto のまま各ツールに strict: true を付けるか、structured outputs へ移し、ツールを使わせたい場面はプロンプトで「このときはこのツールを使う」と書きます。

thinkingブロックが会話に紐づく

各 thinking ブロックは生成したモデルを記録しており、読めるモデルが決まっています。Opus 5.5 は Opus 5 とそれ以前の Opus・Sonnet・Haiku のブロックを読めますが、Fable・Mythos 系のブロックは読めません。逆に Claude API 上の Fable 5.1 と Mythos 5.1 は Opus 5.5 のブロックを読めます。読めないブロックはエラーではなく API 側で落とされ(課金もされない)、thinking-binding-controls-2026-08-01 ベータヘッダーを付けると input_transformations に落とした事実が載ります。

もう 1 つは前方部分の検査です。ブロックより前にある systemtools・過去メッセージが生成時から変わっていると、そのブロック以降は無効になります。8月31日以降の新規アカウントは既定で検査され、該当する再送は 400 です。それより前に作ったアカウントは thinking.block_binding.prefix_mismatch_behavior を明示したリクエストだけ検査されます。"drop_block" を指定すると、エラーではなく該当ブロックを捨てて続行します。

computer_20251124が使えない

Claude API と Google Cloud では、toolscomputer_20251124 型を入れると 400 になります(エラー文は 'claude-opus-5-5' does not support tool types: computer_20251124. で始まり、受け付ける型の一覧が続きます)。computer_toolset_20260801へ移すには、ベータヘッダーを外し、tools の項目を {"type": "computer_toolset_20260801"} に差し替え、エージェントループ側でメンバー tool_use ブロック(アクション名はブロックの name)・1 ターン複数アクション・結果に付ける toolset_name に対応します。Amazon Bedrock では旧型がそのまま動くので変更不要です。既に toolset か browser use tool を使っている統合も変更不要です。旧型でのループ設計はComputer Use 本番運用ガイドを参照してください。

失敗しないが変わる点|ツール呼び出しの合間の文章

Opus 5.5 は Fable 5.1 と同じく、ツール呼び出しの間に書く短い進捗の文を text ではなく progress-update の thinking ブロックで返します(各ツール呼び出しの前に最大 1 つ)。既定の display: "omitted" では中身が空なので、進捗を UI に流していたアプリは黙り込みます。復元するには thinking.display"updates"(ベータ・thinking-display-updates-2026-08-18 ヘッダー)か "summarized" にして、空でない thinking ブロックを直後の tool_use の前に描画し、ブロックはそのまま返します。

安全分類器の区分が増えた

Opus 5.5 は stop_reason: "refusal"stop_details の区分を返すことがあり、Opus 5 の "cyber" に加えて "bio""reasoning_extraction" が増えました。fallbacks: "default"(ベータ)を付けるとサーバ側で推奨モデルに再試行されますが、reasoning_extraction だけは再試行されず、そのまま返ってきます。

thinking を「切る」から effort で「深さを決める」へ

Opus 5.5 で thinking の制御は effort 一本になりました。従来(Opus 5)といま(Opus 5.5)の考え方の切り替えを、公式の effort ページの記述で整理します。

Opus 5ではthinkingを切って節約し既定はhighだったが、Opus 5.5ではthinkingは常時ONで既定はmedium、low/medium/high/xhigh/maxのeffortで深さを決める、という考え方の切り替えを左右で対比した図

  • effortの既定はmedium。Opus 5 とそれ以前の Opus では既定はhighでした。effort を省略したリクエストは Opus 5 のときより 1 段低い設定で動きます。low/medium/high/xhigh/max の 5 段すべてに対応しています。
  • thinkingは常時ON。Opus 5 で使えた「type: disabledthinkingを切って節約する」発想は捨て、節約したい場面は low へ下げます。effort は思考だけでなく応答本文・ツール引数を含む全出力トークンに効き、低いほどツール呼び出しも少なく短くなります。
  • 同じ effort でも Opus 5.5 は 1 ターンあたりの思考が Opus 5 より多く、特に xhighmax で顕著です。Opus 5 の設定値を持ち越さず、自分の評価セットで effort の掃引をやり直すよう公式が求めています。
  • max_tokens は思考分を含む上限なので、Opus 5 で thinking を切っていた頃の値のままだと本文が途中で切れます。長いエージェント的ターンでは、モデルの上限である 128,000 が Anthropic のテストで有効だったと書かれています。
  • 公式の記述では、Anthropic のテストで Opus 5.5 の medium はコーディングと知識労働の評価で Opus 5 の high と同等以上、いくつかのコーディング評価では low がはるかに低いコストでそれに近づいたとされています。

会話の途中で effort を変えるときは、トップレベルの effort を変えるとプロンプトキャッシュが無効になります。Opus 5.5 は per-message effort(ベータ・mid-conversation-output-config-2026-07-01 ヘッダー)に対応しており、空の system メッセージに output_config.effort を載せると、次の user ターンから新しい段階が効き、キャッシュは保たれます。公式の例(モデルは claude-fable-5-1 のままの掲載)は次のとおりで、Opus 5.5 でも同じ形です。

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "anthropic-beta: mid-conversation-output-config-2026-07-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 4096,
    "output_config": {"effort": "high"},
    "messages": [
      {"role": "user", "content": "Plan a migration from SQLite to PostgreSQL in three short steps."},
      {"role": "assistant", "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts."},
      {"role": "system", "content": [], "output_config": {"effort": "low"}},
      {"role": "user", "content": "Summarize the plan in one sentence."}
    ]
  }'

Opus 5 の時点で effort を振り分け設計の主役にする考え方はClaude Opus 5 登場|エージェント設計のモデル振り分けが変わるで整理しました。Opus 5.5 では「切る」選択肢が無くなった分、その設計がそのまま必須になります。

移行手順|公式 migration guide の順に 4 段で進める

公式の migration guide は Opus 5 からの移行を「モデル ID → 破壊的変更 4 つ → 推奨変更 → チェックリスト」の順で書いています。以下のコードはすべて公式ページに載っている例で、この記事の執筆者が動かして確かめたものではありません。

Claude Opus 5.5への移行手順4段。1 モデルIDを差し替える(claude-opus-5-5)、2 thinking指定を消してeffortを決める(既定はmedium)、3 tool_choiceをautoにしてstrictを付ける(strict: true)、4 computer useをtoolsetへ移す(Bedrockは変更不要)

1 モデルIDを差し替える

model = "claude-opus-5"  # Before
model = "claude-opus-5-5"  # After

Bedrock だけ anthropic.claude-opus-5-5、他の経路は claude-opus-5-5 です。Claude Managed Agents を使っている場合は、公式の注記によればモデル名の更新以外の変更は不要です。

2 thinking指定を消してeffortを決める

Before は Opus 5 で通り、Opus 5.5 では 400 になる形です。

client.messages.create(
    model="claude-opus-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    messages=[{"role": "user", "content": "..."}],
)

After。thinking を切っていた場面は effort を下げて置き換えます。

client.messages.create(
    model="claude-opus-5-5",
    max_tokens=16000,
    output_config={"effort": "low"},  # thinking is always on; effort is the control
    messages=[{"role": "user", "content": "..."}],
)

3 tool_choiceをautoにしてstrictを付ける

client.messages.create(
    model="claude-opus-5-5",
    max_tokens=1024,
    # strict tool use: every call matches the tool's input_schema
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[
        {
            "role": "user",
            "content": "What's the weather in Paris? Use the get_weather tool.",
        }
    ],
)

strict: true はトークンのサンプリングをスキーマに合う出力に制限する仕組み(grammar-constrained sampling)で、型のずれや必須項目の欠落を無くします。強制していた「必ずこのツールを呼ぶ」の部分は、例のようにプロンプトへ移します。

4 computer useをtoolsetへ移す

client.messages.create(
    model="claude-opus-5-5",
    max_tokens=4096,
    # no beta header; the toolset entry takes no name or display size
    tools=[{"type": "computer_toolset_20260801"}],
    messages=[{"role": "user", "content": "Open the display settings."}],
)

Bedrockは変更不要です。Claude API と Google Cloud だけ、この差し替えとエージェントループの更新が要ります。

公式チェックリストの残り

  • effort を明示する(既定が medium に変わったため)。
  • ルーターやフォールバックで Opus 5.5 から別モデルへ会話が移る構成では、そのモデルが Opus 5.5 の thinking 無しで動くことを前提にする(例外は Claude API 上の Fable 5.1 と Mythos 5.1)。
  • コンテンツブロックは type で読み、thinking ブロックはそのまま返す。
  • ツール呼び出しの合間の文を UI に出しているなら display: "updates"(ベータ)か "summarized" を設定する。
  • 会話途中で systemtools・過去ターンを編集しているなら、preserved thinking のページに従って append-only へ直す。
  • stop_reason: "refusal" を処理し、フォールバックを設定する。
  • 選んだ effort でコストとレイテンシを測り直す。

Opus 4.8 以前からの移行は、まず Opus 5 の migration guide(thinking 既定 ON・サンプリングパラメータの拒否・prefill 廃止・新トークナイザ)を適用してから、この 4 段を重ねる順序になっています。Claude Code を使っているなら、同梱の Claude API skill で移行作業そのものを自動化できます。

/claude-api migrate this project to claude-opus-5-5

公式の説明では、モデル ID の差し替え・破壊的変更に伴うパラメータ変更・prefill の置換・effort の較正をコードベース全体に適用し、手動確認すべき項目のチェックリストを出力します。編集前に対象範囲(作業ディレクトリ全体・サブディレクトリ・特定ファイル)の確認を求め、Bedrock と Claude Platform on AWS のクライアントも検出して ID 形式を調整するとされています。

Claude Code と Agent SDK での扱い|公式ドキュメントに書かれている範囲

Claude Code 側は model-config のページに、次の記載があります(参照日 2026年9月23日)。

  • Opus 5.5 は Claude Code v2.1.280 以降が必要。claude update で更新する。
  • エイリアス opus は Anthropic API・Claude Platform on AWS・Amazon Bedrock・Google Cloud の Agent Platform で Opus 5.5 を指す。Microsoft Foundry では opus は Opus 4.6 のままで、使うにはフルネーム指定か ANTHROPIC_DEFAULT_OPUS_MODEL の設定が要る。
  • default 設定は Pro・Max・Team・Enterprise・Anthropic API と、Claude Platform on AWS・Bedrock・Google Cloud の Agent Platform で Opus 5.5 に解決する(Foundry は Sonnet 4.5)。
  • effort の既定は Opus 5.5 だけ medium。ユーザー設定ファイルのトップレベル effortLevel(古い形式)は Opus 5.5 には効かず、/effort/model で段階を選ぶまで既定で動く。プロジェクト・ローカル・管理設定の effortLevel は全モデルに効く。
  • thinking は切れない。セッションの切り替え(macOS は Option+T)・alwaysThinkingEnabledMAX_THINKING_TOKENS=0 はいずれも Opus 5.5 と Fable 系には効かない。
  • 安全分類器でフラグが立った要求は、生物学系は Opus 5 へ、サイバーセキュリティ系は Opus 4.8 へ再実行され、その旨がトランスクリプトに表示される。

Claude Agent SDK は、オプションの model にエイリアスかフルネームを渡してモデルを決め、fallbackModel(Python は fallback_model)で過負荷時の代替を並べます。effort はオプションの effort で設定します。preserved thinking のページには、Claude Code・claude.ai・Managed Agents・Agent SDK がリクエストを組み立てている場合は何も変える必要がないと明記されています。自前で Messages API を叩いているコードだけが、前節のチェックリストの対象です。

注意点|透かし・preserved thinking の対象アカウント・安全分類器

テキスト出力に透かしが入る

GitHub の changelog は「Claude Opus 5.5 はテキスト出力に透かし(watermark)を入れる」と明記し、Anthropic の 2026年8月14日の解説記事へ誘導しています。同記事によると、透かしは EU AI Act への対応で、次の性質を持ちます。

  • 文字や隠し文字を足すのではなく、複数候補から次の語を選ぶときの乱数の出どころを鍵で置き換える方式(Google DeepMind の SynthID-Text 系)。読者には見分けがつかない。
  • トークンは増えず、料金も速度も変わらない。
  • 利用者・組織・チャットを特定する情報は含まれない。
  • コードのように「正解が 1 つ」の出力にはほとんど作用しない(コメントなど任意性のある部分には作用し得る)。
  • 検出 API は非公開プレビューで、EU 法上の義務がある組織などに限定。

言い換えると、透かしのために API 側の設定を変える必要はありません。「AI が書いたかどうか」を第三者が判定できる可能性がある、という前提だけ押さえておけば十分です。

preserved thinking(anti-distillation)の対象は 2026年8月31日以降のアカウント

Anthropic は Opus 5.5 を、Fable 5.1 で導入した anti-distillation の仕組み「preserved thinking」つきで公開しました。API 利用者が Claude の過去の文脈を編集して推論を抜き出すことを防ぐもので、Fable 5.1 と Opus 5.5 に対し、2026年8月31日 00:00 UTC 以降に作成した API アカウントで既定の検査が有効です。それより前のアカウントでは、prefix_mismatch_behavior を明示しない限りエラーにはならず、検査に引っかかったブロックもそのままモデルに渡ります。公式は「自分のキーでエラーが出ないことは影響が無いことの証明にはならない。thinking-binding-controls-2026-08-01 ヘッダーを付けて input_transformations を見れば、新規アカウントで起きることを自分のアカウントでも確認できる」と書いています。自分のツールを他人の API キーで動かしてもらう開発者ほど、先に確認しておく価値があります。

安全分類器の再ルーティングは前提として設計する

発表文によると、Opus 5.5 は生物学とサイバーセキュリティで Claude Mythos 5.1 に匹敵するため、Fable 5.1 と同じ区分の安全装置つきで提供されます。通常のソフトウェア開発でのバグ発見・修正はできますが、多くのサイバーセキュリティ作業は Opus 4.8 へ振り替えられます。生命科学の研究用途には Life Sciences Verification Program、セキュリティ実務者向けには Cyber Verification Program の拡大が案内されています。API では stop_reason: "refusal" として返るので、前節のフォールバック設定とセットで扱います。

なお発表文は「Claude Sonnet 5.5 と Claude Haiku 5.5 は今後数週間で続く」としています。時期の断定はなく、2026年9月23日時点で公式発表はこの 1 文だけです。

失敗パターン 4 つ(❌→⭕)

1. モデル ID だけ差し替えて thinking の設定を残す

modelclaude-opus-5-5 にしただけで、thinking: {"type": "disabled"}budget_tokens の指定が残っている。全リクエストが 400 で止まります。
thinking フィールドを消し、output_config: {"effort": "low"} のように段階を決める。応答の先頭が thinking ブロックになることも前提にする。

2. JSON を確実に返させるために tool_choice で強制する

tool_choice: {"type": "tool", "name": "extract"} でスキーマどおりの出力を保証していた。Opus 5.5 では 400 です。
⭕ ツール定義に strict: true を付けて tool_choiceauto、プロンプトで「抽出結果は extract ツールで返す」と書く。単なる JSON 出力なら structured outputs へ移す。

3. max_tokens を Opus 5 の値のまま持ち越す

❌ thinking を切っていた頃の max_tokens(例えば数千)のまま Opus 5.5 を呼び、本文が途中で切れる。思考トークンは返されない設定でも max_tokens に数えられます。
⭕ 思考分を見込んで上限を上げる。長いエージェント的ターンでは公式が 128,000 を挙げている。減らしたいのは effort を下げるほうで対応する。

4. ツール実行中に UI が黙ったのをモデルの問題と誤解する

❌ Opus 5 で text ブロックを進捗表示に使っていたアプリが、Opus 5.5 でツール呼び出し中に何も表示しなくなり、「モデルが進捗を書かなくなった」と判断してプロンプトを増やす。
⭕ 進捗は thinking ブロックで届いている。display: "updates"(ベータ)を設定し、空でない thinking ブロックを直後の tool_use の前に描画する。それでも間隔が空くなら、公式の手順どおりターン限定の system メッセージで更新を促す。

よくある質問

Claude Opus 5.5 の API 料金はいくらですか?

100万トークンあたり入力 $4、出力 $20 です。キャッシュ読み取りは $0.20、5分キャッシュ書き込みは $5、1時間キャッシュ書き込みは $8、Batch API は $2/$10、fast mode は $8/$40(Claude API のみ)。1M トークンのコンテキストは全域が同じ単価で、200k 超の割増はありません。

Opus 5 で動いているコードは、そのまま claude-opus-5-5 に向ければ動きますか?

thinking を ON のまま、tool_choiceauto、computer use は使っていない(または toolset か Bedrock)、会話は追記だけ、という条件が揃っていれば ID の差し替えだけで動きます。それ以外は本文の 4 点のどれかで 400 になるか、進捗表示が消えます。

コスト削減のために thinking を切っていました。どうすればいいですか?

Opus 5.5 では切れません。公式は「low から始めて自分のトラフィックでレイテンシと品質を測り、品質が落ちるなら medium へ」と案内しています。それでも最初のトークンまでの時間が気になる場合、system prompt に「Answer directly without deliberating.」のような 1 行を足すと思考をさらに減らせるが、品質を必ず測ること、とも書かれています。

個人の API アカウントでも Opus 5.5 は使えますか?

Claude API では全顧客に提供されています。注意点はアカウントの作成日で、2026年8月31日以降に作ったアカウントは preserved thinking の前方検査が既定で有効です。会話履歴を追記だけで扱うコードなら影響はありません。

Bedrock や Google Cloud でも fast mode は使えますか?

使えません。fast mode は研究プレビューで Claude API(Managed Agents 含む)限定です。Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundry では通常速度のみで、料金も通常単価です。

まとめ|今日やる 3 つ

  1. コードを grep する: "type": "disabled"budget_tokenstool_choiceanytoolcomputer_20251124 の 4 語を探し、該当箇所を本文の 4 段で置き換える。Claude Code なら /claude-api migrate で一括変更できる。
  2. effort を明示して掃引する: 既定が medium に下がったので、lowmediumhigh を自分の評価セットで測り、max_tokens を思考分込みで上げる。
  3. 会話の扱いと表示を確認する: append-only になっているか、ツール実行中の進捗を thinking ブロックから読めているか、refusal のフォールバックがあるかを見る。

料金の低下分は、キャッシュ読み取りが多いエージェント用途ほど大きく出ます。反対に、thinking を切って安く回していた用途は effort の測り直しが要るので、移行の前後でコストの内訳を残しておくことをお勧めします。法人での導入判断(料金・使い分け・研修)はUravation 側の Claude Opus 5.5 解説にまとめています。

この記事を読んで導入イメージが固まってきた方へ

UravationではAIエージェント導入の研修・コンサルを行っています。

運営元 Uravation よりAIエージェントを構想から本番運用まで進める順番と、体制・KPIの決め方をまとめた資料を無料で公開しています。 AIエージェント導入ロードマップを受け取る(無料)

参考・出典

すべて 2026年9月23日に参照。数値・エラー文・コード例はこれらの公式ページの記載です。

Need help moving from reading to rollout?

この記事を読んで導入イメージが固まってきた方へ

Uravationでは、AIエージェントの要件整理、PoC設計、社内導入、研修まで一気通貫で支援しています。

この記事をシェア

X Facebook LINE

※ 本記事の情報は2026年9月時点のものです。サービスの料金・仕様は変更される可能性があります。最新情報は各サービスの公式サイトをご確認ください。

関連記事