先に、要点をまとめます。
- Claude Opus 5.5は 2026年9月22日に公開 され、API料金は 100万トークンあたり入力4米ドル・出力20米ドル (Opus 5は5米ドル・25米ドル)です。
- 公式が示す 「40%削減」は既定設定・典型的なワークロードでの比較 です。主因は キャッシュ読み取りが0.50米ドルから0.20米ドルへ60%下がったこと で、キャッシュ比率の低い使い方では同じ割合になりません。公式ドキュメントは 同じeffort設定でもOpus 5より1ターンあたりの思考量が増える傾向 を明記しており、単価が下がっても出力トークンが増えれば請求額は戻ります。
- 最も見落としやすいのは effortの既定値がhighからmediumへ下がったこと です。モデルIDを書き換えるだけの移行は エラーを出さずに推論水準だけが下がります 。
2026年9月23日時点で確認した情報です。料金・提供条件は改定されることがあるため、判断の直前には本文中の公式ページで最新の状態をご確認ください。
Claude Opus 5.5とは?いつから使えますか?
2026年9月22日に公開され、Claude APIと主要クラウドで利用できます。モデルIDはclaude-opus-5-5です。
Anthropicの2026年9月22日の発表と公式ドキュメントでは、長時間動くエージェント的なコーディングと知識労働に向けたモデルとして案内されています。
提供先はClaude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryです。提供先ごとにモデルIDの書式が異なり、Amazon Bedrockではanthropic.claude-opus-5-5を使います。課金体系と提供終了時期の扱いも提供先ごとに異なるため、契約中の提供先の条件を確認します。
Claude Opus 5.5の料金はいくらですか?
100万トークンあたり入力4米ドル・出力20米ドルです。Opus 5の5米ドル・25米ドルから下がりました。
機能追加・AIを組み込みたいについて相談するいまの業務システムは残したまま、機能追加・改修やAIの組み込みで手間を減らす受託開発。書類の読み取り、社内資料への回答、既存システムとの連携まで機能追加・AIを組み込みたいを見る →2026年9月23日に公式ドキュメントで確認した単価です。
| 項目 | Opus 5.5 | Opus 5 |
|---|---|---|
| 入力(100万トークン) | 4米ドル | 5米ドル |
| 出力(100万トークン) | 20米ドル | 25米ドル |
| キャッシュ読み取り | 0.20米ドル | — |
| キャッシュ書き込み(5分) | 5米ドル | — |
| キャッシュ書き込み(1時間) | 8米ドル | — |
| バッチ処理 | 入力2米ドル/出力10米ドル | — |
| コンテキスト | 100万トークン | 100万トークン |
| 最大出力 | 12万8千トークン | 12万8千トークン |
税・為替・請求経路は別に確認が必要です。月額のチャット契約とAPIの従量課金は別の体系のため、混同しないでください。本記事の単価はAPIの従量課金の話です。
本当に費用は40%下がりますか?
下がる割合は使い方によります。公式の40%はキャッシュ読み取りの値下げが主因で、入力・出力の単価はそれぞれ20%しか下がっていません。
Anthropicの発表は「Our tests show that at default settings it will cost 40% less than Opus 5 on typical workloads」(既定設定・典型的なワークロードでの当社テスト)と条件を付けています。内訳は次のとおりです。
| 費目 | Opus 5 | Opus 5.5 | 下げ幅 |
|---|---|---|---|
| 入力 | 5米ドル | 4米ドル | 20% |
| 出力 | 25米ドル | 20米ドル | 20% |
| キャッシュ読み取り | 0.50米ドル | 0.20米ドル | 60% |
40%に届くのはキャッシュ読み取りが60%下がったためで、公式も「キャッシュ読み取りがエージェント的な作業・コーディング作業の費用の大半を占める」と説明しています。裏を返せば、キャッシュがあまり効かない使い方では削減率は20%前後にとどまります。 同じ資料を繰り返し参照する処理か、毎回違う入力を1回ずつ投げる処理かで、結果は大きく変わります。
費用は「単価×トークン量」で決まります。単価は確かに20%下がりましたが、公式ドキュメントはトークン量が増える方向の変化を2つ挙げています。
第一に、推論(thinking)を無効にできません。Opus 5では条件つきで無効化できましたが、Opus 5.5ではthinking: {"type": "disabled"}が400エラーになります。推論を切って出力を抑えていた処理は、その手段を失います。
第二に、公式ドキュメントの「Behavior differences」には、 同じeffort設定でもOpus 5より1ターンあたりの思考量が増える傾向がある (特にxhighとmax)と記載されています。effortを据え置いても出力トークンは同じとは限りません。
出力の単価は20%下がりますが、出力トークンが25%増えれば出力側の請求額は元に戻ります。請求額の比較は、単価表ではなく実際に消費したトークン量で行ってください。
エラーは出ないのに品質が下がるのはなぜですか?
effortの既定値がOpus 5のhighからmediumへ下がったためです。設定を明示していないコードは、モデルIDを書き換えるだけで推論水準が下がります。
公式の移行ガイドには「its default is medium where Claude Opus 5's is high」と記載されています。
この変更はエラーを出しません。APIは正常に応答を返し、処理も完走します。変わるのは出力の質だけです。そのため、次のような形で表面化します。
- 移行直後は「安くなった」ように見える(推論量が減るため)
- 数週間後に「最近AIの精度が落ちた気がする」という現場の声が出る
- ログにもエラーにも記録が残らないため、原因の特定に時間がかかる
移行時にeffortを明示的にhighと書いておけば、この問題は起きません。費用を下げる場合も、既定値に任せず意図的に下げた水準として記録してください。
なお、破壊的変更はこのeffortの件を含めず4点あります。推論の無効化不可、tool_choiceのany・toolの廃止、thinkingブロックのモデル束縛、そしてClaude APIとGoogle Cloudでのcomputer_20251124の非対応(Amazon Bedrockでは引き続き利用できます)です。API実装での手順はClaude Opus 5.5移行|4つの破壊的変更とNext.js実装で整理しています。
自社の費用と品質はどう測り直せばよいですか?
切替前に基準値を取ることが唯一の方法です。切替後の出力だけを見ても、以前と比べられません。
次の手順を一度作れば、次の世代交代でも使い回せます。
- 切替前に基準値を取る。 代表業務を3件決め、現行モデル・現行設定のまま実行し、下表の欄を埋めます。切替後には取り直せない値があるため、必ず先に取ります。
- 設定を揃えて切り替える。 モデルIDだけを変え、effortは切替前と同じ水準を明示します。既定値に任せません。
- 同じ3件を再実行し、同じ欄を埋める。 判定者と受入基準は変えません。
- 差が出た欄だけを追う。 費用が下がり品質が保てていれば採用します。品質が落ちていればeffortを上げて再計測し、そのときの費用で比較し直します。
比較用の記録表
| 記録する欄 | 単位 | 取り方 |
|---|---|---|
| モデルID | 文字列 | リクエストに送った値をそのまま |
| effort | low/medium/high/xhigh/max | 明示した値。未指定なら「未指定(既定値)」と記録 |
| 入力トークン | 数 | APIレスポンスのusage(キャッシュ命中・未命中を分ける) |
| 出力トークン | 数 | APIレスポンスのusage。thinking分を含む |
| 請求額 | 円または米ドル | 上記トークン量×単価。月次請求ではなく対象処理分 |
| 応答時間 | 秒 | リクエスト送信から完了まで |
| 採用できた件数 | 3件中の数 | 修正なしで使えた件数 |
| 修正した箇所 | 数と内容 | どこを直したか。「なんとなく悪い」と書かない |
| 修正にかけた時間 | 分 | 担当者の実時間 |
最後の3行が重要です。トークン費用が半分になっても確認・修正の人件費が倍になれば、総負担は増えています。当社の作業単価1時間11,000円(税込)で換算すれば、修正時間10分は約1,830円です。API費用の数円・数十円より桁が大きくなることは珍しくありません。
業務で試すときの確認点
具体例として、長い仕様書を繰り返し参照する調査作業でOpus 5から切り替える場合を考えます。
切替前に代表的な仕様書3件で現行の出力・トークン量・修正時間を記録し、モデルIDをclaude-opus-5-5に変えてeffortはOpus 5と同じhighを明示し、同じ3件を流します。ここでeffortを書き忘れるとmediumで動くため、比較になりません。
キャッシュ読み取りが入力単価の20分の1のため、同じ仕様書を繰り返し参照する使い方ではキャッシュ命中率が結果を左右します。公式の40%削減が最も効くのもこの形の処理です。品質が落ちた場合はeffortを上げて再計測し、その費用で比較し直します。
なお公式ドキュメントでは、まずOpus 5.5を使い、より高い推論設定でも品質が足りない場合にClaude Fable 5.1を検討する順番が案内されています。Opus 5の時点ではFable 5.1を先に検討する案内でしたが、順番が変わりました。上位モデルを常用する前提で見積もらず、必要な作業だけを切り分けてください。
この記事は2026年9月23日時点の公開情報にもとづく解説です。上記の例は手順を説明するための想定であり、当社の測定結果ではありません。
よくある質問
Q. Opus 5.5に変えれば費用が40%下がりますか?
公式の40%は既定設定・典型的なワークロードでの比較で、主因はキャッシュ読み取りの60%値下げです。入力・出力の単価はそれぞれ20%しか下がっていないため、キャッシュがあまり効かない使い方では削減率は20%前後にとどまります。自社の入力量、出力量、キャッシュ比率、effortの設定、確認作業によって結果が変わります。特に同じeffortでも思考量が増える傾向があるため、単価差だけで削減額を見積もらないでください。
Q. モデルIDを書き換えるだけで移行できますか?
推論を無効化していない、tool_choiceでanyやtoolを使っていない、computer useを使っていない場合は、モデルIDの変更でリクエスト自体は通ります。ただしeffortを明示していなければ推論水準がhighからmediumに下がります。エラーは出ないため、設定を明示することをおすすめします。
Q. 品質が落ちたかどうかは、どう確認すればよいですか?
切替前に同じ業務の出力を記録しておく以外に方法はありません。切替後の出力だけを見ても、以前と比べられません。代表業務3件分の基準値を先に取ってください。
Q. 今使っているOpus 5はすぐ使えなくなりますか?
公式ドキュメントでは、Opus 5は現在も利用可能なモデルとして掲載されています。提供終了の時期は提供先ごとに異なるため、契約先の告知を確認してください。
自社の状況を整理して相談する
まず、比較したい業務、代表的な入力、現在のeffort設定、確認にかけている時間を書き出してください。この記事に合う検討シートとAI相談用プロンプトで、未確認の項目を残したまま整理できます。シートを完成させる前でも、お気軽にご相談いただけます。
前のモデルからの位置づけを確認したい場合は、Claude Opus 5とは?公式料金と複雑な業務の評価方法もあわせてご確認ください。複数サービスを横断した設定の考え方は、生成AIに学習させない設定まとめで整理しています。
運営・編集