は2026年9月22日、 を公開しました。公式発表の「Opus 5より40%低コスト」は、開発で使う人には気になる数字です。ただし、この数字をそのまま自社の請求額に掛けると見積もりを誤ります。この記事では、 の単価と作業全体の費用を分け、日本語で指示する身近な業務で比較する準備まで進めます。
2026年9月23日時点の公式発表・料金・仕様を確認し、料金計算と架空の集計教材をオフラインで検証しました。Opus 5/5.5を有料APIで動かす比較試験は実施していません。以下の使用量と計算額は、実測結果ではなく、計算方法を説明する仮の例です。
1. 20%・40%・60%は、それぞれ何の数字か
通常の入力・出力は、同じ数なら20%安くなります。一方、繰り返し送る入力を再利用するでは、読み取り単価が60%下がりました。公式の40%という説明は、この単価変更だけでなく、モデルが仕事を終えるまでに使う量も含めた、既定設定・典型的な作業での試験結果です。単価の値下げ率と、一つの仕事の削減率は別に確認する必要があります。発表の費用・速度説明
| 料金の区分 | Opus 5 | Opus 5.5 | 単価の変化 |
|---|---|---|---|
| 通常の入力 | $5 | $4 | 20%減 |
| 出力 | $25 | $20 | 20%減 |
| キャッシュ書き込み・5分保持 | $6.25 | $5 | 20%減 |
| キャッシュ書き込み・1時間保持 | $10 | $8 | 20%減 |
| キャッシュ読み取り | $0.50 | $0.20 | 60%減 |
表の出典は公式料金表です。キャッシュは読み取りだけを数えればよいわけではなく、新しく保存する部分には書き込み料金がかかります。また、出力には最終回答だけでなく推論に使う分も含まれます。画面の回答が短くなったことと、請求対象の出力が減ったことを同じ意味にしないでください。公式の作業単位の費用解説
を月額プランで使っている場合、この表から月額料金の40%値下げや「仕事を何件できるか」は計算できません。公式発表では利用枠の拡大も案内されていますが、従量課金の単価とは別の話です。まず、自分が比較したいものを「APIの請求額」「利用枠の消費」「作業時間」のどれかに決めると、調査がぶれません。
2. 同じ使用量ならいくら違う?書き込み込みで計算する
最初は、モデルの性能差を入れず、同じ使用量を両方の単価で計算します。これで分かるのは料金変更の影響だけです。下表は、通常入力10万、5分キャッシュ書き込み10万、読み取り200万、出力8万トークンを仮定しています。複数回のやり取りを通算した例なので、読み取りの累計は、一度に渡す文書の長さとは異なります。
| 区分 | 仮の使用量 | Opus 5 | Opus 5.5 |
|---|---|---|---|
| 通常入力 | 100,000 | $0.500 | $0.400 |
| 5分書き込み | 100,000 | $0.625 | $0.500 |
| 1時間書き込み | 0 | $0.000 | $0.000 |
| 読み取り | 2,000,000 | $1.000 | $0.400 |
| 出力 | 80,000 | $2.000 | $1.600 |
| 合計 | 同じ量を比較 | $4.125 | $2.900 |
この例の削減率は 1 − 2.900 ÷ 4.125、約29.7%です。40%と一致しないのは誤りではありません。読み取りの割合が違えば、同じ使用量でも削減率は変わります。さらに、仮に5.5だけ出力が16万トークンに増え、他の条件が同じなら、5.5の合計は4.500ドルとなり、旧モデルの4.125ドルを上回ります。単価が下がっても、作業を終えるまでの総額が必ず下がるとは限らない、と分かる例です。
自分でも確かめられるよう、標準ライブラリだけで動くの料金計算スクリプトと仮の使用量を用意しました。両方を同じフォルダーへ保存して、次を実行してください。通信もAPIキーも不要です。結果の same_usage_price_only は、同じ量を異なる単価で計算した比較を表します。
python3 cost.py hypothetical-usage.json
# 結果の主要部分(架空の使用量から計算)# opus5_token_cost: 4.125# opus55_token_cost: 2.9# savings_percent: 29.7import jsonfrom decimal import Decimalfrom pathlib import Pathfrom cost import token_cost
usage = json.loads(Path("hypothetical-usage.json").read_text(encoding="utf-8"))old = token_cost(usage, "claude-opus-5")new = token_cost(usage, "claude-opus-5-5")assert old == Decimal("4.125")assert new == Decimal("2.9")print(f"単価だけの削減率: {(1 - new / old) * 100:.1f}%")3. 実際の使用量を集めるときの二重計上を防ぐ
スクリプトの入力は、記事用に決めた5項目の形式です。APIから返された内容をそのまま読み込むものではありません。通常のClaude APIでは、usage.input_tokens はキャッシュ読み取り・書き込みを除いた入力です。入力全体だと思ってここからキャッシュ分を引いたり、逆に全入力へ通常単価を掛けたうえでキャッシュ料金を足したりすると、金額が合わなくなります。公式の使用量の内訳
| スクリプトの項目 | 通常Claude APIの使用量から集計するもの |
|---|---|
fresh_input | usage.input_tokens |
cache_write_5m | usage.cache_creation.ephemeral_5m_input_tokens |
cache_write_1h | usage.cache_creation.ephemeral_1h_input_tokens |
cache_read | usage.cache_read_input_tokens |
output | usage.output_tokens |
cache_creation_input_tokens は、5分と1時間の書き込み内訳の合計です。内訳を計算に入れたあとで、合計も足してはいけません。書き込みの保存時間が分からない記録は、金額の確定に使わず保留にします。スクリプトも5項目を必須にし、欠損、負数、小数を受け付けません。0は「不明」ではなく「発生しなかった」と確認できた場合だけ入れます。保存時間別の使用量
実際の一つの仕事では、最初の依頼から修正・再試行が終わるまでの、全リクエストを集計します。同じリクエストの途中経過と最終記録を二重に足さないことも必要です。モデルごとの集計を opus5-usage.json と opus55-usage.json に保存したら、python3 cost.py opus5-usage.json opus55-usage.json で、それぞれ異なる使用量を比較できます。組織で集める仕組みはClaudeの使用量集計も参照してください。
4. 日本語の売上集計を、同じ条件で頼んでみる
費用の安さは、必要な仕事が完了して初めて意味があります。いきなり大きな案件を比べず、まずは月次売上を取引先別にまとめる小さな課題を使います。架空の売上CSVと比較用の課題・正解・記録手順を公開しました。には返品の負数、金額の空欄、名前に含まれるカンマ、対象月外の明細を入れています。日常の集計で落としやすい条件を、短い指示で確認するためです。
sales.csv は架空の売上明細です。Python の標準ライブラリだけで summarize.py を作ってください。
1. python3 summarize.py sales.csv 2026-09 で、その月の取引先別税抜売上を標準出力へCSVで返す。
2. 出力の列は「取引先,税抜売上,件数」。取引先は対象月で最初に現れた順とする。
3. 負数は返品なので合計に含める。金額が空欄の行は件数にも含めず、元ファイルの行番号を標準エラーへ記録する。先頭の見出しを1行目とする。
4. 他月の明細は集計しない。取引先名中のカンマを正しく扱う。
5. 正常な入力への集計結果だけを標準出力へ書く。入力ファイルは変更しない。
6. 自動テストも作って実行する。実行コマンド、結果、制約を最後に日本語で報告する。このだけを、同じ初期ファイルを置いた別々の作業場所と新しい会話で渡します。片方が作ったコードや正解を、もう片方へ見せないようにします。モデル名だけでなく、使う開発ツールのバージョン、実行を許す範囲、制限時間も記録します。既存プロジェクトへ進む場合は、CLAUDE.mdの設計で扱う規約や実行手順も、両方へ同じ内容を渡してください。
| 取引先 | 税抜売上 | 件数 |
|---|---|---|
| 青葉商店 | 9,000円 | 2 |
| 朝日工業 | 20,000円 | 1 |
| ふくふく,東店 | 5,000円 | 1 |
合計34,000円に加え、空欄のある元ファイル5行目が除外され、その行番号が記録されること、入力ファイルが変わっていないことを人が確認します。生成されたテストだけでは、モデル自身が誤解した仕様を正しいと判定する場合があります。正解表と別に突き合わせ、既存業務に組み込む段階ではも残します。確認の役割分担はAIと人間のレビューの境界につながります。
5. 比較表には、失敗と人の確認時間も残す
比較の目的が「いつもの設定から乗り換えてよいか」なら、各モデルの既定設定を記録して比べます。「同じ設定での違い」を知りたい試験とは分けてください。5.5の既定のは medium で、推論を無効にはできません。同じ設定名でも消費量が等しくなる保証はありません。モデル仕様とeffortの説明を確認したうえで、比較条件を固定します。
| 記録するもの | 判断に使う理由 |
|---|---|
| モデル・設定・ツール・試行番号 | 別条件の結果を混ぜない |
| 完了/失敗/時間切れ | 安く途中終了した試行を成功扱いしない |
| 正解との違い・追加指示の回数 | やり直しの負担を含める |
| 経過時間・人の確認時間 | 生成の速さと業務の時短を分ける |
| 5区分の使用量・別料金 | 単価差と消費量の差を分ける |
予算の範囲で複数回繰り返し、成功した試行だけを選ばず、時間切れや修正できなかった結果も残します。完了した仕事の費用を判断するなら、失敗・再試行に使った分も含む総額と、完了件数を並べます。1回だけの小さな課題から、開発全体の改善率を推定することはできません。公式のと自分の業務課題は、別々の材料として読んでください。
6. この計算で分からないことと、移行前の注意
計算対象は通常のClaude APIのトークン料金だけです。高速モード、バッチ割引、地域指定による加算、検索などのツール料金、外部の実行環境、税金、為替は含めていません。他社のクラウド経由や個別契約でも、適用単価は確認が必要です。請求額を照合するときは、それらを別の行に分けて足してください。最新の料金・追加費用
また、既存のAPI処理ではモデル名だけの置き換えが成功するとは限りません。公式は、推論の無効化、ツール呼び出しの強制、推論ブロックの引き継ぎ、旧コンピューター操作ツールに関する互換性の変更を案内しています。進捗表示に使う応答の扱いにも変更があります。料金比較の前に、使っている機能が公式移行ガイドに該当しないか確認してください。
この記事の計算例で確かめたのは、公式単価を正しく掛けたときの差額と、教材の期待する集計値までです。Opus 5.5が日本語の仕様をどの程度理解するか、何回のやり直しで完了するか、実際にいくら掛かるかは未検証です。最初の比較を終えたら、月次集計、既存コードの修正、説明文の作成など、仕事の種類を分けて結果を蓄積するのが次の一歩です。
ここまでのまとめ
Opus 5.5の導入判断では、通常入力・出力20%減、キャッシュ読み取り60%減という単価の変化から始め、同じ量の計算と、同じ仕事を完了するまでの比較を順に行います。書き込みや失敗した試行、人の確認時間も残すことで、自分の業務にとっての効果が見えてきます。今回の教材を出発点に、続編は読者リアクションに応じて随時追加していきます。
よくある質問
- Claude Opus 5.5は必ず40%安くなりますか?
- 40%はAnthropicが既定設定・典型的な作業で確認した結果です。通常APIの入力・出力単価はOpus 5より20%、キャッシュ読み取り単価は60%低くなりましたが、自分の作業の総額は使用量や再試行で変わります。
- 料金計算サンプルにAPIキーは必要ですか?
- 不要です。同梱のPythonスクリプトは保存したトークン数に単価を掛けるだけで、ネットワーク通信をしません。仮の使用量を計算するもので、Opus 5.5の性能を測るプログラムではありません。
- Claudeの月額プランも40%値下げされたのですか?
- この記事の計算は従量課金の通常Claude APIが対象です。月額プランの料金や利用枠とは別なので、API単価から月額料金の値下げや作業可能件数を計算することはできません。