「この問い合わせを担当別に分けて」。AIへの依頼は一行でも、裏では社内規則や会話履歴、使えるツールの説明をまとめて渡していることがあります。新しいの料金を見るときは、この送信する入力全体が大切です。
Anthropicは10月7日付でHaiku 5.5を発表しました。大量の分類や抽出、要約などを担う小型モデルです。料金は入力100万トークン当たり0.10米ドルから。ただし、1回の入力が10万トークンを超えると、入力・出力とも別の単価になります。公式モデル仕様
この記事では業務に組み込む際の料金と設定を整理します。確認日は2026年10月8日。モデルのAPI呼び出しは行っていません。 後半の教材で検算したのは、架空の使用量に対する料金です。日本語の精度や速度、実際の消費量の測定ではありません。
1. 分類・抜き出し・短い要約を、たくさん処理するモデル
Haiku 5.5は、問い合わせの振り分け、書類からの項目抽出、大きな作業の一部を任せる補助エージェントなどを想定しています。100万トークンの文脈を扱い、通常の同期APIでは最大12万8,000トークンを出力できます。
ただし、大きな入力を受け付けることと、同じ低単価で処理できることは別です。複雑な仕事をすべてHaikuへ置き換えるより、まず「必要な項目が決まっている」「人が答えを確認できる」工程に分けて試すと評価しやすくなります。
たとえば請求書の問い合わせなら、担当部署・請求番号・期限を抜き出す作業を切り出します。金額の訂正や顧客への返信送信まで一度に任せず、抽出結果を確認して次へ進める設計です。これは使い方の提案であり、今回その精度を測定した結果ではありません。
公式発表はClaude APIと主要クラウドでの提供開始を案内しています。対応国一覧には日本もあります。API上のモデル名はclaude-haiku-5-5です。利用できる画面やアカウント権限、クラウド側の料金はそれぞれ確認してください。
2. 10万トークンを超えると、その要求の料金行が変わる
次はClaude APIの標準料金です。単位は100万当たりの米ドル。日本円への換算や税、サーバーツールの追加料金は含みません。公式料金表
| 1回の総入力 | 通常入力 | 出力 | キャッシュ読み取り |
|---|---|---|---|
| 100,000トークン以下 | $0.10 | $0.50 | $0.01 |
| 100,000トークン超 | $0.50 | $2.50 | $0.05 |
境界を超えた1トークンだけが高くなる計算ではなく、その要求に使う料金行が切り替わります。出力単価も入力の長さに応じて変わるため、返答を短く指定しただけでは低い料金行に戻りません。
仮に、キャッシュなしの入力100,000トークン、出力1,000トークンなら合計は$0.0105です。入力だけ100,001トークンへ増やすと、同じ出力量でも$0.0525005になります。これは料金表の計算例で、実際に巨大な文章を送った測定ではありません。
一件の差は小さく見えても、同じ処理を一万回行うなら、それぞれ$105と$525.005です。固定の長い資料を毎回渡す設計では、単価だけでなく、要求ごとの総入力と回数を合わせて見積もる必要があります。
3. 一行の指示の後ろに、履歴とツールがある
APIへ送る入力には、今の質問だけでなく、システム指示、送信する会話履歴、資料、ツール名や説明・入力形式、前のツール実行結果などが入ります。画面に見える最新の依頼文の長さだけで判断できません。入力と履歴の扱い
たとえば、送信全体が100,000トークン近くある状態で、ツールの説明や過去の結果を追加すれば境界を越え得ます。不要な古い資料を外す、必要なツールだけ渡す、独立した仕事を別の会話にする、といった整理が費用に関わります。ただし必要な規則まで削ると、業務上の判断が変わるため、減らした後も期待する答えを確認します。
も「入力から消す」仕組みではありません。公式のusageでは、通常入力のinput_tokensに、読み取りと書き込みの入力を足したものが総入力です。
総入力 = input_tokens + cache_read_input_tokens + cache_creation_input_tokensたとえば通常入力1,001とキャッシュ読み取り99,000なら、総入力は100,001です。input_tokensだけを見て「短い要求だから低単価」と判断しないようにします。キャッシュの書き込みは初回に別料金があり、読み取りが安いことと初回から同じ費用で済むことも違います。公式の使用量の読み方
移行時にはトークンの数え直しも必要です。Haiku 5.5はHaiku 4.5と異なるを使い、同じテキストでも約30%多く数えると公式は説明しています。増え方は内容で変わるため、以前の値を一律1.3倍すれば正確になるわけではありません。
実装時は、送信する要求全体を対象モデルで計数し、実行後の使用量と照合します。公式のToken Countingも推定値で、請求と完全一致する保証ではありません。境界ぎりぎりを前提に運用せず、余裕を設けるのが現実的です。モデル別のトークン計数
4. effortは「まずmedium」、上げる前に期待値を決める
Haiku 5.5では、考える量を調整するeffortが使えます。段階はlow、medium、high、xhigh、maxで、APIの既定値はmediumです。思考は既定で有効になっています。Haiku向けの公式設定ガイド
仕事の答えが決まっているなら、まずmediumで候補を作り、同じ入力をlowでも検収する順序が考えられます。Sonnet 5.5の記事と同様に、設定を比べる前に正解条件を決めます。担当を誤った件数、情報不足なのに断定した件数、欠けた必須項目を分けて数えます。安い設定ほどよいと決めず、修正に人手が増えるかまで確認します。
思考分も出力トークンに入り、max_tokensを消費します。最終回答が短くても、内部で考える量によって費用は変わります。古い設定のまま出力上限を小さくすると、回答本文が出る前に上限へ達する場合があります。
Haiku 4.5から移す開発担当者は、budget_tokensを指定する旧方式をそのまま使えない点にも注意してください。応答の先頭が必ず本文とは限らないため、テキスト型のブロックを取り出します。モデル名の変更だけで移行完了とはせず、公式移行ガイドに沿って確認します。
5. 架空使用量の教材で、費用の読み違いを見つける
料金計算教材ZIPには、架空の使用量10例、手計算の期待値、計算プログラムと確認用テストを入れました。APIキーも追加ライブラリも不要で、展開したフォルダで実行できます。
python3 -B calculate.pypython3 -B -m unittest test_calculate.py -v| 架空の条件(出力はいずれも1,000) | 総入力 | 計算した合計 |
|---|---|---|
| 通常入力のみ | 100,000 | $0.0105 |
| 通常入力のみ | 100,001 | $0.0525005 |
| 通常入力1,000+キャッシュ読取99,000 | 100,000 | $0.00159 |
| 通常入力1,001+キャッシュ読取99,000 | 100,001 | $0.0079505 |
| 通常入力のみ、Batch利用 | 100,001 | $0.02625025 |
Batchは非同期でまとめて処理する方式で、入力・出力の単価が50%引きです。長入力の料金段階は残り、キャッシュの料金係数とも併用できます。即時回答が必要な窓口と、翌日までに整理すればよい集計は分けて検討できます。
教材では5分・1時間キャッシュの書き込み、Batchと読み取りの併用も確認しました。10例の計算は手計算と一致し、不正な数値などを拒否するテストも通りました。確認したのは料金式であり、キャッシュが実際に命中するかや、任意のAPI要求が有効かを判定するプログラムではありません。
6. Max/TeamのAPIクレジットは、用途と受取先を確認
同時に発表された月額APIクレジットは、今週中に順次提供される予定です。Max 5xは月$100、Max 20xは月$200。TeamはStandard席$20、Premium席$100を合算し、チーム全体で月$500が上限です。Free・Pro・Enterpriseは対象外で、新規の対象契約には7日間の条件があります。受取条件と使い道
対象のClaude契約とConsole組織を関連付けて受け取ります。Claude APIなどに使えますが、Claude CodeやClaudeアプリの追加利用、Bedrock等の他プラットフォームには使えません。未使用分は繰り越されず、通常のClaude利用枠が増えるものでもありません。
支払方法の追加は必須ではない一方、既存の購入クレジットや自動購入が設定されていれば、付与分を使い切った後も処理が続き得ます。試作の前に、受け取る組織と利用上限を確かめておきます。Haikuの低単価と組み合わせる場合も、まず一工程の総入力・期待する出力・実際の使用量を記録すると、継続費用を判断しやすくなります。