Opus 5.5で1つの仕事にいくらかかる?「トークン単価」ではなく「タスク単価」で考えるAIのコストの仕組みと節約術をやさしく解説|トレジャーフットAI

Opus 5.5で1つの仕事にいくらかかる?「トークン単価」ではなく「タスク単価」で考えるAIのコストの仕組みと節約術を解説

この記事の結論(30秒で読める要約)

Anthropicは2026年9月22日、公式ブログ「What a task costs on Opus 5.5(Opus 5.5でタスクにかかるコスト)」を公開しました。いちばん大事なメッセージは、「同じトークン単価でも、1つの仕事(タスク)にかかる金額は大きく変わる」ということです。AIは1往復(ターン)ごとに、それまでの会話をまるごと読み直すため、往復の回数が多いほど費用がかさみます。費用を左右するのは、往復の回数、キャッシュ(読み直しの割引)の効き具合、出力の量、使うモデルの4つです。Opus 5.5は前モデルより単価が下がり、特にキャッシュ読み込みは60%安くなりました。そのうえで、努力レベルの使い分け、下位モデルへの作業の振り分け、会話の整理(/clearや/compact)で、さらに無駄を減らせます。

Contents

この記事で解説するブログについて

今回解説するのは、Anthropicが2026年9月22日にClaude公式ブログで公開した記事「What a task costs on Opus 5.5」です。筆者はAddy Osmani氏で、主にAIコーディングツール「Claude Code」の利用者に向けて、Opus 5.5で仕事を頼んだときに実際いくらかかるのか、どうすれば無駄を減らせるのかをまとめています。

元の記事は開発者向けで専門用語が多いため、この記事ではたとえ話を交えながら、AIを業務で使うすべての人にわかるように解説します。

なお、元の記事の数字は「説明のための例」として示されたものです。実際の費用は、扱う資料やコードの量、指示の出し方、使い方のクセによって大きく変わります。以下の入力費用の試算はキャッシュ書き込み料金を含まず、出力費用も別です。「会話を読み直す」とは、その時点でClaude Codeがモデルに送る履歴や資料を指し、圧縮・削除済みの履歴まで毎回送るという意味ではありません。

そもそも「トークン単価」と「タスク単価」は何が違う?

トークン単価は「AIが読み書きする文字量あたりの値段」、タスク単価は「1つの仕事を終えるまでにかかった合計の値段」です。

トークンとは、AIが文章を扱うときの単位のことです。AIの料金は「100万トークンあたり何ドル」という形で決まっています。Opus 5.5のAPIの定価は次のとおりです。

種類 Opus 5.5の定価(100万トークンあたり)
入力(AIが読む文章) 4ドル
出力(AIが書く文章) 20ドル
キャッシュ読み込み(読み直しの割引価格) 0.20ドル

ここで大事なのは、この単価が同じでも、1つの仕事にかかる金額は大きく変わることです。

タクシーにたとえるとわかりやすいでしょう。1kmあたりの運賃が同じでも、遠回りすれば料金は高くなります。AIも同じで、同じ仕事を終えるのに10往復で済むか、40往復かかるかで、支払う金額はまったく変わります。

なぜAIは往復が増えるほど高くなるの?

AIは1往復ごとに、それまでの会話をすべて読み直すからです。

AIに仕事を頼むと、AIは「会話の履歴を読む、考える、答えやファイルの編集を書く」をくり返します。このとき、2回目の往復では1回目の内容を、10回目の往復では1〜9回目の内容を、毎回まるごと読み直しています。

元の記事では、次のような例が示されています。

往復の回数 1往復あたりの平均の文章量 合計の入力量 入力の費用(キャッシュが90%効いた場合)
40往復 約7万トークン 約280万トークン 約1.62ドル
25往復 約7万トークン 約175万トークン 約1.02ドル

同じ仕事でも、往復が40回から25回に減るだけで、入力の費用は約4割下がります。つまり、AIのコストを下げるいちばんの近道は、少ない往復で仕事を終わらせることです。

1つの仕事の費用は、何で決まる?

元の記事では、費用を左右する要素として次の4つを挙げています。

  • 往復(ターン)の回数:1往復ごとに会話の履歴をまるごと送り直す
  • キャッシュ読み込み:前の往復で読んだ文章は、割引価格で読み直せる
  • 出力トークン:入力の5倍の値段で、AIが「考える」ための思考の部分も含まれる
  • モデルの選択:すべてのトークンの値段を決める

キャッシュが効くかどうかで、費用は10倍以上変わる

キャッシュとは、一度読んだ文章をAI側で一時的に覚えておき、次に読み直すときに割引価格で済ませる仕組みです。Opus 5.5では、キャッシュからの読み込みは通常の入力の5%の値段です。

元の記事の例で、合計280万トークンを読む場合の費用を比べると、次のようになります。

キャッシュが効いた割合 入力の費用
0%(まったく効かない) 11.20ドル
90% 1.62ドル
96% 0.99ドル

同じ量を読んでも、キャッシュが効くかどうかで10倍以上の差がつきます。

出力はいちばん高くつく

出力トークンは入力の5倍の値段です。元の記事によると、6万トークンの出力には1.20ドルかかり、これはキャッシュから600万トークンを読むのと同じ金額です。AIが長々と考えたり、何度も書き直したりすると、出力の費用がふくらみます。

Opus 5.5では、何が安くなった?

Opus 5.5では、前モデルのOpus 5からすべての単価が下がりました。特に大きいのが、キャッシュ読み込みの値下げです。

種類(100万トークンあたり) Opus 5.5 Opus 5 変化
入力 4ドル 5ドル 20%安い
出力 20ドル 25ドル 20%安い
キャッシュ読み込み 0.20ドル 0.50ドル 60%安い

キャッシュ読み込みは、入力の値段に対する割合でいうと、10%から5%に下がりました。

元の記事で示されたセッションの例では、まったく同じトークン量を使った場合でも、Opus 5.5のほうが全体で約31%安くなっています。このセッションでは、量としていちばん多いのはキャッシュ読み込み(200万トークン)で、出力は量としては最も少ないのに、金額では最も大きな項目でした。

さらにOpus 5.5では、長い作業の最後に、変更した内容や見つけたことをまとめて報告するようになりました。やり直しが減れば、そのぶん費用も下がります。

費用を抑えるコツ1:モデルを変える前に、努力レベルを上げる

Opus 5.5には、AIがどれだけ深く考えるかを決める「努力レベル(effort)」があります。元の記事では、次のように使い分けることをすすめています。

努力レベル 向いている仕事
low 名前の置き換えなど、決まった手順の機械的な作業
medium 範囲がはっきりした日々の仕事(基本はこれ)
high mediumで同じところから先に進まなくなったとき
xhigh・max 最も難しい仕事

努力レベルを上げると、AIが考えるための出力が増えるので、1回あたりの費用は上がります。元の記事の目安では、highにすると1つの仕事で思考のトークンが約2万増え、Opus 5.5では約0.40ドルの追加です。ただし、mediumで10往復のやり直しをくり返すと同じくらいの費用がかかるため、この試算では10往復程度のやり直しを1回避けられれば、highの追加費用は元が取れる、と説明されています。

注意点もあります。作業の途中で努力レベルを変えると、それまでのキャッシュを再利用できなくなることがあります。努力レベルの設定もキャッシュの照合に使われるためです。切り替えるなら、作業の区切りで行いましょう。

費用を抑えるコツ2:仕事に合わせてモデルを使い分ける

元の記事では、Opus 5.5を普段使いの主力とし、仕事の内容によって上位や下位のモデルに切り替えることをすすめています。

Opus 5.5が向いている仕事

新しい機能づくり、不具合の調査、コードのレビューなど、人が様子を見ながら進める日々の仕事です。人が見ていれば、往復が無駄に長引くのを防げます。

上位モデルのFable 5.1に切り替えるとき

次のような場合は、Fable 5.1に切り替える価値があります。

  • トークンの費用より、結果の質のほうが大事なとき
  • 人が見ていない状態で、長時間まかせるとき
  • 前例のない、新しい問題に取り組むとき
  • 複数のAIを連携させる大規模な作業

元の記事では、「Opus 5.5のhighで同じ問題に2回つまずいたら切り替え、解決したら戻す」という目安が示されています。

Fable 5.1の定価は入力10ドル・出力50ドル(100万トークンあたり)で、Opus 5.5の2.5倍です。一方、キャッシュ読み込みは0.25ドルで、Opus 5.5の1.25倍にとどまります。そのため、キャッシュをたくさん読む長い作業では価格差が小さく、出力の多い作業では価格差が大きくなります。

下位モデルのSonnet・Haikuに任せるとき

調べもの、検索、要約、ログの読み取り、テスト結果の確認、「これはどこで定義されている?」といった質問など、コードを書かない作業は、SonnetやHaikuで十分なことが多いと説明されています。

Claude Codeでは、補助役のAI(サブエージェント)の定義に model: haiku や model: sonnet と書くか、環境変数 CLAUDE_CODE_SUBAGENT_MODEL で、補助役に使うモデルを指定できます。

ただし、下位モデルが読み間違えると、メインのAIが見当違いのファイルを調べ始め、かえって高くつくこともあります。コードの編集そのものはOpus 5.5に任せるのがおすすめです。

費用を抑えるコツ3:乗り換えるときは、指示文を見直す

前のモデルのために書いた指示文には、新しいモデルでは不要な手順が残っていることがあります。元の記事では、指示文を点検するコマンド /claude-api prompt-audit が紹介されています。このコマンドは、次のような無駄な指示を見つけてくれます。

  • 形だけの多段階の手順
  • 必ずメモを書かせるルール
  • 2回確認させる指示
  • お互いに矛盾する指示

Anthropicの社内のカスタマーサポートの評価(44件の問い合わせ)では、Opus 4.8からOpus 5.5のlow設定に切り替えるだけで費用が約18%下がりました。さらに指示文を点検すると9%下がり、合計でOpus 4.8より約25%安くなりました。ただし、これは1つの評価での結果なので、あくまで一例として受け止めるのがよいでしょう。

費用を抑えるコツ4:キャッシュが効き続ける使い方をする

キャッシュの「書き込み」は、読み込みよりずっと高い

キャッシュは、一度書き込んでおけば安く読み直せますが、書き込み自体には費用がかかります。Opus 5.5では次のとおりです。

項目 値段
キャッシュ読み込み 通常の入力の5%
キャッシュ書き込み(5分間保持) 通常の入力の1.25倍
キャッシュ書き込み(1時間保持) 通常の入力の2倍

元の記事の例では、12万トークンの会話の場合、5分間保持の書き込みは約0.60ドル、1時間保持の書き込みは約0.96ドル、読み込みは約0.02ドルです。1回の書き込みで、読み込み約25回分の費用がかかります。

キャッシュが保持される時間は、Claudeのサブスクリプションでは1時間、APIキーやクラウド事業者経由では初期設定で5分間です。ただし、サブスクリプションでも利用クレジットでの利用に移ると5分間になります。APIキーで5分間の設定を使っている場合、6分休憩しただけでキャッシュが失効し、0.02ドルで済んだはずの読み込みが0.60ドルの書き込みに変わってしまいます。

キャッシュが消えてしまう主な場面

会話の最後に新しいやりとりを足していくだけの、流れのよい使い方ならキャッシュは効き続けます。一方、次のような場面ではキャッシュが消えたり、作り直しになったりします。

  • キャッシュの保持時間より長く、作業を中断したとき
  • 努力レベルや思考の設定を変えたとき
  • MCPサーバー(外部ツールとの接続)をつないだり外したりしたとき
  • モデルを切り替えたとき
  • 会話を圧縮(compact)したとき

会話が長いほど、1往復あたりの費用は上がる

1往復ごとに会話全体を読み直すので、会話が長くなるほど1往復の費用は上がります。元の記事の例では次のとおりです。

会話の長さ 1往復あたりのキャッシュ読み込み費用 30往復した場合
2万トークン 約0.004ドル 約0.12ドル
15万トークン 約0.03ドル 約0.90ドル

同じ30往復でも、会話が長いと読み込みだけで7倍以上の費用になります。

費用を抑えるコツ5:会話をこまめに整理する

Claude Codeには、会話の長さを整理するコマンドがあります。

コマンド はたらき 費用
/clear 会話を空にする。関係のない仕事に移るときに使う かからない
/compact 古い会話を要約して短くする 1回分のリクエスト
/autocompact 会話がどのくらい長くなったら自動で要約するかを、トークン数で設定する 要約が走るたびに1回分

元の記事の目安では、15万トークンの会話を圧縮すると約0.25ドルかかりますが、1往復あたり約0.025ドル安くなるため、約10往復で元が取れます。ただし、要約すると細かい内容は失われます。作業の区切りで行い、残しておきたい内容を指示してから圧縮するのがコツです。

また、Claude Codeが作業の最初に読み込む設定ファイル「CLAUDE.md」は、200行以内におさえることがすすめられています。外部ツール(MCP)の詳しい定義は、最初は名前だけが読み込まれ、実際に使うときに読み込まれる仕組みになっています。

実際の費用は、どうやって確かめればいい?

元の記事の目安では、企業でClaude Codeを使った場合の平均は、開発者1人・稼働1日あたり約13ドルで、90%の利用者は1日30ドル未満に収まっています。

ただし、元の記事がいちばん強調しているのは「自分の数字を測ること」です。確かめ方は次のとおりです。

  • 仕事の終わりに /usage(または /cost)を実行し、トークン数と費用の見積もりを確認する
  • 同じ仕事を、/model でモデルを切り替えて2回実行する
  • それぞれの往復の回数、出力トークン、費用を記録する
  • 結論を出す前に、3〜4つの仕事で比べる
  • チームで使う場合は、Claude Code Analytics APIやUsage & Cost APIで集計する

/usage の結果を見るときは、次の点をチェックします。

  • キャッシュの割合:長い作業なら高くなっているはず
  • 出力と入力のバランス:小さな変更なのに出力が多いなら、努力レベルが高すぎるか、やり直しが多い
  • 合計の入力量と会話の長さの比:何倍にもなっているなら、往復が多く、同じことをくり返している可能性がある

元の記事は、「実際の仕事を1つずつ各モデルで試して、/usageの結果を比べること。信じるべきなのは自分の数字だ」という趣旨の言葉で締めくくられています。

元の記事のおすすめを一覧にすると

  • 範囲がはっきりした日々の仕事は、努力レベルmediumで行う
  • AIが自分で作業を確認できる手段(テストなど)を用意する
  • 複数のファイルにまたがる変更は、計画モード(plan mode)から始める
  • mediumで行き詰まったら、作業の区切りでhighに上げる
  • highでも同じ問題に2回つまずいたらFable 5.1に切り替え、解決したら戻す
  • 検索やログの読み取りなどの補助役は、SonnetやHaikuに任せる
  • コードの編集はOpus 5.5に任せる
  • 作業の流れを止めず、キャッシュが効いた状態を保つ
  • 関係のない仕事の間には /clear、作業の区切りには残す内容を指示して /compact

中小企業やAIを業務で使う人にとってのポイント

元の記事はClaude Codeを使う開発者向けですが、考え方はAIを業務で使うすべての人に役立ちます。

いちばんのポイントは、「AIの費用は、単価よりも使い方で決まる」ということです。あいまいな指示でAIとのやりとりが何往復も続けば、その分だけ費用も時間もかかります。最初に「何を、どんな条件で、どんな形で」を具体的に伝えて、少ない往復で仕事を終わらせることが、費用の節約にもなります。

もうひとつは、「高いモデルを使えばよいわけではない」ということです。日々の仕事はOpus 5.5、簡単な調べものは下位モデル、本当に難しい仕事だけ上位モデルというように使い分けることで、品質と費用のバランスがとれます。

よくある質問(FAQ)

Q1. Opus 5.5で1つの仕事にかかる費用はいくらですか?

仕事の内容や使い方によって大きく変わるため、決まった金額はありません。元の記事の例では、40往復・合計280万トークンを読む作業で、キャッシュが90%効いた場合の入力費用が約1.62ドルでした。企業でClaude Codeを使った場合の平均は、開発者1人・稼働1日あたり約13ドルと紹介されています。

Q2. トークン単価が同じなのに、費用が変わるのはなぜですか?

AIは1往復ごとに、それまでの会話をまるごと読み直すからです。同じ仕事でも、往復の回数が多いほど、また会話が長いほど、読み込むトークンが増えて費用が上がります。キャッシュが効くかどうか、出力の量、使うモデルによっても変わります。

Q3. キャッシュとは何ですか?

一度読んだ文章をAI側で一時的に保持し、次に読み直すときに割引価格で済ませる仕組みです。Opus 5.5では、キャッシュからの読み込みは通常の入力の5%の値段です。保持時間は、Claudeのサブスクリプションでは1時間、APIキーでは初期設定で5分間です。

Q4. 努力レベルはどう選べばいいですか?

範囲がはっきりした日々の仕事はmedium、mediumで行き詰まったらhigh、最も難しい仕事はxhighやmax、機械的な作業はlowが目安です。highは1回あたりの費用が上がりますが、元記事の試算では10往復程度のやり直しを1回避けられれば追加費用を回収できます。切り替えるとキャッシュを再利用できなくなることがあるので、作業の区切りで変えましょう。

Q5. Opus 5.5とFable 5.1はどう使い分ければいいですか?

日々の仕事はOpus 5.5、結果の質が費用より大事なときや、長時間まかせる仕事、前例のない問題にはFable 5.1が向いています。Fable 5.1の入出力の単価はOpus 5.5の2.5倍です。Opus 5.5のhighで同じ問題に2回つまずいたら切り替え、解決したら戻すのが目安です。

Q6. /clear と /compact の違いは何ですか?

/clearは会話を空にするコマンドで、費用はかかりません。関係のない仕事に移るときに使います。/compactは古い会話を要約して短くするコマンドで、1回分の費用がかかりますが、その後の往復が安くなります。細かい内容は失われるので、作業の区切りで使いましょう。

Q7. 自分の費用はどうやって確認できますか?

Claude Codeでは、仕事の終わりに /usage(または /cost)を実行すると、トークン数と費用の見積もりを確認できます。同じ仕事をモデルを変えて試し、3〜4つの仕事で比べてから判断するのがおすすめです。

まとめ

  • AIの費用は「トークン単価」ではなく「1つの仕事を終えるまでの合計(タスク単価)」で考える
  • AIは1往復ごとに会話をまるごと読み直すため、往復が多いほど、会話が長いほど高くなる
  • 費用を左右するのは、往復の回数、キャッシュ、出力の量、モデルの4つ
  • Opus 5.5は入出力が20%、キャッシュ読み込みが60%安くなり、同じ使い方でも約31%安くなる例が示された
  • 努力レベルの使い分け、モデルの使い分け、指示文の見直し、キャッシュを保つ使い方、会話の整理で、さらに無駄を減らせる
  • いちばん信頼できるのは、自分の仕事で実際に測った数字

AIの費用を抑えるカギは、ツールの設定だけでなく、「少ない往復で伝わる指示を出す力」にあります。当社のAI研修では、業務に合わせた指示の出し方や、モデルの使い分けまで、実際の仕事を題材にお伝えしています。お気軽にお問い合わせください。

出典

本記事の数字は、上記の元記事で「説明のための例」として示されたものに基づいています(2026年9月24日確認)。料金はすべてAPIの定価で、サブスクリプションや一括処理の割引、大口の割引などでは異なる場合があります。

活動の日々

BLOG

PAGE TOP