AI時短ラボ
検証· 約15分

Claude Codeの1タスクはいくらかかるか──ターン数・キャッシュ・出力トークンの内訳をAnthropicが公式ブログで示す

Anthropicが2026年9月22日、公式ブログでClaude CodeのタスクがOpus 5.5でいくらかかるかを分解した記事を公開した。著者はAddy Osmani氏。例示では40ターン・キャッシュ命中率90%のタスクの入力コストが約1.62ドル、ターン数を25に減らすと約1.02ドルに下がる一方、トークンを減らす工夫はリトライ1回で帳消しになりうると説明している。

Claude Codeの1タスクはいくらかかるか──ターン数・キャッシュ・出力トークンの内訳をAnthropicが公式ブログで示す
執筆・編集:
目次

Claude Codeでの1タスクは、実際いくらかかるのでしょうか。Anthropicが2026年9月22日、claude.comの公式ブログでこの問いに答える記事「What a task costs on Opus 5.5」を公開しました。著者はAddy Osmani氏です。単価表だけでなく、ターン数・キャッシュ読み込み・出力トークンという内訳ごとに金額の動き方を計算例で示し、トークンを減らす工夫がかえってリトライを招いて高くつく場合がある、という論点を数字で説明しています。本記事は同ブログの本文を取得し、前提が本文に書かれている金額はすべて単価から掛け算で検算したうえで書いています。数値は2026年9月24日深夜・日本時間時点で確認したものです。

  • Anthropicが2026年9月22日、Claude Codeの1タスクの費用を分解する記事を公開。著者はAddy Osmani氏で、金額を左右する要素をターン数・キャッシュ読み込み・出力トークンの種類・モデルの4つに整理している
  • 記事中の例では、40ターン・キャッシュ命中率90%のタスクの入力コストは約1.62ドル。同じ作業を25ターンに抑えると約1.02ドルまで下がるとしている
  • 出力トークンは入力の5倍、キャッシュ読み込みの100倍の単価。effortを上げて余分に思考させる費用と、10ターンのリトライ1回分の費用がほぼ同額になる計算例も示されている

コストを決める4つの要素——ターン・キャッシュ・出力・モデル

Anthropicは、Claude Codeでの1タスクを「モデルが会話を読み、ツールを呼び、結果を読む」というループとして説明しています。ループを1周するたびに1回のリクエストが発生し、その料金を左右する要素を次の4つに整理しています。

  1. ターン数 — ターンのたびに、それまでの会話全体を送り直す
  2. キャッシュ読み込み — 送り直す内容の大半は前のターンで読んだテキストで、入力単価のごく一部の「キャッシュ読み込み」として課金される
  3. 出力トークンの種類 — 入力の5倍の単価で最も高いトークン。thinkingも出力として課金される
  4. モデル — モデルごとに単価が違うため、選んだモデルがすべてのトークンの値段を決める

記事が使っている単価はOpus 5.5のAPIリスト価格です。

項目(100万トークンあたり) Opus 5.5 入力比
入力 $4 —
出力 $20 5倍
キャッシュ読み込み $0.20 5%(1/20)
キャッシュ書き込み(5分保持) $5 1.25倍
キャッシュ書き込み(1時間保持) $8 2倍

キャッシュ書き込みについて、記事は「入力単価の1.25倍(5分)・2倍(1時間)」と倍率で書いており、表のドル額は当サイトがその倍率から計算したものです(記事中の「120Kトークンの5分書き込みで約0.60ドル、1時間書き込みで約0.96ドル」と一致します)。

AnthropicはOpus 5.5の単価が、入力・出力ともOpus 5より20%、キャッシュ読み込みは60%安いと説明しています。この比率から逆算すると、Opus 5は入力5ドル・出力25ドル・キャッシュ読み込み0.5ドルという計算になり、これは当サイトがOpus 5.5公開時の記事で公式ドキュメントから確認した価格と一致します。

40ターンと25ターンで入力コストはどう変わるか

記事は、20Kトークンの会話から始まり120Kトークンまで増えるタスクを例に挙げています。40ターンで進めると、1ターンあたり平均で約70Kトークンを送ることになり、タスク全体では約280万トークンの入力になります。会話そのものは120Kトークンまでしか増えていなくても、送信の総量は280万トークンに達する計算です。

条件(同じタスク・約280万トークン) 入力コスト
キャッシュ命中率0%(全てフレッシュ入力扱い) $11.20
キャッシュ命中率90%(記事の40ターン例) $1.62
キャッシュ命中率96% $0.99
25ターンに抑えた場合(約175万トークン・命中率90%) $1.02

記事はこれらの例について、キャッシュから読んだ分をキャッシュ読み込み単価、残りを入力単価で計算し、キャッシュ書き込みの費用は含めていないと断っています。

ターン数を40から25に減らすと、入力コストは1.62ドルから1.02ドルへ下がります。Anthropicは、1ターンの費用はそのターンが新しく足すトークンの分より大きく、それ以前の会話をまるごと送り直すためだと説明しています。そのうえで、ターン数を減らす習慣として、モデルに自分の作業を確かめる手段(実行できるテスト、ビルド、エンドポイントを呼び出すスクリプトなど)を与えることを挙げ、そうしたモデルは間違いに早く気づくとしています。

出力トークンは入力の5倍、キャッシュ読み込みの100倍

出力トークンはOpus 5.5で入力の5倍、キャッシュ読み込みの100倍の単価です。記事の例では、典型的なタスクの出力6万トークンは1.20ドルで、これはキャッシュから600万トークンを読み込むのと同じ金額になります。出力にはthinkingも含まれており、Claude Codeの画面には要約しか表示されなくても、そのすべてが課金対象だとAnthropicは説明しています。effortが主に動かすのはモデルがどれだけ考えるかであり、だからこそeffortは請求額を大きく動かす、としています。

トークンの節約が、リトライ1回で帳消しになる計算

記事は冒頭で、トークンを減らすどの方法(effortを下げる、小さいモデルを使う、文脈を減らす)も、タスクを1回で終えられるかどうかと引き換えになりうる、と書いています。Anthropicは"A retry costs more than those savings."(「リトライは、その節約分より高くつく」)と書いています。

具体例として、effortをhighにして1タスクあたり2万トークン余分に思考させた場合の追加費用を試算しています。Opus 5.5ではこれが0.40ドルです。一方、10万トークンのキャッシュされた文脈で10ターン回り、合計1万トークンを出力するリトライのループの費用も、およそ0.40ドルになるとしています。両者がほぼ同額になる計算から、Anthropicはhighはリトライを1回減らせるタスクなら元が取れる、と説明しています。逆に、mediumでも一度で終わるタスクにhighを使うと、その分は無駄になるとも付け加えています。

記事によると、Opus 5.5のeffortにはlow・medium・high・xhighの4段階と、1セッション限定のmaxがあり、Claude Codeでは/effort highのようにコマンドで作業の途中でも変更でき、新しい設定は次のリクエストから効きます。ただしeffortやthinkingの設定を変えると、キャッシュされた会話が消え、次のリクエストは会話全体をキャッシュ書き込み価格で払い直すことになる、と注記されています。

Opus 4.8からの移行テスト:effortをlowにして18%減、prompt-auditを足すと約25%減

Anthropicは、44件のチケットからなる社内のカスタマーサポート用ベンチマークで、Opus 4.8(既定のeffort)からOpus 5.5(low)への移行を試したとしています。このベンチマークのプロンプトには、古いモデル向けに書かれた指示の「アンチパターン」が複数含まれていたといいます。Opus 5.5に切り替えてeffortをlowにしたことで費用は約18%下がり、Claude Codeの/claude-api prompt-auditでプロンプトを点検するとさらに9%下がって、Opus 4.8の開始点から約25%減になったとしています。監査で取り除かれたのは、モデルに多く書かせ、ツール呼び出しを繰り返させる儀式的な指示で、記事は「6段階の手順を必須にする指示」「スクラッチパッドのルール」「2回確認させるルール」「互いに矛盾する指示」を挙げています。

ただしAnthropicはこの数字について、単一のベンチマークの結果であり、期待していい数字としてではなく一例として扱ってほしいと断っています。本記事もこの断り書きをそのまま引き継ぎます。

セッションが長引くほど1ターンの単価が上がる

キャッシュが効いていても、会話が長くなるほど1ターンの単価は上がります。記事の例では、20Kトークンの文脈でのキャッシュ読み込みは1ターンあたり約0.004ドルですが、150Kトークンまで伸びると約0.03ドルになります。150Kトークンの文脈で30ターン進めると読み込みだけで約0.90ドルかかる一方、同じ30ターンでも20Kトークンの文脈なら約0.12ドルで済む計算です。

Claude Codeの/compactは、会話を要約して以降のターンで送る文脈を短くするコマンドです。記事は、150Kトークン時点での圧縮に約0.25ドルかかる一方、圧縮後は1ターンあたり約0.025ドルの節約になり、10ターンほどで元が取れると試算しています。作業を終える直前の圧縮は節約より費用のほうが大きい、とも書いています。関係のない作業に移るときは無料の/clearで会話を空にし、続きがある作業では/compactに何を残すかを書き添えるとよい、としています。

自分の作業でいくら使ったか確認する方法

Anthropicは、この記事の数字を例示だと繰り返し断ったうえで、自分の作業では/usage(/costでも同じ)コマンドを使うよう勧めています。Sessionの欄にトークン使用量とリスト価格ベースの推定金額が、プロンプトキャッシュの行に入力のうちキャッシュから来た割合が表示され、Pro・Max・Team・Enterpriseプランでは同じ画面にプランの利用量バーも出るとしています。この金額は手元のマシンでリスト価格から計算したもので、サブスクリプションの場合は請求額ではなく作業量の目安だ、とも書いています。チーム向けには、ユーザーごとの推定費用が分かるClaude Code Analytics APIと、モデル別・キャッシュ有無別に支出を分解できるUsage and Cost APIも紹介されています。

比較の基準として、記事はClaude Codeのコストに関する公式ドキュメントの数字を引用し、エンタープライズ導入全体の平均が開発者1人・稼働1日あたり約13ドル、利用者の90%は1日30ドル未満に収まっているとしています。

Anthropicが「例示」と断っている数字について

本記事で扱った40ターン・280万トークンの例や、effortとリトライを比べた0.40ドルの計算など、具体的な数値の多くは、記事本文で"illustrative"(例示)あるいは"best effort illustrations"(できる限りの例示)と明記されています。記事は「数字の一部はリスト価格で、一部はそこから組み立てた例示」と書いており、実際のセッションから記録した値ではありません。Opus 4.8からの移行の18%・25%はベンチマークでの測定ですが、上に書いたとおり一例という位置づけです。Anthropicも「自分のコードベース、プロンプト、習慣は違うので、自分の作業で測ってほしい」という趣旨を繰り返し書いており、本記事もこの位置づけをそのまま引き継ぎます。

記事にはOpus 5とOpus 5.5を並べた図や、数値を自分で入力できる計算機が埋め込まれています。本記事はページを取得してテキストを読む方法で確認したため、計算機のスライダーを動かした結果までは確認していません。「キャッシュの行が1.00ドルから0.40ドルに下がる」「セッション全体では約31%安くなる」といった記述は本文の文章として書かれていたものを拾っています(1.00ドルと0.40ドルは、キャッシュ読み込み200万トークンをOpus 5とOpus 5.5の単価で計算した値と一致します)。

記事が引用しているClaude Codeのコストに関する公式ドキュメント「Manage costs effectively」も開いて確認しました。エンタープライズ平均の1日約13ドル、90%の利用者が1日30ドル未満という数字と、CLAUDE.mdを200行未満に保つという目安は、同ドキュメントにも同じ内容で書かれています。

出典(Anthropicブログ)と本記事が検算した範囲

本記事の数字と記述は、Anthropicの公式ブログ記事「What a task costs on Opus 5.5」(2026年9月22日公開・著者Addy Osmani)の本文によります(Opus 5の単価のみ、当サイトの公開時の記事による)。本文に書かれた単価(入力4ドル・出力20ドル・キャッシュ読み込み0.20ドル、キャッシュ書き込みは入力の1.25倍と2倍)から、入力コストの1.62ドル・1.02ドル・0.99ドル・11.20ドル、出力6万トークンの1.20ドル、effortを上げた場合とリトライの0.40ドル、キャッシュ書き込みの0.60ドル・0.96ドル、文脈の長さ別の読み込み費用(0.004ドル・0.03ドル・0.90ドル・0.12ドル)を掛け算で検算し、本文の記述と一致することを確認しています。圧縮の約0.25ドルは、要約の出力量や圧縮後の文脈の大きさが本文に数値で書かれていないため、検算の対象に含めていません。

Opus 5.5自体の単価とベンチマークは公開時の記事で、APIでのeffortの既定値がhighからmediumに変わった経緯は公式プロンプトガイドの記事で、他社モデルを含めた料金の読み方は料金ガイドで、それぞれ別記事として確認しています。

価格や試算は今後Anthropicの発表で変わる可能性があります。続報があれば本記事を更新します。

シェア: ポスト はてブ

出典・参照資料

AIニュースの解説を動画でも

YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。

コメント

まだコメントはありません。最初のコメントを書いてみませんか?

AIについて聞きたいことはありますか?

質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。

質問箱を見る →

新しい記事をメールで受け取る

AIの新しい発表を、出典付きで整理して届けます。

関連記事

Claude Opus 5.5が登場──入力4ドル・出力20ドルでOpus 5より2割安、公式ベンチ9項目のうち7項目で首位の記事画像
モデル09.22読了17分

Claude Opus 5.5が登場──入力4ドル・出力20ドルでOpus 5より2割安、公式ベンチ9項目のうち7項目で首位

出典 ─ Anthropic公式
Claude Opus 5.5公式ガイド解説動画のサムネイル
活用09.23読了30分

Claude Opus 5.5公式プロンプトガイドを全部読む──effortの既定がhighからmediumへ、無人エージェントが止まる4つの型と公式の対策文、貼るだけのプロンプト6型

出典 ─ Anthropic 公式ドキュメント(.md版を取得して照合)実機検証
Claude・GPT・Gemini API料金の読み方──2026年8月27日に公式ページで確認した単価早見表の記事画像
活用07.16読了18分

Claude・GPT・Gemini API料金の読み方──2026年8月27日に公式ページで確認した単価早見表

出典 ─ Anthropic 公式料金ページ(Pric
Claude Codeのコスト表示に「US限定推論の1.1倍」が反映されるようになった──/costで何が変わったかの記事画像
検証09.06読了16分

Claude Codeのコスト表示に「US限定推論の1.1倍」が反映されるようになった──/costで何が変わったか

出典 ─ anthropics/claude-code(GitHub公式リリースノート)
Claude Opus 5.5がGitHub Copilotで利用可能に──使えるプランとClaude Code・APIとの料金差の記事画像
プロダクト09.24読了21分

Claude Opus 5.5がGitHub Copilotで利用可能に──使えるプランとClaude Code・APIとの料金差

出典 ─ GitHub Changelog
Claude Fable 5.1公式比較表(Anthropic公式ブログの画像)
モデル09.19読了11分

Claude Fable 5.1とは──公開、プラン別の使える条件、料金、公式プロンプトガイド、370年暗号の検算、GPT-6 Astraとの比較まで、当サイトの記事を1ページに(随時更新)

出典 ─ Anthropic公式ブログ(2026-09-01)
Anthropicヘルプセンター「Claude Fable models on your plan」の画面
活用09.18読了18分

Claude Fable 5.1の使い方──どのプランで使えて、上限に当たるとどうなり、遮断されたら何が起きるか(Pro・Max・Claude Code・API)

出典 ─ Anthropicヘルプセンター(2026-09-02更新)
GPT-6 AstraとClaude Fable 5.1の公式比較資料を並べた画像
モデル09.18読了25分

GPT-6 Astra vs Claude Fable 5.1 比較──同じ$10/$50で何が違うか。公式ベンチの突合・独立指標・プラン別に使える条件・キャッシュ単価の4倍差を1枚に

出典 ─ OpenAI公式ブログ(比較表・脚注・2026-09-03)