Claude Codeのコスト表示に「US限定推論の1.1倍」が反映されるようになった──/costで何が変わったか
anthropics/claude-codeのv2.1.239で、/cost・ステータスライン・--max-budget-usdのコスト見積りが、データレジデンシーワークスペース向けの「US限定推論1.1倍」の割増を含むようになりました。Claude Managed Agentsのinference_geoパラメータで確認した1.1倍という料金設定が、Claude CodeのUI表示にも波及しているという確認です。

目次
2026年8月27日、GitHubの公式リリースノート(anthropics/claude-code)を実際に開いて確認した内容です。 v2.1.239(2026年8月21日公開)の変更点一覧の先頭に、次の記載があります(原文と訳)。
"Cost estimates (
/cost, status line,--max-budget-usd) now include the 1.1× US-only-inference premium for data-residency workspaces"(訳:コスト見積り(
/cost、ステータスライン、--max-budget-usd)が、データレジデンシーワークスペース向けの「US限定推論1.1倍」の割増を含むようになった)
当サイトの別記事で確認した通り、Claude APIにはinference_geoパラメータがあり、"us"(米国内インフラのみで推論)を指定するとClaude 4.6以降のモデルで標準料金の1.1倍が課金される、という料金設定がAnthropic公式ドキュメントに明記されています。今回のClaude Codeの変更は、この料金設定がCLI側のコスト表示機能にも反映された、という確認です。
3行まとめ
- Claude Codeの
/costコマンド、ステータスライン、--max-budget-usdオプションによるコスト見積りが、データレジデンシーワークスペースで発生する「US限定推論1.1倍」の割増分を含めて計算されるようになった- この1.1倍という料率自体は、Claude APIの
inference_geo: "us"パラメータに紐づく既存の料金設定(Claude 4.6以降のモデルが対象)- 変更はv2.1.239(2026年8月21日)で、Managed Agentsの
inference_geo機能追加(2026年8月7日)から2週間後というタイミング
なぜ「表示が変わった」ことがニュースなのか
料金設定自体は既にAnthropic公式ドキュメントに明記されていたものですが、実際に使うツール(Claude Code)側のコスト見積り機能がその割増を正しく反映していなかった場合、データレジデンシーワークスペースで作業しているユーザーは、/costやステータスラインに表示される見積り額が実際の請求額より低く出ていた可能性があります。今回の変更は、その表示の不整合を解消した、という位置づけです。
--max-budget-usdはセッションの予算上限を指定するオプションですが、この見積り計算に1.1倍の割増が正しく含まれていなかった場合、データレジデンシーワークスペースでは想定より早く(あるいは想定と違うタイミングで)予算上限に達してしまう、という実務上の影響があったと考えられます。今回の修正でこの計算が是正された、という理解です。
対象はデータレジデンシーワークスペースのみ
この変更が影響するのは、「データレジデンシーワークスペース」──つまりデータの保管場所や推論の実行地域を制御する設定を有効にしている組織・ワークスペースに限られます。通常のワークスペース(inference_geoをデフォルトの"global"のまま使っている場合)には、この1.1倍の割増自体が適用されないため、今回のコスト表示の変更による影響もありません。
1.1倍という料率のおさらい
当サイトのClaude Managed Agentsのinference_geoに関する記事で確認した通り、Anthropic公式ドキュメントは次のように明記しています(原文と訳)。
"Claude 4.6 and later models: US-only inference (
inference_geo: "us") is priced at 1.1x the standard rate across all token pricing categories (input tokens, output tokens, cache writes, and cache reads)."(訳:Claude 4.6以降のモデル:米国限定推論(
inference_geo: "us")は、全トークン料金カテゴリ(入力トークン・出力トークン・キャッシュ書き込み・キャッシュ読み取り)にわたって標準料金の1.1倍で課金される)
入力・出力トークンだけでなく、キャッシュの書き込み・読み取りも含めた全カテゴリが対象になっている点は、コストを見積もる上で見落としやすいポイントです。プロンプトキャッシュを多用する運用をしている場合、キャッシュ関連のコストにも同じ1.1倍が乗る、ということになります。
「Inference geo」と「Workspace geo」は別物
公式ドキュメントを最初から読み直すと、データレジデンシーには実は2つの独立した設定があると分かる。「Inference geo」(inference_geoパラメータ。モデル推論をどこで実行するかをリクエスト単位で制御)と、「Workspace geo」(データの保管場所・画像変換やコード実行などのエンドポイント処理をどこで行うかをワークスペース単位で制御)だ。今回の1.1倍はこのうち前者(Inference geo)にかかる料率で、Workspace geoには現時点で"us"しか選択肢がなく、しかもワークスペース作成後に変更できない、とドキュメントには明記されている。
対応モデルにも制約がある。inference_geoパラメータが使えるのはClaude 4.6以降のモデルのみで、Claude Opus 4.5・Sonnet 4.5・Haiku 4.5以前のモデルにこのパラメータを付けてリクエストすると400エラーが返る。また、Amazon BedrockやGoogle Cloud経由では推論リージョンがエンドポイントURLで決まるためこのパラメータ自体が適用されず、OpenAI SDK互換エンドポイント経由でも利用できない。Microsoft Foundry上ではinference_geoパラメータは使えないが、Azureでホストされた「US Data Zone Standard」というデプロイ形式を選べば、同じ1.1倍の料率が適用される、という代替経路がある。
Priority Tier契約では「お金」だけでなく「トークン消費量」にも1.1倍がかかる
ドキュメントの注記の中で、当サイトの元記事・当記事いずれの初回確認でも見落としていた重要な一文があった。
"If you have a Priority Tier commitment, the 1.1x multiplier for US-only inference also affects how tokens are counted against your Priority Tier capacity. Each token consumed with
inference_geo: "us"draws down 1.1 tokens from your committed TPM, consistent with how other pricing multipliers (such as prompt caching) affect burndown rates."
(Priority Tier契約がある場合、米国限定推論の1.1倍の乗数は、Priority Tierの容量に対するトークンのカウント方法にも影響する。inference_geo: "us"で消費された各トークンは、契約済みのTPM(分間トークン数)容量から1.1トークン分を消費する。これは、プロンプトキャッシュなど他の料金乗数がバーンダウン率に影響するのと同じ扱いだ)
つまり、US限定推論の1.1倍は単純な請求額の割増だけでなく、Priority Tier契約者にとっては「契約した処理能力(TPM)をどれだけ早く使い切るか」にも影響する。Claude Codeの--max-budget-usdが金額ベースの見積りだとすれば、Priority Tier契約者にとってはさらにTPM容量の消費ペースという別軸でも1.1倍の影響が及ぶことになる。
過去にグローバルルーティングをオプトアウトしていた組織は自動移行済み
ドキュメントには、過去の設定からの移行についての記載もあった。以前「グローバルルーティングをオプトアウトし、推論を米国内に限定する」という組織レベルの設定を使っていた組織は、allowed_inference_geos: ["us"]・default_inference_geo: "us"という新しい設定に自動的に移行済みで、コード変更は不要とされている。つまり、こうした組織は今回のClaude Code側のコスト表示修正が入る以前から、実質的にずっと1.1倍の対象だった可能性がある、ということになる。
なお、現時点での制限として、レート制限は全ジオ(地理的リージョン)で共有されている・Inference geoの選択肢は"us"と"global"の2つのみ・Workspace geoは"us"のみで作成後変更不可、という3点がドキュメントに明記されている。
同じリリースの他のコスト関連機能
v2.1.239の変更点一覧には、コスト管理に関する別の記載もありました。
"The usage-limit message shown when your monthly spend limit is already used up now also says when your session or weekly limit resets"
(訳:月次の支出上限を既に使い切った時に表示される利用制限メッセージが、セッション単位・週次単位の上限がいつリセットされるかも表示するようになった)
コストの見積り精度(1.1倍の反映)と、上限到達時の情報提示(リセット時期の明示)という、コスト管理まわりの改善が同じリリースにまとまって入っていたことが分かります。GitHubリポジトリ内のCHANGELOG.mdを直接確認すると、同じv2.1.239には課金の実額そのものに関わる修正も含まれていました。
"Fixed Bedrock streaming behind proxies that strip the response Content-Type header, which silently doubled billed API calls by re-running every turn non-streaming"
(訳:レスポンスのContent-Typeヘッダーを取り除くプロキシ経由でBedrockのストリーミングを使った場合の不具合を修正した。この不具合は、各ターンをストリーミングなしで再実行することにより、請求対象のAPI呼び出し回数を気づかれないまま2倍にしていた)
こちらは「表示が実額より低く出ていた」今回の1.1倍の件とは逆に、「実際の請求そのものが水増しされていた」不具合で、対象もBedrock経由・特定のプロキシ環境に限られる。同じリリースに、コスト表示側の不整合修正と、実課金側の不具合修正が同時に含まれていたことになる。
他の料金乗数と「重複適用」される
料金ガイド全体を扱う別ページ(about-claude/pricing)にも、データレジデンシー料率についての記載があり、次の一文があった。
"These multipliers stack with other pricing modifiers, including the Batch API discount and data residency."
(これらの乗数は、Batch APIの割引やデータレジデンシーを含む、他の料金修飾子と重複して適用される)
つまり、US限定推論の1.1倍は単独で効くのではなく、fast modeなど他の料金修飾子と掛け合わされる形で適用される。Batch APIの割引と「重複する」という書き方から、Batch API経由でUS限定推論を使った場合、Batch割引とデータレジデンシー1.1倍の両方が同時に計算式に入る、という理解になる(具体的な計算式・掛け算の順序までは、このページには記載がなかった)。
設定の組み合わせ早見表
ここまでの情報を整理すると、次のような組み合わせになる。
| 設定 | 選べる値 | 料金への影響 |
|---|---|---|
Inference geo(inference_geoパラメータ) |
"global"(デフォルト)/"us" |
"us"はClaude 4.6以降で標準の1.1倍。"global"は標準料金 |
| Workspace geo(ワークスペース作成時に固定) | "us"のみ(現時点) |
Workspace geo自体には追加料金の記載なし。データの保管場所・エンドポイント処理の所在を決める |
Priority Tier契約時のinference_geo: "us" |
─ | 金額の1.1倍に加え、契約TPM容量からも1トークンあたり1.1トークン分を消費 |
Claude 4.6より前のモデルにinference_geoを指定 |
─ | 400エラー(パラメータ自体が使えない) |
| Bedrock・Google Cloud経由 | ─ | inference_geoパラメータ自体が適用対象外(エンドポイントURLでリージョンが決まる) |
乖離の大きさそのものは分からなかった
この修正が入る前、/costやステータスラインの見積りが具体的にどれだけ実際の請求額と乖離していたのか(1.1倍の分がまるごと欠落していたのか、一部だけ反映されていたのか)についての詳細は、今回確認したリリースノートの1行には記載がありませんでした。また、この表示修正が過去の請求そのものに影響するものではなく、あくまでCLI上の見積り表示の問題だったのか、実際の課金計算自体には誤りがなかったのかについても、リリースノートの記載だけでは断定できません。TPM burndownの1.1倍がClaude Code上のどの表示(/cost・ステータスライン・--max-budget-usdのいずれか)に反映されているのか、あるいはこれらは金額ベースの見積りのみでTPM消費量の表示は対象外なのかについても、今回確認したv2.1.239のリリースノート1行とデータレジデンシー公式ドキュメントの範囲では特定できませんでした。
関連記事
出典・参照資料
AIニュースの解説を動画でも
YouTubeでは注目ニュースの背景を解説し、Xでは新着記事をお知らせしています。
コメント
まだコメントはありません。最初のコメントを書いてみませんか?
AIについて聞きたいことはありますか?
質問箱で無料で受け付けています。回答は公開され、他の方の参考にもなります。
質問箱を見る →新しい記事をメールで受け取る
AIの新しい発表を、出典付きで整理して届けます。