知識がなくても始められる、AIと共にある豊かな毎日。
AIコーディング

Claude Code の権限と費用を、常駐させる前に決める — 承認なしで走る実行に何を渡すか

ゲンキ

※本記事にはアフィリエイト広告(PR)が含まれます。

ルーティン、ワークフロー、リモートコントロール、アーティファクト。ここまでの記事で、Claude Code を「席を外しても仕事が進む」形にする面を一つずつ見てきた。どの面にも共通する問いが二つ残っている。いくらかかるのかと、何を渡してはいけないのか。

この二つは別々の問いに見えて、同じ場所で交差する。承認なしで走る面では、費用の同意も承認の一種であり、人が押せない場面では課金だけが先に進む。本記事は、公式文書の記述と当サイトの実測をもとに、費用の構造と権限の構造を一枚にまとめる。

数値は 2026年9月17日に取得した。当サイトの環境は Claude Code 2.1.273、Windows 11、auto mode、claude.ai のサブスクリプションである。

忍者AdMax

費用の入口は単価ではなく「前置き」の大きさ

費用の入口は単価ではなく「前置き」の大きさ

まず、当サイトの環境で実測した数字を置く。claude -p "hello" --output-format json という、ただ「hello」と言うだけの非対話の実行を1回行い、返ってきた使用量を読んだ。

項目値
1時間 TTL でキャッシュに書き込んだトークン51,962
5分 TTL で書き込んだトークン0
キャッシュから読んだトークン15,055
キャッシュに乗らない新規入力2
出力385
Claude Code が表示した推定費用(API 換算)$0.5368
所要6,767 ms

「hello」一語に対して、リクエストには約67,000トークンの前置きが載っていた。内訳は、新規にキャッシュへ書き込んだ約52,000と、直前のセッションが温めていた分から読んだ約15,000。新規入力は2トークンしかない。前置きの中身はシステムプロンプト、ツールの定義、当サイトの CLAUDE.md、自動メモリである。

この数字は当サイトの環境に依存する。CLAUDE.md が長く、メモリが多いほど前置きは太る。しかし構造は誰の環境でも同じで、費用は打った文字の量ではなく、毎回送り直される前置きの量と、それがキャッシュから読めるかどうかで決まる。単価の話は、この前提の上に乗る。

単価表を、書込と読み取りに分けて読む

単価表を、書込と読み取りに分けて読む

Claude Fable 5.1 で何が変わったのか(2026-09-21 公開) で扱った単価を、権限の話に必要な範囲で再掲する。100万トークンあたり、米ドル、公式の料金表から。

項目Claude Opus 5Claude Fable 5.1
入力$5.00$10.00
出力$25.00$50.00
5分キャッシュ書込$6.25$12.50
1時間キャッシュ書込$10.00$20.00
キャッシュ読み取り$0.50$0.25

上の実測に当てはめると、「hello」1回の費用の大半は、52,000トークンの1時間書込である。読み取りの15,000トークンはその20分の1以下にしかならない。前置きを毎回書き直す使い方は高く、一度書いて読み直す使い方は安い。この差は、Fable 5.1 では書込 $20 に対して読み取り $0.25 で80倍、Opus 5 でも $10 に対して $0.50 で20倍ある。

Claude Code の文書は、キャッシュ読み取りを「標準入力のおよそ10%」と一般則で書いている。Fable 5.1 と Mythos 5.1 だけは 2.5% で、この二つは公式の料金表の脚注で別扱いになっている。文書によって一般則と例外が分かれて書かれているので、両方を引いておく。

キャッシュの寿命は、誰が払っているかで変わる

キャッシュの寿命は、誰が払っているかで変わる

キャッシュには寿命があり、寿命が切れると次のリクエストは前置きを全部書き直す。Claude Code は寿命をリクエストごとに二つの箱に分けて決める。

リクエストの箱サブスクリプションの枠内usage credits・API キー・クラウドプロバイダ
主会話(対話の手番、-p 実行、Agent SDK の手番)1時間5分
それ以外(サブエージェント、ワークフロー、チームメイト、fork、compaction)原則5分(Anthropic がサーバー側で制御する一部の補助は1時間)5分

当サイトの実測で「hello」が1時間 TTL の書込になったのは、-p 実行が主会話の箱に入り、サブスクリプションの枠内だったからだ。

ここに落とし穴が一つある。枠を使い切って usage credits に入ると、主会話の寿命も5分に落ちる。それまで1時間持っていたキャッシュが、5分で切れるようになる。従量課金に入った瞬間から、席を外している間にキャッシュが消え、戻ってきた最初の一手が高くなる。寿命を自分で指定したければ promptCacheTtl と subagentPromptCacheTtl の設定がある(v2.1.242 以降)。1時間の書込は単価が高いので、短い作業ばかりなら5分のままのほうが安い。

キャッシュを壊す操作と、壊さない操作

キャッシュを壊す操作と、壊さない操作

寿命の前に、操作でキャッシュが無効になることがある。次のリクエストが一度だけ遅く、高くなる。文書の一覧を、条件つきのものは条件を残して写す。

壊す操作

  • モデルの切り替え。モデルごとに別のキャッシュを持つ。opusplan の設定では plan mode の出入りが切り替えになる。安全分類器による自動フォールバックも切り替えになる
  • effort の変更。ただし Fable 5.1 では、API キーかサブスクリプションのログインなら壊れない(v2.1.260 以降)
  • fast mode の初回。ヘッダがキャッシュの鍵に含まれるため、最初の一回だけ
  • MCP サーバーの接続と切断。ただし tool search で定義が遅延読み込みされる既定では壊れず、前置きに読み込む設定のときだけ壊れる。プラグインが提供する MCP も同じ条件
  • ツール全体の deny 規則。これも tool search が有効なら壊れず、無効のときだけ壊れる
  • /compact。会話の層を要約で置き換えるので、設計上壊れる
  • 画像の蓄積。上限に達すると古い画像がまとめて外れ、そこから後ろが再処理される
  • Claude Code の更新。システムプロンプトが変わるので、更新後の最初の会話は先頭から

壊さない操作

  • リポジトリのファイル編集。読み直しは会話への追記になる
  • プロジェクト直下とユーザー階層の CLAUDE.md の途中編集。壊れないが、適用もされない。次の /clear・/compact・再起動で読まれる。サブディレクトリの CLAUDE.md は読み込み前なら編集が効く
  • 権限モードの変更(opusplan の plan mode を除く)
  • 出力スタイルの変更、スキルの呼び出し(ただし frontmatter で別モデルを指定したスキル・コマンドは、その手番だけモデル切り替えになる)、/recap、/rewind、サブエージェントの生成

権限がテーマの本記事で拾っておきたいのは、deny 規則の項だ。「危ないツールを deny すればキャッシュが壊れる」という理解は、既定の環境では誤りである。tool search が有効なら、deny 規則を足してもリクエストの定義は変わらず、キャッシュは残る。権限を絞ることに費用の副作用は、既定では無い。

自分の環境で確かめる方法

自分の環境で確かめる方法

ヒット率は測れる。/usage を実行すると、主会話の最初の応答のあとに「Prompt cache (main)」という行が出て、セッションのヒット率、ミスの回数、いまキャッシュが温かいかどうかが表示される(v2.1.251 以降)。ミスの原因が特定できるときは「likely cause: tool definitions changed」のように理由も出る(v2.1.260 以降)。ステータスラインのスクリプトからは prompt_cache のオブジェクトで同じ値を読める。

TTL がどちらだったかは、上の実測と同じく -p の JSON 出力で cache_creation を見る。1時間なら ephemeral_1h_input_tokens、5分なら ephemeral_5m_input_tokens に数字が入る。

当サイトの /usage の値は、本記事の執筆時点では取得していない。対話セッションで実行して、公開までに追記する。

権限モードという前提を、一度だけ確認する

権限モードという前提を、一度だけ確認する

各面の承認の話に入る前に、通常のセッションで承認がどう決まっているかを一段だけ戻して確認する。Claude Code 2026春アップデート総まとめ — auto mode・/ultrareview・xhigh effortの使いこなし(2026-04-22 公開) で扱った内容なので、要点だけを置く。

対話セッションの権限モードは六つある。manual(ファイルの変更やコマンドの実行のたびに確認する。Enterprise・API キー・-p では既定)、accept edits(ファイルの編集は自動で許し、それ以外は確認する)、auto mode(分類器が各操作を審査し、安全と判断したものは確認なしに進める。Pro・Max・Team の対話セッションでは v2.1.228 以降これが既定)、bypass permissions(すべて確認しない)、dontAsk(事前に許可したツールだけ動き、確認が要る操作は拒否に倒す。CI やスクリプト向け)、そして読むだけで書かない plan mode。

本記事で扱う面は、この前提の上に重なる。ワークフローが生むエージェントは、セッションの許可規則とモードをそのまま継承する。アーティファクトの公開は、auto mode なら分類器の審査、manual 系なら確認プロンプトになる。Chrome の操作は、サイト単位の権限に加えて、モードごとの確認が重なる。そしてルーティンだけが、この前提の外にある。権限モードそのものが存在しないからだ。

当サイトは auto mode で運用している。Pro・Max・Team の既定でもある。本記事の実測も、アーティファクトの公開も、Chrome の読み取りも、確認のプロンプト無しに進んだ。auto mode を選ぶこと自体が「分類器の判断を信じる」という承認の委譲であり、その委譲の範囲を知らずに常駐の面へ進むと、どこで誰が押したのかが分からなくなる。

Fable を使うと、承認なしで従量課金に入ることがある

Fable を使うと、承認なしで従量課金に入ることがある

ここから、費用と権限が交差する場所に入る。

Claude Code の文書によれば、Fable 系のモデルの利用は、プランとシートの階層によっては、プランの枠ではなく usage credits に課金される。そのとき /model の一覧には「Requires usage credits」と表示され、対話セッションでは課金の前に同意のプロンプトが出る(組織課金の Enterprise では出ない。一度続行を選ぶと以後は出ない)。

問題は、同意が出ない場所だ。-p の非対話実行と Agent SDK では、同意のプロンプトは表示されず、そのまま課金される。リモートコントロールで手元の Claude Code を外から進める(2026-09-24 公開) で書いたとおり、この同意はスマホにも転送されない。セッションが走っているターミナルで既定5分(dialogExpiry)以内に誰も答えなければ、その手番はリクエストを送らずに終わり、次の手番で再び同意を求める。

つまり「席を外して走らせる」使い方で Fable 5.1 を選ぶと、プランによっては、人が同意を押す機会が無いまま従量課金が積み上がるか、逆に同意を待って止まるかのどちらかになる。どちらになるかは、走らせる面(対話か、-p か、リモートか)で決まる。常駐させる前に、自分のプランで Fable が枠内か従量かを /model で確かめておく。

費用を読む三つの画面

費用を読む三つの画面

費用は、面ごとに別の画面に出る。常駐させるなら、どこを見れば自分の使用量が分かるかを先に押さえておく。

セッションの費用は /usage。 主会話のヒット率とミスの回数が「Prompt cache (main)」の行に出る。Session ブロックはこのセッション分の集計で、プランの使用量バーには常駐の面を含む全体が合算で出るが、面別の内訳は出ない。

ワークフローの費用は /workflows。 実行ごとに、フェーズ別のエージェント数・トークン合計・経過時間が見える。エージェントの詳細を開けば、1体ずつのトークンも読める。当サイトの記事検査の台本は、ここで14体・約208万トークンと確認した。走っている途中でも止められ、完了した分はおおむね残る(停止時に走っていた体と、失敗した体より後に始まった体はやり直しになる)。

ルーティンの費用は claude.ai/code/routines。 実行の一覧と、日次の実行上限の残数がここに出る。上限はプランで異なり、文書に値は書かれていない。使用量の全体は claude.ai/settings/usage にまとまる。

この三つは互いに合算されない。従量分の今月の支出は /usage の usage credits の行か使用量の設定画面で読めるが、枠内の使用量は金額では計測されない。「どの面がいくら使ったか」は面ごとの画面を回る必要がある。常駐の面を増やすほど、この確認の手間も増える。

面ごとに、誰が承認を押すか

面ごとに、誰が承認を押すか

費用の同意を含めて、各面で承認が誰の手にあるかを一枚にする。

面承認外に出るもの費用の出方
ルーティン(クラウド)無い。権限モードの選択肢が無く、含めたコネクタの書き込みも確認なしリポジトリはクローン。環境変数は環境を使う全員に見える。コネクタの操作は本人名義実行ごとにサブスクリプションの使用量。日次の実行上限(プランで異なる)
ワークフロー(手元)起動時に確認(モード依存)。各エージェントは通常の許可規則に従うセッションと同じエージェント数に比例。25体か150万トークンで助言の警告(既定の指針のとき)
リモートコントロール承認プロンプトを端末で押せる。費用の同意は転送されない会話の記録は Anthropic のサーバー。実行とファイルは手元通常のセッションと同じ枠
Claude in Chromeサイト単位の権限と、モードに応じた確認(セッション中の一括許可あり。auto では出ないことがある)ブラウザのログイン状態を共有既定で有効にするとブラウザツールが常に読み込まれ、文脈の使用量が増える
アーティファクト公開は権限モード依存。auto mode では分類器が審査し、確認なしに公開されうる既定は非公開。公開リンクは誰でも閲覧。コネクタは閲覧者の権限で動く出力トークン。装飾ページは多い
コンピュータ操作(CLI、macOS のみ・Pro/Max のみ・対話セッションのみ)アプリごとにセッション単位で承認。ターミナル等は警告つき実際のデスクトップセッションと同じ

表を縦に読むと、承認の「無い」面が一つだけある。ルーティンだ。ルーティンで Claude Code を留守番させる(2026-09-22 公開) で書いたとおり、当サイトが作ったルーティンには、指定していないコネクタが8本、作成直後に付いていた。Gmail の送信も Zapier の実行も、確認なしで呼べる状態だった。承認が無い面に何を渡すかは、プロンプトの丁寧さではなく、渡した範囲そのもので決まる。

渡してはいけないもの

渡してはいけないもの

どこから任せるかを、費用と取り返しのつきやすさで決める(2026-09-20 公開) で引いた線を、Claude Code の面に当てはめると次の表になる。根拠は各面の文書と、当サイトの方針を分けて書く。

#渡さない根拠の種類
1鍵(API キー・パスワード)を環境変数に置かない。Pro/Max では API 資格情報として保存する。Team/Enterprise では API 資格情報が未提供のため、共有環境の環境変数に置くと全員に見える文書
2承認の無い面(ルーティン)に、不可逆な購買・公開の最終確認を任せない当サイトの方針(構造からの帰結)
3ルーティンのコネクタは、作成直後に必要最小限まで外す。既定で全部入る文書+当サイトの実測
4API トリガーのトークンは表示が1回きり。漏れたら失効させる。呼び出しの本文は「信頼できないデータ」として届く設計だが、それに頼らない文書
5Chrome に触らせる作業は読み取りと確認に限定し、公開・削除・購入のクリックは頼まない。GIF の記録にはログイン済みページのアカウント情報が写る(公式の注意)。スクリーンショットも同様に扱う(当サイトの推論)文書+当サイトの方針
6席を外して走らせる面で Fable を使う前に、自分のプランで従量課金になるかを確かめる文書
7アーティファクトにコネクタを付けたまま公開しようとしない(公開できない)。公開するページには何も保存させない文書+当サイトの方針

表の「根拠の種類」を分けたのは、文書が禁じていることと、当サイトが決めていることを混ぜないためだ。文書は「できる」「できない」を書き、「してよいか」は書かない。2番と5番の後半と7番の後半は、当サイトが決めた線であって、機能の制約ではない。

3Dプリントの作業台で、何を常駐させるか

3Dプリントの作業台で、何を常駐させるか

当サイトの制作工程で言えば、常駐に向くのは公開前ゲートの週次実行(ネットワーク不要、承認不要、結果を読むだけ)で、向かないのは出典リンクの検査(外部への到達が要る)と WordPress への投稿(公開の操作)だった。この振り分けは、費用ではなく権限で決まった。

3Dプリントの作業なら、印刷記録の週次集計は常駐に向く。フィラメントの発注は向かない。発注は購買であり、承認の無い面に置かない。価格の監視は、外部サイトへの到達が要るので、ルーティンの既定の Trusted ネットワークでは成立しない。環境を Custom か Full にするか、手元のセッションで /loop を回すか、人が見る。

当サイトの週次の工程に当てはめると、こうなる。月曜の朝、ルーティンが公開前ゲートを走らせて結果を残す(承認なし、外部到達なし)。人が席に着いたら、その結果を読み、出典リンクの検査を手元で回す(承認あり、外部到達あり)。記事の検査はワークフローの台本で回し(起動時に一度だけ承認)、画像生成の待ち時間はリモートコントロールで承認を押す(費用の同意だけは机で)。公開の操作は、最後まで人が机で押す。面ごとに承認の主体が違うことを前提に組むと、どこで誰が押したかが後から追える。

費用の側では、繰り返す仕事ほど前置きを固定して読み直す形にする。原価計算のように前置き(式・単価表・送料表)が固定で入力だけ変わる仕事は、キャッシュ読み取りの単価で回る。逆に、毎回モデルを切り替えたり、途中で /compact を挟んだりする使い方は、寿命と無関係にキャッシュを壊し続ける。

まとめ

まとめ

Claude Code を常駐させる前に、確かめる順序は次のとおりだ。

  1. 前置きの大きさを知る。当サイトでは「hello」1語で約67,000トークン。費用は文字数ではなく前置きと、それが読めるかで決まる
  2. 書込と読み取りを分けて読む。Fable 5.1 は載せるのが高く読み直すのが安い。Opus 5 の読み取り $0.50 より Fable 5.1 の $0.25 が安い
  3. 寿命は誰が払っているかで変わる。枠内は主会話1時間、従量に入ると5分に落ちる
  4. 壊す操作には条件がある。deny 規則も MCP も、tool search が有効な既定では壊れない
  5. Fable は承認なしで従量課金に入りうる。-p・SDK では同意が出ず、リモートには転送されない
  6. 承認の無い面はルーティンだけ。そこに渡すものは範囲で絞る。コネクタは作成直後に外す
  7. 文書が禁じることと、自分が決めることを分けて書く

数値は 2026年9月17日時点のもので、当サイトの環境に依存する部分は明記した。/usage のヒット率は、対話セッションで取得したのちに追記する。

Claude Code を体系的に押さえたい場合の入門書の例。本シリーズは公式ドキュメントを一次情報にしているので、書籍は補助線として。

出典・参考

ブラウザだけでできる本格的なAI画像生成【ConoHa AI Canvas】
ABOUT ME
swiftwand
swiftwand
AIを使って、毎日の生活をもっと快適にするアイデアや将来像を発信しています。 初心者にもわかりやすく、すぐに取り入れられる実践的な情報をお届けします。 Sharing ideas and visions for a better daily life with AI. Practical tips that anyone can start using right away.
記事URLをコピーしました