たとえば月次の締めで、生成AIのAPI利用料の請求を開いたら、前月の倍近い金額になっていたとします。請求書に並んでいるのは米ドルの合計とトークンの総数だけで、部長からは「何が増えたの?来月はいくらになる?」と聞かれます。利用部門に確かめても使い方は変えていないと返ってきて、経理の手元では説明の材料がそろいません。
先に答えを書きます。AIの月の請求額は、件数、1件あたりのトークン量、単価、為替、使用量に連動しない固定分の5つで決まり、倍違う月はこの5つのどれかが動いています。出力の単価が入力より高い料金体系では、画面に出ない推論や思考のトークンも出力として数えられるため、件数が同じでも1件の重さだけで請求は大きく変わります(2026年9月時点の公式料金)。請求書から利用明細へ見る資料を移し、前月との差を5つに割り振り、上司への1枚と技術側への質問に落とすところまでを整理します。
- 月の請求額は「件数 × 1件あたりのトークン量 × 単価 × 為替 + 固定分」。前月の倍になったら、この5つのどれが動いたかを分けて見ます。
- 件数が同じでも請求は伸びます。Claude Sonnet 5の単価は100万トークンあたり入力2ドル・出力10ドル(2026年9月時点)で、回答が長くなるだけで伸び方が変わります。
- 1件の重さやモデルの切り替えは経理の手元から見えません。利用部門と開発・情シスに聞く項目を先に決めておくと、毎月の説明が同じ往復で止まらなくなります。
目次
AIの費用が月で倍違うのは、5つの要素のどれかが動いたから
呼び出しの件数が増えていれば利用部門に、件数が同じで1件のトークンが増えていれば開発・情シスに確かめます。トークンも変わらないなら単価の改定・モデルの変更・為替を、使っていないのに減らないなら固定の契約を見ます。前月差の説明は、まずこの分岐で担当の窓口が決まります。
式にすると、月の請求額は「件数 × 1件あたりのトークン量 × 単価 × 為替 + 使用量に連動しない固定分」です。前の4つは掛け算なので、どれか1つが2倍になれば請求も2倍になります。2つが少しずつ同時に動いても、掛け合わさって倍に近づきます。

上限の決め方や、使い始める前の見積もりは、前月との差を説明できるようになった後に決める話です。まずは起きたことを5つのどれかに割り振れる状態を作ります。
利用明細に出ている症状から、動いた要素を当てる
請求書だけを見ても、5つのどれが動いたかは分かりません。技術側に利用明細(日別・モデル別の回数とトークン数)を出してもらい、前月と並べて下の表に当てはめます。
| 利用明細で見える症状 | 動いた要素 | 確かめる資料 | 聞く相手 |
|---|---|---|---|
| 呼び出しの回数が前月より増えた | ① 件数 | 日別・部署別の呼び出し回数 | 利用部門 |
| 回数は同じで、1回あたりのトークン(特に出力)が増えた | ② 1件の重さ | 入力・出力別のトークン数 | 開発・情シス |
| 回数もトークンも近いのに、ドルの金額が増えた | ③ 単価 | 公式の料金ページ、モデル名の変更履歴 | 開発・情シス |
| ドルの金額は同じで、円の支払額だけが違う | ④ 為替 | カード明細・支払記録の換算額 | 経理自身 |
| 呼び出しの無い日にも一定の金額が出ている | ⑤ 固定分 | 課金の内訳(メーター別)、デプロイの一覧 | 契約を持つ部署・情シス |
回数とトークンが同時に増えた月は、1件の重さを先に見る
件数と1件の重さが同じ月に動くことはよくあります。そのときは、件数より先に1件あたりのトークン量を確かめるのが私の見立てです。件数の伸びは利用部門の実感と一致しやすい一方、1件の重さは誰も気づかないまま変わるからです。
決めきれない例もあります。モデルを新しい世代に替えると、同じ文章でもトークン数が増えることがあり、明細上は②に見えます。ただ原因はモデルの変更なので、③に入れると説明が通ります。どちらに入れるかより、モデルを替えた日付を1行残すほうが説明の役に立ちます。
AIの請求額は、件数よりトークンの量と単価で決まる
生成AIの従量課金とは、使った件数ではなく、入力と出力のトークン量にそれぞれの単価を掛けて合計する料金の決め方です。請求はその月に実際に使った量に基づき、Claude APIの支払いはすべて米ドル建てです。
この領域でつまずきやすいのは、ツール選定よりも「業務の中のどこに組み込むか」の設計です。BoostXのAI顧問は、業務ヒアリングから設計・定着支援までをサービス対応範囲としてカバーできる領域です。
トークンは、文章をAIが処理する単位に区切ったものです。1件の問い合わせでも、長い資料を読ませれば入力のトークンが増え、長い回答を書かせれば出力のトークンが増えます。件数と金額が比例しないのはこのためです。
Azure上で使う場合は、課金の単位と料金がモデル、デプロイの種類、測り方によって変わります。従量課金と予約の枠のどちらを選んだかで、請求の形そのものが違ってきます。その比べ方はAzure OpenAIの費用と落とし穴を比較表で整理した記事にまとめています。
入力と出力で単価が違い、Sonnet 5では出力が入力の5倍
Claude Sonnet 5の標準単価は、100万トークンあたり入力2ドル、出力10ドルです(2026年9月時点)。計算すると、出力の単価は入力の5倍になります。
この差があるので、請求の伸びは件数の伸びと一致しません。同じ1件でも、回答が長くなった月は、高いほうの単価がかかる部分が増えます。前月差を見るときに、入力と出力を1本の合計にまとめてしまうと、どちらが動いたのかが消えます。
件数が同じなのに増えた月は、1件あたりの重さが変わっている
利用部門が使い方を変えていないと言う月でも、1件の中身は変わっていることがあります。見るべきは、1件あたりの入力トークンと出力トークンの前月比です。ここが動いていれば、原因は次の4つのどこかにあります。
回答を長く書かせるようにした月は、出力の単価で伸びる
要約を詳しくする、報告書の下書きまで出させる、といった設定の変更は、件数を変えずに出力のトークンだけを増やします。出力は単価の高い側なので、請求の伸び方は件数の伸びより大きくなります。
技術側への質問は「回答の長さや出力の形式を変えた日はあるか」の1つで足ります。変えた日が分かれば、その日の前後で1件あたりの出力トークンを比べるだけで説明がつきます。
画面に出ない推論のトークンにも、費用はかかるのか
かかります。OpenAIの推論モデルが内部で使う推論トークンは、画面には出ませんが出力トークンとして課金されます。Geminiでも、思考(thinking)をオンにした場合、応答の料金は出力トークンと思考トークンの合計になります(どちらも2026年9月時点)。
つまり、回答の文字数が前月と同じでも、推論や思考を使う設定に切り替えた月は、見えない出力が上乗せされています。利用明細で出力トークンだけが増え、回答の長さが変わっていないなら、この設定の有無を聞きます。
調べものをさせる会話は、続けるほど1回が重くなる
Claudeのウェブ検索を使うと、会話の途中で取ってきた検索結果が、その後のやり取りでも入力トークンとして数えられます。同じ会話を続けるほど、前の検索結果を抱えたまま次の1回が処理されるので、1回あたりの入力が増えていきます。
検索そのものにも、トークンとは別に1,000回あたり10ドルがかかります。調べものの用途が広がった月は、検索の回数とトークンの両方が増えるため、利用明細では2つの行を分けて見ます。
長い資料を1回で読ませた月は、入力の単価そのものが上がる
Gemini 3.1 Pro Previewでは、1回の入力が20万トークン以下なら入力単価は100万トークンあたり2ドル、20万トークンを超えると4ドルです。契約書や議事録をまとめて1回で読ませる使い方を始めた月は、トークン量が増えるうえに、単価の段も上がります。
この段料金は、件数でも月の合計でもなく、1回ごとの入力の長さで決まります。技術側には「1回に渡す資料の量を増やした処理はあるか」と聞きます。
同じ使い方でも、モデルの切り替えと単価改定で請求は動く
Anthropicは料金ページで、新しいトークナイザーでは同じテキストに対して約30%多くのトークンが生成されると書いています(2026年9月時点)。モデルを替えた月は、件数も文章も同じまま請求が増え得ます。
同じ文章でもトークン数が約30%増える切り替えがある
トークナイザーは、文章をトークンに区切る仕組みです。区切り方が変われば、同じ請求書の文面を読ませても数えられるトークンが変わります。単価表が同じに見えても、掛ける相手の数が増えるので、請求は増えます。
モデルや設定を替えた月は、変更日を請求の区切りとして扱うのが私の考えです。月の途中で替えたなら、変更前の日数と変更後の日数に分けて1日あたりの金額を比べると、切り替えの影響だけが見えます。
単価の改定日をまたぐ月は、件数が同じでも請求が変わる
Gemini 3.8 Flashの入力単価は、2026年12月までは100万トークンあたり0.75ドル、2027年1月からは1.50ドルです。計算すると入力単価は2倍になり、件数も使い方も同じなら、2027年1月分から入力の請求が倍になり得ます。
無料枠の超過も同じ形で効きます。Google検索で回答を補う機能(グラウンディング)は、月5,000件の検索までが無料で、その後は1,000件あたり14ドルです。この無料枠はGemini 3.xのモデル全体で共有なので、別の部署が使い始めただけで、自部署の分まで早く枠を使い切ることがあります。
割引が外れた月と、円で払う会社の為替
安くなる仕組みが効かなくなった月も、請求は上がります。ClaudeのBatch API(急がない処理をまとめて流す方式)は入力・出力とも50%割引で、プロンプトキャッシュが効くと、同じ前提文の読み込みは通常の入力単価の一部で済みます。処理を即時に切り替えた、前提文を毎回書き換えるようにした、という変更があれば、単価が上がったのと同じ結果になります。
為替は、円で払う会社なら必ず説明に入れる要素です。ドル建ての金額が前月と同じでも、円の支払額は動きます。レートの数字は、経理の支払記録から前月分と今月分を取って並べます。
使っていない月も減らない費用は、使用量と別に乗る固定分
使用量に連動しない費用は、利用が減った月にも同じ額で残ります。前月差を見る前に、変動分と固定分を分けておかないと、利用が半分の月に請求が半分にならない理由を説明できません。
呼び出しが0件の日も、デプロイしている限り1時間ごとに乗る
Azure OpenAIで微調整(ファインチューニング)したモデルは、デプロイしている間、使っていない時間も1時間ごとにホスティング料金がかかります。検証のために置いたままのモデルがあると、利用明細の呼び出しが0件の日にも金額が出ます。
固定分は、利用部門に聞いても出てきません。聞く先は、契約を持っている部署と、デプロイの一覧を管理している情シスです。月に1回、一覧と請求の行を突き合わせれば、使っていないのに残っているものが見つかります。
上司への説明は、前月差を5つに割り振った1枚で足りる
請求書は「いくら払ったか」しか示さず、利用明細は日別・モデル別・メーター別に「何が増えたか」を示します。上司への1枚は、請求書ではなく利用明細を元に作ります。
1枚に載せる列は6つ、行は5つの要素
Azureのコスト分析では、日・月・年ごとのコストの表示や予算との比較ができ、課金のメーター別に内訳を見られます。ほかのサービスでも、管理画面の利用明細から同じ粒度の数字を出してもらいます。行は5つの要素で固定し、列は次の6つにします。
| 列 | 書く中身 | 取ってくる先 |
|---|---|---|
| 要素 | 件数/1件の重さ/単価/為替/固定分 | 固定(毎月同じ5行) |
| 前月 | 前月の回数・トークン・単価・レート・固定額 | 前月の利用明細と支払記録 |
| 今月 | 同じ項目の今月の値 | 今月の利用明細と支払記録 |
| 差 | 今月から前月を引いた値 | 経理が計算 |
| 動いた訳 | 設定の変更、モデル名、利用部署の増減など | 利用部門・開発・情シスの回答 |
| 確認元 | 誰に、いつ確かめたか | 経理が記録 |
差の計算は経理の担当者が行い、どの要素が動いたかの判断は、技術側の回答を受けて人が確認してから決めます。「動いた訳」の欄が埋まらない行は、そのまま技術側への質問になります。上司には、埋まった行で説明し、埋まっていない行は「確認中」と書いて出せば足ります。全部の行を埋めてから出そうとすると、報告が翌月にずれ込みます。
来月の予算は、倍になった月の数字だけで決めない
Microsoftは、予算とアラートのしきい値を、少なくとも1回の完全な請求サイクルの傾向を確かめた後にだけ更新するよう案内しています。倍になった月の金額をそのまま来月の予算に置くと、原因が一時的だった場合に予算だけが膨らみます。
来月の見込みを聞かれたら、5つのうちどれが来月も続くかで答えます。設定の変更やモデルの切り替えなら続き、1回きりの大量処理なら戻ります。上限やアラートの置き方は、この見込みを1回の請求サイクルで確かめてから決めます。
経理だけで変動を追い続けると、どこで止まるのか?
経理だけで追える要素は、為替と、請求書に載っている固定の行までです。1件の重さ、モデルの切り替え、推論や検索の設定は、技術側の画面にしか出てきません。
経理の手元に無い情報と、突き合わせる場が無いときに起きること
いちばん重いのは、設定を替えた日付がどこにも残っていないことです。開発側は改善のつもりで回答を長くし、推論をオンにし、モデルを新しくします。どれも正しい判断ですが、日付と一緒に経理へ届かなければ、請求が増えた月に原因を後から探すことになります。
利用明細を出せる人が社内に1人しかいない場合も止まります。その人が忙しい月は、明細が締めに間に合わず、前月差の1枚が作れません。
もう1つは、月次で突き合わせる場が無いことです。場が無いと、経理は締めのたびに一から聞き直し、技術側も前月と同じ説明を繰り返すことになります。変更日の記録と明細の出し方を決める段階で詰まっているなら、社内だけで回そうとせず、外部に頼んで最初の型を作るほうが早い場面です。
ビフォーアフター:AI費用の説明が「分からない」から「どれが動いたか」に変わる
冒頭の仮の場面の続きで、前月差の説明にかかる締めの数日を比べます。変わるのは使うツールではなく、見る資料と聞く順番です。
請求書の合計だけで説明しようとする締めの3日間
締めの1日目に、請求書の米ドル合計が前月の倍近いことに気づきます。2日目に利用部門へ聞くと、使い方は変えていないと返ってきます。3日目に開発・情シスへ聞くと、何を出せばよいかと聞き返され、部長への説明は「確認中」のまま翌月に持ち越されます。
5つの要素の1枚で、聞く相手が決まっている締めの1日目
締めの1日目の朝に、日別・モデル別の利用明細が届きます。5行6列の1枚に前月と今月を入れると、件数は横ばいで、1件あたりの出力トークンだけが増えていると分かります。昼に開発へ「回答の長さか推論の設定を変えた日はあるか」と1つだけ聞き、夕方には変更日つきの1枚を部長に出せます。
違いを生んでいるのはツールではなく、要素ごとに聞く相手を決めた順番
BeforeとAfterで、使っているAIも請求の額も同じです。違うのは、請求書ではなく利用明細を元にしたことと、5つの要素ごとに誰に何を聞くかを先に決めていたことです。この順番が決まっていれば、締めの1日目に説明の形がそろいます。Beforeの3日間に近いと感じたら、次の欄の支援範囲が判断の材料になります。
この記事のまとめ
- 次の締めまでに決めるのは、日別・モデル別の利用明細を誰が、何日までに経理へ渡すかの1点です。
- 開発・情シスには、モデル名・推論の設定・回答の長さを変えた日を、その都度1行で経理に知らせてもらう約束を取り付けます。
- 固定分は、契約とデプロイの一覧を月に1回だけ突き合わせ、使っていないのに残っている行を先に消します。
- 2027年1月のように単価の改定が決まっている月は、前月の終わりに来月の差として先に書いておきます。
公開日:2026年9月
読んで終わりにしないために
「自社の場合は、どうすれば?」
その答えを、最大45分で持ち帰る。
記事で分かるのは、一般論まで。AI導入を専門に見ている担当が、貴社の業務に当てはめて“次の一手”だけを一緒に整理します。
この相談で持ち帰れるもの
- 01
自社業務に当てはめたAI活用マップ
- 02
投資対効果(ROI)のシミュレーション
- 03
いまの悩み・疑問への、その場の個別回答


