← ブログに戻る

2026年 Gemini API 料金はいくら?本番費用の見積もり方

2026年 Gemini API 料金はいくら?本番費用の見積もり方

Gemini APIを本番アプリに組み込むチーム向けに、料金が発生する箇所と月額費用の計算式を整理します。無料枠の限界、長いコンテキスト、再試行、検索接地、キャッシュ、バッチ処理まで確認し、nuvcloudのMac開発環境費用と合わせて総予算を見積もれる構成です。

「無料で使い始められるなら、本番運用もほとんど費用はかからない」と考えてしまうのは、Gemini APIの料金を見積もるときによくある誤解です。実際には、入力トークンと出力トークンだけでなく、モデルの種類、処理方式、キャッシュ、検索接地、再試行回数までが請求額に影響します。

では、Gemini API 料金はいくらなのでしょうか。答えを1つの固定金額で出すのではなく、自社のリクエスト数と1回あたりのトークン量から再計算できる状態にすることが、本番導入では重要です。

Gemini APIの費用は何に分かれるのでしょうか?

基本となるのは、入力トークンと出力トークンです。入力にはユーザーの質問だけでなく、システム指示、会話履歴、検索結果、PDFや画像などの付加データも含まれます。出力には通常の回答だけでなく、モデルによっては内部推論に使われるトークンも含まれます。(ai.google.dev)

2026年7月25日時点の公式料金ページでは、例えばGemini 2.5 Flash-Liteの標準利用は、テキスト・画像・動画入力が100万トークンあたり$0.10、出力が$0.40です。一方、Gemini 2.5 Flashは入力$0.30、出力$2.50で、同じリクエスト数でも出力の長さによって差が広がります。料金は変更される可能性があるため、導入前には公式のGemini API料金ページを確認してください。(ai.google.dev)

請求額を構成する主な要素は次のとおりです。

  • 通常の入力トークン
  • 出力トークンと推論トークン
  • 音声、画像、動画、PDFなどの入力
  • コンテキストキャッシュの保存時間と利用量
  • バッチ処理、優先処理などの処理方式
  • 検索や地図を使うグラウンディング
  • 失敗時の再試行や重複送信

特に見落としやすいのが、API料金と開発環境費用は別である点です。APIの請求が小さくても、ビルド、テスト、ログ保存、CI/CD、リモート接続に使うMac環境の費用が加われば、プロダクト全体の開発原価は変わります。

無料枠だけで本番運用できるのでしょうか?

Gemini API 無料枠は、学習、個人開発、短期間のプロトタイプには便利です。ただし、本番サービスの前提にする場合は、料金だけでなく、利用できるモデル、レート制限、データの扱い、障害時の運用を確認しなければなりません。無料枠では、モデルによって利用条件が異なり、すべての機能を同じように使えるわけではありません。(ai.google.dev)

無料枠と有料利用は、次のように分けて考えると判断しやすくなります。

  • 学習段階:SDKの接続、プロンプト、レスポンス形式の確認
  • 試作段階:少人数の社内利用、画面とワークフローの検証
  • 本番段階:利用者数、応答時間、上限、監視、請求管理を含めた運用

本番で無料枠に依存すると、アクセス増加時にリクエストが通らない、利用上限に達して検証と本番が競合する、データポリシーの違いを見落とすといった問題が起こります。レート制限はRPM、入力TPM、RPDなど複数の軸で適用され、プロジェクト単位で管理されます。(ai.google.dev)

Gemini APIの料金計算はどう行いますか?

Gemini API の料金計算は、月間リクエスト数から始めると失敗しにくくなります。次の式をスプレッドシートに入れておけば、モデルや利用量を変更して比較できます。

月間入力費用
= 月間リクエスト数 × 1回あたり入力トークン ÷ 1,000,000 × 入力単価

月間出力費用
= 月間リクエスト数 × 1回あたり出力トークン ÷ 1,000,000 × 出力単価

推定月額
= 入力費用 + 出力費用 + キャッシュ費用
  + 検索接地費用 + その他の処理費用

実際の計算では、次の5段階で数字を集めます。

  1. 直近のログから、成功したリクエスト数を数えます。
  2. 入力トークンと出力トークンの平均値だけでなく、中央値と95パーセンタイルも確認します。
  3. 無料枠を使う検証環境と、有料の本番環境を分けます。
  4. エラーによる再試行率、タイムアウト率、ユーザーによる再送率を加えます。
  5. 通常月だけでなく、キャンペーンや障害復旧時の最大利用量でも試算します。

例えば、1回の入力が短くても、毎回同じ長いシステム指示や会話履歴を付ければ、月間入力トークンは急増します。逆に、回答が長いモデルでは、リクエスト数が少なくても出力費用が入力費用を上回ることがあります。

どの隠れた要因で予算を超えるのでしょうか?

長いコンテキストを毎回送っていませんか?

社内規程、商品カタログ、コードリポジトリ、過去の会話を毎回そのまま送る設計は、入力トークンを膨らませます。1回の質問自体は短くても、前置きが大きければ請求額は利用者数に比例して増えます。

自動再試行が重複請求を生んでいませんか?

429やタイムアウトを理由に、同じリクエストを短い間隔で何度も送る実装は危険です。レート制限にはRPM、TPM、RPDだけでなく、支出ベースの制限もあります。公式情報では、Tier 1の支出レート制限は10分間で$10、Tier 2とTier 3は$200とされています。(ai.google.dev)

再試行には指数バックオフを使い、リクエストIDを記録し、結果が確定した処理を再送しない仕組みを用意してください。

検索接地をすべての質問に付けていませんか?

最新情報が必要な質問だけに検索接地を付けるべきです。公式料金ページでは、モデルにより一定数の検索クエリが無料対象となり、超過後は1,000クエリ単位で課金されます。また、1つの利用者リクエストから複数の検索クエリが発生する場合があるため、「検索付きリクエスト数」と「実際の検索クエリ数」は分けて記録する必要があります。(ai.google.dev)

APIキーが漏れていませんか?

クライアントアプリにAPIキーを埋め込むと、第三者がキーを取得して大量利用する可能性があります。キーはサーバー側で管理し、環境変数、利用量監視、発行元制限、日次予算確認を組み合わせてください。

Gemini APIをどう節約すればよいのでしょうか?

Gemini APIの節約方法という検索意図に対して、単純に最安モデルへ変更するだけでは不十分です。品質低下による再生成や人手確認が増えると、見かけのAPI単価より総コストが高くなるためです。

1. 用途ごとにモデルを分ける

分類、要約、定型抽出、短文生成は軽量モデルに寄せ、複雑な推論や最終回答だけ高性能モデルに振り分けます。最初からすべてを高性能モデルへ送るより、品質評価を行ったうえでルーティングした方が管理しやすくなります。

2. 出力上限を設ける

JSON抽出や短い分類結果に、長文を生成できる上限を設定する必要はありません。最大出力トークンを業務要件に合わせ、不要な説明文をプロンプトで禁止すると、出力費用と後処理時間を同時に抑えられます。

3. 繰り返す資料はキャッシュする

同じ規程集やコードベースを何度も参照するなら、コンテキストキャッシュが候補になります。キャッシュは入力トークンの再利用に向いていますが、保存時間にも費用が発生するため、参照回数が少ない資料では逆効果になり得ます。(ai.google.dev)

4. 急がない処理はバッチ化する

評価データの処理、文書の事前分類、夜間の要約などは、リアルタイム応答である必要がありません。公式ドキュメントでは、Batch APIは標準料金の50%で大量処理できる一方、目標処理時間は最大24時間とされています。(ai.google.dev)

5. 予算と使用量を別々に監視する

月額予算だけでなく、入力トークン、出力トークン、検索クエリ、再試行数、モデル別利用量を記録します。予算アラートは「請求額が増えた後」に気付く仕組みではなく、急増している指標を早期に知らせる仕組みにしてください。

nuvcloudのMac開発環境も含めて考えると?

APIだけでなく、開発者が毎月使うMac環境も本番予算に含めると、より現実的な比較ができます。nuvcloudの注文ページでは、16GB / 256GBの構成が月額$101.3、24GB / 512GBの構成が月額$201.7として表示されています。SSD拡張やマルチMac接続などの追加項目は別料金です。(nuvcloud.com)

構成・用途 API費用の確認項目 開発環境で確認する項目
学習・小規模試作 無料枠、モデル制限、RPD 16GB / 256GB、短時間利用
社内検証 入出力トークン、再試行、ログ 24GB / 512GB、ビルド時間
本番前の評価 モデル別単価、検索接地、バッチ CI/CD、複数ユーザー、SSD容量
継続運用 予算上限、監視、キー管理 稼働時間、リージョン、接続方式
費用モジュール 試算に入れる数値 見落としやすい点
Gemini API 月間リクエスト数、平均入出力トークン 95パーセンタイルの長文入力
キャッシュ キャッシュ対象トークン、保存時間 参照回数が少ない場合の逆効果
検索接地 検索付きリクエスト、実検索クエリ数 1リクエストから複数検索が発生
Mac開発環境 メモリ、SSD、利用期間 API費用だけで総原価を判断
運用保守 再試行、監視、障害対応時間 キー漏えい時の異常利用

開発用Macを手元の端末だけでまかなう方法は、端末の買い替え、チーム共有、CI/CD用の別環境、外出先からの接続性に課題が残ります。必要な期間だけ専用環境を確保し、日本リージョンのMac構成米国西部リージョンのMac構成をAPI費用と同じ表に入れると、プロダクト単位の月額原価を比較できます。

Gemini API単体の料金だけを見ると、無料枠や低単価モデルが魅力的に見えます。しかし、長い入力、再試行、検索接地、監視されていないAPIキーが加わると、予算は簡単に変動します。さらに、開発用Macを毎回個別に用意する方法では、初期購入費、更新時期、チーム内の共有、CI/CD環境の分離が負担になります。

本番導入を検討しているなら、nuvcloudのMacレンタル構成を使い、Gemini APIの利用量と開発環境の稼働費を一つの試算表で確認するのが現実的です。APIのモデル選択だけでなく、どのMacを何か月使うかまで含めて比較すると、見かけの単価ではなく、サービスを完成させて運用するための総コストで判断できます。

開発用Macの費用もnuvcloudでスマートに管理

nuvcloudなら、アプリ開発に必要なMac環境をクラウド上で利用できます。

手元の端末に左右されず、場所を選ばずに開発作業へアクセスできます。

関連記事

期間限定オファー →