「AI 起業、1年目のサーバー費用はいくら?」——資金調達資料には「クラウドコスト年間 X 万円」という一行がよく登場しますが、創業者自身は X の根拠を説明できないことが多いです。OpenAI API の請求書だけを答えにする人、A100 を1台借りる感覚で見積もる人、Cursor サブスク・ベクトルDB・CI Runner・監視 SaaS を6枚のカードに分散させ、年末に気づく人——サーバー費用 ≠ モデル API、1年目も決して一直線ではありません。
本文は技術系創業者と1〜5人の AI 起業チーム向けに、キャッシュフローの視点で勘定を整理します。何が真のサーバー費用か、何が見落とされがちな「隠れインフラ」か、3つの典型的なプロダクト形態で1年目にいくらかかるか。Mac を買うかクラウド Mac を借りるかも迷っているなら 初めての起業、Mac は費用か投資か を参照。Agent 請求が先に届いているなら Agent 時代の請求書分解 を。本文の主題は1年目インフラの総勘定 + ランウェイです。
1) なぜ「1年目」が最も計算しにくいのか
AI 起業1年目のインフラ支出には、少なくとも3本の曲線が重なっており、月額 × 12 で単純外推できません:
- 検証期(0〜3か月): トラフィックはほぼゼロだが、R&D 使用量は高い——創業者自身が「ヘビーユーザー」になり、API と IDE が先に増える;
- パイロット期(3〜8か月): 最初の有料またはパイロット顧客が現れ、推論 QPS とベクトルDB ストレージが上昇。監視とコンプライアンス支出が発生;
- ランプアップまたは pivot(8〜12か月): 使用量が指数関数的に増えてスケールが必要になるか、方向転換で GPU リースや専用クラスタが埋没費用になる。
さらに厄介なのはプロダクト形態がまだ固まっていないこと。今日は API ラッパー、明日 RAG を追加、明後日 fine-tune を試す——pivot のたびにコスト構造が変わります。だから「1年目のサーバー費用」は単一の数字ではなく、区間付きのキャッシュフローモデル。本文では3段階の算例で落とし込みます。
2) API 請求書だけをサーバー費用と見ない
多くの AI 起業チームのメンタルモデルは2023年のまま:サーバー = 大規模言語モデル API を叩くこと。しかし2026年、本番稼働できる AI プロダクトのバックエンドには、少なくとも次の「非モデル」支出があります:
| よく漏れる項目 | なぜ「サーバー/インフラ」に含めるか | 1年目の典型形態 |
|---|---|---|
| アプリホスティング(Vercel / Fly / ECS) | API ゲートウェイ、BFF、Webhook がここで動く | 無料枠から月1万〜6万円 |
| ベクトルDB / 検索(Pinecone、pgvector、Milvus) | RAG プロダクトの「第2ストレージ」 | ベクトル次元 + クエリ QPS 課金 |
| オブジェクトストレージ + CDN | ドキュメント分割、ユーザーアップロード、静的リソース | 量が小さいうちは安い。海外展開後は帯域が高くなる |
| キュー / キャッシュ(Redis、SQS) | 非同期推論、レート制限、セッション状態 | Agent 長時間タスクに必須 |
| 可観測性(ログ、APM、アラート) | 推論レイテンシ、エラー率、コスト帰属 | 顧客が増えたら printf デバッグでは足りない |
| CI / Runner(macOS 含む) | モバイル、デスクトップ、署名パイプライン | GitHub Actions 分単位または専用マシン |
| R&D 側 Agent 環境 | 常時稼働 Mac / クラウドマシンで Claude Code、OpenClaw を実行 | 営業費用だが、同じ現金を消費 |
財務が「モデル API 予算」だけを承認すると、2か月目からエンジニアが個人カードで Redis と監視を立て替える——1年目サーバー費用の落とし穴の半分は、勘定科目の設計ミスです。
3) 6バケツ・インフラコストモデル
AI 起業1年目のクラウドと算力支出を6バケツにまとめると、予算策定と pivot 時の損切りがしやすくなります:
| バケツ | 含むもの | 課金特性 | 1年目に最も痛いチーム |
|---|---|---|---|
| B1 推論 | クローズド API(OpenAI / Anthropic / 国内大規模モデル)、自ホスト vLLM / Ollama | トークン単位または GPU 時間 | ユーザー獲得後、QPS に比例または超比例で増加 |
| B2 学習 / 微調整 | LoRA、Embedding 再学習、評価バッチ | 突発的、プロジェクト単位 | 「GPU を数週間借りる」か「常時 GPU を維持する」かの分岐点 |
| B3 データ層 | Postgres、ベクトルDB、S3、ETL | ストレージ + 読み書きが増加 | RAG / Agent Memory プロダクト |
| B4 計算とネットワーク | K8s ノード、Serverless、出口帯域、WAF | 固定 + トラフィック | 海外展開、マルチリージョン展開 |
| B5 開発生産性 | CI Runner、staging 環境、クラウド Mac、Dev GPU | 常時稼働または分単位 | フルスタック + モバイルチーム |
| B6 セキュリティとコンプライアンス | 鍵管理、監査ログ、プライベート展開プレミアム | シートまたは固定費 | ToB、金融・医療顧客 |
6バケツのうちB1 が最も目立ち、B3+B5 が1年目に最も過小評価されがちです。巨大テックの算力インフラ戦争は供給側の話——起業チームが気にすべきは:収益曲線が B1〜B6 の重なった傾きをカバーできるかです。
4) 3つの AI 起業形態の1年目請求書プロファイル
以下の3段階は2026年に最も多い AI 起業パスです。数字は円建ての量级区間(算例仮定、見積もりではありません)。自社のクラウドコンソールで再計算してください。
4.1 A パターン:API ラッパー / 垂直 SaaS(自前学習なし)
プロダクト形態:クローズド API + 自社ビジネスロジック + Web/App シェル。典型チーム1〜3人。1年目の目標は有料意向の検証。GPU 調達は行わない。
| 段階 | 月次インフラ(目安) | 主な構成 |
|---|---|---|
| 0〜3か月 MVP | 4万〜16万円 | API 開発自用 + Vercel/Fly + Supabase 無料枠の端 |
| 4〜8か月 パイロット | 16万〜50万円 | 顧客 API 使用量 + ベクトルDB 入門プラン + 基本監視 |
| 9〜12か月 ランプアップ | 50万〜160万円+ | 推論が MAU に連動して増加。キャッシュ・ルーティングでコスト削減が必要 |
1年目合計の粗算:300万〜900万円(顧客獲得速度で1桁変わる)。主要リスク:API に粗利を取られる——客単価が低く呼び出しが深いと、PMF 前に unit economics で負ける。
4.2 B パターン:RAG / Agent プロダクト(データ層が重い)
プロダクト形態:ドキュメント Q&A、企業ナレッジベース、多段 Agent ワークフロー。B3 データ層と B5 開発生産性の比重が上がる。プライベート展開要求が多い。
| 段階 | 月次インフラ(目安) | 主な構成 |
|---|---|---|
| 0〜3か月 | 10万〜30万円 | Embedding API + ベクトルDB + オブジェクトストレージ + Agent IDE |
| 4〜8か月 | 30万〜80万円 | 顧客データ取り込み、検索 QPS、staging 複数環境 |
| 9〜12か月 | 80万〜240万円 | 大企業 POC では独立 VPC が必要なことが多い。コンプライアンスログ |
1年目合計の粗算:700万〜1,800万円。 API 以外にベクトル次元とストレージ増加の予算を確保——多くのチームが6か月目に Pinecone 請求が3倍になったことに気づきます。
4.3 C パターン:自ホスト推論 / モデル差別化(GPU に触れる)
プロダクト形態:オープンソースモデル微調整、プライベート展開、レイテンシとコストに極端に敏感。1年目は「GPU レンタルで検証 → 購入または長期契約を検討」が多く、キャッシュフローの変動が最大。
| 段階 | 月次インフラ(目安) | 主な構成 |
|---|---|---|
| 0〜3か月 | 20万〜60万円 | 従量 GPU で実験 + 小規模推論マシン |
| 4〜8か月 | 60万〜200万円 | A100/H100 級 1〜2台のリースまたは同等算力パック |
| 9〜12か月 | 100万〜400万円+ | 推論レプリカ複数、K8s、ネットワーク出口、運用人件費の暗黙コスト |
1年目合計の粗算:1,200万〜3,600万円+(フルタイム MLOps 除く)。重要な判断:いつ従量から予約インスタンスへ移行するか、いつ「自ホストは割に合わない」と認め API に戻るか。
5) 12か月キャッシュフロー3段階算例(自社ランウェイに当てはめて)
起動資金に6か月分の生活費が含まれ、インフラは会社口座から支出すると仮定。下表は年間インフラ現金支出の累計(人件費、オフィス、マーケティング除く):
| 戦略 | プロダクト形態 | 年間インフラ(目安) | ランウェイの意味(総資金1,600万円の場合) |
|---|---|---|---|
| 保守的 | A パターン API SaaS、顧客獲得が遅い | 360万円 | クラウド比率が低く、マーケと人件費に残せる |
| 中立的 | B パターン RAG、年中に有料顧客2社 | 1,100万円 | クラウドが第2の固定支出。粗利を注視 |
| 積極的 | C パターン自ホスト、Q3 にマルチテナント本番 | 2,400万円 | 未調達なら生活費を圧迫。資金調達または仕様削減が必要 |
3戦略の差は「誰が賢いか」ではなく、プロダクトが本当にその GPU とベクトル規模を必要とするかです。初めての AI 起業でよくある失敗:有料ユーザー10人もいないのに C パターンアーキテクチャ——技術ロマン主義がランウェイを消耗する。
6) コスト曲線:MVP から PMF までの3つの鉄則
- 推論は API で済ませ、unit economics が自ホストを迫るまで。 自ホストの損益分岐点は、通常「月次推論請求が160万〜300万円で安定し、モデル選定が固定された後」に初めて本格的に計算する価値がある(チーム規模により異なる)。
- データ層は「顧客」単位で勘定。総請求だけを見ない。 各有料顧客が占めるベクトルストレージ、検索 QPS——大企業 POC を別途課金または導入費で回収すべきか。
- 開発環境は営業費用として、本番と科目を分ける。 Cursor、Claude API、クラウド Mac、GitHub Actions 分——5バケツ Agent コストを参照。本番 API に混ぜると粗利を誤判断する。
1年目のコスト管理の核心は「クラウドを使わない」ことではなく、不可逆支出を先延ばしにすること:GPU 長期契約、マルチリージョン展開、専用コンプライアンスクラスタ——設定とルーティングで済むものを、調達で解決しない。
7) 見落とされがちな「サーバー」:macOS CI と Agent 常時稼働マシン
多くの AI 起業チームの主戦場は Linux クラウドですが、プロダクトに iOS / macOS クライアント、TestFlight、デスクトップ Agent が入ると、Apple エコシステムの制約にぶつかります:xcodebuild、署名、公証は macOS 上でのみ実行可能。この支出は「開発ツール」に分類されがちですが、キャッシュフローでは同じように効いてきます:
| 選択肢 | 1年目のキャッシュフロー特性 | 向く段階 |
|---|---|---|
| 創業者 MacBook 兼用 | 購入2万〜4万円の一時支出。7×24 Agent には不向き | 純検証、モバイルなし |
| GitHub ホスト macOS Runner | 分単位。低頻度なら許容、Agent トリガーが多いと急増 | 週数回の PR ビルド |
| 専用クラウド Mac mini | 月額の営業費用、停止可能。CI + リモート Agent に向く | 安定パイプラインが必要、小チームで専任 IT なし |
AI プロダクト + App シェルを同時に進めるなら、1年目予算に 「macOS 算力」年10万〜30万円 を単独行で計上(クラウド Mac レンタル目安。自前 Mac mini は減価償却別途)。Runner TCO 記事、Mac は費用か投資か と同じフレームワークで整理できます。
8) 1年目インフラ予算:契約前の12項目セルフチェック
- プロダクト形態は A / B / C のどれ? 先に段階を決めてからクラウド設計。C パターンの幻想と A パターンの収入を混ぜない。
- 月次推論量の上限は? API コンソールで hard limit + アラートを設定。一晩で請求が爆発するのを防ぐ。
- ベクトルとオブジェクトストレージは6か月後どの規模? 「顧客あたり10GB ドキュメント」で粗算し、営業計画が現実的か確認。
- 単一顧客の独立展開要求はある? あれば B6 コンプライアンスと重複環境コストが N 倍。
- GPU は「週次実験」か「7×24 推論」か? 前者は従量。後者で初めて予約を検討。
- staging / prod は分離している? 混在は1年目の節約策だが、顧客が増えると借金返済になる。
- CI と Agent 環境は常時稼働? なら B5 に計上。漏らさない。
- 海外展開するか? 帯域とマルチリージョンアカウントは初日から計画。後から移行は高い。
- 粗利モデルで API は収入の何%? >40% かつ客単価が低いなら、先に価格改定かキャッシュ。いきなり資金調達でサーバー拡張しない。
- pivot 確率 >50% なら、従量・短期契約・停止可能サービスを優先。
- 30日で6バケツ請求を1枚の表にエクスポートできる? できなければ、まだ投資家と会う準備ができていない。
- 最大のクラウド支出を除いても、マイルストーンは達成可能? 感度分析を事業計画書に書く。
9) よくある質問(FAQ)
Q1:1年目のサーバー費用の業界平均は?
統一された平均値はありません——A パターンなら300万円以内、C パターンなら2,000万円+も普通です。平均より有用なのは:12か月以内に収益が B1 の傾きをカバーできるか。
Q2:無料枠はどれくらい持つ?
個人 MVP なら1〜3か月が多い。外部ユーザーまたは Agent の7×24 稼働が始まると、無料枠は通常足りない。「まだ支払っていない」を「コストゼロ」と混同しない。
Q3:いつ API から自ホストに切り替える?
モデル選定が安定し、月次 API 請求が3か月連続で閾値を超え、GPU 運用(または雇用)の能力がある——3条件が同時に満たされたとき初めて TCO を計算。
Q4:ベクトルDBは最初 Postgres pgvector で節約できる?
多くの A/B パターンチームには1年目で十分。QPS と次元が上がったら専用ベクトルDBへ移行。移行コストはロードマップに事前記載。
Q5:AI 起業で最初から K8s が必要?
5人以内のチームの多くは1年目不要。Serverless + マネージド DB の方が速い。K8s は複雑性税であり、成熟度の勲章ではない。
Q6:資金調達時、クラウドコストを事業計画書にどう書く?
6バケツに分解し、保守/中立の2段階を示し、「有料ユーザー100人増ごとの限界クラウドコスト」を明記——「クラウドサービス費50万円」の一行より10倍信頼される。
サーバー勘定に、macOS の一行を忘れない
AI 起業1年目、Linux クラウド請求はスプレッドシートに載りますが、iOS ビルド、署名、TestFlight、常時稼働 Agent は「別のカード」に散らばりがちです。macOS 算力を予測可能な月額にまとめ、API 使用量と同様に計画・停止可能にすれば——ランウェイが見えるようになります。
Nuvcloud は専用 M4 Mac mini を日/週/月課金で提供。小チームの CI とリモート Agent 環境に最適。料金を見る、または MCP クラウド Mac 展開記事 で B5 開発生産性バケツを試算。