「AI 제품 하나 만들려면 얼마나 준비해야 하죠?」——PM, 1인 개발자, 퇴근 후 사이드 프로젝트를 시작하는 사람이 이 질문을 하면 자주 듣는 답은 «상황에 따라 다릅니다». 맞는 말이지만 AI 엔지니어링 경험이 전혀 없는 사람에게는 아무 말도 안 하는 것과 같습니다. «상황»이 뭔지 모르고, 청구서에 나오는 낯선 용어도 구분이 안 됩니다.
2026년 현실은 이렇습니다. 대형 모델 API는 2년 전보다 훨씬 저렴해졌습니다(주요 벤더 가격이 지난 18개월에 약 60%–80% 하락). 그래도 «공개 가능한 AI 제품»을 만드는 비용은 API 한 줄로 끝나지 않습니다. 서버 호스팅, 벡터 검색, 개발 도구, 도메인, 결제 수수료——어느 것도 예고 없이 튀어나올 수 있습니다. 이 글은 AI 배경 없이 0에서 데모 가능한 MVP를 만들고 싶은 독자를 위해 «네 가지 비용 + 세 단계 + 세 가지 예산 티어»로 정리합니다. 이미 소규모 팀으로 1년차 현금 흐름을 짜는 중이라면 AI 창업 1년차 서버 비용을, 런칭 후 첫 100명 사용자에서 무엇이 터지는지는 AI 제품 첫 100명 사용자 문제域을 참고하세요.
一、초보가 무서운 건 비싼 게 아니라, 돈이 어디로 가는지 모르는 것
처음 AI 제품을 만들 때 머릿속에 있는 청구서는 대개 OpenAI나 각사 LLM API 요금 하나뿐입니다. 실제로는 «아이디어가 있다»에서 «친구가 QR로 써본다»까지 최소 네 종류의 지출이 있고, 시점도 다릅니다.
- 검증기(1주차): 본인만 사용자. API 체험 크레딧과 Cursor / Claude Code 같은 코딩 어시스턴트 구독이 중심;
- 껍데기 만들기(1개월): 데모를 공개 URL에 올림——도메인, 호스팅, DB가 무료 티어를 넘어섬;
- 시험 운영(3개월): 진짜 사용자 유입. API는 인원에 비례해 늘고, 벡터 DB와 모니터링이 과금 대상이 됨.
초보의 진짜 불안은 «더 싸게 못 하냐»가 아니라 다음에 무엇이 청구될지 보이지 않는다는 점입니다. 먼저 루트 결정표로 기술 경로를 고정한 뒤, 네 가지 비용 틀로 쪼개 봅니다.
二、먼저 루트 선택: 세 가지 기술 경로가 청구의 80%를 결정
숫자를 내기 전에 답하세요. 제품에 AI를 어떻게 붙일 건가요? 루트가 다르면 비용 구조가 완전히 달라집니다.
| 루트 | 적합한 사람 | 전형적 제품 | 월 운영 비용(MVP 기) | 주요 리스크 |
|---|---|---|---|---|
| A. 순수 API 래퍼 | 미경험, GPU 지식 없음 | AI 글쓰기, 챗봇, 카피 생성 | $40–280 | API가 사용자와 연동; 마진 얇음 |
| B. API + RAG | 백엔드 조금 가능 | 사내 지식 QA, 문서 어시스턴트, 업종 Copilot | $200–1,100 | 벡터 DB + 스토리지; 검색 품질 튜닝 |
| C. 자체 호스팅 / 로컬 모델 | 운영 가능 or 배울 의지 | 프라이버시, 고동시성, token 과금 탈피 | $400–4,000+ | GPU 고정비; 품질은 자기 책임 |
미경험이면 A부터 시작하는 게 정석입니다. OpenAI API 요금이나 DeepSeek API 요금으로 한 줄 연결해 제품 로직을 통과한 뒤 B의 지식베이스를 검토하세요. C(GPU 렌탈, Ollama / vLLM)는 월 API가 몇 달 연속 $2,000–3,000을 넘을 때 TCO를 보는 게 맞습니다——너무 이른 자체 호스팅은 초보의 «착각 절약» 대표입니다.
루트 선택은 DeepSeek vs Copilot vs Cursor 가이드도 참고하세요. «개발 도구비»와 «제품 API비»는 따로 장부에 씁니다.
三、네 가지 비용 틀: 모델, 서버, 도구, 숨은 잡비
AI 제품 운영 지출을 네 덩어리로 묶으면 기록도 공동 창업자 설명도 쉬워집니다.
| 비용 | 포함 항목 | 초보가 놓치기 쉬운가 | MVP 기 전형 구간 |
|---|---|---|---|
| ① 모델 API | 채팅, 완성, Embedding, 이미지/음성(필요 시) | 덜 놓침; output token 과소평가 | $15–700/월 |
| ② 서버와 데이터 | 앱 호스팅, DB, 객체 스토리지, 벡터 DB, CDN | 자주 놓침: Vercel 무료가 영원하다고 생각 | $0–400/월 |
| ③ 개발 도구 | Cursor, Claude Code, GitHub Copilot, 디자인 SaaS | 개인 구독에 섞어 제품 원가에 안 넣음 | $30–200/월 |
| ④ 숨은 잡비 | 도메인, SSL, SMS 인증, 결제 수수료, 모니터링 알림 | 가장 놓치기 쉬움 | $7–100/월 |
①과 ②는 사용자 증가와 연동됩니다. ③은 MVP 기간 거의 고정 월정액. ④는 한국에서 본격 공개할 때 SMS·PG·세금계산서 대응도 들어갑니다. 매월 네 줄짜리 표만 채워도 카드 명세보다 열 배 명확합니다.
四、대형 모델 API 비용: 2026 가격과 token 빠른 계산
API는 token 단위 과금. «글자 조각»으로 이해하면 되고, 한국어 1글자는 대략 1–2 token. 일반 Q&A(사용자 200자 + 모델 500자)면 800–1500 token 정도입니다.
4.1 2026년 주류 모델 가격(100만 token당, USD)
각사 2026년 7월 공개 요금 기준. 실제 청구는 캐시 히트, Batch 할인 등으로 달라집니다. 전체 요금표는 Anthropic 요금과 OpenAI 요금 페이지를 보세요.
| 모델 | 입력 ($/1M) | 출력 ($/1M) | 적합 시나리오 |
|---|---|---|---|
| DeepSeek V3.2 | $0.14 | $0.28 | 고트래픽, 비용 민감, 다국어 |
| GPT-4.1 Nano | $0.10 | $0.40 | 분류, 태깅, 짧은 응답 |
| Claude Haiku 4.5 | $1.00 | $5.00 | 저지연 지원, 경량 Agent |
| GPT-4.1 / GPT-5.4 Mini | $0.40–2.50 | $1.60–12.50 | 범용 대화, 중간 복잡도 |
| Claude Sonnet 4 | $3.00 | $15.00 | 복잡 추론, 장문, 코드 |
| Claude Opus 4.6 | $5.00 | $25.00 | 고품질·저볼륨 핵심 작업 |
4.2 초보용 빠른 계산식
월 API 비용은 세 숫자면 됩니다. 일일 활성 D, 1인당 일일 요청 R, 1회 평균 token T(입출력 합계).
월 token 총량 = D × R × T × 30 월 API 비용 ≈ (월 token × 입력 단가 × 입력 비율) + (월 token × 출력 단가 × 출력 비율) # 예: DAU 50, 1인 5회/일, 1회 2000 token, DeepSeek V3.2 # 월 token = 50 × 5 × 2000 × 30 = 15,000,000 # 입출력 반반 가정: 약 $1.05 + $2.1 ≈ $3.15/월 # Claude Sonnet 동일 조건: 약 $67 + $112 ≈ $180/월
같은 제품도 모델 선택만으로 청구가 50배 차이 나도 이상하지 않습니다. 초보 MVP 황금률: 쉬운 일은 소형 모델(Nano / Haiku / DeepSeek), 막힐 때만 승격. Agent 다턴 대화는 T를 폭증시킵니다——자동 실행형이면 반드시 Agent 시대 청구서 해부를 읽으세요.
五、서버와 인프라: 무료 티어에서 유료로 넘어가는 시점
«서버»는 웹과 백엔드를 24시간 공개하는 클라우드 일체를 뜻합니다. 2026년 흔한 조합:
- 프론트 + Serverless API: Vercel / Cloudflare Pages — MVP는 무료가 많음. 트래픽 증가 시 $30–150/월;
- 전통 VPS: AWS Lightsail, NCP, 카페24 클라우드 — $20–80/월, 환경 구성은 직접;
- 관리형 DB: Supabase / PlanetScale 무료 → 사용자 늘면 $15–70/월;
- 벡터 DB(B 루트): Pinecone 무료는 제한적. 프로덕션은 $40–280/월, 또는 Postgres + pgvector로 DB에 통합;
- 객체 스토리지: 사용자 업로드——소량이어도 egress는 놓치기 쉬움.
무료 티어에서 올려야 할 신호는 세 가지. 응답 지연, DB 연결 수 경고, Vercel 초과 메일. 초보가 처음부터 GPU 서버를 빌릴 필요는 없습니다——그건 C 루트입니다.
六、세 단계 지출 지도: 1주차 / 1개월 / 3개월
시간축으로 보면 언제 무엇에 돈이 나가는지 한눈에 보입니다.
1주차: 아이디어 검증(예산 $0–70)
목표: 본인이 코어 플로우를 통과. API 체험(많은 벤더가 $5–$20 제공) + 선택적 Cursor Pro(약 $20/월). 서버 불필요——로컬 + ngrok로 충분.
1개월: 공유 가능한 MVP(예산 $70–420)
목표: 친구가 QR로 쓸 URL. 추가: 도메인($15–25/년), 호스팅, Supabase, SMS/이메일 인증. 내부 테스트 10명이면 DeepSeek 루트에서 API는 월 $7 미만도 가능.
3개월: 소규모 오픈 베타(예산 $280–1,400)
목표: 50–500 실사용자. API 선형 증가; RAG면 벡터 DB와 Embedding 과금; Sentry 등 기본 모니터링. 이쯤엔 API 월간 hard limit을 반드시 설정——바이럴로 카드가 터지는 걸 막습니다.
七、세 가지 월 예산 티어: $70 / $420 / $1,400+
부품을 조합한 세 가지 «프로필»입니다.
| 티어 | 적합한 사람 | 루트 | 월 비용 구성(대략) | 감당 가능 규모 |
|---|---|---|---|---|
| 스타터 $70 | 부업, 1인, 내부 테스트 <20명 | A 순수 API | API $15 + 도구 $30 + 호스트 $0–15 + 잡비 $7 | 데모, 피드백, 수요 검증 |
| 그로스 $420 | 본격 창업, 2–3인 팀 | A 또는 경량 B | API $110 + 서버 $80 + 도구 $110 + 잡비 $40 + 예비 $70 | 백 명 규모, 단순 RAG, 기본 모니터링 |
| 스케일 $1,400+ | 유료 고객, SLA 필요 | B 또는 C 혼합 | API/추론 $550 + 인프라 $420 + 도구 $210 + 컴플라이언스/모니터링 $210 | 천 명 규모, 기업 파일럿, 다중 환경 |
티어를 넘는 가장 큰 점프는 서버보다 ① API 사용량과 ② RAG/Agent 탑재 여부입니다. 그로스에서 스케일로 가기 전에, 유료 1인당 공헌이익이 그 사람의 한계 API 비용을 덮는지 계산하세요.
八、초보가 실행할 수 있는 비용 절감 7가지
- 모델 라우팅: 분류·요약은 Mini / DeepSeek, 어려운 것만 Sonnet——API 40%–85% 절감;
- Prompt 캐시: 시스템 프롬프트 반복 전송 시 OpenAI / Anthropic 캐시 히트로 입력 token 약 90% 절약;
- 출력 길이 제한:
max_tokens를 합리적으로. Agent는 «수다 루프» 주의; - API 콘솔 hard limit + 이메일 알림: 초보 필수. 의지에 맡기지 말 것;
- 벡터 DB는 나중에: 문서가 적을 땐 전문 context로 충분한 경우 많음;
- 개발 도구는 하나만: Cursor와 Claude Code를 풀 과금으로 동시에 쓸 필요 없음;
- 자체 호스팅은 미루기: 월 API가 안정적으로 $2,000 넘을 때 GPU 검토. 6개월 일찍 빌리면 손해.
九、흔한 함정 5가지
- 외주 개발비를 월 운영비로 착각: MVP 외주는 $3,000–12,000 일시금이 흔함. 이 글의 $70–420/월과 다름;
- 무료 크레딧을 영구로 생각: OpenAI / Claude 체험 소진 후는 종량. 상한 설정 잊지 말 것;
- Agent 무한 루프: 사용자 클릭 한 번에 십수 회 추론——청구는 선형이 아니라 지수;
- 본격 공개 시 SMS·결제 누락: 토스·카카오페이 수수료, SMS 인증 건당 ₩20–40——④잡비에 반영;
- 제품 미검증 상태에서 Mac / GPU 구매: 검증 전엔 클라우드 API + 무료 호스트로 충분. 하드웨어는 3층 워크플로가 안정된 뒤 투자.
十、자주 묻는 질문(FAQ)
Q1: 경험 없이 AI 제품, 최소 월 얼마?
순수 API + 무료 호스트면 1인 내부 테스트 $50–70/월(코딩 어시스턴트 포함)도 가능. 전부 무료 도구 + 체험 크레딧만 쓰면 1주차는 거의 $0——다만 실사용자 공개에는 부족.
Q2: API와 서버, 어느 쪽이 더 비싼가?
MVP(백 명 미만)에선 보통 API가 50%–70%. 서버는 무료 티어면 무시 가능. 천 명·RAG 이후 서버와 벡터 DB가 30%–40%.
Q3: 프로그래밍 필수인가?
2026년엔 Cursor / Claude Code로 비개발자도 단순 MVP 가능. 다만 디버깅, 배포, API 상한 설정엔 기초 기술 리터러시가 필요. 노코드(Bubble + Zapier + API)도 있으나 월비 더 높고 유연성 낮음.
Q4: DeepSeek이 싸다. 계속 DeepSeek만?
많은 한국어·업무 시나리오에 충분. 최강 추론·초장문·영문 법무가 필요하면 메인 모델 + 승격 모델 조합이 현실적.
Q5: 언제 API에서 자체 배포로 전환?
다음 셋이 동시에: 월 API 3개월 연속 $2,000 초과, 모델 선택 확정, GPU/로컬 추론 운영 가능 인력. 하나라도 빠지면 API 유지.
Q6: AI 제품 vs 일반 앱, 비용 차이?
일반 앱 MVP는 월 <$30(호스트만)도 가능. AI는 종량 모델 API가 추가되고 사용자와 선형 증가——가격 설계와 사용량 모니터링은 첫날부터.
Q7: 얼마나 예비 자금?
최소 그로스 티어 3개월분(약 $1,260), 인건비 제외. API와 클라우드는 카드 즉시 결제——사용자 급증이나 Agent 디버깅 스파이크용 버퍼.
검증 후에는 개발 환경도 총비용에 넣으세요
초보 AI 제품에서 네 가지 비용 중 과소평가되기 쉬운 건 ③개발 도구 + 상시 온라인 개발 머신입니다. iOS 클라이언트, 로컬 Agent(OpenClaw / Claude Code), macOS 전용 툴체인이 필요하면 Mac mini 구매는 큰 CapEx. 클라우드 Mac mini 일/주 과금이면 pivot 시 중단해 고정비를 변동비로 바꿀 수 있습니다. Apple Silicon 통합 메모리는 로컬 소형 모델 검증에도 유리——Linux VPS와는 다른 카테고리입니다.
«로컬 데모»에서 협업 가능한 본격 환경으로 옮긴다면 Nuvcloud 클라우드 Mac mini M4는 개발·Agent 샌드박스에 적합합니다——요금제 보기, 또는 OpenHuman 클라우드 Mac 실전으로 상시 Agent 기대 비용을 산출해 보세요.