«Хочу сделать AI-продукт — сколько денег закладывать?» Этот вопрос задают продакты, инди-разработчики и те, кто ведёт side project. Ответ «зависит от ситуации» верен, но бесполезен, если вы не понимаете, какие статьи вообще появятся в счёте.
В 2026 году парадокс очевиден: API моделей сильно подешевели (у крупных провайдеров часто минус 60–80 % за 18 месяцев), но «рабочий AI-продукт в проде» стоит дороже одной строки OpenAI. Хостинг, векторный поиск, dev-инструменты, домен, комиссии платёжек — каждая позиция всплывает в своё время. Гайд для читателей без ML-бэкграунда, которым нужен демонстрируемый MVP с нуля — через «четыре кошелька + три фазы + три бюджетных уровня». Если команда уже есть, сравните стоимость серверов в первый год; про первых 100 пользователей — проблемы первых 100 пользователей.
Непрозрачность дороже самой цены
Большинство новичков видят только одну строку — API OpenAI или Anthropic. От наброска идеи до ссылки, которую можно скинуть в чат, минимум четыре типа расходов — в разное время:
- Валидация (неделя 1): вы единственный пользователь. API на тесты и Cursor / Claude Code;
- Оболочка продукта (месяц 1): демо должно быть в сети — домен, хостинг, БД выходят за free tier;
- Первые реальные юзеры (месяц 3): API растёт линейно; векторная БД и мониторинг становятся заметны.
Главная боль не «можно ли дешевле», а не знать, какой счёт придёт следующим. Сначала маршрут, потом четыре кошелька.
Три техмаршрута — 80 % счёта
До цифр ответьте: как продукт будет подключать ИИ? Маршрут задаёт всю структуру затрат.
| Маршрут | Кому | Типичный продукт | MVP/мес (порядок) | Главный риск |
|---|---|---|---|---|
| A. Чистая API-обёртка | Новичок, без GPU | Ассистент письма, чатбот, генератор текстов | $55–250 | API растёт с юзерами; тонкая маржа |
| B. API + RAG | Немного бэкенда | База знаний, Q&A по докам, отраслевой копилот | $250–950 | Вектор + хранилище; качество retrieval |
| C. Self-host / локальная модель | Ops или готовность учиться | Приватность, высокая нагрузка, уйти от token | $500–3 200+ | Фикс машин/GPU; качество на вас |
Новичкам — маршрут A. Подключите модель через тарифы OpenAI или тарифы DeepSeek, проверьте логику, потом RAG. Маршрут C (аренда GPU, Ollama / vLLM) обычно имеет смысл, когда API стабильно >$1 400–1 500/мес — раньше это ложная экономия.
Инструменты разработки отдельно: сравнение DeepSeek vs Copilot vs Cursor.
Четыре кошелька: модель, сервер, инструменты, скрытое
Четыре строки в таблице — понятно вам и сооснователям:
| Кошелёк | Что входит | Часто забывают? | Диапазон MVP |
|---|---|---|---|
| ① API модели | Чат, completion, embedding, картинка/голос при необходимости | Редко — но output token недооценивают | $15–520/мес |
| ② Сервер и данные | Хостинг приложения, БД, object storage, вектор, CDN | Да — «Vercel же бесплатный» | $0–260/мес |
| ③ Dev-инструменты | Cursor, Claude Code, Copilot, design SaaS | Часто «личная подписка», не в продукт | $22–130/мес |
| ④ Скрытое | Домен, SSL, SMS/email verify, комиссии, мониторинг, 152-ФЗ/договоры | Чаще всего | $7–75/мес |
① и ② растут с пользователями; ③ в MVP почти фикс; ④ смешивает разовые и ежемесячные. Четыре строки в месяц лучше одной сводки по карте.
Стоимость API в 2026: тарифы и расчёт токенов
API считает токены — фрагменты текста. По-русски ~1–2 токена на слово; обычный Q&A (200 слов ввод, 500 ответ) ≈ 800–1 500 токенов суммарно.
4.1 Ориентиры (за миллион токенов, USD)
Публичные тарифы июль 2026; кэш и batch снижают. Полностью: цены Anthropic и страница цен OpenAI.
| Модель | Ввод ($/1M) | Вывод ($/1M) | Сценарий |
|---|---|---|---|
| DeepSeek V3.2 | $0,14 | $0,28 | Высокий трафик, чувствительность к цене, RU/EN |
| GPT-4.1 Nano | $0,10 | $0,40 | Классификация, теги, короткие ответы |
| Claude Haiku 4.5 | $1,00 | $5,00 | Быстрая поддержка, лёгкий agent |
| GPT-4.1 / GPT-5.4 Mini | $0,40–2,50 | $1,60–12,50 | Общий чат, средняя сложность |
| Claude Sonnet 4 | $3,00 | $15,00 | Reasoning, длинные доки, код |
| Claude Opus 4.6 | $5,00 | $25,00 | Максимум качества, малый объём |
4.2 Быстрая формула
Три числа: DAU D, запросов в день R, токенов на запрос T (ввод + вывод).
Токенов/мес = D × R × T × 30 API ≈ (токены × цена ввода × доля ввода) + (токены × цена вывода × доля вывода) # Пример: 50 DAU, 5 запр/день, 2000 токенов, DeepSeek V3.2 # Токенов/мес = 50 × 5 × 2000 × 30 = 15 000 000 # Ввод/вывод по 50%: ~ $1,05 + $2,10 ≈ $3,15/мес # Та же нагрузка на Claude Sonnet: ~ $67 + $112 ≈ $180/мес
Один продукт, разница в счёте в 50 раз — норма. Правило MVP: Mini / Haiku / DeepSeek для простого, апгрейд только при тупике. Agent-циклы взрывают T — читайте разбор счёта эпохи агентов.
Сервер и инфра: когда уходить с free tier
«Сервер» — всё, что делает приложение доступным 24/7. Типичный стек 2026:
- Фронт + serverless API: Vercel / Cloudflare Pages — MVP часто бесплатно, потом $22–110/мес;
- VPS: зарубежные или локальные провайдеры — $6–28/мес, админка на вас;
- Managed БД: Supabase / Neon free → при нагрузке $11–48/мес;
- Вектор (маршрут B): Pinecone free ограничен; прод часто $32–190/мес или pgvector в Postgres;
- Object storage: мелкие загрузки копейки — не забывайте egress.
Сигналы апгрейда: медленные API, лимит соединений БД, письмо о перерасходе Vercel. GPU в день один не нужен — это маршрут C.
Три фазы: неделя 1 / месяц 1 / месяц 3
Неделя 1: проверить идею ($0–70)
Цель: пройти core flow сами. Кредит API ($5–20) + опционально Cursor Pro (~$20/мес). Сервер необязателен — локально + ngrok.
Месяц 1: MVP для шаринга ($70–420)
Цель: ссылка для друзей. Домен (~$12/год), Vercel, Supabase, верификация email/SMS. При 10 beta и DeepSeek API может быть <$12.
Месяц 3: маленький публичный тест ($260–1 400)
Цель: 50–500 реальных пользователей. API линейно; при RAG — embedding и вектор; мониторинг (Sentry). Сейчас же ставьте месячный hard limit на API.
Три уровня: ~$70 / ~$420 / $1 400+
Три «портрета» для самооценки:
| Уровень | Кому | Маршрут | Месяц (порядок) | Хватает на |
|---|---|---|---|---|
| Старт ~$70 | Side project, solo, <20 тестеров | A чистый API | API $17 + инструменты $38 + хостинг $0–16 + прочее $11 | Демо, фидбек, проверка спроса |
| Рост ~$420 | Серьёзный запуск, 2–3 человека | A или лёгкий B | API $105 + сервер $72 + инструменты $105 + прочее $52 + запас $86 | ~100 юзеров, простой RAG, мониторинг |
| Масштаб $1 400+ | Платящие клиенты, SLA | B или mix C | API/инференс $560 + инфра $410 + инструменты $185 + комплаенс $265 | 1 000+ юзеров, enterprise POC, multi-env |
Скачок Старт → Рост редко из-за сервера — чаще из-за объёма API и включения RAG/agent. Перед масштабом: покрывает ли платящий юзер свой маржинальный API?
Семь способов сэкономить новичку
- Роутинг моделей: классификация на Mini/DeepSeek, Sonnet только при необходимости — минус 40–85 % API;
- Кэш промпта: повторяющийся system prompt — до ~90 % ввода у OpenAI/Anthropic;
- Ограничить
max_tokens: особенно в agent-сценариях; - Hard limit + почтовый алерт в консоли API — обязательно;
- Без вектора рано: мало доков — часто хватает context;
- Один основной dev-инструмент: не Cursor и Claude Code full параллельно;
- Отложить self-host: когда API стабильно >$1 400/мес три месяца.
Пять типичных бюджетных ловушек
- Путать агентство и месячный бюджет: внешний MVP часто $15–40k разово — не $70/мес;
- Free tier навсегда: после trial — pay-as-you-go, ставьте лимит;
- Бесконечный agent-цикл: один клик → 15 вызовов модели, счёт экспоненциальный;
- Игнор 152-ФЗ и хранения данных: B2B в РФ спросит локализацию и договор — время + тариф;
- Купить Mac/GPU «на будущее»: до валидации хватит API + free hosting; железо после стабильного workflow — см. архитектура personal AI agent.
FAQ
В1: Абсолютный минимум в месяц?
С API + free hosting и solo-beta часто $60–70/мес (с ассистентом кода). Только trial-кредиты ≈ почти $0 на неделе 1 — без реального трафика.
В2: API или сервер — что дороже?
В MVP (<100 юзеров) обычно 50–70 % — API. После ~1 000 или с RAG инфра до 30–40 %.
В3: Нужно ли уметь кодить?
Cursor / Claude Code в 2026 помогают — но деплой, лимиты и отладка требуют базы. No-code возможен, часто дороже и менее гибок.
В4: Только DeepSeek — хватит?
Для многих RU-сценариев да. Для топ-reasoning, длинных контрактов или EN legal — основная + upgrade-модель.
В5: Когда уходить с API на self-host?
Когда три условия: API >$1 400/мес три месяца подряд, модель зафиксирована, есть кто ведёт GPU/ops. Иначе API.
В6: Отличие от обычного app-MVP?
Классическое приложение <$22/мес хостинга возможно. AI-продукт — переменная стоимость модели на использование; pricing и мониторинг с первого дня.
В7: Сколько резерва?
Минимум 3 месяца уровня Рост (~$1 260) без зарплат. Буфер на вирусный всплеск и отладку agent.
После валидации: считайте dev-среду
В четырёх кошельках ③ инструменты + always-on dev-машина недооценивают. iOS-клиент, локальный agent (OpenClaw / Claude Code) или macOS-only toolchain: покупка Mac mini — тяжёлый capex; облачный Mac mini посуточно делает фикс переменным — pivot без долга по железу. Apple Silicon удобен и для отладки локальных малых моделей.
Если AI-MVP уходит с ноутбука в совместную среду: Nuvcloud Mac mini M4 для dev и agent-sandbox — смотреть цены, или практика OpenHuman облачный Mac для оценки always-on agent.