«Je veux lancer un produit IA — il faut prévoir combien ?» C’est la question qu’on entend chez les PM, indie hackers et porteurs de side project. La réponse habituelle — « ça dépend » — est vraie mais inutile si vous ne savez pas quels postes apparaîtront sur la facture.
En 2026, le paradoxe est net : les API de modèles ont beaucoup baissé (souvent 60 à 80 % de baisse en 18 mois chez les grands acteurs), mais « un produit IA en ligne » coûte plus qu’une ligne OpenAI. Hébergement, recherche vectorielle, outils dev, domaine, frais de paiement — chaque ligne arrive à un moment différent. Ce guide s’adresse aux lecteurs sans bagage ML qui veulent un MVP démontrable depuis zéro, avec « quatre enveloppes + trois phases + trois paliers ». Si vous avez déjà une équipe, comparez coût serveurs la première année ; pour les 100 premiers utilisateurs, voir problèmes des 100 premiers utilisateurs.
L’opacité coûte plus cher que le prix
Beaucoup de débutants n’imaginent qu’une ligne : l’API OpenAI ou Anthropic. De l’idée au lien partageable, au moins quatre types de dépenses interviennent — à des moments distincts :
- Validation (semaine 1) : vous êtes le seul utilisateur. API d’essai + Cursor / Claude Code ;
- Coque produit (mois 1) : la démo doit être publique — domaine, hébergement, base de données au-delà du free tier ;
- Premiers vrais users (mois 3) : l’API grimpe par tête ; vecteur et monitoring deviennent visibles.
Le vrai blocage n’est pas « peut-on payer moins », mais ne pas savoir quelle facture arrive ensuite. Choisissez d’abord la voie technique, puis ouvrez les quatre enveloppes.
Trois voies techniques — 80 % de la facture
Avant les chiffres : comment votre produit branchera-t-il l’IA ? La voie fixe toute la structure de coûts.
| Voie | Pour qui | Produit type | Mois MVP (ordre) | Risque principal |
|---|---|---|---|---|
| A. Enveloppe API pure | Débutant, zéro GPU | Assistant rédaction, chatbot, générateur | 60–280 $ | API suit les users ; marge fine |
| B. API + RAG | Un peu de backend | Base de connaissances, Q&R docs, copilote vertical | 280–1 000 $ | Vecteur + stockage ; qualité retrieval |
| C. Self-host / modèle local | Ops ou envie d’apprendre | Confidentialité, fort volume, fuir le token | 550–3 500 $+ | Coût machine fixe ; qualité à votre charge |
Débutants : voie A. Branchez un modèle via tarifs OpenAI ou tarifs DeepSeek, validez la logique, puis RAG. La voie C (GPU, Ollama / vLLM) vaut souvent le coup quand la facture API dépasse ~1 500 $/mois plusieurs mois — avant, c’est du faux économie.
Séparez outils et produit : comparatif DeepSeek vs Copilot vs Cursor.
Quatre enveloppes : modèle, serveur, outils, caché
Quatre lignes sur votre tableur — clair pour vous et vos associés :
| Enveloppe | Contenu | Oubli fréquent ? | Fourchette MVP |
|---|---|---|---|
| ① API modèle | Chat, complétion, embedding, image/voix si besoin | Rare — mais output token sous-estimé | 20–550 $/mois |
| ② Serveur & données | Hébergement app, BDD, stockage objet, vecteur, CDN | Oui — « Vercel reste gratuit » | 0–280 $/mois |
| ③ Outils dev | Cursor, Claude Code, Copilot, design SaaS | Souvent « abo perso », pas au produit | 25–140 $/mois |
| ④ Frais cachés | Domaine, SSL, SMS/email verify, frais Stripe, monitoring, RGPD | Le plus souvent | 8–80 $/mois |
① et ② suivent la croissance ; ③ est fixe en MVP ; ④ mélange one-shot et mensuel. Quatre lignes par mois valent mieux qu’une seule carte bancaire.
Coût API 2026 : tarifs et calcul token
Facturation au token — morceaux de texte. En français, ~1 token par mot ; une Q&R classique (200 mots in, 500 out) ≈ 800–1 500 tokens.
4.1 Référence (par million de tokens, USD)
Tarifs publics juillet 2026 ; cache et batch peuvent réduire. Détail : tarifs Anthropic et page tarifs OpenAI.
| Modèle | Entrée ($/1M) | Sortie ($/1M) | Usage |
|---|---|---|---|
| DeepSeek V3.2 | 0,14 $ | 0,28 $ | Fort trafic, sensible au coût |
| GPT-4.1 Nano | 0,10 $ | 0,40 $ | Classification, tags, réponses courtes |
| Claude Haiku 4.5 | 1,00 $ | 5,00 $ | Support rapide, agent léger |
| GPT-4.1 / GPT-5.4 Mini | 0,40–2,50 $ | 1,60–12,50 $ | Chat général, complexité moyenne |
| Claude Sonnet 4 | 3,00 $ | 15,00 $ | Raisonnement, longs docs, code |
| Claude Opus 4.6 | 5,00 $ | 25,00 $ | Qualité max, faible volume |
4.2 Formule rapide
Trois nombres : DAU D, requêtes/jour R, tokens/requête T (entrée + sortie).
Tokens/mois = D × R × T × 30 API ≈ (tokens × prix entrée × part entrée) + (tokens × prix sortie × part sortie) # Exemple : 50 DAU, 5 req/j, 2000 tokens, DeepSeek V3.2 # Tokens/mois = 50 × 5 × 2000 × 30 = 15 000 000 # Entrée/sortie 50/50 : ~ 1,05 $ + 2,10 $ ≈ 3,15 $/mois # Même charge avec Claude Sonnet : ~ 67 $ + 112 $ ≈ 180 $/mois
Même produit, facture ×50 — banal. Règle MVP : Mini / Haiku / DeepSeek pour le simple, upgrade seulement si bloqué. Les boucles agent font exploser T — lisez décomposition facture ère agent.
Serveur & infra : quand quitter le gratuit
« Serveur » = tout ce qui rend votre app accessible 24 h/24. Stack courante 2026 :
- Front + API serverless : Vercel / Cloudflare Pages — souvent gratuit en MVP, puis 25–120 $/mois ;
- VPS : OVH, Scaleway — 6–30 $/mois, admin manuelle ;
- BDD managée : Supabase / Neon free → puis 12–50 $/mois ;
- Vecteur (voie B) : Pinecone free limité ; prod souvent 35–200 $/mois, ou pgvector ;
- Stockage objet : uploads peu chers — ne négligez pas l’egress.
Signaux d’upgrade : lenteur API, limite connexions BDD, mail de dépassement Vercel. Pas de GPU au jour 1 — c’est la voie C.
Trois phases : semaine 1 / mois 1 / mois 3
Semaine 1 : valider l’idée (0–70 $)
Objectif : parcourir le flux vous-même. Crédit API ($5–20) + Cursor Pro optionnel (~20 $/mois). Pas d’hébergement obligatoire — local + ngrok.
Mois 1 : MVP partageable (70–420 $)
Objectif : lien pour amis. Domaine (~12 $/an), Vercel, Supabase, vérif email/SMS. Avec 10 beta users et DeepSeek, l’API peut rester <15 $.
Mois 3 : petit test public (280–1 400 $)
Objectif : 50–500 vrais utilisateurs. API linéaire ; RAG = embedding + vecteur ; monitoring (Sentry). Posez un hard limit mensuel API maintenant.
Trois paliers : ~70 $ / ~420 $ / 1 400 $+
Trois profils pour vous situer :
| Palier | Pour qui | Voie | Mois (ordre) | Permet |
|---|---|---|---|---|
| Starter ~70 $ | Side project, solo, <20 testeurs | A API pure | API 18 $ + outils 40 $ + hébergement 0–18 $ + divers 12 $ | Démo, feedback, validation besoin |
| Croissance ~420 $ | Projet sérieux, 2–3 personnes | A ou B léger | API 110 $ + serveur 75 $ + outils 110 $ + divers 55 $ + marge 70 $ | ~100 users, RAG simple, monitoring |
| Échelle 1 400 $+ | Clients payants, SLA | B ou mix C | API/inférence 580 $ + infra 420 $ + outils 190 $ + conformité 280 $ | 1 000+ users, POC entreprise, multi-env |
Le saut Starter → Croissance vient rarement du serveur — plutôt du volume API et du passage RAG/agent. Avant d’escalader : un client payant couvre-t-il son coût marginal API ?
Sept leviers d’économie pour débutants
- Routage modèle : classification en Mini/DeepSeek, Sonnet seulement si nécessaire — 40–85 % d’API en moins ;
- Cache de prompt : prompts système répétés — jusqu’à ~90 % d’entrée en moins chez OpenAI/Anthropic ;
- Limiter
max_tokens: surtout en scénario agent ; - Hard limit + alerte mail sur la console API — non négociable ;
- Pas de vecteur trop tôt : peu de docs → contexte direct ;
- Un seul outil dev principal : pas Cursor + Claude Code full en parallèle ;
- Reporter le self-host : quand l’API dépasse ~1 500 $/mois de façon stable.
Cinq pièges budgétaires fréquents
- Confondre agence et coût mensuel : MVP externalisé souvent 20–50 k$ — pas 70 $/mois ;
- Free tier éternel : après crédit d’essai, facturation à l’usage — limitez ;
- Boucle agent infinie : un clic → 15 appels modèle, facture exponentielle ;
- Ignorer RGPD et DPA : les clients B2B français demandent hébergement UE et sous-traitance — temps + tarif ;
- Acheter Mac/GPU « pour plus tard » : avant validation, API + hébergement gratuit suffisent — voir architecture agent IA personnel.
FAQ
Q1 : Minimum mensuel absolu ?
Avec API + hébergement gratuit et beta solo, souvent 60–70 $/mois (assistant code inclus). Crédits d’essai seuls ≈ quasi 0 en semaine 1 — sans vrais utilisateurs.
Q2 : API ou serveur — le plus cher ?
En MVP (<100 users), l’API pèse 50–70 %. Au-delà de ~1 000 users ou avec RAG, l’infra monte à 30–40 %.
Q3 : Faut-il savoir coder ?
Cursor / Claude Code aident en 2026 — mais déploiement, limites et debug demandent des bases. No-code possible, souvent plus cher et moins flexible.
Q4 : DeepSeek uniquement — suffisant ?
Pour beaucoup de cas FR oui. Pour raisonnement maximal ou docs juridiques EN : modèle principal + upgrade.
Q5 : Quand passer de l’API au self-host ?
Quand trois conditions : API >1 500 $/mois trois mois d’affilée, modèle stabilisé, quelqu’un pour l’ops GPU. Sinon API.
Q6 : Différence avec une app classique ?
App classique <25 $/mois d’hébergement possible. Produit IA = coût modèle variable par usage — pricing et monitoring dès le jour 1.
Q7 : Combien de réserve ?
Au moins 3 mois palier Croissance (~1 260 $) hors salaires. Tampon pour pic viral et debug agent.
Après validation : comptez l’environnement de dev
Dans les quatre enveloppes, ③ outils + machine dev always-on est sous-estimé. Client iOS, agent local (OpenClaw / Claude Code) ou chaîne macOS : acheter un Mac mini, c’est du capex lourd ; Mac mini cloud à la journée transforme le fixe en variable — pivot sans dette matérielle. Apple Silicon aide aussi pour déboguer de petits modèles locaux.
Pour passer du démo laptop à un environnement collaboratif : Nuvcloud Mac mini M4 pour dev et sandbox agent — voir les tarifs, ou pratique OpenHuman Mac cloud pour estimer un agent always-on.