1. Le monde des APIs d'IA (l'infrastructure invisible)
Pourquoi les APIs et pas seulement les interfaces ?
INTERFACE (chat) API (programme)
─────────────────── ───────────────────
Vous tapez un message Votre code envoie une requête
│ │
v v
Réponse à l'écran Réponse dans votre application
│ │
v v
Usage : 1 personne à la Usage : 1000 clients simultanés,
fois, manuellement 24h/24, automatisé
→ Le business de l'IA vit dans la colonne de droite.
Les grands fournisseurs d'IA par API (2026)
| Fournisseur | Modèles phares | Spécialité | Lien |
|---|---|---|---|
| OpenAI | GPT-5.x, DALL-E, Whisper, Sora | Généraliste, écosystème | platform.openai.com |
| Anthropic | Claude Opus/Sonnet | Texte long, code, agents | console.anthropic.com |
| Gemini 3, Veo | Multimodal, vidéo | ai.google.dev | |
| DeepSeek | V3.x, R1 | Prix imbattables, open weights | platform.deepseek.com |
| Mistral | Mistral Large, Codestral | Européen, souveraineté | console.mistral.ai |
| MiniMax | Hailuo (vidéo), M2 | Vidéo pas chère | platform.minimax.io |
| Kuaishou | Kling 3.0 | Vidéo cinéma | app.klingai.com (API via agrégateurs) |
Comprendre la facturation (le nerf de la guerre)
Prix d'un LLM textuel = par million de tokens (Mtok)
Exemple concret pour résumer 50 pages (~75.000 tokens entrée) :
Modèle Entrée/Mtok Sortie/Mtok Coût du résumé
────────────── ────────── ─────────── ───────────────
DeepSeek V3 ~0,30 $ ~0,90 $ ~0,03 $
GPT-5 mini ~0,40 $ ~1,60 $ ~0,05 $
Claude Sonnet ~3 $ ~15 $ ~0,40 $
Claude Opus ~15 $ ~75 $ ~1,90 $
→ Le même travail coûte 60x moins cher selon le modèle choisi.
→ Règle pro : modèle pas cher pour le volume, modèle premium
pour la qualité finale.
2. Votre première API d'IA (guide pas à pas)
Exemple : appeler DeepSeek en 10 lignes
import requests
response = requests.post(
"https://api.deepseek.com/chat/completions",
headers={
"Authorization": f"Bearer {API_KEY}", # jamais en dur dans le code !
"Content-Type": "application/json"
},
json={
"model": "deepseek-chat",
"messages": [
{"role": "system", "content": "Tu es un assistant commercial français."},
{"role": "user", "content": "Rédige un mail de relance client poli."}
]
}
)
print(response.json()["choices"][0]["message"]["content"])
Anatomie d'un appel LLM :
system: les instructions permanentes (le rôle)user: la demande du momentmodel: quel cerveau utiliser- La réponse arrive dans
choices[0].message.content
Les 3 règles de sécurité des clés API
- Jamais dans le code → variables d'environnement (
.envhors Git) - Jamais dans le chat/mail/vocal → fichier sécurisé sur le serveur (chmod 600)
- Rotation : si une fuite est suspectée, on régénère la clé immédiatement
3. Les modèles vidéo par API (veille 2026, extraits réels)
Ce tableau provient d'une veille réelle menée en octobre 2026 (sources dans l'annexe B) :
| Modèle | Société | Points forts | Prix API |
|---|---|---|---|
| Kling 3.0 / O3 | Kuaishou | 4K, audio natif multi-langue (dont FR), multi-plans | ~0,08-0,11 $/s |
| Hailuo 2.3 / MiniMax H3 | MiniMax | Le moins cher du marché, sujets humains | ~0,28 $/vidéo 1080p |
| Vidu Q3 | ShengShu | Cohérence de personnage, 7 images de référence | ~0,04-0,08 $/s |
| Seedance 2.0 | ByteDance | 9 images de référence, entrée audio | ~0,08-0,10 $/s |
| Wan 2.7 | Alibaba | Open-source (auto-hébergeable, Apache 2.0) | 0,02-0,10 $/s |
| Veo 3.1 | Plafond qualité cinéma (référence non chinoise) | 0,05-0,20 $/s |
Usage concret (One Day studio) : Hailuo pour les drafts sociaux (0,28 $), Kling pour la version finale client (audio FR natif).
4. Architecture d'une solution IA professionnelle
┌────────────────────────────────────────────────────────────┐
│ VOTRE APPLICATION │
│ │
│ ┌─────────┐ ┌──────────────┐ ┌────────────────────┐ │
│ │ Interface│ -> │ Logique métier│ -> │ Base de données │ │
│ │ (web/app)│ │ (votre code) │ │ (PostgreSQL...) │ │
│ └─────────┘ └──────┬───────┘ └────────────────────┘ │
│ │ │
└────────────────────────┼───────────────────────────────────┘
│ (uniquement quand nécessaire)
v
┌─────────────────────┐
│ COUCHE IA (API) │
│ │
│ - LLM (DeepSeek) │ ← le moins cher possible
│ - Vecteurs (pgvector)│ ← pour chercher dans vos docs
│ - Image/Vidéo │ ← au cas par cas (coûteux)
└─────────────────────┘
Règle d'architecture : l'IA est un service externe comme un autre. Votre app doit marcher même si l'IA est lente ou en panne (fallback, cache, file d'attente).
5. RAG : donner ses données à l'IA (le pattern pro n°1)
Le RAG (Retrieval-Augmented Generation) = l'IA répond à partir de VOS documents.
1. VOS DOCUMENTS 2. RECHERCHE 3. GÉNÉRATION
(PDF, pages web, ("quels documents (le LLM répond
bases clients...) parlent de la avec les extraits
│ question ?") trouvés)
v │ │
Découpage en morceaux v v
+ indexation vectorielle "Les pages 3 et 7 "D'après vos
(embeddings) sont pertinentes" documents, ..."
Pourquoi c'est le pattern roi : sans RAG, le LLM invente. Avec RAG, il cite vos sources. C'est la différence entre un stagiaire qui bluffe et un assistant qui a lu vos dossiers.
6. IA et business : monétisation concrète
| Modèle économique | Exemple concret | Marge |
|---|---|---|
| Service augmenté | Agence web qui livre 3x plus vite grâce à l'IA | +50-70 % de marge |
| Produit IA | SaaS de veille automatisée (surveillance, alertes) | Récurrente |
| Formation | Ateliers IA en entreprise (1500-3000 €/jour) | Quasi 100 % |
| Contenu à l'échelle | Pipeline SEO assisté IA (blog bien-être) | Volume |
| Data/API resale | Agrégation de données + enrichissement IA | Récurrente |
7. RGPD et IA : les 5 règles européennes
- Base légale : définir pourquoi vous traitez (consentement, contrat, intérêt légitime)
- Minimisation : ne pas envoyer à l'IA plus que nécessaire
- Transparence : informer les personnes (et parfois mentionner l'usage IA)
- Transfert hors UE : privilégier des hébergeurs européens (Mistral) ou des clauses contractuelles types pour les API US/asiatiques
- Droit à l'effacement : pouvoir supprimer les données d'une personne sur demande
Source : www.cnil.fr/fr/ia/ai-act et le règlement européen AI Act.
8. Exercices
- Créez un compte DeepSeek API, déposez 2 $, et refaites l'appel Python ci-dessus.
- Branchez le résultat dans un webhook n8n (le pont entre module 3 et module 4).
- Construisez un mini-RAG : 3 PDF + embeddings (option pgvector ou service type LangChain).
- Calculez le coût d'un pipeline traitant 1 000 documents/mois avec 2 modèles différents.
9. Points clés
- L'API est le vrai monde pro de l'IA : le choix du modèle est une décision économique.
- RAG = le pattern n°1 pour une IA qui parle de VOS données sans inventer.
- Sécurité des clés : variables d'environnement, jamais dans le code ni le chat.
- L'IA est un service externe : prévoyez fallback et cache.
- RGPD : minimisation + transparence (AI Act en vigueur progressivement).