NO.007 / IA
GUIDE DÉBUTANT

GUIDE SIMPLE · JUILLET 2026

Prix, points forts, et pour quoi chacune sert vraiment. Expliqué clairement, même si tu démarres de zéro.

AVANT DE COMMENCER

C’EST QUOI UN « TOKEN » ?

Un token, c’est un petit bout de texte (environ un morceau de mot). Les prix sont donnés pour 1 million de tokens : imagine un très gros roman.

Lire (ce que tu envoies) coûte souvent moins cher que écrire (ce que l’IA répond). Plus le chiffre est bas, moins tu paies.

01 · COMPARATIF

LES IA · PRIX · À QUOI ELLES SERVENT

FILTRER PAR BESOIN

0 · prix en dollars US pour 1 million de tokens · indicatifs

02 · COMMENT CHOISIR

4 RÈGLES SIMPLES

03 · EXEMPLES CONCRETS

JE VEUX… → QUELLE IA PRENDRE

Tu dis ce que tu veux faire. On te dit quoi utiliser, et pourquoi. Simple.

04 · MAPPING A

ROUTAGE AGENT · PROSPECTION

L’erreur classique : coller le même modèle premium partout (souvent un Opus) parce que « c’est le meilleur ». Sur un agent qui boucle, tu crames le budget pour rien. Voici mon mapping concret sur un système de prospection.

RÈGLE

Cheap / rapide pour le volume. Premium seulement quand la qualité de sortie change vraiment le résultat.

HUMAIN DANS LA BOUCLE

Dès qu’une étape a des conséquences (lead retenu, mail qui part), j’ai une validation humaine. Pas pour tout refaire : juste dire oui / non, et corriger quand il le faut. Contrairement à ce qu’on croit, c’est un gain de temps de ouf. L’agent bosse. Toi tu pilotes.

CORE BUDGET

Orchestrateur

DeepSeek V4 Flash

Décide qui fait quoi. Pas cher, rapide, toujours allumé.

coût relatif · bas
01 · COLLECTE BUDGET

Volume & listes

DeepSeek V4 Flash

Scraping, boucles, beaucoup d’appels. Peu de valeur par call. Autopilote.

coût relatif · bas
02 · FILTRAGE BUDGET

Scoring leads

DeepSeek V4 Flash

Trier, noter, écarter le bruit. Toujours du volume.

coût relatif · bas
GATE · CONSÉQUENCE TOI

Validation leads

Humain · oui / non (+ retouches)

Le scoring a une vraie conséquence : qui entre dans le pipeline. Tu valides. Tu modifies si besoin. Tu ne reconstrues pas la liste.

03 · ROUTING BUDGET

Prochaine étape

DeepSeek V4 Flash

Choisir la suite du parcours. Pas besoin d’un cerveau premium.

coût relatif · bas
04 · RÉDACTION PREMIUM

Mail sortant

Claude Sonnet 5

DeepSeek est faible en vrai mail. Ici la qualité de sortie compte : on monte en gamme.

coût relatif · haut (mais rare)
GATE · ENVOI TOI

Validation avant envoi

Humain · oui / non (+ retouches)

Conséquence max : le mail part chez le prospect. Tu dis oui, non, ou tu ajustes deux phrases. L’agent a déjà fait 90 % du taf.

SORTIE

Vers le prospect

Pipeline Flash · mail Sonnet · OK humain

Cohérent, contrôlé, et pas une facture de ouf.

05 · MAPPING B

ROUTAGE CHAT · PROMPT COMPLET

Autre setup : un seul chat. Tu tapes. Derrière, des règles simples (ou une petite IA routeur) choisissent le modèle. Si la réponse est pourrie, rollback : on remonte d’un cran vers l’IA du dessus.

IDÉE

Commencer cheap. Escalader seulement quand la sortie n’est pas ouf. Tu paies le premium en secours, pas en défaut.

01 · ENTRÉE CHAT

Prompt utilisateur

Une seule interface

Tu parles à « le chat ». Tu ne choisis pas le modèle à la main. Le système lit la demande et route.

02 · ROUTEUR BUDGET

Règles simples + IA décideur

Flash (micro-classif) ou if / else

D’abord des règles bêtes et efficaces. Sinon une petite IA qui classe le prompt (code, écriture, analyse, blabla).

SI python / code / bug / script → DeepSeek Flash
SI mail / pitch / copy longue → Claude Sonnet
SI doc long / multimodal → Gemini Flash
SINON le routeur IA choisit → défaut Flash
03 · LADDER NIVEAUX

Échelle de modèles

Du moins cher au plus fort

On attaque en bas. On grimpe seulement si besoin.

  1. L1
    DeepSeek V4 Flash défaut · volume · code simple
  2. L2
    Gemini 2.5 Flash docs / contexte large / rapide
  3. L3
    Claude Sonnet 5 qualité texte · raisonnement propre
  4. L4
    Claude Opus / flagship dernier recours · cher
04 · ROLLBACK ↑ UP

Réponse pas ouf → IA du dessus

Check auto ou « meh » humain

Si la sortie est faible (score auto, ou toi qui dis non), on ne recommence pas au même niveau. On remonte d’un cran sur l’échelle et on régénère. Une seule fois, ou jusqu’à L4 max.

GATE · OPTIONNEL TOI

Oui / non sur la réponse

Humain · déclenche le rollback

Sur les trucs qui comptent, tu valides. « Non » = remonter d’un niveau. Tu ne réécris pas tout : tu pilotes l’échelle.

SORTIE

Réponse dans le chat

Bon niveau · coût maîtrisé

La plupart des prompts restent en L1 / L2. Le premium ne sort que quand le bas de l’échelle a échoué.