Orchestrateur
DeepSeek V4 Flash
Décide qui fait quoi. Pas cher, rapide, toujours allumé.
coût relatif · basGUIDE SIMPLE · JUILLET 2026
Prix, points forts, et pour quoi chacune sert vraiment. Expliqué clairement, même si tu démarres de zéro.
Un token, c’est un petit bout de texte (environ un morceau de mot). Les prix sont donnés
pour 1 million de tokens : imagine un très gros roman.
Lire (ce que tu envoies) coûte souvent moins cher que
écrire (ce que l’IA répond). Plus le chiffre est bas, moins tu paies.
FILTRER PAR BESOIN
RIEN NE CORRESPOND · ESSAIE UN AUTRE FILTRE
Tu dis ce que tu veux faire. On te dit quoi utiliser, et pourquoi. Simple.
L’erreur classique : coller le même modèle premium partout (souvent un Opus) parce que « c’est le meilleur ». Sur un agent qui boucle, tu crames le budget pour rien. Voici mon mapping concret sur un système de prospection.
Cheap / rapide pour le volume. Premium seulement quand la qualité de sortie change vraiment le résultat.
Dès qu’une étape a des conséquences (lead retenu, mail qui part), j’ai une validation humaine. Pas pour tout refaire : juste dire oui / non, et corriger quand il le faut. Contrairement à ce qu’on croit, c’est un gain de temps de ouf. L’agent bosse. Toi tu pilotes.
DeepSeek V4 Flash
Décide qui fait quoi. Pas cher, rapide, toujours allumé.
coût relatif · basDeepSeek V4 Flash
Scraping, boucles, beaucoup d’appels. Peu de valeur par call. Autopilote.
coût relatif · basDeepSeek V4 Flash
Trier, noter, écarter le bruit. Toujours du volume.
coût relatif · basHumain · oui / non (+ retouches)
Le scoring a une vraie conséquence : qui entre dans le pipeline. Tu valides. Tu modifies si besoin. Tu ne reconstrues pas la liste.
DeepSeek V4 Flash
Choisir la suite du parcours. Pas besoin d’un cerveau premium.
coût relatif · basClaude Sonnet 5
DeepSeek est faible en vrai mail. Ici la qualité de sortie compte : on monte en gamme.
coût relatif · haut (mais rare)Humain · oui / non (+ retouches)
Conséquence max : le mail part chez le prospect. Tu dis oui, non, ou tu ajustes deux phrases. L’agent a déjà fait 90 % du taf.
Pipeline Flash · mail Sonnet · OK humain
Cohérent, contrôlé, et pas une facture de ouf.
Autre setup : un seul chat. Tu tapes. Derrière, des règles simples (ou une petite IA routeur) choisissent le modèle. Si la réponse est pourrie, rollback : on remonte d’un cran vers l’IA du dessus.
Commencer cheap. Escalader seulement quand la sortie n’est pas ouf. Tu paies le premium en secours, pas en défaut.
Une seule interface
Tu parles à « le chat ». Tu ne choisis pas le modèle à la main. Le système lit la demande et route.
Flash (micro-classif) ou if / else
D’abord des règles bêtes et efficaces. Sinon une petite IA qui classe le prompt (code, écriture, analyse, blabla).
Du moins cher au plus fort
On attaque en bas. On grimpe seulement si besoin.
Check auto ou « meh » humain
Si la sortie est faible (score auto, ou toi qui dis non), on ne recommence pas au même niveau. On remonte d’un cran sur l’échelle et on régénère. Une seule fois, ou jusqu’à L4 max.
Humain · déclenche le rollback
Sur les trucs qui comptent, tu valides. « Non » = remonter d’un niveau. Tu ne réécris pas tout : tu pilotes l’échelle.
Bon niveau · coût maîtrisé
La plupart des prompts restent en L1 / L2. Le premium ne sort que quand le bas de l’échelle a échoué.