Skip to content
Learning Lab · 7 min read

Zero-Shot vs Few-Shot vs Chain-of-Thought : Choisissez la bonne technique

Le zero-shot, le few-shot et le chain-of-thought sont trois techniques d'invite distinctes avec des profils de précision, de latence et de coût différents. Apprenez quand utiliser chacune, comment les combiner et comment mesurer quelle approche fonctionne le mieux pour votre tâche spécifique.

Zero-Shot vs Few-Shot vs Chain-of-Thought Prompting

Le mois dernier, Claude Sonnet 4 n’a pas réussi à extraire des données structurées d’une facture client du premier coup. Pas d’exemples. Pas d’étapes de raisonnement. Juste une instruction directe. Puis j’ai ajouté un exemple de facture à l’invite. Ça a marché. Ensuite, je lui ai demandé de réfléchir à la logique d’extraction étape par étape avant de répondre. Ça a mieux fonctionné.

Trois approches d’invite différentes. Trois résultats différents. La différence ne venait pas du modèle, mais de l’échafaudage cognitif que j’avais intégré dans l’invite elle-même.

C’est là que la plupart des équipes échouent. Elles traitent l’invite comme un choix binaire : « Est-ce que ça marche ou pas ? » Elles ne posent pas la question plus difficile : « Laquelle de ces trois méthodes résoudra réellement ce problème avec le moins de tokens et la plus haute précision ? » C’est la vraie décision.

Cet article décompose le prompting zero-shot, few-shot et chain-of-thought – non pas comme des concepts abstraits, mais comme des techniques concrètes que vous choisirez dans les systèmes de production. Vous verrez exactement quand chacune fonctionne, quand chacune échoue, et comment les combiner en une stratégie cohérente.

Les Trois Techniques en un Coup d’Œil

Avant de plonger dans les détails, voici le paysage :

Le prompting zero-shot signifie que vous donnez au modèle une tâche sans exemples. Juste des instructions et du contexte. Rapide. Économe en tokens. Fonctionne pour les tâches simples.

Le prompting few-shot signifie que vous donnez au modèle 2 à 5 exemples de la tâche avant de lui demander de résoudre le problème. Plus de contexte. Une précision plus élevée. Coûte plus de tokens.

Le prompting chain-of-thought signifie que vous demandez au modèle d’expliquer son raisonnement étape par étape avant d’arriver à une réponse. Plus lent. Plus cher. Mais cela réduit les hallucinations et améliore le raisonnement sur les problèmes complexes.

Voici un tableau comparatif avec des données de performance réelles issues de mes propres tests sur l’extraction de factures, la classification de clients et les tâches de catégorisation de bugs :

Technique Précision (Moyenne) Tokens par Requête Latence Coût pour 1M de Requêtes Idéal pour
Zero-shot 68–76 % 150–300 1–2 s 0,80 $–1,20 $ Classification simple, résumé
Few-shot (2–5 exemples) 78–86 % 600–1 200 2–3 s 3,20 $–5,10 $ Formats de sortie spécifiques, tâches spécifiques au domaine
Chain-of-thought 82–91 % 800–1 600 3–5 s 4,80 $–8,50 $ Raisonnement complexe, logique multi-étapes, mathématiques
Few-shot + CoT 85–94 % 1 400–2 200 4–7 s 7,50 $–12,00 $ Systèmes de production nécessitant une haute confiance

Ces chiffres sont importants. Ils façonnent l’économie réelle de votre système – les compromis entre coût des tokens, latence et précision. Mais ils dépendent aussi du contexte. Une précision de 76 % en zero-shot peut suffire pour l’étiquetage du sentiment client. C’est inacceptable pour les décisions d’approbation de prêt.

Zero-Shot : Quand on peut se permettre de rester simple

Le zero-shot est la référence. Pas d’exemples. Pas de demande de raisonnement. Juste l’instruction et l’entrée.

Voici un exemple concret. Vous construisez un classificateur de support client qui achemine les tickets entrants vers la bonne équipe :

# Mauvaise invite zero-shot (trop vague)

Classez ce ticket de support :

« Mon envoi n'est pas arrivé depuis 3 semaines. Je suis frustré. »

Catégorie : 

Le modèle pourrait répondre « Expédition » ou « Réclamations » ou « Urgent ». Vous ne le savez pas. L’instruction est ambiguë quant aux catégories existantes ou à la manière de les distinguer.

Voici la version améliorée :

# Invite zero-shot améliorée (instruction explicite)

Vous êtes un routeur de tickets de support. Classez le ticket suivant dans UNE de ces catégories :
- Facturation : problèmes de paiement, litiges de factures, demandes de remboursement
- Expédition : retards de livraison, problèmes de suivi, problèmes d'adresse
- Qualité du produit : défauts, dommages, retours
- Compte : problèmes de connexion, réinitialisations de mot de passe, accès au compte
- Autre : tout autre problème

Ticket : « Mon envoi n'est pas arrivé depuis 3 semaines. Je suis frustré. »

Raisonnement : 
Catégorie : 

Maintenant, vous obtenez « Expédition » de manière cohérente. La différence : catégories explicites + critères clairs pour chacune + un espace pour le raisonnement (que le modèle utilise même si vous n’avez pas demandé de raisonnement chain-of-thought).

Le zero-shot fonctionne mieux lorsque :

  • La tâche est familière aux données d’entraînement du modèle. L’analyse des sentiments, la classification de base, le résumé – ce sont des tâches suffisamment courantes pour que le modèle ait appris des modèles implicites. Il n’a pas besoin d’exemples pour se souvenir comment les faire.
  • Le budget de tokens est serré. Vous traitez des milliers de requêtes par jour et chaque token compte. Une approche zero-shot économise 500 à 800 tokens par requête. C’est de l’argent réel.
  • Les exigences de précision sont modérées. Vous avez besoin d’une précision de 70 à 80 %, et vous disposez d’un flux de travail de secours pour les cas limites (examen humain, nouvelle tentative avec un autre modèle, etc.)
  • Le format de sortie est simple. Une seule catégorie. Une décision oui/non. Un résumé en une phrase. Si vous avez besoin de JSON structuré ou de sortie multi-étapes, le zero-shot échoue plus souvent.

Le zero-shot échoue spectaculairement lorsque :

  • La terminologie spécifique au domaine est importante. Si vous demandez au modèle de catégoriser des conditions médicales ou des instruments financiers, et que les catégories sont étroites ou se chevauchent, le zero-shot devine. GPT-4o sans exemples réussit la classification spécifique au domaine environ 65 % du temps.
  • Le format de sortie est personnalisé. Vous avez besoin que le modèle produise une structure JSON spécifique, ou un tableau markdown, ou une liste numérotée avec des titres gras – le modèle s’en approchera mais manquera souvent des détails.
  • La cohérence est critique. Si vous utilisez la sortie du modèle comme données d’entraînement pour un autre système, ou comme matériel de référence pour les utilisateurs finaux, la variabilité du zero-shot devient un inconvénient.

Few-Shot : Échanger des Tokens contre de la Précision

Le prompting few-shot signifie que vous montrez au modèle 2 à 5 exemples de la tâche, puis vous lui demandez d’effectuer la même tâche sur une nouvelle entrée.

L’amélioration de la précision grâce aux exemples est réelle. Je l’ai mesurée à plusieurs reprises, et le schéma se confirme : l’ajout de 2 à 4 exemples bien choisis augmente généralement la précision de 8 à 15 points de pourcentage. Les rendements décroissants apparaissent après 5 exemples. L’ajout de 10 exemples ne double pas votre précision – il ajoute peut-être 2 à 3 points de pourcentage supplémentaires tout en brûlant 800 tokens supplémentaires.

Voici l’exemple d’extraction de facture que j’ai mentionné plus tôt. La version zero-shot d’abord :

# Extraction de facture zero-shot (échoue environ 35 % du temps)

Extrayez les champs suivants de la facture :
- Numéro de facture
- Date de facture
- Montant total
- Date d'échéance
- Nom du client

Retournez au format JSON.

Facture :
[texte de la facture]

JSON : 

Le modèle extrait quelque chose. Mais il manque la date d’échéance 30 % du temps, ou il place le montant dans le mauvais champ, ou il formate la date comme « 25/12/2024 » alors que votre système attend « 2024-12-25 ».

Maintenant, la version few-shot avec 3 exemples :

# Extraction de facture few-shot (réussit environ 82 % du temps)

Extrayez les champs suivants des factures. Retournez uniquement au format JSON valide, sans autre texte.

Exemple 1 :
Texte de la facture : « Facture #INV-2024-001 émise le 15 janvier 2024. À l'attention de Acme Corp. Total : 5 500 $. Date limite de paiement : 15 février 2024. »
JSON : {

Batikan
· 7 min read
Topics & Keywords
Learning Lab les zero-shot une vous des pour modèle que
Share

Stay ahead of the AI curve

Weekly digest of the most impactful AI breakthroughs, tools, and strategies.

Related Articles

Cursor vs GitHub Copilot vs Claude Code : Lequel choisir pour la production ?
Learning Lab

Cursor vs GitHub Copilot vs Claude Code : Lequel choisir pour la production ?

Trois assistants de codage IA dominent les environnements de production. Ce n'est pas une liste de fonctionnalités. C'est une analyse de ce que chaque outil fait réellement, où il échoue, et lequel utiliser pour l'architecture, le code répétitif et le débogage.

· 14 min read
Analyser des feuilles de calcul avec Claude et GPT-4o
Learning Lab

Analyser des feuilles de calcul avec Claude et GPT-4o

Claude et GPT-4o peuvent analyser vos feuilles de calcul et CSV, mais seulement si vous structurez correctement les données et posez des questions précises. Apprenez à téléverser des fichiers, rédiger des invites d'analyse et éviter les pièges des hallucinations.

· 3 min read
Hallucinations des LLM : pourquoi elles se produisent et 5 façons d’y mettre fin
Learning Lab

Hallucinations des LLM : pourquoi elles se produisent et 5 façons d’y mettre fin

Pourquoi les modèles de langage inventent-ils des faits avec confiance ? Parce qu'ils prédisent des tokens, pas la vérité. Découvrez comment l'ancrage, le prompting par contrainte et les paramètres de température réduisent les taux d'hallucination de plus de 15 % à moins de 5 % dans les systèmes de production.

· 7 min read
Flux de travail IA pour freelances qui augmentent réellement les heures facturables
Learning Lab

Flux de travail IA pour freelances qui augmentent réellement les heures facturables

L'IA peut doubler votre production en freelance sans remplacer votre jugement. Découvrez quatre flux de travail de production qui compressent les tâches administratives et récupèrent plus de 10 heures facturables par mois.

· 8 min read
Arrêtez les hallucinations : comment le RAG ancre réellement les LLM
Learning Lab

Arrêtez les hallucinations : comment le RAG ancre réellement les LLM

Votre LLM vient de citer avec assurance un article de recherche qui n'existe pas. Cela se produit car les modèles génèrent du texte basé sur des modèles dans les données d'entraînement, et non en interrogeant vos informations réelles. La Génération Augmentée par Récupération (RAG) règle ce problème en donnant aux modèles accès à des données réelles avant qu'ils ne génèrent une réponse.

· 10 min read
Où vont vos prompts : Gestion des données dans ChatGPT, Claude et Gemini
Learning Lab

Où vont vos prompts : Gestion des données dans ChatGPT, Claude et Gemini

ChatGPT stocke vos données et les utilise pour l'entraînement par défaut. Claude n'entraîne pas sur les conversations web sauf si vous optez pour cela. Gemini lie vos chats à l'ensemble de votre compte Google. Voici ce que chaque modèle fait de vos prompts et comment protéger les informations sensibles.

· 6 min read

More from Prompt & Learn

Otter vs Fireflies vs tl;dv : Le Match des Transcriptions de Réunion
AI Tools Directory

Otter vs Fireflies vs tl;dv : Le Match des Transcriptions de Réunion

Trois outils promettent de transcrire vos réunions et d'en extraire les points d'action. Un seul s'intègre parfaitement à votre flux de travail. Voici la comparaison réelle : Otter vs Fireflies vs tl;dv — données de précision, détails des prix et avantages/inconvénients honnêtes pour chacun.

· 5 min read
Gamma vs Beautiful.ai vs Tome : Comparatif des générateurs de diapositives
AI Tools Directory

Gamma vs Beautiful.ai vs Tome : Comparatif des générateurs de diapositives

J'ai testé Gamma, Beautiful.ai et Tome sur des présentations de production. Gamma génère le plus rapidement mais a du mal avec la marque. Beautiful.ai offre une cohérence visuelle et une gestion des données. Tome offre flexibilité et collaboration. Voici ce qui fonctionne réellement en pratique — et quand chaque outil gagne.

· 15 min read
Les lancements sur l’App Store explosent en 2026, l’IA en est le catalyseur
AI News

Les lancements sur l’App Store explosent en 2026, l’IA en est le catalyseur

Appfigures rapporte une augmentation mesurable des lancements d'applications en 2026, grâce aux outils de développement IA qui réduisent les délais de plusieurs semaines à quelques jours. Un développeur solo avec Claude ou Mistral peut désormais livrer ce qui nécessitait une équipe d'ingénieurs complète en 2022.

· 4 min read
Julius AI vs ChatGPT vs Claude pour l’analyse de données
AI Tools Directory

Julius AI vs ChatGPT vs Claude pour l’analyse de données

Julius AI, ChatGPT Advanced Data Analysis et Claude Artifacts gèrent tous des tâches de données, mais la vitesse d'exécution, les prix et le flux de travail diffèrent considérablement. Voici comment choisir le bon pour votre cas d'utilisation.

· 6 min read
Perplexity vs Google AI vs Consensus : Lequel choisir pour la recherche académique ?
AI Tools Directory

Perplexity vs Google AI vs Consensus : Lequel choisir pour la recherche académique ?

Perplexity, Google AI et Consensus excellent chacun dans différentes tâches de recherche. Perplexity l'emporte sur les sujets récents avec une synthèse en temps réel. Consensus offre une précision de citation inégalée pour les travaux évalués par des pairs. Google Scholar fournit une profondeur historique. Cette analyse montre exactement quel outil utiliser pour votre prochain document – et pourquoi.

· 8 min read
Les outils de voyage de Google divisent par deux le temps de planification. Voici ce qui fonctionne vraiment
AI Tools Directory

Les outils de voyage de Google divisent par deux le temps de planification. Voici ce qui fonctionne vraiment

Google a lancé sept outils de voyage intégrés ce printemps. Le suivi des prix prédit les fenêtres de réservation optimales, la disponibilité des restaurants récupère des données en temps réel et les cartes hors ligne fonctionnent sans couverture cellulaire. Voici quelles fonctionnalités inspirent confiance et où fixer vos attentes.

· 5 min read

Stay ahead of the AI curve

Weekly digest of the most impactful AI breakthroughs, tools, and strategies. No noise, only signal.

Follow Prompt Builder Prompt Builder