Fine-tuning vs RAG vs prompt engineering : que choisir pour ton cas ?
Fine-tuning, RAG ou prompt engineering ? Tableau de décision, coûts réels, cas terrain. 90% du temps...
Le prompt engineering est la pratique qui consiste à formuler, structurer et tester les instructions envoyées à un modèle de langage pour en obtenir un résultat fiable et reproductible. Un prompt n'est rien d'autre que le texte de la demande, mais sa rédaction relève d'un travail de conception, pas d'une formule magique.
La comparaison la plus parlante est celle du briefing donné à un collaborateur compétent et rapide, mais qui ne connaît ni votre entreprise ni le contexte de la demande, et qui oublie tout entre deux échanges. Tout ce que vous ne dites pas, il le comble de façon plausible.
À modèle égal, l'écart entre une consigne vague et une consigne cadrée se lit directement dans le taux d'erreur. Pour l'extraction d'informations dans des courriels, la classification de demandes entrantes ou la rédaction sous contrainte, c'est le levier le moins cher et le plus immédiat : aucune infrastructure à modifier, un effet mesurable en quelques essais.
Le premier est le prompt qui grossit sans fin, où chaque incident ajoute une phrase jusqu'à rendre l'ensemble contradictoire. Le deuxième est l'absence de jeu de test : on corrige un cas, on en casse trois, et personne ne s'en aperçoit. Le troisième est l'injection d'instructions, lorsque le texte d'un utilisateur ou d'un document se retrouve collé aux consignes et peut les détourner, ce qui impose de séparer nettement les deux et de ne jamais accorder de confiance au contenu reçu. Le quatrième est la dépendance à une version de modèle, un changement de version pouvant modifier le comportement sans prévenir.
Le prompt engineering traite les problèmes de formulation, pas les problèmes de connaissance. Si le modèle ignore vos documents, il faut les lui fournir par une recherche documentaire plutôt que réécrire l'instruction pour la dixième fois. Et si la règle à appliquer est déterministe, une condition écrite dans du code sera toujours plus fiable, plus rapide et moins chère qu'une demande adressée à un modèle.
Un LLM, ou grand modèle de langage, est un programme entraîné sur d'énormes volumes de textes pour ...
Un agent IA est un système autonome piloté par un modèle de langage, capable de raisonner, de chois...
Le NLP (Natural Language Processing), ou traitement automatique du langage naturel, est le domaine ...
Un persona est le portrait fictif mais documenté d'un utilisateur type, construit à partir d'élémen...
Un prototype est une version simulée et cliquable d'un produit numérique : on navigue d'un écran à ...
Une PWA, ou application web progressive, est un site web qui utilise des technologies navigateur st...