The AI Forge · Fondation · F2
Recherche et connaissance (RAG)
Ingestion, découpage, embeddings, recherche vectorielle, qualité de la recherche, déployés
- Durée
- 3 jours · 9h00–17h00 chaque jour (19,5 h de contact, pauses et déjeuner inclus)
- Niveau des participants
- Intermédiaire : utilisateurs réguliers de l'IA
- Format
- Ateliers guidés par le formateur, construction en direct
- Participants
- 8 inclus · 12 maximum (taille de groupe flexible)
- Prérequis
- F1 (ou équivalent)
- Écosystème
- Indépendant : tout fournisseur de modèle ou toute stack
- Prix
- 11 500 € (650 € par participant supplémentaire)
Montants en euros, hors taxes.
ai-generatedCe que les participants seront capables de faire
- Concevoir et construire un pipeline RAG de qualité production, de zéro
- Choisir et configurer la base vectorielle adaptée à votre cas d'usage
- Évaluer la qualité de la recherche avec la précision, le rappel et les métriques RAGAS
- Déployer et superviser un système RAG en production
Outils & ressources
Ce qui change après ce module
Les ingénieurs livrent un système de recherche complet et évalué, qui ancre un modèle dans des données réelles, et comprennent les schémas de recherche qui perdurent quand les modèles d'embeddings et les bases vectorielles changent.
À qui s'adresse ce module
Ingénieurs et professionnels de la data. Intermédiaire : utilisateurs réguliers de l'IA.
Programme
Ce programme est indicatif. Le contenu, l'enchaînement et les exemples sont adaptés au contexte, aux outils et aux objectifs de votre équipe.
Avant de commencer
- Un ordinateur portable avec un environnement de développement fonctionnel et les droits administrateur
- La maîtrise d'au moins un langage généraliste (Python et/ou JavaScript/TypeScript)
- Un éditeur ou IDE avec un assistant de code IA validé et activé
- Une clé d'API pour un fournisseur de modèles validé (délivrée par l'entreprise)
- Un dépôt Git et de l'aisance en ligne de commande
- Module F1 suivi, ou niveau équivalent
- Un corpus documentaire réel sur lequel construire (anonymisé si sensible)
| Jour 1 | 9:00–10:30 | Quand ancrer le modèle, et comment: Recherche, fine-tuning ou contexte long ; le pipeline RAG vu comme une suite d'étapes durables, et non comme un framework particulier Atelier : choisissez la bonne approche d'ancrage pour trois cas d'usage réels et justifiez chacune sur le coût, la fraîcheur et l'exactitudeL'un d'eux devient votre cas de construction pour les trois jours. |
| 10:30–10:45 · ☕ Pause café | ||
| Jour 1 | 10:45–12:30 | Ingestion et analyse des documents: Analyse multi-format, nettoyage et métadonnées : la qualité de ce qui entre plafonne tout ce qui suit Atelier : construisez un pipeline d'ingestion qui transforme un corpus multi-format en fragments propres et étiquetés de métadonnées. |
| 12:30–13:30 · 🍽 Pause déjeuner | ||
| Jour 1 | 13:30–15:30 | Stratégies de découpage: Découpage fixe, sémantique, récursif et sensible à la structure ; le recouvrement ; comment choisir selon le type de contenu Atelier : faites passer le même corpus par plusieurs stratégies de découpage et notez la qualité de la recherche pour chacune. |
| 15:30–15:45 · ☕ Pause café | ||
| Jour 1 | 15:45–17:00 | Atelier : pipeline d'ingestion: Consolider l'analyse et le découpage en un pipeline reproductible Atelier : livrez un pipeline d'ingestion, chargez votre corpus prêt pour l'embedding, et rédigez le jeu de référence de 20 questions sur lequel vous évaluerez tout le reste de la construction. |
| Jour 2 | 9:00–10:30 | Embeddings: Ce que sont les embeddings, les arbitrages entre dimension, latence et coût, les enjeux multilingues, et pourquoi on compare par mesure plutôt que par marque Atelier : comparez deux approches d'embedding sur vos données et tranchez sur preuves. |
| 10:30–10:45 · ☕ Pause café | ||
| Jour 2 | 10:45–12:30 | Recherche vectorielle: Indexation, similarité, filtrage par métadonnées et recherche hybride (mots-clés et vecteurs) : des concepts stables d'une base à l'autre Atelier : montez une base vectorielle, indexez vos fragments, et lancez des requêtes hybrides avec filtres de métadonnées. |
| 12:30–13:30 · 🍽 Pause déjeuner | ||
| Jour 2 | 13:30–15:30 | Optimisation de la recherche: Reclassement, réécriture de requête, hypothetical-document embeddings et fusion : c'est là que se gagne l'essentiel de l'exactitude Atelier : ajoutez le reclassement et la réécriture de requête, puis mesurez le gain d'exactitude par rapport à la version naïve. |
| 15:30–15:45 · ☕ Pause café | ||
| Jour 2 | 15:45–17:00 | Atelier : service de recherche: Brancher les embeddings, la base et la recherche en un service Atelier : livrez un service de recherche et mesurez la précision et le rappel sur un jeu de requêtes annoté. |
| Jour 3 | 9:00–10:30 | Génération et ancrage: La conception des prompts pour le RAG, la citation et l'attribution des sources, et la réduction des réponses non ancrées Atelier : ajoutez une génération ancrée avec citations et réduisez les réponses non ancrées sur votre jeu d'évaluation. |
| 10:30–10:45 · ☕ Pause café | ||
| Jour 3 | 10:45–12:30 | Évaluation d'un RAG: Faithfulness, context precision et recall, answer relevance : les métriques RAG qui durent ; la construction du jeu d'évaluation Atelier : construisez une suite d'évaluation RAG et obtenez un score de départ sur la fidélité et la pertinence. |
| 12:30–13:30 · 🍽 Pause déjeuner | ||
| Jour 3 | 13:30–15:30 | Atelier : système RAG complet: De bout en bout : ingestion, embedding, recherche, génération, le tout déployé Atelier : déployez le système RAG complet et interrogez-le en direct sur votre corpus. |
| 15:30–15:45 · ☕ Pause café | ||
| Jour 3 | 15:45–17:00 | Production et revue: Mise en cache, limitation de débit, supervision, coût à l'échelle ; revue par les pairs Atelier : ajoutez la mise en cache et la supervision, puis présentez votre système avec ses chiffres de référence. |
Livrables
- Système RAG déployé et interrogeable
- Pipeline d'ingestion et de découpage
- Service de recherche avec recherche hybride et reclassement
- Suite d'évaluation RAG avec scores de référence
- Notes de production (cache, supervision, coût)
Intéressé par ce module pour votre équipe ? Contactez-nous pour adapter le format, les dates et la modalité à votre contexte.
Demander cette formationVotre formateur
Expert senior
A mis des systèmes RAG en production ; forte expérience de la recherche, du découpage et de l'évaluation
Séance de découverte
Ce module nécessite une journée complète pour offrir une expérience d'apprentissage significative. Nous ne le proposons qu'en version intégrale.
Fait partie d'un parcours plus large
- Enterprise115 000 € · jusqu'à 30 jours de formation
Questions fréquentes
Les modules peuvent-ils être suivis à l'unité ?
Oui. Chaque module se suffit à lui-même, à prix fixe, et compte dans un programme si vous poursuivez.
Où se déroulent les formations ?
Dans vos locaux ou à distance, à vos dates, pour des groupes privés. Les sessions ouvertes suivent un calendrier mensuel fixe.
Sur quels outils IA formez-vous ?
Les vôtres. Chaque module existe en quatre éditions et fait ses exercices sur vos propres outils.
Qui anime les formations ?
Les consultants et formateurs seniors d'Inforca. Les modules signalés et le parcours dirigeants sont animés au niveau expert senior.
Parlons de ce module lors d'un premier échange : pertinence, dates, et le parcours autour.
Sans engagement · notre équipe répond sous un jour ouvré