Aller au contenu
AI Agency

The AI Forge · Fondation · F2

Recherche et connaissance (RAG)

Ingestion, découpage, embeddings, recherche vectorielle, qualité de la recherche, déployés

Durée
3 jours · 9h00–17h00 chaque jour (19,5 h de contact, pauses et déjeuner inclus)
Niveau des participants
Intermédiaire : utilisateurs réguliers de l'IA
Format
Ateliers guidés par le formateur, construction en direct
Participants
8 inclus · 12 maximum (taille de groupe flexible)
Prérequis
F1 (ou équivalent)
Écosystème
Indépendant : tout fournisseur de modèle ou toute stack
Prix
11 500 € (650 € par participant supplémentaire)

Montants en euros, hors taxes.

Un formateur qui s'adresse à des participants travaillant sur leurs ordinateurs portables, dans une salle de formation lumineuseai-generated

Ce que les participants seront capables de faire

  • Concevoir et construire un pipeline RAG de qualité production, de zéro
  • Choisir et configurer la base vectorielle adaptée à votre cas d'usage
  • Évaluer la qualité de la recherche avec la précision, le rappel et les métriques RAGAS
  • Déployer et superviser un système RAG en production

Outils & ressources

PythonLangChain / LlamaIndexPinecone / Qdrant / WeaviateOpenAI / Anthropic APIFramework d'évaluation RAGAS

Ce qui change après ce module

Les ingénieurs livrent un système de recherche complet et évalué, qui ancre un modèle dans des données réelles, et comprennent les schémas de recherche qui perdurent quand les modèles d'embeddings et les bases vectorielles changent.

À qui s'adresse ce module

Ingénieurs et professionnels de la data. Intermédiaire : utilisateurs réguliers de l'IA.

Programme

Ce programme est indicatif. Le contenu, l'enchaînement et les exemples sont adaptés au contexte, aux outils et aux objectifs de votre équipe.

Avant de commencer

  • Un ordinateur portable avec un environnement de développement fonctionnel et les droits administrateur
  • La maîtrise d'au moins un langage généraliste (Python et/ou JavaScript/TypeScript)
  • Un éditeur ou IDE avec un assistant de code IA validé et activé
  • Une clé d'API pour un fournisseur de modèles validé (délivrée par l'entreprise)
  • Un dépôt Git et de l'aisance en ligne de commande
  • Module F1 suivi, ou niveau équivalent
  • Un corpus documentaire réel sur lequel construire (anonymisé si sensible)
Jour 19:00–10:30Quand ancrer le modèle, et comment: Recherche, fine-tuning ou contexte long ; le pipeline RAG vu comme une suite d'étapes durables, et non comme un framework particulier Atelier : choisissez la bonne approche d'ancrage pour trois cas d'usage réels et justifiez chacune sur le coût, la fraîcheur et l'exactitudeL'un d'eux devient votre cas de construction pour les trois jours.
10:30–10:45 · ☕ Pause café
Jour 110:45–12:30Ingestion et analyse des documents: Analyse multi-format, nettoyage et métadonnées : la qualité de ce qui entre plafonne tout ce qui suit Atelier : construisez un pipeline d'ingestion qui transforme un corpus multi-format en fragments propres et étiquetés de métadonnées.
12:30–13:30 · 🍽 Pause déjeuner
Jour 113:30–15:30Stratégies de découpage: Découpage fixe, sémantique, récursif et sensible à la structure ; le recouvrement ; comment choisir selon le type de contenu Atelier : faites passer le même corpus par plusieurs stratégies de découpage et notez la qualité de la recherche pour chacune.
15:30–15:45 · ☕ Pause café
Jour 115:45–17:00Atelier : pipeline d'ingestion: Consolider l'analyse et le découpage en un pipeline reproductible Atelier : livrez un pipeline d'ingestion, chargez votre corpus prêt pour l'embedding, et rédigez le jeu de référence de 20 questions sur lequel vous évaluerez tout le reste de la construction.
Jour 29:00–10:30Embeddings: Ce que sont les embeddings, les arbitrages entre dimension, latence et coût, les enjeux multilingues, et pourquoi on compare par mesure plutôt que par marque Atelier : comparez deux approches d'embedding sur vos données et tranchez sur preuves.
10:30–10:45 · ☕ Pause café
Jour 210:45–12:30Recherche vectorielle: Indexation, similarité, filtrage par métadonnées et recherche hybride (mots-clés et vecteurs) : des concepts stables d'une base à l'autre Atelier : montez une base vectorielle, indexez vos fragments, et lancez des requêtes hybrides avec filtres de métadonnées.
12:30–13:30 · 🍽 Pause déjeuner
Jour 213:30–15:30Optimisation de la recherche: Reclassement, réécriture de requête, hypothetical-document embeddings et fusion : c'est là que se gagne l'essentiel de l'exactitude Atelier : ajoutez le reclassement et la réécriture de requête, puis mesurez le gain d'exactitude par rapport à la version naïve.
15:30–15:45 · ☕ Pause café
Jour 215:45–17:00Atelier : service de recherche: Brancher les embeddings, la base et la recherche en un service Atelier : livrez un service de recherche et mesurez la précision et le rappel sur un jeu de requêtes annoté.
Jour 39:00–10:30Génération et ancrage: La conception des prompts pour le RAG, la citation et l'attribution des sources, et la réduction des réponses non ancrées Atelier : ajoutez une génération ancrée avec citations et réduisez les réponses non ancrées sur votre jeu d'évaluation.
10:30–10:45 · ☕ Pause café
Jour 310:45–12:30Évaluation d'un RAG: Faithfulness, context precision et recall, answer relevance : les métriques RAG qui durent ; la construction du jeu d'évaluation Atelier : construisez une suite d'évaluation RAG et obtenez un score de départ sur la fidélité et la pertinence.
12:30–13:30 · 🍽 Pause déjeuner
Jour 313:30–15:30Atelier : système RAG complet: De bout en bout : ingestion, embedding, recherche, génération, le tout déployé Atelier : déployez le système RAG complet et interrogez-le en direct sur votre corpus.
15:30–15:45 · ☕ Pause café
Jour 315:45–17:00Production et revue: Mise en cache, limitation de débit, supervision, coût à l'échelle ; revue par les pairs Atelier : ajoutez la mise en cache et la supervision, puis présentez votre système avec ses chiffres de référence.

Livrables

  • Système RAG déployé et interrogeable
  • Pipeline d'ingestion et de découpage
  • Service de recherche avec recherche hybride et reclassement
  • Suite d'évaluation RAG avec scores de référence
  • Notes de production (cache, supervision, coût)

Intéressé par ce module pour votre équipe ? Contactez-nous pour adapter le format, les dates et la modalité à votre contexte.

Demander cette formation

Votre formateur

Expert senior

A mis des systèmes RAG en production ; forte expérience de la recherche, du découpage et de l'évaluation

Séance de découverte

Ce module nécessite une journée complète pour offrir une expérience d'apprentissage significative. Nous ne le proposons qu'en version intégrale.

Fait partie d'un parcours plus large

  • Enterprise115 000 € · jusqu'à 30 jours de formation
Voir les programmes

Questions fréquentes

Les modules peuvent-ils être suivis à l'unité ?

Oui. Chaque module se suffit à lui-même, à prix fixe, et compte dans un programme si vous poursuivez.

Où se déroulent les formations ?

Dans vos locaux ou à distance, à vos dates, pour des groupes privés. Les sessions ouvertes suivent un calendrier mensuel fixe.

Sur quels outils IA formez-vous ?

Les vôtres. Chaque module existe en quatre éditions et fait ses exercices sur vos propres outils.

Qui anime les formations ?

Les consultants et formateurs seniors d'Inforca. Les modules signalés et le parcours dirigeants sont animés au niveau expert senior.

Parlons de ce module lors d'un premier échange : pertinence, dates, et le parcours autour.

Réserver un échange

Sans engagement · notre équipe répond sous un jour ouvré