La génération augmentée par recherche relie un modèle à une base documentaire. Elle peut améliorer la précision, mais elle crée une nouvelle chaîne de confiance : ingestion, indexation, filtrage, récupération, composition du prompt et affichage de la réponse.
Le périmètre avant l'outil
Le contrôle d'accès doit s'appliquer au moment de la recherche, pas seulement à l'interface. Un utilisateur qui ne peut pas ouvrir un document ne doit pas en recevoir un extrait par l'assistant. Les métadonnées de droits, la suppression et la mise à jour doivent suivre le cycle de vie du document source.
Commencez par une unité que l'équipe sait nommer : un service, un processus, une classe de données ou un chemin d'accès. Associez-lui un propriétaire, une dépendance métier et une conséquence observable. Cette discipline évite les programmes trop larges où chaque équipe attend qu'une autre commence.
Les contrôles qui changent la situation
- Conserver les permissions dans l'index. Vérifiez le responsable, la fréquence et la preuve produite avant de considérer ce contrôle comme actif.
- Filtrer avant la récupération des passages. Vérifiez le responsable, la fréquence et la preuve produite avant de considérer ce contrôle comme actif.
- Afficher les références internes utilisées. Vérifiez le responsable, la fréquence et la preuve produite avant de considérer ce contrôle comme actif.
- Traiter les documents comme des entrées potentiellement hostiles. Vérifiez le responsable, la fréquence et la preuve produite avant de considérer ce contrôle comme actif.
- Tester la suppression et la révocation. Vérifiez le responsable, la fréquence et la preuve produite avant de considérer ce contrôle comme actif.
Un contrôle n'est pas une intention. Il existe lorsque sa portée est connue, qu'une personne peut montrer sa configuration et qu'un test révèle son échec. Si l'une de ces conditions manque, classez-le comme chantier en cours avec une date de reprise.
Ce que disent les sources primaires
Le point de référence est OWASP Top 10 for LLM Applications . Le projet décrit notamment l'injection de consignes, la divulgation d'informations sensibles, les dépendances, la sortie non maîtrisée et les excès d'autonomie dans les applications fondées sur des modèles de langage.
Pour vérifier le cadre, consultez Fiches pratiques sur l'intelligence artificielle . Les fiches pratiques détaillent la qualification des acteurs, la collecte des données, l'analyse d'impact, l'exercice des droits et la documentation attendue au fil du projet.
La méthode peut être rapprochée de AI Risk Management Framework . Le cadre propose quatre fonctions complémentaires, gouverner, cartographier, mesurer et gérer, afin de traiter les risques d'un système d'IA dans son contexte d'usage.
Ces références donnent un cadre commun, pas une réponse automatique au cas particulier. Reprenez les termes applicables à votre système et indiquez ce qui reste à confirmer. Une source peut soutenir plusieurs décisions sans être répétée à chaque phrase.
Un scénario pour éprouver la méthode
Un assistant de support mélange les procédures internes et des dossiers clients. Un conseiller demande une question générale et reçoit un détail provenant d'un ticket auquel il n'a pas accès. L'équipe sépare les corpus, applique les droits avant récupération et ajoute un test de non-divulgation à chaque livraison.
Le scénario sert à tester l'enchaînement des décisions. Changez une hypothèse, comme l'absence d'un responsable ou l'indisponibilité d'un fournisseur, puis observez si le plan garde un chemin praticable. Un dispositif robuste ne dépend pas d'une seule personne ni d'une seule console.
Le plan de travail en cinq passages
- Choisir un corpus limité avec un propriétaire. Conservez le résultat, l'écart découvert et la décision suivante dans le dossier du service.
- Définir qui peut voir chaque classe de document. Conservez le résultat, l'écart découvert et la décision suivante dans le dossier du service.
- Construire des tests de fuite entre profils. Conservez le résultat, l'écart découvert et la décision suivante dans le dossier du service.
- Évaluer les réponses avec et sans source pertinente. Conservez le résultat, l'écart découvert et la décision suivante dans le dossier du service.
- Vérifier qu'une suppression disparaît réellement de l'index. Conservez le résultat, l'écart découvert et la décision suivante dans le dossier du service.
Chaque passage doit rester assez petit pour être repris. La progression vient de la fermeture des écarts, pas du nombre de réunions. Lorsque le test contredit la documentation, corrigez d'abord l'état réel, puis la procédure qui devra le reproduire.
Les preuves à conserver
- Version du corpus
- Identité et groupes du demandeur
- Passages récupérés
- Réponse et références
- Résultat des tests de cloisonnement
Une preuve utile est datée, liée à un périmètre et compréhensible par une personne qui n'a pas participé au projet. Évitez les captures isolées sans contexte. Préférez un rapport court qui nomme la commande, le résultat attendu, l'écart et l'action décidée.
Les pièges qui affaiblissent le programme
- Filtrer seulement après génération. Ce raccourci déplace le risque sans rendre la décision plus vérifiable.
- Indexer des partages publics sans propriétaire. Ce raccourci déplace le risque sans rendre la décision plus vérifiable.
- Faire confiance au document parce qu'il est interne. Ce raccourci déplace le risque sans rendre la décision plus vérifiable.
- Oublier les anciennes versions. Ce raccourci déplace le risque sans rendre la décision plus vérifiable.
- Journaliser intégralement des données sensibles. Ce raccourci déplace le risque sans rendre la décision plus vérifiable.
Ces pièges viennent souvent d'une volonté d'aller vite. Leur antidote est un retour au service réel, à la personne qui en dépend et au test que l'on peut rejouer. Une décision prudente peut être temporaire, à condition que sa date de réexamen soit explicite.
La prochaine décision utile
Un RAG sûr sait aussi ne pas répondre. Lorsque les droits, la source ou la pertinence sont insuffisants, il doit l'indiquer et orienter vers le document ou le responsable adapté. Cette limite explicite protège davantage qu'une réponse fluide sans provenance.
Écrivez la décision avec son responsable, sa date et la condition qui permettra de la fermer. Le sujet devient alors pilotable : l'entreprise sait ce qu'elle protège, ce qu'elle ignore encore et comment vérifier la prochaine étape.
Commentaires
Aucun commentaire pour le moment