Sodoc

Recherche en langage naturel sur SharePoint : comment fonctionne une IA qui respecte vos droits d’accès

recherche en langage naturel SharePoint

Poser une question en français à ses documents SharePoint et recevoir une réponse sourcée en quelques secondes, sans jamais sortir de son périmètre de droits : c’est le composant que SoDoc présente actuellement en démonstration. Voici comment il fonctionne, et pourquoi la sécurité y occupe une place aussi importante que l’intelligence artificielle elle-même.

Le problème : la recherche par mots-clés montre ses limites

La recherche SharePoint classique repose sur des mots-clés. Elle suppose que l’utilisateur connaisse le nom exact du document, son emplacement dans l’arborescence ou les termes utilisés par son auteur quelques mois ou quelques années plus tôt.

Dans une petite organisation, cette approche fonctionne encore. Dans une structure de plusieurs centaines ou milliers de collaborateurs, avec des sites SharePoint multipliés au fil des projets, elle atteint vite ses limites. Le temps perdu à chercher un document devient un coût caché, comparable au stockage qui s’accumule sans gouvernance.

Conséquence fréquente : faute de retrouver la bonne version à temps, c’est une version obsolète qui circule, avec les erreurs et les risques que cela suppose en matière de qualité ou de conformité.

Le fonctionnement, étape par étape

Le composant démontré par SoDoc répond à une question posée normalement, en français courant, et déroule quatre étapes avant d’afficher une réponse.

Étape 1 : La question

L’utilisateur écrit sa demande sans syntaxe particulière. Exemple observé en démonstration : « Quelles sont les dernières règles de sécurité pour le bâtiment A ? »

Étape 2 : La vérification d'accès

Le système contrôle la licence Copilot de l’utilisateur et son identité, puis applique un filtre KQL qui restreint la recherche au périmètre de documents que cette personne est autorisée à consulter. Aucun document hors de ses droits n’entre dans le calcul de la réponse.

Étape 3 : La sélection des documents

Le système scanne les documents SharePoint concernés et s’appuie sur l’API de récupération Copilot (Copilot Retrieval API) pour identifier ceux qui sont les plus pertinents par rapport à la question posée.

Étape 4 : La génération de la réponse

Ces documents sont transmis au modèle GPT-4o, hébergé sur Azure AI Foundry, qui rédige une réponse claire et cite les documents utilisés en sources. L’utilisateur voit d’où vient chaque information.

Pourquoi la sécurité passe avant la génération

Donner à une IA générative un accès large aux documents d’une entreprise soulève une question concrète : que se passe-t-il si elle répond à partir d’un document que l’utilisateur n’aurait jamais du consulter ?

Dans ce composant, la vérification des droits intervient avant la recherche. Le périmètre filtre par KQL garantit que la recherche elle-même ne porte que sur les documents autorisés. La citation des sources permet ensuite à l’utilisateur de vérifier d’où vient chaque information, plutôt que de prendre la réponse pour argent comptant.

Cette logique est délibérée : une IA utile en entreprise doit d’abord être sûre. La performance vient en second.

Une approche qui s'inscrit dans un paysage plus large

Ce principe n’est pas propre à SoDoc. Microsoft développe ses propres briques de recherche sémantique dans l’écosystème Copilot, avec des résultats filtrés selon les permissions de chaque utilisateur. Plusieurs plateformes de recherche d’entreprise explorent aujourd’hui les mêmes fondamentaux : réponses sourcées, respect des droits d’accès, réduction des approximations par le retrieval.

Ce qui distingue l’approche de SoDoc, c’est son ancrage dans une gestion documentaire Microsoft 365 déjà déployée et gouvernée chez le client. La recherche s’appuie sur des documents déjà classés, validés et soumis à des workflows métier, dans un environnement que le client utilise au quotidien.

Des cas d'usage dans tous les métiers

En Qualité, retrouver en quelques secondes la dernière version validée d’une procédure évite de rouvrir cinq dossiers d’audit.

En Ressources humaines, répondre directement à une question sur une politique interne réduit les sollicitations adressées au service RH.

En Juridique, retrouver la clause exacte d’un contrat parmi plusieurs centaines de pages archivées devient possible, avec la référence du document à l’appui.

Dans les Achats, vérifier les conditions negociées avec un fournisseur ne dépend plus de la mémoire d’un seul collaborateur.

Recherche IA - SharePoint

Le lien avec la gouvernance documentaire

Une IA générative produit des réponses fiables uniquement si elle travaille sur des données propres. Des droits d’accès à jour et une base purgée des fichiers redondants : ce travail de fond, que SoDoc mène avec Radar sur la gouvernance du stockage Microsoft 365, rend la recherche plus pertinente et les réponses plus sûres (voir les rapports de gouvernance SharePoint).

Les deux chantiers se renforcent mutuellement. Radar prépare la donnée, la recherche en langage naturel l’exploite.

Ou en est cette fonctionnalité aujourd'hui ?

Le composant est en cours de développement et déjà visible lors des démonstrations SoDoc. Aucune date de disponibilité generale n’est annoncée à ce stade. Cette avancée illustre la direction que prend SoDoc sur l’IA appliquée à la gestion documentaire Microsoft 365.

Vous voulez voir cette recherche fonctionner sur vos propres documents SharePoint ?

Partager :

FAQ

Le composant de recherche en langage naturel est-il disponible pour les clients SoDoc ?

Pas encore en production. Le composant est présenté lors des démonstrations SoDoc ; aucune date de disponibilité générale n’est annoncée à ce stade.

Faut-il une licence Microsoft Copilot pour utiliser ce composant ?

Oui. La vérification de la licence Copilot fait partie de l’étape 2 du processus. Ce prérequis est intégré à l’architecture de sécurité du composant.

Le composant peut-il accéder à des documents que je n'ai pas le droit de consulter ?

Non. Le filtre KQL appliqué à l’étape 2 restreint la recherche au périmètre de documents que l’utilisateur est autorisé à consulter. Aucun document hors droits n’entre dans le calcul de la réponse.

Une IA générative peut-elle inventer des informations ?

Le risque existe dans les systèmes sans retrieval. Ici, GPT-4o ne travaille qu’à partir des documents extraits dans le périmètre autorisé. La citation des sources permet à chaque utilisateur de vérifier l’origine de chaque information.

 

Faut-il restructurer ses données SharePoint avant de déployer ce composant ?

Aucune migration n’est requise. Le composant travaille sur les documents SharePoint existants. La pertinence des réponses dépend cependant de la qualité des données : des droits d’accès mal configurés ou une base documentaire non nettoyée dégradent la fiabilité des réponses. SoDoc Radar prépare précisément cette base pour un usage IA.

Quels métiers peuvent bénéficier de ce composant ?

Tous les métiers qui s’appuient sur des documents SharePoint : la Qualité (retrouver une procédure validée), les Ressources humaines (répondre à une politique interne), le Juridique (localiser une clause dans un contrat archivé) et les Achats (vérifier les conditions négociées avec un fournisseur).

Retour en haut

Analysez votre environnement Microsoft 365 et
identifiez les zones de gaspillage documentaire

Documents dormants, doublons, versions inutiles… Sodoc Radar révèle les zones de stockage qui génèrent du désordre et des coûts invisibles.

Demande de démo - Sodoc Radar

Replay - IA & Gestion de la connaissance : structurer l’information pour la rendre réellement exploitable