Usage de l'intelligence artificielle

Notre philosophie sur l'IA, les traitements réellement opérés, les données transmises aux modèles et le choix du fournisseur

Introduction

L'intelligence artificielle est présente dans Kabeen depuis l'origine, mais toujours au service d'un objectif unique : automatiser la documentation de votre système d'information. Cartographier un SI est un travail long, répétitif et rarement à jour. L'IA nous permet de produire cette documentation à partir de l'usage réel — sans questionnaire, sans atelier de recensement, sans fichier Excel à maintenir.

Cet article décrit précisément ce que l'IA fait dans la plateforme, quelles données lui sont transmises et comment vous en gardez la maîtrise.

Notre philosophie

L'IA documente, elle ne décide pas

Kabeen AI produit des propositions : une application candidate à l'inventaire, une fonctionnalité métier probablement utilisée, une synthèse d'analyse. Ces propositions sont assorties d'un indice de confiance et restent soumises à votre validation. La décision — intégrer, rejeter, corriger — appartient toujours à un humain.

Le minimum de données, jamais plus

Nous appliquons une règle simple : un traitement IA ne reçoit que les métadonnées strictement nécessaires à son résultat, jamais le contenu de votre système d'information au sens large. Concrètement, cela signifie des chemins d'URL et des titres de page plutôt que le contenu des applications, des agrégats d'usage plutôt que des journaux nominatifs, et des extraits bornés plutôt que des exports complets.

Chaque fois qu'un traitement peut être réalisé sans appeler un modèle de langage, il l'est. L'auto-découverte des applications et l'auto-découverte des équipes, par exemple, sont entièrement algorithmiques : aucune donnée ne quitte la plateforme pour ces deux traitements.

Réversibilité et transparence

Toutes les fonctions Kabeen AI sont activables et désactivables indépendamment depuis les paramètres de l'espace. Aucune n'est un prérequis au fonctionnement de la plateforme : désactiver l'IA réduit le niveau d'automatisation, jamais la disponibilité de vos données.

Aucun entraînement sur vos données

Les données transmises aux fournisseurs d'IA le sont dans le cadre d'un traitement à la demande. Aucune donnée de votre espace n'est utilisée pour entraîner des modèles, ni par Kabeen ni par ses fournisseurs.

Le choix du moteur d'IA

Trois fournisseurs, un seul à la fois

Kabeen s'appuie sur trois fournisseurs de modèles de langage :

FournisseurLocalisationStatut
Mistral AIFrance / Union européenneFournisseur par défaut
OpenAIÉtats-UnisSur sélection
AnthropicÉtats-UnisSur sélection

Le fournisseur est choisi au niveau de l'espace, dans les paramètres Kabeen AI, par un administrateur disposant du droit d'administration de l'espace. Par défaut, l'espace est configuré sur Mistral AI, notre fournisseur français.

Étanchéité du choix

Le fournisseur sélectionné s'applique à tous les traitements IA de l'espace. Si votre espace est configuré sur Mistral, seuls des modèles Mistral sont appelés : il n'y a aucun repli, aucun basculement et aucun appel croisé vers les modèles d'un autre fournisseur, quelles que soient les circonstances — y compris en cas d'indisponibilité. Un traitement qui échoue échoue franchement plutôt que de router vos données ailleurs.

Ce cloisonnement est également appliqué côté requêtes : seuls les administrateurs de l'espace peuvent choisir un fournisseur. Une requête forgée par un utilisateur non habilité est ignorée et retombe sur le fournisseur configuré pour l'espace.

Un mix de modèles chez le fournisseur retenu

Chez un fournisseur donné, Kabeen n'utilise pas un modèle unique : nous sélectionnons le modèle adapté à chaque traitement, ce qui limite à la fois la consommation et la latence.

  • Les traitements conversationnels et de raisonnement (Prism) mobilisent le modèle le plus capable de la gamme du fournisseur.
  • Les traitements d'enrichissement en arrière-plan (auto-découverte des fonctionnalités, analyse approfondie, génération de titres de conversation, compaction d'historique) mobilisent des modèles légers et rapides.

Ces modèles évoluent au rythme des gammes de nos fournisseurs, mais toujours au sein du fournisseur sélectionné pour votre espace.

Les traitements IA aujourd'hui

Vue d'ensemble

TraitementAppel à un modèle d'IADonnées transmises
Auto-découverte des applicationsNon — algorithmiqueAucune
Auto-découverte des équipesNon — statistiqueAucune
Auto-découverte des fonctionnalitésOui — modèle légerMétadonnées d'URL, titres de page, agrégats d'usage, catalogue de capacités
Assistant PrismOui — modèle de raisonnementQuestion, historique de conversation, contexte de page, résultats d'outils
Analyse approfondie (Prism)Oui — modèles légersFiches d'application dans le périmètre demandé
Recherche web (Prism)Non — service de rechercheUniquement la requête de recherche

Auto-découverte des applications — sans modèle d'IA

L'inventaire applicatif se constitue par rapprochement algorithmique : chaque URL collectée par les agents (domaine et chemin uniquement) est comparée au catalogue Kabeen de plus de 80 000 applications professionnelles. Les URL sans correspondance sont ensuite passées au crible d'heuristiques de forme (sous-domaines app., cloud., portal., admin., chemins /app, /dashboard, /portal…) pour distinguer une application professionnelle d'un site grand public.

Aucun appel à un fournisseur d'IA n'est réalisé pour ce traitement. Les données restent intégralement dans l'infrastructure Kabeen.

Voir l'article Auto-découverte des applications pour le détail fonctionnel.

Auto-découverte des équipes — sans modèle d'IA

Le rattachement d'une application aux équipes qui l'utilisent est déduit statistiquement des usages observés et de l'arborescence organisationnelle de votre espace. Là encore, aucune donnée n'est transmise à un fournisseur d'IA.

Auto-découverte des fonctionnalités — le seul enrichissement qui appelle un modèle

C'est le traitement qui transforme un inventaire d'applications en cartographie des capacités métier réellement exercées. Il s'agit du seul enrichissement automatique de la plateforme qui sollicite un modèle de langage.

Ce qui est transmis au modèle, pour une application :

  • Les métadonnées de la fiche : nom, description, catégorie, éditeur, URL d'accès — chacune tronquée à 200 caractères.
  • Un échantillon de chemins d'URL observés, plafonné à 100 entrées, chaque chemin tronqué à 500 caractères.
  • Les titres de page associés, tronqués à 100 caractères.
  • Des agrégats d'usage sur les 90 derniers jours : nombre de vues, nombre d'utilisateurs distincts, nombre de chemins distincts. Ce sont des compteurs, pas des identités.
  • Le catalogue de capacités fonctionnelles de votre organisation, qui constitue la liste fermée dans laquelle le modèle doit choisir.

Ce qui n'est jamais transmis : le contenu des pages, les paramètres de requête, les identités d'utilisateurs, les identifiants de session, les données saisies dans l'application.

Les protections appliquées :

  • Assainissement en entrée : suppression des caractères de contrôle, neutralisation des séquences d'injection de prompt, troncature systématique. Une application dont le nom ou les URL contiendraient des instructions déguisées ne peut pas détourner l'analyse.
  • Validation en sortie : seules les capacités correspondant exactement à une entrée de votre catalogue sont retenues ; les propositions hors catalogue sont écartées. Les expressions régulières produites par le modèle sont vérifiées avant enregistrement.
  • Dégradation silencieuse : en cas d'échec, le traitement rend un résultat vide. Il n'est jamais bloquant, et ne réessaie pas indéfiniment.
  • Modèle léger : ce traitement utilise le petit modèle du fournisseur sélectionné, pas le modèle conversationnel.

Voir l'article Auto-découverte des fonctionnalités pour le détail fonctionnel.

Assistant Prism

Prism est l'agent conversationnel de la plateforme. Il est le traitement IA le plus riche, et donc celui dont le périmètre de données mérite le plus de précision.

Ce qui est transmis au modèle à chaque tour de conversation :

  • Votre message.
  • L'historique de la conversation, limité à 50 messages. Au-delà, les tours les plus anciens sont remplacés par un résumé produit par un modèle léger, afin de ne pas renvoyer indéfiniment l'intégralité de l'échange.
  • Le contexte de la page depuis laquelle vous ouvrez Prism, réduit à une liste fermée d'éléments : type d'entité, identifiant technique de l'entité et filtres actifs parmi une liste autorisée (statut, catégorie, criticité, périmètre organisationnel, période…). Aucun autre élément de la page n'est transmis.
  • Votre mémoire d'assistant : un fichier de préférences que vous alimentez explicitement (« je raisonne toujours par filiale », « affiche les coûts en TTC »), plafonné à 4 000 caractères et rattaché à votre seul compte.
  • La définition des outils disponibles pour le tour, restreinte aux domaines pertinents plutôt qu'au catalogue complet.
  • Les résultats des outils appelés, c'est-à-dire les données de votre espace nécessaires à la réponse. Chaque résultat est plafonné à environ 8 000 caractères : les listes trop longues sont tronquées, et le modèle est informé du nombre d'éléments omis. Prism ne reçoit donc jamais un export complet de votre référentiel.

Le cloisonnement des données :

  • Chaque outil est exécuté avec votre identifiant d'espace et vos permissions. Une donnée que votre compte ne peut pas voir dans l'interface est également invisible pour Prism : il ne contourne aucun droit d'accès.
  • Le mode de suivi d'identité de l'espace s'applique. En mode anonyme, Prism manipule des comptages, pas des noms.
  • Toute action d'écriture (création, modification, rattachement) est journalisée dans la piste d'audit avec l'auteur, l'horodatage et le contexte. Les actions destructrices requièrent une confirmation explicite.
  • Prism ne s'exprime que sur la base des données de votre espace. Lorsqu'une information n'existe pas, il le dit plutôt que de l'inventer.

Deux traitements dérivés :

  • L'analyse approfondie répond aux questions portant sur un large portefeuille (« quelles applications sont candidates à la rationalisation ? »). Elle lance un sous-agent borné par application — 25 applications au maximum, modèle léger, lecture seule — et n'en remonte qu'une synthèse condensée. Cette approche évite d'envoyer l'ensemble du portefeuille dans un seul contexte.
  • La recherche web permet à Prism de qualifier un éditeur ou une technologie à partir de sources publiques. Seule la requête de recherche est transmise au service de recherche : aucune donnée de votre espace n'y est jointe.

Conservation : vos conversations sont stockées dans votre espace pour vous permettre de les retrouver. Vous pouvez supprimer une conversation, ou reprendre le fil à partir d'un message donné, à tout moment.

Traçabilité technique : chaque échange génère une trace technique (question, réponse, outils appelés, consommation de jetons) dans notre plateforme d'observabilité hébergée dans l'Union européenne. Elle sert exclusivement au diagnostic et à la qualité de service.

Voir l'article Assistant Prism pour le détail fonctionnel.

Ce qui n'est jamais transmis à un moteur d'IA

Quel que soit le traitement et quel que soit le fournisseur sélectionné, les éléments suivants ne quittent jamais la plateforme :

  • Le contenu des pages web consultées (textes, images, formulaires)
  • Les identifiants, mots de passe et jetons d'authentification
  • Les frappes clavier et les captures d'écran
  • Les fichiers ouverts ou modifiés sur les postes
  • Les paramètres de requête des URL
  • Les conversations et messages issus de vos outils métier

Cette liste découle de la collecte elle-même : ces données ne sont pas collectées par les agents Kabeen, elles ne peuvent donc pas être transmises. Voir l'article Confidentialité des données.

Garder la maîtrise

Depuis les paramètres Kabeen AI de votre espace, un administrateur peut :

  • Activer ou désactiver indépendamment l'assistant Prism, l'auto-découverte des applications, l'auto-découverte des équipes et l'auto-découverte des fonctionnalités.
  • Choisir le fournisseur d'IA appliqué à l'ensemble des traitements de l'espace.

Au-delà de ces réglages, la visibilité des données reste pilotée par les rôles et permissions et par le mode de suivi d'identité de l'espace, qui s'appliquent aux traitements IA comme au reste de la plateforme.

Voir les articles Rôles et permissions et Confidentialité des données.

Les traitements à venir

La feuille de route IA de Kabeen suit la même ligne : automatiser davantage la documentation du SI, sans élargir le périmètre des données partagées. Les chantiers en cours portent notamment sur la qualification automatique des flux applicatifs, la détection des redondances fonctionnelles à l'échelle du portefeuille et l'enrichissement automatique des fiches à partir de sources publiques.

Chacun de ces traitements respectera les mêmes principes : métadonnées uniquement, modèle adapté au besoin, fournisseur unique choisi par l'espace, proposition soumise à validation humaine, activation réversible. Cet article sera mis à jour à mesure que ces traitements seront mis en production.

Voir aussi