Le kit Copilot Studio : tester les agents avant que les employés ne les utilisent

Comment le kit Copilot Studio structure les ensembles de tests pour vos propres agents, quels types de tests existent et comment l'installer et le configurer.

Le kit Copilot Studio, officiellement appelé Copilot Agent Kit, est un outil supplémentaire géré par l'équipe Power Customer Advisory Team (Power CAT) pour Microsoft Copilot Studio, qui vous permet de tester, de surveiller et de sécuriser vos propres agents avant que les employés ou les clients ne les voient. Le cœur du kit est constitué d'ensembles de tests qui confrontent un agent à des entrées définies et contrôlent automatiquement les réponses par rapport aux valeurs attendues, au lieu de cliquer manuellement chaque modification dans le chat. État : août 2026.

Comment installer le kit Copilot Studio ?

Le chemin le plus simple passe par le Marketplace : accédez au Kit agent Copilot dans le Marketplace, sélectionnez Obtenir maintenant, connectez-vous et choisissez l'environnement cible.

  • Installation depuis le Marketplace : confirmez les conditions, sélectionnez Installer, puis ouvrez la solution standard dans Power Apps sous Solutions et fournissez à la référence de connexion Kit d'agent Copilot Studio - Dataverse une connexion Dataverse valide.
  • Installation depuis GitHub : téléchargez la solution gérée actuelle du référentiel officiel Power CAT et importez-la dans Power Apps via Solutions, recréez les connexions si nécessaire.
  • Accès : après l'installation, vous trouverez l'application sous Applications comme Kit d'agent Copilot Studio Power CAT, ouvrez-la en cliquant sur Lecture et partagez-la ensuite avec l'équipe via la fonction de partage.

Un assistant de configuration dans le kit automatise en grande partie la configuration des références de connexion, des variables d'environnement et des flux cloud.

Comment créer des ensembles de tests pour vos agents ?

Un ensemble de tests combine plusieurs tests individuels que vous exécutez ensemble par rapport à un agent. Les éléments de base sont six types de tests avec des profondeurs de vérification différentes.

  • Correspondance de réponse : compare la réponse de l'agent directement à une réponse attendue, optionnellement exactement, contient ou commence par.
  • Pièces jointes : vérifie les pièces jointes structurées comme les cartes adaptatives, optionnellement via validation assistée par IA contre vos propres instructions de vérification.
  • Correspondance de thème : compare le thème attendu avec le thème réellement déclenché et supporte également plusieurs thèmes simultanément en orchestration générative.
  • Réponses génératives : laisse un modèle de langage juger si une réponse générée par IA correspond à une réponse modèle ou à vos propres instructions de vérification.
  • Plusieurs tours : enchaîne plusieurs tests individuels dans un ordre fixe au sein de la même conversation et s'arrête en cas d'erreurs critiques.
  • Validation du plan : vérifie en orchestration générative si l'agent utilise réellement les outils attendus dans son plan d'exécution, évalué via un seuil de réussite en pourcentage.

Les ensembles de tests peuvent être créés en masse et gérés via Excel, les tests individuels ou les ensembles entiers peuvent être dupliqués pour dériver rapidement des variantes.

Qu'offre le kit au-delà de la simple réalisation de tests ?

Au-delà de l'automatisation des tests, le kit contient plusieurs modules qui traitent de la gouvernance et de l'exploitation des flottes d'agents. Le Compliance Hub évalue l'inventaire des agents par rapport aux contrôles configurés et marque les violations de politiques, le module Agent Debugger fournit des diagnostics étape par étape pour les conversations enregistrées, et les KPI de conversation regroupent les métriques d'utilisation et de qualité en plus de l'analyse intégrée de Copilot Studio. Pour les entreprises qui utilisent Copilot Studio en production, l'automatisation des tests et le Compliance Hub en combinaison sont le levier le plus efficace contre la prolifération incontrôlée des agents.

À quoi sert le test de connexion pour les sources de données protégées ?

Si un agent accède à une source de données externe comme SharePoint ou Dataverse, une carte d'autorisation apparaît lors de la première conversation, qu'un utilisateur doit confirmer. Vous simulerez ce processus via un test multi-tours avec deux tests enfants : le premier test déclenche la carte d'autorisation et compare son contenu, le second envoie la confirmation et vérifie la réponse suivante. Une fois autorisé pour un utilisateur de test, les tests ultérieurs par rapport au même connecteur se exécutent sans ce détour. Quiconque veut intégrer cette couverture de test dans une stratégie d'automatisation existante avec "Microsoft Copilot" bénéficie d'une séparation claire entre l'environnement de développement et de production.

Questions fréquentes sur le kit Copilot Studio

Le kit Copilot Studio entraîne-t-il des frais de licence supplémentaires ?

Le kit lui-même est un outil supplémentaire gratuit géré par l'équipe Power CAT de Microsoft, que vous pouvez installer à partir du Marketplace ou de GitHub. Cependant, il nécessite un environnement Power Apps et Dataverse auquel les règles de licence Power Platform usuelles s'appliquent.

Puis-je exécuter automatiquement les tests avant chaque déploiement ?

Oui, en reliant les tests à Power Platform Pipelines, vous pouvez exécuter les tests automatiquement avant qu'un agent ne soit promu entre les environnements. Le kit est donc également utilisable pour des processus de publication multi-étages allant du développement aux tests jusqu'à la production.

Quel type de test convient à un dialogue multi-étapes ?

Le type de test multi-tours modélise plusieurs messages consécutifs dans la même conversation et peut être combiné avec les tests de correspondance de réponse, pièces jointes, correspondance de thème et réponses génératives en tant que tests enfants. Les tests enfants critiques arrêtent l'exécution du test entier en cas d'erreur, les tests non critiques continuent et fournissent un contexte supplémentaire.

Ai-je besoin d'une configuration supplémentaire pour les tests de réponses génératives ?

Oui, ce type de test nécessite un enrichissement AI Builder activé, afin qu'un modèle de langage puisse évaluer la réponse générée par rapport à une réponse modèle ou à vos propres instructions de vérification. Sans cet enrichissement, le type de test n'est pas disponible dans l'interface.

Simon Glowik, fondateur de NordFlux
À propos de l’auteur

Fondateur de NordFlux. Sept ans d'expérience, du web et du SEO jusqu'à l'automatisation à l'échelle d'un groupe, aujourd'hui pragmatique pour les PME et avec une souveraineté des données allemande.

Certifications

  • Certifié Microsoft — PL-900 et AZ-900
  • Certifié UiPath — Automation Developer Associate
Tous les articles
Analyse initiale gratuite

Des questions concrètes sur l’automatisation ou l’IA ?

Lors d’une analyse initiale gratuite, nous discutons directement de votre cas. Sans engagement.

Kit Copilot Studio : tester les agents (Guide)