Ce que la délégation économise (et ce qu'elle n'économise pas)
Comment la délégation des tâches GRC à ISMS Copilot via MCP maintient le contexte hors de la transcription de votre agent, ce pour quoi votre agent paie toujours, ce que le reçu d'utilisation indique, et où l'utilisation d'ISMS Copilot est facturée.
Lorsque votre orchestrateur délègue une question de conformité à ISMS Copilot, une partie du travail est effectuée côté ISMS Copilot plutôt que dans le contexte de votre agent. Cette page explique le mécanisme, ce qui ne change pas, et comment les deux côtés sont facturés. Elle ne prétend pas indiquer combien vous économisez : cela dépend de votre orchestrateur, de votre modèle et de votre travail.
Pourquoi le contexte de votre agent est important
Un agent basé sur le chat ne conserve pas les échanges précédents par lui-même. À chaque tour, un orchestrateur typique renvoie au modèle sa transcription : vos instructions, les définitions des outils, les messages précédents, les fichiers lus et les résultats des outils. Tout ce qui entre dans cette transcription est renvoyé ou retraité lors des tours suivants et peut être comptabilisé dans l'utilisation, sous réserve de la mise en cache, de la compaction et de la comptabilité du fournisseur. Le chat d'ISMS Copilot fonctionne de la même manière, c'est pourquoi les longs fils de discussion utilisent davantage votre fenêtre d'utilisation par message.
La question n'est donc pas seulement de savoir ce qu'une seule réponse coûte, mais aussi ce qui reste dans la transcription de votre agent par la suite.
Ce qui reste côté ISMS Copilot
Lorsque le travail est délégué, les éléments ci-dessous restent côté ISMS Copilot, sauf si le résultat retourné les reproduit. La requête MCP que votre agent envoie et le résultat qu'il reçoit (la réponse ainsi que des champs tels que les ID, le statut, l'utilisation et les erreurs) entrent dans sa transcription, aux côtés des schémas d'outils abordés plus loin :
- Matériel source des cadres de référence : les références aux normes et réglementations sur lesquelles ISMS Copilot base ses réponses. Votre agent envoie la question, pas le texte du cadre de référence. La réponse peut citer ou référencer les parties pertinentes.
- Récupération : recherche des clauses, contrôles et articles pertinents pour la question, ainsi que du contexte assemblé pour le modèle.
- Mémoires et fichiers de l'espace de travail : dans un tour avec un
workspace_id, ils sont lus côté ISMS Copilot. Votre agent ne les charge pas, bien que la réponse puisse utiliser des faits qui en proviennent. - Contexte de l’entreprise. Lorsque votre compte dispose d’un profil d’entreprise, ISMS Copilot l’ajoute en arrière-plan de son côté pour les tours dans les conversations démarrées par votre compte, sauf dans les espaces de travail partagés en équipe et les discussions temporaires. Votre orchestrateur ne le charge pas, bien que la réponse puisse utiliser des faits qui en proviennent.
- Raisonnement intermédiaire : l'analyse derrière la réponse, y compris le travail multi-étapes des modes Think et Beyond.
- Passes de rédaction : les textes longs sont générés côté ISMS Copilot. Votre agent reçoit le résultat, pas le processus de rédaction.
- Copie de la discussion par le spécialiste : les suites avec
send_messagecontinuent une discussion qu'ISMS Copilot conserve. Votre agent ne renvoie donc pas les tours précédents de cette discussion dans sa requête. Les appels d'outils et les réponses précédents restent dans la transcription de votre agent jusqu'à ce qu'il les supprime.
Ce pour quoi votre agent paie toujours
La délégation ne rend pas l'étape de conformité gratuite pour votre orchestrateur :
- Schéma des outils : les définitions des outils MCP d'ISMS Copilot se trouvent dans le contexte de votre agent une fois le serveur connecté, comme pour tout autre serveur MCP.
- La question qu'il envoie : tout ce que votre agent écrit dans
create_conversationousend_messagefait partie de sa transcription. - La réponse qu'il lit : la réponse retournée est une entrée pour le modèle de votre agent, et elle reste dans la transcription pour le reste de la session.
La réponse est la partie que vous contrôlez le plus. Utilisez answer_format: "brief" (environ 150 mots) ou "decision" (recommandation en premier, environ 300 mots) lorsque votre agent n'a besoin que de la conclusion. Lorsque le livrable est un long document, demandez à votre agent de l'écrire dans un fichier plutôt que de le répéter dans le chat. Voir Déléguer les tâches GRC depuis votre agent.
Le reçu d'utilisation
Une réponse Fast ou Think terminée peut inclure un objet usage :
{
"usage": {
"copilot_input_tokens": 0,
"copilot_output_tokens": 0
}
}Les valeurs ci-dessus sont des espaces réservés. Les champs sont les suivants :
copilot_input_tokensetcopilot_output_tokens: jetons traités et produits par les modèles d'ISMS Copilot pour ce tour.copilot_cache_read_input_tokensetcopilot_cache_creation_input_tokens: inclus uniquement lorsque le fournisseur de modèle les signale.
Ce reçu compte uniquement les jetons côté ISMS Copilot. Il ne s'agit pas du nombre de jetons de votre agent et n'inclut pas ce que votre orchestrateur dépense pour la question, les schémas d'outils ou la lecture de la réponse. Votre orchestrateur signale ces éléments lui-même. L'objet usage est omis lorsque les chiffres ne sont pas encore disponibles (get_reply l'inclut une fois qu'ils sont enregistrés), et les réponses Beyond ne l'incluent pas.
Où l'utilisation d'ISMS Copilot est facturée
Il n'y a pas de produit ou de compteur MCP séparé. Les tours délégués sont comptabilisés dans votre forfait chat ISMS Copilot :
- Fenêtre d'utilisation de 4 heures : les tours MCP puisent dans la même session UTC de 4 heures que l'application de chat, sur votre propre budget ou celui de votre organisation. Voir Comprendre les limites d'utilisation.
- Dépassement : sur les comptes solo payants éligibles (hors Essential, avec la Protection avancée des données désactivée), lorsque la fenêtre est épuisée, votre agent ne peut continuer que sur votre accord explicite en renvoyant la requête avec
overflow_consent: true. Le tour s'exécute alors sur les modèles de repli divulgués, jusqu'à une limite supplémentaire de 2 fois la limite de jetons du forfait. Le dépassement n'est jamais disponible sur un pool d'équipe. - Exécutions Beyond : limitées à 10 par jour UTC pour les forfaits payants, 50 pour Unlimited.
L'utilisation du modèle de votre orchestrateur est facturée par votre fournisseur d'orchestrateur, comme d'habitude.
Résultats mesurés
Le 2026-09-28, nous avons évalué Claude Code (claude-sonnet-5) fonctionnant seul avec recherche web par rapport à Claude Code déléguant à ISMS Copilot selon la règle de routage publiée, avec une méthode préenregistrée, une clé de réponses construite à partir de sources officielles et une notation mécanique :
- Recherches et conseils rapides : égalité de précision selon la règle préenregistrée, pour un coût API Claude inférieur par réponse correcte.
- Une longue session mixte de codage et de conformité : égalité de précision, à un coût Claude environ identique.
- Petites tâches que Claude connaît déjà, sans recherche nécessaire : la délégation coûte 1.6 à 2.1 fois plus en consommation Claude, en raison des échanges supplémentaires. Gardez ces tâches dans votre orchestrateur.
L’utilisation du plan ISMS Copilot n’est pas incluse dans ces chiffres. La méthode, les tableaux, les mises en garde et ce que nous revendiquons ou non figurent sur la page de benchmark.
Ces résultats proviennent d’un seul orchestrateur, d’un seul modèle et d’un nombre limité d’exécutions. Ils ne justifient aucune économie en pourcentage, aucune affirmation de coût inférieur à celui d’un autre modèle ou abonnement, ni aucune affirmation de meilleure qualité de réponse que celle de votre propre orchestrateur.