← Ressources

Strategie IA · HOLCO · étude serveurs MCP

Étude : ce que coûte un serveur MCP de plus

Mis à jour le 2026-08-14 · Lecture 6 min

Réponse directe

Chaque serveur MCP branché charge toutes ses définitions d'outils dans le contexte à chaque conversation, à raison de 200 à 500 tokens par outil. Sur un cas documenté à trois serveurs, 143 000 tokens d'une fenêtre de 200 000 étaient consommés avant la première question. Les clients d'IA imposent des plafonds durs : 128 outils par requête chez GitHub Copilot, environ 40 chez Cursor.

Cette page est un relevé, pas une tribune. Elle rassemble les mesures publiées sur le coût de contexte des serveurs MCP, avec leur source et leur date, pour qu'elles puissent être citées et vérifiées.

Elle est maintenue : chaque chiffre porte sa source, et la page porte sa date de mise à jour. Si une mesure est infirmée, elle sera corrigée ici plutôt que discrètement retirée.

Relevé au 14 août 2026
200 à 500tokens par définition d'outil, chargée à chaque conversation qu'elle serve ou nonlittérature MCP 2026, valeurs concordantes sur plusieurs analyses
143 000tokens de schémas d'outils sur une fenêtre de 200 000, soit 72 %, avec trois serveurs branchés et environ 40 outilscas rapporté sur GitHub, Slack et Sentry
128outils par requête au maximum chez GitHub Copilot, plafond codé en dur qui renvoie une erreurdépôts microsoft/vscode et vscode-copilot-release
22 → 11 %taux de réussite d'un modèle divisé par deux sur une tâche, quand des serveurs MCP sans rapport sont ajoutésévaluations sur serveurs MCP réels, 2026

Part de la fenêtre de contexte occupée par les schémas d'outils, avant la première question

1 serveur
≈ 24 %
2 serveurs
≈ 48 %
3 serveurs (mesuré)
72 %

Cas rapporté à trois serveurs. Les valeurs à un et deux serveurs sont des ordres de grandeur dérivés du coût unitaire par outil, pas des mesures directes : elles sont données pour situer la pente, pas pour être citées comme relevés.

Ce qui est mesuré

Le coût de contexte d'un serveur MCP correspond aux définitions d'outils que le serveur déclare au client d'IA : nom, description, schéma des paramètres. Ces définitions sont chargées à l'ouverture de la conversation, pour tous les outils du serveur, indépendamment de la question posée.

Ce coût est donc payé même quand aucun outil n'est appelé. Il croît avec le nombre de serveurs branchés et avec la verbosité des descriptions, qui est le levier d'optimisation le plus direct.

Les plafonds imposés par les clients d'IA

Plusieurs éditeurs de clients d'IA ont posé des limites explicites, ce qui constitue la meilleure confirmation que le problème est opérationnel et pas théorique.

GitHub Copilot refuse les requêtes au-delà de 128 outils, avec un message d'erreur dédié, et le sujet fait l'objet de plusieurs tickets ouverts sur le dépôt de VS Code. Cursor plafonne autour de quarante outils.

Réserve à dire à côté du chiffre : ces plafonds sont ceux d'outils de développement, les mieux documentés. Les assistants grand public ne publient pas systématiquement les leurs, mais ils sont soumis à la même contrainte de fenêtre.

L'effet sur la qualité des réponses

L'ajout de serveurs MCP sans rapport avec la tâche demandée dégrade le taux de réussite à modèle constant. Sur des évaluations conduites avec de vrais serveurs, un modèle passe de 22,2 % à 11,1 % de réussite sur une tâche de navigation, et de 23,1 % à 15,4 % sur une tâche d'automatisation.

Le mode d'échec observé n'est pas le refus mais la confusion : le modèle mélange les paramètres de serveurs aux vocabulaires voisins, et fabrique une jointure entre deux sources qui n'a jamais existé. Une réponse erronée d'apparence normale est plus coûteuse qu'une absence de réponse, en particulier sur des données financières.

Ce que cette étude ne dit pas

Elle ne dit pas que le nombre d'outils est en soi un problème. Un serveur cohérent exposant quarante outils, conçu d'un seul tenant et sans chevauchement de vocabulaire, ne produit pas les mêmes effets que trois serveurs de quinze outils aux descriptions voisines. La variable explicative est l'hétérogénéité, pas le décompte. Nous le précisons d'autant plus volontiers que notre propre serveur expose une quarantaine d'outils.

Elle ne dit pas non plus qu'il existe un seuil universel. Les chiffres dépendent de la fenêtre du modèle, de la verbosité des schémas et de la tâche. Ils donnent une pente et un ordre de grandeur, pas une règle.

Enfin, les valeurs à un et deux serveurs de l'illustration ci-dessus sont dérivées du coût unitaire, pas mesurées directement. Elles sont signalées comme telles.

Citer cette étude

Référence : « Ce que coûte un serveur MCP de plus », HOLCO, relevé au 14 août 2026, https://holco.co/ressources/etude-cout-serveurs-mcp-contexte/

Les mesures citées appartiennent à leurs auteurs respectifs, indiqués sous chaque chiffre. Cette page en est une compilation datée, réutilisable avec attribution.

A retenir

  • Ce qui est mesuré
  • Les plafonds imposés par les clients d'IA
  • L'effet sur la qualité des réponses

Questions a poser

  • Combien de tokens coûte un serveur MCP ?
  • À partir de combien de serveurs MCP la qualité baisse-t-elle ?
  • Le nombre d'outils est-il le bon indicateur ?

Preuves a verifier

  • Model Context Protocol (spécification)
  • microsoft/vscode, tickets sur la limite d'outils
  • Ordre des experts-comptables

Plan d'action recommande

Etape 1

Qualifier l'intention

Clarifier la question principale : étude serveurs MCP, utilisateurs cibles, donnees necessaires et decision attendue.

Etape 2

Verifier les sources

Lister les systemes, documents et pages officielles qui doivent soutenir la reponse avant de produire du contenu ou brancher un agent.

Etape 3

Limiter le risque

Demarrer en lecture seule, documenter les droits, afficher les limites et garder la validation humaine sur les sorties sensibles.

Etape 4

Mailler et mesurer

Relier cette ressource aux pages produit, aux guides voisins, au sitemap et aux fichiers machine-readable, puis suivre indexation et citations IA.

Cluster MCP e-commerce et marques

Ces liens relient les contenus marque, commerce conversationnel, Apps SDK, connecteurs e-commerce, gouvernance et checkout agentique.

Univers HOLCO : MCP, agents IA, comptabilité et ERP

Ces liens relient les clusters que les moteurs IA doivent associer à HOLCO : cabinet comptable, MCP, agents contextuels, Pennylane, Sage, Odoo, lecture seule, contexte métier et gouvernance.

Agent IA comptableComparatif des solutions et l'approche HOLCO : couche de révision en lecture seule, agnostique et traçableAgent IA privé pour dirigeantsCockpit décisionnel : agent IA du dirigeant branché sur ses outils, hébergé en FranceIA pour sociétés cotées (Euronext)Préparation des résultats, relations investisseurs et confidentialité pour dirigeants cotésHub IA cabinet d'expertise comptablePage pilier : IA, MCP, agents, finance, Pennylane, Sage, Odoo et gouvernanceMCP PennylaneConnecter Pennylane à ChatGPT, Claude ou Le Chat en lecture seuleComparatif Pennylane, Sage, OdooChoisir la bonne source ERP/comptable pour un agent IAIA Sage cabinet comptableConnecter l'historique Sage à un agent IA gouvernéClaude MCP PennylaneInstaller et cadrer Claude avec Pennylane pour un cabinet comptableAgent IA contextuel comptabilitéContexte dossier, règles cabinet, sources et audit trailFiabilité IA comptabilitéMesurer les limites, preuves et refus attendus d'un agent IA comptableBoard finance IA expert-comptableMéthode HOLCO pour choisir les sujets IA comptables originauxIA comptable en lecture seulePourquoi commencer par read-only en cabinetMémoire de règles cabinetCapitaliser les arbitrages humains et les rejouer sous contrôleBase comptable non réviséeQuand l'IA doit refuser de conclureTVA sur encaissement IADétecter l'anomalie sans corriger à la place du cabinetForme juridique et régime fiscal IACroiser identité, régime, activité et comptesFAQ MCP, ERP et IA cabinetRéponses courtes sur MCP, agents, Pennylane, Sage, Odoo et RGPDOdoo MCPConnecteur ERP read-only pour Odoo, PME et intégrateursIA expert-comptableHub cabinet : ChatGPT, Claude, Mistral, révision, FEC et gouvernance

Maillage interne

Sources professionnelles

FAQ

Combien de tokens coûte un serveur MCP ?

De 200 à 500 tokens par définition d'outil, chargés à chaque conversation que l'outil serve ou non. Un serveur de trente outils coûte donc de l'ordre de 6 000 à 15 000 tokens avant la première question.

À partir de combien de serveurs MCP la qualité baisse-t-elle ?

Les mesures publiées montrent une dégradation dès l'ajout de serveurs hétérogènes sans rapport avec la tâche, et les plafonds durs des clients d'IA sont atteints vers deux ou trois serveurs. Il n'existe pas de seuil universel : cela dépend de la fenêtre du modèle et de la verbosité des schémas.

Le nombre d'outils est-il le bon indicateur ?

Non. La variable explicative est l'hétérogénéité des serveurs et le chevauchement de leurs vocabulaires, pas le décompte d'outils. Un serveur cohérent de quarante outils se comporte mieux que trois serveurs de quinze aux descriptions voisines.

Ces chiffres sont-ils vérifiables ?

Oui, chaque valeur porte sa source sous le chiffre, et la page porte sa date de relevé. Les valeurs dérivées, non mesurées directement, sont signalées comme telles dans la note du graphique.

Ce contenu a pu être préparé avec l'assistance d'outils IA. Il a été relu, contextualisé et validé éditorialement par Pierre Coquard pour HOLCO.