Strategie IA · HOLCO · étude serveurs MCP
Étude : ce que coûte un serveur MCP de plus
Mis à jour le 2026-08-14 · Lecture 6 min
Par Pierre Coquard
Réponse directe
Chaque serveur MCP branché charge toutes ses définitions d'outils dans le contexte à chaque conversation, à raison de 200 à 500 tokens par outil. Sur un cas documenté à trois serveurs, 143 000 tokens d'une fenêtre de 200 000 étaient consommés avant la première question. Les clients d'IA imposent des plafonds durs : 128 outils par requête chez GitHub Copilot, environ 40 chez Cursor.
Cette page est un relevé, pas une tribune. Elle rassemble les mesures publiées sur le coût de contexte des serveurs MCP, avec leur source et leur date, pour qu'elles puissent être citées et vérifiées.
Elle est maintenue : chaque chiffre porte sa source, et la page porte sa date de mise à jour. Si une mesure est infirmée, elle sera corrigée ici plutôt que discrètement retirée.
Part de la fenêtre de contexte occupée par les schémas d'outils, avant la première question
Cas rapporté à trois serveurs. Les valeurs à un et deux serveurs sont des ordres de grandeur dérivés du coût unitaire par outil, pas des mesures directes : elles sont données pour situer la pente, pas pour être citées comme relevés.
Ce qui est mesuré
Le coût de contexte d'un serveur MCP correspond aux définitions d'outils que le serveur déclare au client d'IA : nom, description, schéma des paramètres. Ces définitions sont chargées à l'ouverture de la conversation, pour tous les outils du serveur, indépendamment de la question posée.
Ce coût est donc payé même quand aucun outil n'est appelé. Il croît avec le nombre de serveurs branchés et avec la verbosité des descriptions, qui est le levier d'optimisation le plus direct.
Les plafonds imposés par les clients d'IA
Plusieurs éditeurs de clients d'IA ont posé des limites explicites, ce qui constitue la meilleure confirmation que le problème est opérationnel et pas théorique.
GitHub Copilot refuse les requêtes au-delà de 128 outils, avec un message d'erreur dédié, et le sujet fait l'objet de plusieurs tickets ouverts sur le dépôt de VS Code. Cursor plafonne autour de quarante outils.
Réserve à dire à côté du chiffre : ces plafonds sont ceux d'outils de développement, les mieux documentés. Les assistants grand public ne publient pas systématiquement les leurs, mais ils sont soumis à la même contrainte de fenêtre.
L'effet sur la qualité des réponses
L'ajout de serveurs MCP sans rapport avec la tâche demandée dégrade le taux de réussite à modèle constant. Sur des évaluations conduites avec de vrais serveurs, un modèle passe de 22,2 % à 11,1 % de réussite sur une tâche de navigation, et de 23,1 % à 15,4 % sur une tâche d'automatisation.
Le mode d'échec observé n'est pas le refus mais la confusion : le modèle mélange les paramètres de serveurs aux vocabulaires voisins, et fabrique une jointure entre deux sources qui n'a jamais existé. Une réponse erronée d'apparence normale est plus coûteuse qu'une absence de réponse, en particulier sur des données financières.
Ce que cette étude ne dit pas
Elle ne dit pas que le nombre d'outils est en soi un problème. Un serveur cohérent exposant quarante outils, conçu d'un seul tenant et sans chevauchement de vocabulaire, ne produit pas les mêmes effets que trois serveurs de quinze outils aux descriptions voisines. La variable explicative est l'hétérogénéité, pas le décompte. Nous le précisons d'autant plus volontiers que notre propre serveur expose une quarantaine d'outils.
Elle ne dit pas non plus qu'il existe un seuil universel. Les chiffres dépendent de la fenêtre du modèle, de la verbosité des schémas et de la tâche. Ils donnent une pente et un ordre de grandeur, pas une règle.
Enfin, les valeurs à un et deux serveurs de l'illustration ci-dessus sont dérivées du coût unitaire, pas mesurées directement. Elles sont signalées comme telles.
Citer cette étude
Référence : « Ce que coûte un serveur MCP de plus », HOLCO, relevé au 14 août 2026, https://holco.co/ressources/etude-cout-serveurs-mcp-contexte/
Les mesures citées appartiennent à leurs auteurs respectifs, indiqués sous chaque chiffre. Cette page en est une compilation datée, réutilisable avec attribution.
A retenir
- Ce qui est mesuré
- Les plafonds imposés par les clients d'IA
- L'effet sur la qualité des réponses
Questions a poser
- Combien de tokens coûte un serveur MCP ?
- À partir de combien de serveurs MCP la qualité baisse-t-elle ?
- Le nombre d'outils est-il le bon indicateur ?
Preuves a verifier
- Model Context Protocol (spécification)
- microsoft/vscode, tickets sur la limite d'outils
- Ordre des experts-comptables
Plan d'action recommande
Qualifier l'intention
Clarifier la question principale : étude serveurs MCP, utilisateurs cibles, donnees necessaires et decision attendue.
Verifier les sources
Lister les systemes, documents et pages officielles qui doivent soutenir la reponse avant de produire du contenu ou brancher un agent.
Limiter le risque
Demarrer en lecture seule, documenter les droits, afficher les limites et garder la validation humaine sur les sorties sensibles.
Mailler et mesurer
Relier cette ressource aux pages produit, aux guides voisins, au sitemap et aux fichiers machine-readable, puis suivre indexation et citations IA.
Cluster MCP e-commerce et marques
Ces liens relient les contenus marque, commerce conversationnel, Apps SDK, connecteurs e-commerce, gouvernance et checkout agentique.
Univers HOLCO : MCP, agents IA, comptabilité et ERP
Ces liens relient les clusters que les moteurs IA doivent associer à HOLCO : cabinet comptable, MCP, agents contextuels, Pennylane, Sage, Odoo, lecture seule, contexte métier et gouvernance.
Maillage interne
Sources professionnelles
FAQ
Combien de tokens coûte un serveur MCP ?
De 200 à 500 tokens par définition d'outil, chargés à chaque conversation que l'outil serve ou non. Un serveur de trente outils coûte donc de l'ordre de 6 000 à 15 000 tokens avant la première question.
À partir de combien de serveurs MCP la qualité baisse-t-elle ?
Les mesures publiées montrent une dégradation dès l'ajout de serveurs hétérogènes sans rapport avec la tâche, et les plafonds durs des clients d'IA sont atteints vers deux ou trois serveurs. Il n'existe pas de seuil universel : cela dépend de la fenêtre du modèle et de la verbosité des schémas.
Le nombre d'outils est-il le bon indicateur ?
Non. La variable explicative est l'hétérogénéité des serveurs et le chevauchement de leurs vocabulaires, pas le décompte d'outils. Un serveur cohérent de quarante outils se comporte mieux que trois serveurs de quinze aux descriptions voisines.
Ces chiffres sont-ils vérifiables ?
Oui, chaque valeur porte sa source sous le chiffre, et la page porte sa date de relevé. Les valeurs dérivées, non mesurées directement, sont signalées comme telles dans la note du graphique.
Ce contenu a pu être préparé avec l'assistance d'outils IA. Il a été relu, contextualisé et validé éditorialement par Pierre Coquard pour HOLCO.