← Ressources

Stratégie IA · HOLCO · étude serveurs MCP

Étude : ce que coûte un serveur MCP de plus

Mis à jour le 2026-08-14 · Lecture 6 min

Réponse directe

Chaque serveur MCP branché charge toutes ses définitions d'outils dans le contexte à chaque conversation, à raison de 200 à 500 tokens par outil. Sur un cas documenté à trois serveurs, 143 000 tokens d'une fenêtre de 200 000 étaient consommés avant la première question. Les clients d'IA imposent des plafonds durs : 128 outils par requête chez GitHub Copilot, environ 40 chez Cursor.

Le même fil conducteur

Des outils différents. Une lecture gouvernée.

Explorer les ressources

Cette page est un relevé, pas une tribune. Elle rassemble les mesures publiées sur le coût de contexte des serveurs MCP, avec leur source et leur date, pour qu'elles puissent être citées et vérifiées.

Elle est maintenue : chaque chiffre porte sa source, et la page porte sa date de mise à jour. Si une mesure est infirmée, elle sera corrigée ici plutôt que discrètement retirée.

Relevé au 14 août 2026
200 à 500tokens par définition d'outil, chargée à chaque conversation qu'elle serve ou nonlittérature MCP 2026, valeurs concordantes sur plusieurs analyses
143 000tokens de schémas d'outils sur une fenêtre de 200 000, soit 72 %, avec trois serveurs branchés et environ 40 outilscas rapporté sur GitHub, Slack et Sentry
128outils par requête au maximum chez GitHub Copilot, plafond codé en dur qui renvoie une erreurdépôts microsoft/vscode et vscode-copilot-release
22 → 11 %taux de réussite d'un modèle divisé par deux sur une tâche, quand des serveurs MCP sans rapport sont ajoutésévaluations sur serveurs MCP réels, 2026

Part de la fenêtre de contexte occupée par les schémas d'outils, avant la première question

1 serveur
≈ 24 %
2 serveurs
≈ 48 %
3 serveurs (mesuré)
72 %

Cas rapporté à trois serveurs. Les valeurs à un et deux serveurs sont des ordres de grandeur dérivés du coût unitaire par outil, pas des mesures directes : elles sont données pour situer la pente, pas pour être citées comme relevés.

Ce qui est mesuré

Le coût de contexte d'un serveur MCP correspond aux définitions d'outils que le serveur déclare au client d'IA : nom, description, schéma des paramètres. Ces définitions sont chargées à l'ouverture de la conversation, pour tous les outils du serveur, indépendamment de la question posée.

Ce coût est donc payé même quand aucun outil n'est appelé. Il croît avec le nombre de serveurs branchés et avec la verbosité des descriptions, qui est le levier d'optimisation le plus direct.

Les plafonds imposés par les clients d'IA

Plusieurs éditeurs de clients d'IA ont posé des limites explicites, ce qui constitue la meilleure confirmation que le problème est opérationnel et pas théorique.

GitHub Copilot refuse les requêtes au-delà de 128 outils, avec un message d'erreur dédié, et le sujet fait l'objet de plusieurs tickets ouverts sur le dépôt de VS Code. Cursor plafonne autour de quarante outils.

Réserve à dire à côté du chiffre : ces plafonds sont ceux d'outils de développement, les mieux documentés. Les assistants grand public ne publient pas systématiquement les leurs, mais ils sont soumis à la même contrainte de fenêtre.

L'effet sur la qualité des réponses

L'ajout de serveurs MCP sans rapport avec la tâche demandée dégrade le taux de réussite à modèle constant. Sur des évaluations conduites avec de vrais serveurs, un modèle passe de 22,2 % à 11,1 % de réussite sur une tâche de navigation, et de 23,1 % à 15,4 % sur une tâche d'automatisation.

Le mode d'échec observé n'est pas le refus mais la confusion : le modèle mélange les paramètres de serveurs aux vocabulaires voisins, et fabrique une jointure entre deux sources qui n'a jamais existé. Une réponse erronée d'apparence normale est plus coûteuse qu'une absence de réponse, en particulier sur des données financières.

Ce que cette étude ne dit pas

Elle ne dit pas que le nombre d'outils est en soi un problème. Un serveur cohérent exposant quarante outils, conçu d'un seul tenant et sans chevauchement de vocabulaire, ne produit pas les mêmes effets que trois serveurs de quinze outils aux descriptions voisines. La variable explicative est l'hétérogénéité, pas le décompte. Nous le précisons d'autant plus volontiers que notre propre serveur expose une quarantaine d'outils.

Elle ne dit pas non plus qu'il existe un seuil universel. Les chiffres dépendent de la fenêtre du modèle, de la verbosité des schémas et de la tâche. Ils donnent une pente et un ordre de grandeur, pas une règle.

Enfin, les valeurs à un et deux serveurs de l'illustration ci-dessus sont dérivées du coût unitaire, pas mesurées directement. Elles sont signalées comme telles.

Citer cette étude

Référence : « Ce que coûte un serveur MCP de plus », HOLCO, relevé au 14 août 2026, https://holco.co/ressources/etude-cout-serveurs-mcp-contexte/

Les mesures citées appartiennent à leurs auteurs respectifs, indiqués sous chaque chiffre. Cette page en est une compilation datée, réutilisable avec attribution.

À retenir

  • Ce qui est mesuré
  • Les plafonds imposés par les clients d'IA
  • L'effet sur la qualité des réponses

Questions à poser

  • Combien de tokens coûte un serveur MCP ?
  • À partir de combien de serveurs MCP la qualité baisse-t-elle ?
  • Le nombre d'outils est-il le bon indicateur ?

Preuves à vérifier

  • Model Context Protocol (spécification)
  • microsoft/vscode, tickets sur la limite d'outils
  • Ordre des experts-comptables

Ressources / MCP & connecteurs

Approfondir ce sujet

MCP & connecteurs dans HOLCO · Tous les guides du sujet

À lire aussi

Sources professionnelles

FAQ

Combien de tokens coûte un serveur MCP ?

De 200 à 500 tokens par définition d'outil, chargés à chaque conversation que l'outil serve ou non. Un serveur de trente outils coûte donc de l'ordre de 6 000 à 15 000 tokens avant la première question.

À partir de combien de serveurs MCP la qualité baisse-t-elle ?

Les mesures publiées montrent une dégradation dès l'ajout de serveurs hétérogènes sans rapport avec la tâche, et les plafonds durs des clients d'IA sont atteints vers deux ou trois serveurs. Il n'existe pas de seuil universel : cela dépend de la fenêtre du modèle et de la verbosité des schémas.

Le nombre d'outils est-il le bon indicateur ?

Non. La variable explicative est l'hétérogénéité des serveurs et le chevauchement de leurs vocabulaires, pas le décompte d'outils. Un serveur cohérent de quarante outils se comporte mieux que trois serveurs de quinze aux descriptions voisines.

Ces chiffres sont-ils vérifiables ?

Oui, chaque valeur porte sa source sous le chiffre, et la page porte sa date de relevé. Les valeurs dérivées, non mesurées directement, sont signalées comme telles dans la note du graphique.

Ce contenu a pu être préparé avec l'assistance d'outils IA. Il a été relu, contextualisé et validé éditorialement par Pierre Coquard pour HOLCO.

Commencer

HOLCO s'ouvre sur demande.

Nous ouvrons progressivement, typologie de clients par typologie et logiciel par logiciel, parce que chaque déploiement est accompagné. Décrivez votre environnement : nous revenons vers vous si votre contexte correspond aux ouvertures en cours.

Ou écrivez à alan@holco.co

Demander un accès

Deux minutes pour nous présenter votre besoin.

IA déjà utilisées :