La réponse courte
MCP coûte des tokens deux fois. Dans la liste d’outils : chaque définition d’outil est chargée avant votre premier mot. Et dans les allers-retours : chaque appel d’outil est un nouveau passage sur toute la conversation, et chaque résultat repasse par le modèle. Tool Search réduit la liste d’outils. Seul le code supprime les allers-retours.
Dans ce guide
Comment mesurer ce que MCP vous coûte ?
Avant de changer quoi que ce soit, regardez où vont vos tokens. Dans Claude Code, trois commandes le montrent :
/contextmontre ce qui occupe votre fenêtre de contexte, outils MCP compris./mcpliste vos serveurs et vous permet de désactiver ceux que vous n’utilisez pas./usageavec un abonnement, détaille votre utilisation récente du forfait par skills, sous-agents, plugins et serveurs MCP individuels.
Deux nombres comptent : la taille de la liste d’outils, et le nombre d’appels d’outils que fait une tâche typique. Le premier se lit dans /context. Le second se compte dans la transcription : chaque appel d’outil est une requête de plus au modèle.
Pourquoi MCP consomme-t-il autant de tokens ? Deux coûts
Le coût de la liste d’outils
Pour choisir un outil, le modèle doit lire sa définition. Les serveurs MCP publient toutes les leurs, si bien qu’une grosse configuration démarre la conversation déjà pleine. Anthropic a mesuré cinq serveurs avec 58 outils à environ 55 000 tokens avant le premier message ; les 35 outils de GitHub à eux seuls en représentaient environ 26 000. Une longue liste nuit aussi à la précision : au-delà de 30–50 outils, dit Anthropic, Claude choisit moins bien le bon.
Ce coût est déjà réduit à la source. Claude Code reporte par défaut le chargement des définitions d’outils MCP : seuls les noms et les instructions des serveurs entrent dans le contexte tant qu’un outil n’est pas utilisé. Cursor fait de même avec la découverte dynamique de contexte, qui a réduit les tokens de 46,9 % dans son propre test d’exécutions ayant appelé des outils MCP. Le Tool Search Tool d’Anthropic annonce 85 % de tokens en moins.
Le coût des allers-retours
Un appel d’outil n’est pas un appel de fonction à l’intérieur du modèle. C’est une nouvelle requête : le modèle écrit l’appel, l’environnement d’exécution le lance, le résultat revient, et le modèle relit toute la conversation pour écrire l’appel suivant. La documentation de Claude Code le dit sans détour : elle envoie votre conversation complète à chaque requête, et chaque fois que Claude utilise des outils, elle envoie une requête de plus portant ce lot de résultats d’outils. Le cache de prompt rend la relecture moins chère, pas gratuite.
Les résultats se paient une seconde fois. L’exemple d’Anthropic : déplacer la transcription d’une réunion de Google Drive vers Salesforce peut représenter 50 000 tokens de traitement supplémentaires, parce que le texte passe par le modèle en chemin.
Outil par outil
Un seul programme
Tool Search n’y change rien. Dans notre propre test, corriger une release sur un serveur de 152 outils, Claude Code a fait 26 appels au modèle avec Tool Search activé.
Qu’est-ce qui réduit la consommation de tokens MCP ? Les solutions, comparées
Chaque solution règle l’un des deux coûts, ou les deux. Aucune n’est gratuite, et la bonne dépend de la façon dont vous utilisez MCP.
| Solution | Réduit la liste d’outils | Réduit les allers-retours | Effort | Le bémol |
|---|---|---|---|---|
| Déconnecter les serveurs que vous n’utilisez pas | En partiePour ces serveurs | Non | Quelques minutes | Vous perdez ces outils jusqu’à ce que vous les reconnectiez. |
| Tool Search (définitions d’outils chargées à la demande) | OuiIntégré à Claude Code et à Cursor | Non | Aucun, activé par défaut | Chaque recherche est une étape de plus, et les appels eux-mêmes ne changent pas. |
| Une CLI plutôt qu’un serveur MCP (gh, aws…) | OuiPas de liste outil par outil | NonToujours une commande par appel | Seulement là où il existe une bonne CLI | Vous renoncez à l’étendue de MCP : beaucoup de services ont un serveur MCP et pas de CLI. |
| Une passerelle MCP | OuiEn général | En partieSeulement avec un mode code | Un service à exploiter et à sécuriser | Conçue pour les équipes et la gouvernance, pas pour un seul ordinateur portable. |
| Laisser le modèle écrire du code (mode code), construit par vos soins | OuiQuelques outils au lieu de centaines | OuiUn programme par tâche | Élevé : un bac à sable sécurisé, des limites et de la surveillance | Vous construisez et maintenez l’environnement, et Anthropic prévient que cela ajoute une charge d’exploitation. |
| Delta MCP | OuiTrois outils pour chaque serveur | OuiUn programme par tâche | Installez-le : deux minutes, gratuit | Conçu pour les tâches en plusieurs étapes. |
Le mode code est le schéma qu’Anthropic décrit dans Code execution with MCP et Cloudflare dans Code Mode. Delta MCP est ce schéma, prêt à l’emploi, pour les serveurs que vous utilisez déjà.
Que change Delta MCP ?
Delta MCP est une app gratuite qui se place entre vos applications d’IA et leurs serveurs MCP. Votre IA voit trois outils au lieu de chaque outil de chaque serveur, et écrit chaque tâche sous la forme d’un programme typé. Delta MCP vérifie le programme avant le premier appel, fait le moins d’appels possible, les applique tout ou rien, relit le résultat et le garde dans Activity, prêt à être annulé.
C’est le mode code sans le travail : les vérifications, l’application tout ou rien et l’annulation viennent avec l’app, sur votre ordinateur. Vos serveurs restent exactement tels quels, et chaque outil d’origine reste appelable par son nom.
Combien de tokens Delta MCP fait-il économiser ?
Claude Code avec Tool Search activé, Sonnet 5.5, deux à trois exécutions par variante, le résultat final vérifié dans chaque service.
| Tâche | Tokens | Appels au modèle | Mesuré |
|---|---|---|---|
| Corriger une release, en codeCerberus, 152 outils | 13,4× moins | 26 → 6,5 | 5 octobre |
| Ajouter des tests, en texteCerberus, 152 outils | 15,8× moins | 16,6 → 4 | 2 octobre |
| Nettoyer 20 tickets en retardUn gestionnaire de tickets | 4,8× moins | 5 → 2 | 2 octobre |
| Se connecter, ajouter 3 contacts, les listerMicrosoft Playwright MCP | 3,9× moins | 12,6 → 4 | 2 octobre |
| Une question sur la documentationContext7 | 1,2× moins | 4 → 3 | 5 octobre |
Plus une tâche a d’étapes, plus Delta MCP économise.
Toutes les mesures et la méthode
Ai-je encore besoin de Delta MCP si j’utilise Tool Search ?
Oui, quand vos tâches ont plusieurs étapes. Tool Search garde la liste d’outils courte, mais chaque étape reste un passage. Delta MCP supprime ces passages : votre IA écrit la tâche sous la forme d’un seul programme. Nos mesures ont été faites avec Tool Search activé, donc les économies s’y ajoutent.
Questions
Pourquoi MCP consomme-t-il autant de tokens ?
Pour deux raisons. Le modèle lit chaque définition d’outil avant de pouvoir en choisir un, et chaque appel d’outil est une requête distincte qui relit toute la conversation, tandis que chaque résultat repasse par le modèle. La première est le coût de la liste d’outils, la seconde celui des allers-retours.
Combien de tokens les outils MCP utilisent-ils ?
Cela dépend de vos serveurs. Anthropic a mesuré cinq serveurs avec 58 outils à environ 55 000 tokens avant le premier message, et les 35 outils de GitHub à eux seuls à environ 26 000. La commande /context de Claude Code affiche votre propre chiffre.
Tool Search règle-t-il la consommation de tokens de MCP ?
Il règle la liste d’outils, pas les allers-retours. Anthropic annonce 85 % de tokens en moins pour la liste, et l’équivalent de Cursor a réduit les tokens de 46,9 % dans des exécutions qui appelaient des outils MCP. Mais chaque appel d’outil reste sa propre requête sur toute la conversation.
L’exécution de code avec MCP est-elle vraiment moins chère ?
Sur les tâches en plusieurs étapes, souvent. L’exemple d’Anthropic est passé de 150 000 à 2 000 tokens, et Cloudflare a exposé plus de 2 500 points de terminaison d’API en environ 1 000 tokens. Les deux ont un coût : il faut un endroit sûr pour exécuter le code. Dans nos propres mesures, Delta MCP a utilisé 3,3–24,1× moins de tokens sur les tâches en plusieurs étapes.
Delta MCP économise-t-il des tokens ?
Oui, sur les tâches en plusieurs étapes : 3,3–24,1× moins de tokens dans nos tests, parce que votre IA écrit un seul programme au lieu d’un appel par étape.
Dois-je modifier mes serveurs MCP ?
Non. Delta MCP les utilise exactement tels quels, et chaque outil d’origine reste appelable par son nom : 152 sur 152 pour le plus gros serveur que nous ayons essayé.
Comment vérifier combien de tokens consomment mes serveurs MCP ?
Dans Claude Code, /context montre ce qui remplit votre fenêtre de contexte, définitions d’outils MCP comprises. /mcp liste vos serveurs et permet de désactiver ceux que vous n’utilisez pas ; avec un abonnement, /usage ventile l’usage récent par serveur MCP.
Sources
- Anthropic, Code execution with MCP: Building more efficient agents (4 nov. 2025) Les deux problèmes des appels d’outils directs ; l’exemple de 150 000 à 2 000 tokens ; l’exemple de la transcription de 50 000 tokens ; l’avertissement sur le bac à sable.
- Anthropic, Advanced tool use (24 nov. 2025) 58 outils sur cinq serveurs à environ 55 000 tokens ; 85 % de tokens en moins avec le Tool Search Tool.
- Anthropic, Tool search tool (documentation) La précision de Claude pour choisir un outil se dégrade au-delà de 30–50 outils.
- Claude Code, Manage costs effectively (documentation) Définitions d’outils MCP reportées par défaut ; /context, /mcp et /usage ; la conversation entière envoyée à chaque requête ; les CLI et la charge de MCP.
- Cursor, Dynamic context discovery (6 janv. 2026) 46,9 % de tokens en moins dans les exécutions ayant appelé un outil MCP, dans le propre test A/B de Cursor.
- Cloudflare, Code Mode: give agents an entire API in 1,000 tokens (20 févr. 2026) Plus de 2 500 points de terminaison en environ 1 000 tokens, contre 1,17 million avec un serveur MCP classique.
- Delta MCP, Benchmarks Chaque mesure de Delta MCP sur cette page, avec sa méthode.
À lire ensuite
- Limite Claude Code atteinte ? Le coût de vos serveurs MCPLimite d’utilisation Claude Code atteinte : « You've hit your limit » (session, hebdomadaire, Opus, dépenses), ce que coûtent vos serveurs MCP et quoi couper.
- MCP ou CLI pour les agents IA : d’où vient la facture ?MCP ou CLI pour votre agent IA ? Ce que chacun coûte en tokens, ce que montrent les mesures, quand une CLI l’emporte, quand MCP l’emporte, et où le code gagne.
- Fichier de configuration MCP : Claude, Cursor, VS CodeOù Claude Desktop, Claude Code, Cursor, VS Code, Windsurf, Gemini CLI et Codex gardent leur config MCP : chemin, clé JSON, serveurs distants, limites d’outils.