Het korte antwoord
MCP kost tokens op twee manieren. In de toollijst: elke tooldefinitie wordt geladen vóór je eerste woord. En in de roundtrips: elke toolaanroep is een extra ronde over het hele gesprek, en elk resultaat gaat terug door het model. Tool Search maakt de toollijst kleiner. Alleen code haalt de roundtrips weg.
In deze handleiding
Hoe meet je wat MCP je kost?
Kijk eerst waar je tokens naartoe gaan voordat je iets verandert. In Claude Code laten drie commando’s dat zien:
/contexttoont wat je contextvenster gebruikt, MCP-tools inbegrepen./mcptoont je servers en laat je de servers uitzetten die je niet gebruikt./usagesplitst bij een abonnement je recente verbruik uit per skills, subagents, plugins en afzonderlijke MCP-servers.
Twee getallen tellen: hoe groot de toollijst is, en hoeveel toolaanroepen een typische taak doet. Het eerste staat in /context. Het tweede kun je tellen in het transcript: elke toolaanroep is nog een verzoek aan het model.
Waarom verbruikt MCP zoveel tokens? Twee kostenposten
De kosten van de toollijst
Om een tool te kiezen moet het model de definitie ervan lezen. MCP-servers publiceren al hun definities, dus een grote setup begint het gesprek al vol. Anthropic mat vijf servers met 58 tools op ongeveer 55.000 tokens vóór het eerste bericht; alleen al de 35 tools van GitHub kwamen op ongeveer 26.000. Een lange toollijst schaadt ook de nauwkeurigheid: boven de 30–50 tools wordt Claude volgens Anthropic slechter in het kiezen van de juiste.
Deze kostenpost wordt al bij de bron verkleind. Claude Code laadt MCP-tooldefinities standaard pas bij gebruik: alleen namen en serverinstructies komen in de context tot een tool wordt gebruikt. Cursor doet hetzelfde met dynamic context discovery, wat in een eigen test van runs die MCP-tools aanriepen de tokens met 46,9% verminderde. De Tool Search Tool van Anthropic meldt 85% minder tokens.
De kosten van de roundtrips
Een toolaanroep is geen functie-aanroep binnen het model. Het is een nieuw verzoek: het model schrijft de aanroep, de runtime voert hem uit, het resultaat komt terug, en het model leest het hele gesprek opnieuw om de volgende aanroep te schrijven. De eigen documentatie van Claude Code zegt het ronduit: het stuurt je volledige gesprek mee met elk verzoek, en elke keer dat Claude tools gebruikt, stuurt het nog een verzoek met die reeks toolresultaten. Prompt caching maakt het opnieuw lezen goedkoper, niet gratis.
Resultaten betalen een tweede keer. Het voorbeeld van Anthropic: een vergadertranscript van Google Drive naar Salesforce verplaatsen kan betekenen dat er 50.000 extra tokens worden verwerkt, omdat de tekst onderweg door het model stroomt.
Tool voor tool
Eén programma
Tool Search doet niets aan dit alles. In onze eigen test, een release repareren op een server met 152 tools, deed Claude Code 26 modelaanroepen met Tool Search aan.
Wat vermindert het tokenverbruik van MCP? De oplossingen vergeleken
Elke oplossing pakt één kostenpost aan, of beide. Geen enkele is gratis, en de juiste hangt af van hoe je MCP gebruikt.
| Oplossing | Verkleint de toollijst | Vermindert de roundtrips | Inspanning | Het addertje |
|---|---|---|---|---|
| Koppel de servers los die je niet gebruikt | GedeeltelijkVoor die servers | Nee | Minuten | Je verliest die tools tot je ze weer verbindt. |
| Tool Search (tooldefinities pas bij gebruik laden) | JaIngebouwd in Claude Code en Cursor | Nee | Geen, standaard aan | Elke opzoeking is nog een stap, en de aanroepen zelf blijven hetzelfde. |
| Een CLI in plaats van een MCP-server (gh, aws…) | JaGeen lijst per tool | NeeNog steeds één opdracht per aanroep | Alleen waar een goede CLI bestaat | Je geeft het bereik van MCP op: veel services hebben een MCP-server en geen CLI. |
| Een MCP-gateway | JaMeestal | GedeeltelijkAlleen met een code mode | Een dienst om te draaien en te beveiligen | Gebouwd voor teams en governance, niet voor één laptop. |
| Laat het model code schrijven (code mode), door jou gebouwd | JaEen paar tools in plaats van honderden | JaEén programma per taak | Hoog: een veilige sandbox, limieten en monitoring | Jij bouwt en onderhoudt de omgeving, en Anthropic waarschuwt dat het operationele overhead toevoegt. |
| Delta MCP | JaDrie tools voor elke server | JaEén programma per taak | Installeer het: twee minuten, gratis | Gebouwd voor taken met meerdere stappen. |
Code mode is het patroon dat Anthropic beschrijft in Code execution with MCP en Cloudflare in Code Mode. Delta MCP is dat patroon, kant-en-klaar, voor de servers die je al gebruikt.
Wat verandert Delta MCP?
Delta MCP is een gratis app die tussen je AI-apps en hun MCP-servers zit. Je AI ziet drie tools in plaats van elke tool van elke server, en schrijft elke taak als één getypeerd programma. Delta MCP controleert het programma vóór de eerste aanroep, doet zo min mogelijk aanroepen, past ze alles of niets toe, leest het resultaat terug en bewaart het in Activity, klaar om ongedaan te maken.
Dat is code mode zonder het werk: de controles, het alles-of-niets toepassen en het ongedaan maken zitten in de app, op je computer. Je servers blijven precies zoals ze zijn, en elke originele tool blijft aanroepbaar bij naam.
Hoeveel tokens bespaart Delta MCP?
Claude Code met Tool Search aan, Sonnet 5.5, twee tot drie runs per variant, het eindresultaat gecontroleerd in elke service.
| Taak | Tokens | Modelaanroepen | Gemeten |
|---|---|---|---|
| Een release repareren, als codeCerberus, 152 tools | 13,4× minder | 26 → 6,5 | 5 oktober |
| Tests toevoegen, als tekstCerberus, 152 tools | 15,8× minder | 16,6 → 4 | 2 oktober |
| 20 achterstallige tickets opruimenEen ticketsysteem | 4,8× minder | 5 → 2 | 2 oktober |
| Inloggen, 3 contacten toevoegen, ze weergevenMicrosoft Playwright MCP | 3,9× minder | 12,6 → 4 | 2 oktober |
| Een vraag over documentatieContext7 | 1,2× minder | 4 → 3 | 5 oktober |
Hoe meer stappen een taak heeft, hoe meer Delta MCP bespaart.
Heb ik Delta MCP nog nodig als ik Tool Search gebruik?
Ja, als je taken meerdere stappen hebben. Tool Search houdt de toollijst klein, maar elke stap blijft een ronde. Delta MCP haalt die rondes weg: je AI schrijft de taak als één programma. Onze metingen zijn gedaan met Tool Search aan, dus de besparing komt daar bovenop.
Vragen
Waarom gebruikt MCP zoveel tokens?
Twee redenen. Het model leest elke tooldefinitie voordat het er een kan kiezen, en elke toolaanroep is een apart verzoek dat het hele gesprek opnieuw leest, waarbij elk resultaat terugstroomt door het model. Het eerste zijn de kosten van de toollijst, het tweede de kosten van de roundtrips.
Hoeveel tokens gebruiken MCP-tools?
Dat hangt af van je servers. Anthropic mat vijf servers met 58 tools op ongeveer 55.000 tokens vóór het eerste bericht, en alleen al de 35 tools van GitHub op ongeveer 26.000. Het commando /context van Claude Code toont je eigen getal.
Lost Tool Search het MCP-tokenverbruik op?
Het lost de toollijst op, niet de roundtrips. Anthropic meldt 85% minder tokens voor de toollijst, en het equivalent van Cursor verminderde de tokens met 46,9% in runs die MCP-tools aanriepen. Maar elke toolaanroep blijft een eigen verzoek over het hele gesprek.
Is code execution met MCP echt goedkoper?
Bij taken met meerdere stappen vaak wel. Het voorbeeld van Anthropic daalde van 150.000 naar 2.000 tokens, en Cloudflare maakte meer dan 2.500 API-endpoints beschikbaar in ongeveer 1.000 tokens. Beide hebben een prijs: je hebt een veilige plek nodig om de code uit te voeren. In onze eigen metingen gebruikte Delta MCP 3,3–24,1× minder tokens bij taken met meerdere stappen.
Bespaart Delta MCP tokens?
Ja, bij taken met meerdere stappen: 3,3–24,1× minder tokens in onze tests, omdat je AI één programma schrijft in plaats van één aanroep per stap.
Moet ik mijn MCP-servers aanpassen?
Nee. Delta MCP gebruikt ze precies zoals ze zijn, en elke originele tool blijft aanroepbaar bij naam: 152 van 152 op de grootste server die we hebben geprobeerd.
Hoe controleer ik hoeveel tokens mijn MCP-servers gebruiken?
In Claude Code toont /context wat je contextvenster vult, MCP-tooldefinities inbegrepen. /mcp toont je servers en laat je de servers uitzetten die je niet gebruikt, en bij een abonnement splitst /usage het recente verbruik uit per afzonderlijke MCP-server.
Bronnen
- Anthropic, Code execution with MCP: Building more efficient agents (4 nov 2025) De twee problemen met directe toolaanroepen; het voorbeeld van 150.000 naar 2.000 tokens; het voorbeeld van een transcript van 50.000 tokens; de waarschuwing over de sandbox.
- Anthropic, Advanced tool use (24 nov 2025) 58 tools op vijf servers op ongeveer 55.000 tokens; 85% minder tokens met de Tool Search Tool.
- Anthropic, Tool search tool (documentation) De nauwkeurigheid van Claude bij het kiezen van een tool neemt af boven 30–50 tools.
- Claude Code, Manage costs effectively (documentation) MCP-tooldefinities standaard pas bij gebruik geladen; /context, /mcp en /usage; het volledige gesprek dat met elk verzoek wordt meegestuurd; CLI’s en MCP-overhead.
- Cursor, Dynamic context discovery (6 jan 2026) 46,9% minder tokens in runs die een MCP-tool aanriepen, in de eigen A/B-test van Cursor.
- Cloudflare, Code Mode: give agents an entire API in 1,000 tokens (20 feb 2026) Meer dan 2.500 endpoints in ongeveer 1.000 tokens, tegenover 1,17 miljoen als gewone MCP-server.
- Delta MCP, Benchmarks Elke meting van Delta MCP op deze pagina, met de methode.
Lees verder
- Claude Code-limiet bereikt? Wat je MCP-servers kostenWat “You've hit your limit” in Claude Code betekent (sessie, week, Opus, uitgaven), hoe /usage toont wat je MCP-servers kosten, en wat je eerst schrapt.
- MCP vs CLI voor AI-agents: waar de tokenkosten vandaan komenMCP of CLI voor je AI-agent? Wat elk aan tokens kost, wat de metingen laten zien, wanneer een CLI wint, wanneer MCP, en waar code ze allebei verslaat.
- MCP-configbestand: waar staat het? Claude, Cursor, VS CodeWaar Claude Desktop, Claude Code, Cursor, VS Code, Windsurf, Gemini CLI en Codex hun MCP-config bewaren: pad, JSON-sleutel, remote servers en toollimieten.