La risposta breve
MCP costa token due volte. Nell’elenco: ogni definizione di strumento viene caricata prima della tua prima parola. E nei round trip: ogni chiamata a uno strumento è un’altra passata su tutta la conversazione, e ogni risultato ripassa dal modello. Tool Search accorcia l’elenco. Solo il codice elimina i round trip.
In questa guida
Come misuri quanto ti costa MCP?
Prima di cambiare qualcosa, guarda dove vanno i tuoi token. In Claude Code lo mostrano tre comandi:
/contextmostra cosa occupa la tua finestra di contesto, strumenti MCP inclusi./mcpelenca i tuoi server e ti lascia disattivare quelli che non usi./usagecon un abbonamento, suddivide l’utilizzo recente del tuo piano per skill, subagent, plugin e singoli server MCP.
Contano due numeri: quanto è grande l’elenco degli strumenti e quante chiamate a strumenti fa un task tipico. Il primo è in /context. Il secondo puoi contarlo nella trascrizione: ogni chiamata a uno strumento è un’altra richiesta al modello.
Perché MCP consuma così tanti token? Due costi
Il costo dell’elenco degli strumenti
Per scegliere uno strumento, il modello deve leggerne la definizione. I server MCP le pubblicano tutte, quindi una configurazione grande inizia la conversazione già piena. Anthropic ha misurato cinque server con 58 strumenti a circa 55.000 token prima del primo messaggio; i soli 35 strumenti di GitHub arrivavano a circa 26.000. Un elenco lungo peggiora anche la precisione: oltre i 30–50 strumenti, dice Anthropic, Claude sceglie peggio quello giusto.
Questo costo si sta già riducendo alla fonte. Claude Code rinvia di default le definizioni degli strumenti MCP: nel contesto entrano solo i nomi e le istruzioni del server finché non viene usato uno strumento. Cursor fa lo stesso con la dynamic context discovery, che ha ridotto i token del 46,9% nel suo test sulle esecuzioni che chiamavano strumenti MCP. Il Tool Search Tool di Anthropic riporta l’85% di token in meno.
Il costo dei round trip
Una chiamata a uno strumento non è una chiamata di funzione dentro il modello. È una nuova richiesta: il modello scrive la chiamata, il runtime la esegue, il risultato torna indietro e il modello rilegge l’intera conversazione per scrivere la chiamata successiva. La documentazione di Claude Code lo dice chiaramente: invia l’intera conversazione a ogni richiesta, e ogni volta che Claude usa strumenti invia un’altra richiesta con quel lotto di risultati. Il prompt caching rende la rilettura più economica, non gratuita.
I risultati si pagano una seconda volta. L’esempio di Anthropic: spostare la trascrizione di una riunione da Google Drive a Salesforce può significare elaborare altri 50.000 token, perché il testo passa dal modello lungo il percorso.
Strumento per strumento
Un solo programma
Tool Search non fa nulla a riguardo. Nel nostro test, correggere una release su un server con 152 strumenti, Claude Code ha fatto 26 chiamate al modello con Tool Search attivo.
Cosa riduce il consumo di token MCP? Le soluzioni a confronto
Ogni soluzione risolve un costo o entrambi. Nessuna è gratis, e quella giusta dipende da come usi MCP.
| Soluzione | Accorcia l’elenco | Elimina i round trip | Impegno | Il punto debole |
|---|---|---|---|---|
| Disconnetti i server che non usi | In partePer quei server | No | Minuti | Perdi quegli strumenti finché non li ricolleghi. |
| Tool Search (definizioni degli strumenti rinviate) | SìIntegrato in Claude Code e Cursor | No | Nessuno, attivo di default | Ogni ricerca è un passaggio in più, e le chiamate in sé restano uguali. |
| Una CLI al posto di un server MCP (gh, aws…) | SìNessun elenco per strumento | NoSempre un comando per chiamata | Solo dove esiste una buona CLI | Rinunci alla portata di MCP: molti servizi hanno un server MCP e nessuna CLI. |
| Un gateway MCP | SìDi solito | In parteSolo con una modalità codice | Un servizio da gestire e mettere in sicurezza | Pensato per team e governance, non per un solo portatile. |
| Far scrivere codice al modello (modalità codice), costruita da te | SìPochi strumenti invece di centinaia | SìUn programma per task | Alto: una sandbox sicura, limiti e monitoraggio | Costruisci e mantieni tu l’ambiente, e Anthropic avverte che aggiunge overhead operativo. |
| Delta MCP | SìTre strumenti per ogni server | SìUn programma per task | Installalo: due minuti, gratis | Pensato per task con più passaggi. |
La modalità codice è il modello descritto da Anthropic in Code execution with MCP e da Cloudflare in Code Mode. Delta MCP è quel modello, pronto all’uso, per i server che usi già.
Cosa cambia con Delta MCP?
Delta MCP è un’app gratuita che sta tra le tue app di IA e i loro server MCP. La tua IA vede tre strumenti invece di tutti gli strumenti di ogni server, e scrive ogni task come un unico programma tipizzato. Delta MCP controlla il programma prima della prima chiamata, fa il minor numero di chiamate, le applica tutte o nessuna, rilegge il risultato e lo conserva in Activity, pronto da annullare.
È la modalità codice senza il lavoro: i controlli, l’applicazione tutto o niente e l’annullamento vengono con l’app, sul tuo computer. I tuoi server restano esattamente come sono, e ogni strumento originale resta richiamabile per nome.
Quanti token fa risparmiare Delta MCP?
Claude Code con Tool Search attivo, Sonnet 5.5, da due a tre esecuzioni per variante, risultato finale verificato in ogni servizio.
| Task | Token | Chiamate al modello | Misurato |
|---|---|---|---|
| Correggere una release, come codiceCerberus, 152 strumenti | 13,4× in meno | 26 → 6,5 | 5 ottobre |
| Aggiungere test, come testoCerberus, 152 strumenti | 15,8× in meno | 16,6 → 4 | 2 ottobre |
| Sistemare 20 ticket in ritardoUn gestore di ticket | 4,8× in meno | 5 → 2 | 2 ottobre |
| Accedere, aggiungere 3 contatti, elencarliMicrosoft Playwright MCP | 3,9× in meno | 12,6 → 4 | 2 ottobre |
| Una domanda sulla documentazioneContext7 | 1,2× in meno | 4 → 3 | 5 ottobre |
Più passaggi ha un task, più Delta MCP fa risparmiare.
Mi serve ancora Delta MCP se uso Tool Search?
Sì, quando i tuoi task hanno più passaggi. Tool Search mantiene piccolo l’elenco, ma ogni passaggio resta una passata sulla conversazione. Delta MCP elimina quelle passate: la tua IA scrive il task come un unico programma. Le nostre misure sono state fatte con Tool Search attivo, quindi i risparmi si sommano ai suoi.
Domande
Perché MCP consuma così tanti token?
Per due motivi. Il modello legge ogni definizione di strumento prima di poterne scegliere uno, e ogni chiamata a uno strumento è una richiesta separata che rilegge l’intera conversazione, con ogni risultato che ripassa dal modello. Il primo è il costo dell’elenco, il secondo il costo dei round trip.
Quanti token usano gli strumenti MCP?
Dipende dai tuoi server. Anthropic ha misurato cinque server con 58 strumenti a circa 55.000 token prima del primo messaggio, e i soli 35 strumenti di GitHub a circa 26.000. Il comando /context di Claude Code mostra il tuo numero.
Tool Search risolve il consumo di token MCP?
Risolve l’elenco, non i round trip. Anthropic riporta l’85% di token in meno per l’elenco, e l’equivalente di Cursor ha ridotto i token del 46,9% nelle esecuzioni che chiamavano strumenti MCP. Ma ogni chiamata a uno strumento resta una richiesta a sé su tutta la conversazione.
L’esecuzione di codice con MCP costa davvero meno?
Nei task con più passaggi, spesso sì. L’esempio di Anthropic è sceso da 150.000 a 2.000 token, e Cloudflare ha esposto più di 2.500 endpoint API in circa 1.000 token. Entrambi hanno un costo: serve un posto sicuro dove eseguire il codice. Nelle nostre misure Delta MCP ha usato 3,3–24,1× token in meno nei task con più passaggi.
Delta MCP fa risparmiare token?
Sì, nei task con più passaggi: 3,3–24,1× token in meno nei nostri test, perché la tua IA scrive un unico programma invece di una chiamata per passaggio.
Devo modificare i miei server MCP?
No. Delta MCP li usa esattamente come sono, e ogni strumento originale resta richiamabile per nome: 152 su 152 sul server più grande che abbiamo provato.
Come controllo quanti token usano i miei server MCP?
In Claude Code, /context mostra cosa riempie la tua finestra di contesto, definizioni degli strumenti MCP incluse. /mcp elenca i tuoi server e ti lascia disattivare quelli che non usi, e con un abbonamento /usage suddivide l’utilizzo recente per singolo server MCP.
Fonti
- Anthropic, Code execution with MCP: Building more efficient agents (4 nov 2025) I due problemi delle chiamate dirette agli strumenti; l’esempio da 150.000 a 2.000 token; l’esempio della trascrizione da 50.000 token; l’avvertenza sulla sandbox.
- Anthropic, Advanced tool use (24 nov 2025) 58 strumenti su cinque server a circa 55.000 token; 85% di token in meno con il Tool Search Tool.
- Anthropic, Tool search tool (documentation) La precisione di Claude nello scegliere uno strumento peggiora oltre i 30–50 strumenti.
- Claude Code, Manage costs effectively (documentation) Definizioni degli strumenti MCP rinviate di default; /context, /mcp e /usage; la conversazione completa inviata a ogni richiesta; CLI e overhead di MCP.
- Cursor, Dynamic context discovery (6 gen 2026) 46,9% di token in meno nelle esecuzioni che chiamavano uno strumento MCP, nel test A/B di Cursor stesso.
- Cloudflare, Code Mode: give agents an entire API in 1,000 tokens (20 feb 2026) Più di 2.500 endpoint in circa 1.000 token, contro 1,17 milioni come semplice server MCP.
- Delta MCP, Benchmarks Ogni misura di Delta MCP in questa pagina, con il suo metodo.
Continua a leggere
- Limite di Claude Code raggiunto? Cosa costano i server MCPLimite di utilizzo di Claude Code raggiunto: cosa significa «You've hit your limit» (sessione, settimanale, Opus, spesa), cosa mostra /usage e cosa tagliare.
- MCP vs CLI per agenti IA: da dove viene il costo in tokenMCP o CLI per il tuo agente IA? Cosa costa ciascuno in token, cosa mostrano le misure, quando vince una CLI, quando vince MCP e dove il codice batte entrambi.
- File di configurazione MCP: Claude, Cursor, VS Code e altriDove tengono la configurazione MCP Claude Desktop, Claude Code, Cursor, VS Code, Windsurf, Gemini CLI e Codex: percorso, chiave JSON, server remoti e limiti.