नतीजा वही, 24.1× तक कम टोकन।
Delta MCP के साथ कई कदमों वाले काम बहुत कम टोकन में होते हैं, कम लागत में, और उतनी ही तेज़ी से या उससे ज़्यादा तेज़ी से, नतीजा वही, सेवा में ही जाँचा हुआ। 8 परिदृश्य, हर एक Delta MCP के साथ और उसके बिना चलाया गया, Sonnet 5.5 के साथ Claude Code में।
कई कदमों वाले कामों पर कम बिल किए गए टोकन
कई कदमों वाले कामों पर कम लागत, कैश की सबसे सख़्त स्थिति में भी
कई कदमों वाले कामों पर तेज़, और कोई भी परिदृश्य धीमा नहीं
टूल अब भी Delta MCP के ज़रिए घोषित हैं और कॉल किए जा सकते हैं
हर परिदृश्य, हर आँकड़ा
एक रिलीज़ ठीक करने के काम से, जिसमें Delta MCP के बिना 26 मॉडल कॉल लगती हैं, एक अकेले सवाल तक। हर वैरिएंट के 2 से 3 रन का औसत, हर परिदृश्य में नतीजा एक जैसा। “भारित लागत” वह लागत है जो Claude Code हर मॉडल के लिए बताता है, इनपुट टोकन के बराबर इकाइयों में, कैश की सबसे सख़्त स्थिति में। हर सर्वर के लिए डिफ़ॉल्ट “कोड में” है; “टेक्स्ट में” एक Cerberus अडैप्टर का इस्तेमाल करता है।
| काम | सर्वर | टोकन | भारित लागत | मॉडल कॉल | समय | माप की तारीख़ |
|---|---|---|---|---|---|---|
| एक रिलीज़ ठीक करना, टेक्स्ट में | Cerberus, 152 टूल | 24.1× कम | 8.1× कम | 26 → 4.5 | 1.2× तेज़ | 2 अक्टूबर |
| टेस्ट जोड़ना, टेक्स्ट में | Cerberus, 152 टूल | 15.8× कम | 5.8× कम | 16.6 → 4 | 2.0× तेज़ | 2 अक्टूबर |
| एक रिलीज़ ठीक करना, कोड में | Cerberus, 152 टूल | 13.4× कम | 6.1× कम | 26 → 6.5 | उतना ही तेज़ | 5 अक्टूबर* |
| देर से चल रहे 20 टिकट निपटाना | एक टिकट मैनेजर | 4.8× कम | 4.0× कम | 5 → 2 | 4.4× तेज़ | 2 अक्टूबर |
| लॉग इन करना, 3 संपर्क जोड़ना, उनकी सूची देखना | Microsoft Playwright MCP | 3.9× कम | 1.8× कम | 12.6 → 4 | 2.1× तेज़ | 2 अक्टूबर |
| कामों की एक सूची में 6 बदलाव करना | taskqueue-mcp | 3.3× कम | 1.5× कम | 5.6 → 2 | 2.1× तेज़ | 2 अक्टूबर |
| डॉक्यूमेंटेशन से जुड़ा एक सवाल | Context7 | 1.2× कम | 1.11× ज़्यादा | 4 → 3 | उतना ही तेज़ | 5 अक्टूबर |
| एक कदम वाला सवाल | Playwright, books.toscrape.com | 1.25× ज़्यादा | 2.5× ज़्यादा | 4 → 3 | 1.1× तेज़ | 5 अक्टूबर |
* Delta MCP का माप 5 अक्टूबर को, सीधी कॉल का 2 अक्टूबर को।
यह टिकता है
उन कामों पर भी टिकता है जो इसने कभी नहीं देखे
ट्यूनिंग के बाद लिखे गए मिशन, जिनका ट्यूनिंग में कभी इस्तेमाल नहीं हुआ, उनमें 3.7 से 4.1 गुना कम टोकन लगे।
वही गुणवत्ता, हर रन पर जाँची हुई
आख़िरी चरण में 27 में से 26 रन बेदाग रहे, और 27वें में कुछ भी गलत नहीं था। सभी 103 रन एक के बाद एक पढ़े गए: सटीक टेक्स्ट, कोई फ़ील्ड गलती से नहीं छुआ गया, उपयोगकर्ता को सही जवाब। इस जाँच में वे दो ख़ामियाँ भी मिलीं जो अपने आप होने वाली जाँचों से छूट गई थीं, और अब ठीक कर दी गई हैं।
हम कैसे मापते हैं
इस पेज के हर आँकड़े के लिए एक ही तरीका; हर आँकड़ा अपने कच्चे रन तक खोजा जा सकता है।
- बिल किए गए टोकन, सोचने के टोकन सहित, जैसे प्रोवाइडर उन्हें गिनता है।
- कोई रन तभी गिना जाता है जब उसे सच में माँगे गए मॉडल ने चलाया हो।
- मॉडल कॉल मॉडल से आए अलग संदेश हैं, टूल कॉल नहीं।
- सफलता का मतलब है सेवा में जाँची गई आख़िरी स्थिति, और उपयोगकर्ता को दिया गया जवाब।
- लागत कैश की सबसे सख़्त स्थिति में; हर बचत नीचे की ओर राउंड की गई।
- हर प्रकाशित आँकड़े की दावों के रजिस्टर में एक प्रविष्टि है, जो कच्चे रन से दोबारा गिनी जाती है।
आगे: सबसे बड़े MCP सर्वर
Delta MCP को सबसे बड़े MCP सर्वर पर आज़माया जाएगा, और नतीजे उसके रिलीज़ होने पर प्रकाशित किए जाएँगे। उन्हें सबसे पहले देखें।
आगे पढ़ें
-
MCP टोकन उपयोग कैसे कम करें, और MCP इतने टोकन क्यों खाता है
MCP टोकन उपयोग कैसे कम करें: /context से इसे मापें, दोनों खर्च देखें (टूल सूची और राउंड ट्रिप), और हर उपाय की तुलना करें, Tool Search समेत।
-
AI एजेंट के लिए MCP vs CLI: टोकन का बिल कहाँ से आता है
आपके AI एजेंट के लिए MCP या CLI? टोकन में किसका कितना खर्च होता है, माप क्या दिखाते हैं, कब CLI जीतता है, कब MCP, और कहाँ कोड दोनों से आगे निकलता है।
-
Claude Code की यूसेज लिमिट खत्म? देखें MCP सर्वर का खर्च
Claude Code के “You've hit your limit” का मतलब (सेशन, साप्ताहिक, Opus, खर्च), /usage से अपने MCP सर्वर का खर्च कैसे देखें, और पहले क्या घटाएँ।
इसे अपने ही कामों पर मापें
मुफ़्त, आपके कंप्यूटर पर। Delta MCP गिनता रहता है कि उसने आपके कितने टोकन बचाए।
मुफ़्त · बिना अकाउंट · Apple चिप या Intel
मुफ़्त · बिना अकाउंट
मुफ़्त · बिना अकाउंट
Mac, Windows और Linux के लिए। अकाउंट की ज़रूरत नहीं।