छोटा जवाब
MCP को दोष देने से पहले जाँचें। Claude Code का /usage बताता है कि आपके प्लान के हाल के उपयोग का कितना हिस्सा हर MCP सर्वर पर गया। अगर हिस्सा छोटा है, तो लंबे सेशन और आपका चुना मॉडल ज़्यादा खर्च करवाते हैं। अगर बड़ा है, तो बिना इस्तेमाल वाले सर्वर डिस्कनेक्ट करें, फिर कॉल घटाएँ।
इस गाइड में
आपकी कौन सी लिमिट पूरी हुई?
Claude Code अपने संदेश में लिमिट का नाम बताता है, और आप क्या कर सकते हैं, यह इस पर निर्भर है कि वह कौन सी है। सब्सक्रिप्शन पर, उपयोग पाँच घंटे के रोलिंग सेशन में और एक साप्ताहिक अवधि में गिना जाता है, और दोनों एक साथ गिने जाते हैं।
| आपको दिखता है | इसका मतलब | आगे कैसे बढ़ें |
|---|---|---|
You've hit your session limit या You've hit your weekly limit | सभी मॉडल का साझा रोलिंग कोटा। मॉडल बदलने से यह वापस नहीं मिलता। | संदेश में दिए गए रीसेट समय तक इंतज़ार करें, या /usage-credits से उपयोग क्रेडिट जोड़ें। |
You've hit your Opus limit या You've hit your Sonnet limit | सिर्फ़ उसी मॉडल परिवार की सीमा। | /model से उस परिवार के बाहर का मॉडल चुनें और काम जारी रखें। |
You've hit your monthly spend limit | आपके उपयोग क्रेडिट खर्च सीमा तक पहुँच गए। इस संदेश के अलग रूप एक व्यक्ति, एक संगठन और एक टीम के लिए हैं। | claude.ai पर Settings, Usage में सीमा बढ़ाएँ, या अपने एडमिन से कहें। |
आपको घड़ी देखते रहने की ज़रूरत नहीं। सब्सक्रिप्शन से साइन इन होने पर Claude Code यह लाइन दिखाता है और रीसेट के बाद अपने आप काम जारी रखता है:
Continuing automatically at 3:45pm · esc to cancel
इसके लिए वर्शन 2.1.234 या उसके बाद का चाहिए, और यह डिफ़ॉल्ट रूप से चालू है।
डॉक्यूमेंटेशन से एक और बात: एक ही बार की भारी गतिविधि, जैसे बड़ा वर्कफ़्लो फ़ैनआउट, सेशन विंडो रीसेट होने से पहले ही साप्ताहिक कोटा खत्म कर सकती है।
अपने MCP सर्वर का खर्च कैसे देखें?
Claude Code की तीन कमांड इसका जवाब देती हैं। पहली से शुरू करें।
/usageसब्सक्रिप्शन पर, आपके प्लान की सीमाएँ दिखाती है और हाल के उपयोग को स्किल, सबएजेंट, प्लगइन और हर MCP सर्वर के हिसाब से प्रतिशत में बाँटती है। पिछले 24 घंटों के लिए d दबाएँ, पिछले 7 दिनों के लिए w।/contextदिखाती है कि अभी आपकी कॉन्टेक्स्ट विंडो में क्या भरा है, MCP टूल परिभाषाओं समेत।/mcpआपके सर्वर की सूची दिखाती है और जिन्हें आप इस्तेमाल नहीं करते, उन्हें बंद करने देती है।
इन सीमाओं को ध्यान में रखकर संख्याएँ पढ़ें
- आँकड़े अनुमानित हैं और इसी मशीन के सेशन इतिहास से आते हैं। आपके दूसरे डिवाइस या claude.ai का उपयोग इनमें शामिल नहीं है।
- किसी सर्वर के हिस्से में सिर्फ़ वे अनुरोध गिने जाते हैं जिन्होंने उसके किसी टूल का नतीजा इस्तेमाल किया। उसकी टूल सूची साथ लेकर चलने की लागत उस हिस्से में नहीं है: उसे
/contextमें देखें। /usageउन व्यवहारों को भी चिह्नित करती है जो आपके हाल के उपयोग का 10% या ज़्यादा हैं, जैसे लंबा कॉन्टेक्स्ट या कैश मिस, हर एक के साथ एक सुझाव।
फिर MCP वाली लाइन पढ़ें
MCP से ज़्यादा खर्च आम तौर पर किसमें होता है?
Claude Code हर अनुरोध के साथ आपकी पूरी बातचीत भेजता है। इसलिए ज़्यादातर बोझ इस बात का है कि बातचीत कितनी लंबी है, वह कितनी बार कोल्ड कैश से दोबारा शुरू होती है, और उसे कौन सा मॉडल पढ़ता है।
-
लंबा सेशन
हर अनुरोध पूरी बातचीत दोबारा पढ़ता है। दिन भर से खुले सेशन में एक लाइन का सवाल भी पूरी बातचीत जितना उपयोग खर्च करता है।
यह करेंकिसी असंबंधित काम पर जाते समय
/clear। इसमें कुछ खर्च नहीं होता। -
कोल्ड कैश
कैश की अवधि से लंबे ब्रेक के बाद आपका पहला संदेश आपका पूरा कॉन्टेक्स्ट दोबारा प्रोसेस करता है। सब्सक्रिप्शन पर यह अवधि एक घंटा है, और उपयोग क्रेडिट इस्तेमाल करते ही पाँच मिनट।
यह करेंकिसी बहुत बड़े सेशन को निष्क्रिय छोड़कर उस पर वापस न लौटें। Pro और Max पर, जब आप कोई बड़ा सेशन फिर से शुरू करते हैं, तो Claude Code सारांश से शुरू करने का विकल्प देता है।
-
मॉडल
Opus हर टर्न में Sonnet से कई गुना महँगा है, और Sonnet, Haiku से महँगा। एक्सटेंडेड थिंकिंग भी टोकन बढ़ाती है।
यह करेंज़्यादातर कोडिंग के लिए
/modelसे Sonnet, और आसान कामों पर सोच घटाने के लिए/effort। -
भूला हुआ काम
शेड्यूल किया गया काम अपने अंतराल पर चलता है, सेशन निष्क्रिय होने पर भी। हर सबएजेंट आपके अनुरोधों के ऊपर अपने अनुरोध भेजता है, और जब टीम के साथी प्लान मोड में चलते हैं, तो एजेंट टीमें एक सामान्य सेशन से लगभग 7 गुना ज़्यादा टोकन इस्तेमाल करती हैं।
यह करें
/usageमें लूप और सबएजेंट जाँचें, और जिसकी अब ज़रूरत नहीं, उसे बंद करें।
पहले क्या घटाएँ, किस क्रम में?
अगर /usage में MCP का हिस्सा बड़ा दिखता है, तो इस सूची पर ऊपर से नीचे चलें। हर कदम पिछले वाले से ज़्यादा मेहनत माँगता है।
- जिन सर्वर को आप इस्तेमाल नहीं करते, उन्हें डिस्कनेक्ट करें2 मिनट
/mcpचलाएँ और इस हफ़्ते जिसे नहीं छुआ, उसे बंद करें। Claude Code की अपनी लागत गाइड भी यही सलाह देती है। दोबारा चालू करने तक आप वे टूल खो देते हैं। - जाँचें कि Tool Search चालू हैएक जाँच
Claude Code डिफ़ॉल्ट रूप से MCP टूल परिभाषाएँ ज़रूरत पड़ने पर ही लोड करता है, इसलिए जब तक कोई टूल इस्तेमाल न हो, आपके कॉन्टेक्स्ट में सिर्फ़ टूल के नाम और सर्वर के निर्देश आते हैं। यह बंद रहता है जब कस्टम
ANTHROPIC_BASE_URLहो, जबENABLE_TOOL_SEARCH=falseहो, और Google Cloud के Agent Platform पर Claude 4.5 पीढ़ी से पुराने मॉडल पर। - जहाँ अच्छा CLI हो, वहाँ CLI इस्तेमाल करेंजहाँ CLI हो
gh,aws,gcloudऔरsentry-cliहर टूल की सूची नहीं जोड़ते, और लागत गाइड इन्हें कॉन्टेक्स्ट के मामले में MCP सर्वर से ज़्यादा किफ़ायती बताती है। कमी: कई सेवाओं का MCP सर्वर है, पर CLI नहीं। - बड़े नतीजों पर नज़र रखेंकाम के दौरान
जब कोई MCP टूल 10,000 से ज़्यादा टोकन लौटाता है, तो Claude Code चेतावनी देता है, और डिफ़ॉल्ट रूप से किसी नतीजे को 25,000 पर सीमित करता है। जो भी लौटता है, वह बातचीत का हिस्सा बन जाता है, जिसे Claude Code हर अगले अनुरोध के साथ दोबारा पढ़ता है। कम फ़ील्ड या छोटा पेज माँगें।
- कॉल की संख्या घटाएँइंस्टॉल में 2 मिनट
जो बचता है, वह अनुरोधों की संख्या है। हर टूल कॉल एक और अनुरोध है, जो पूरी बातचीत साथ ले जाता है, और इन्हें सिर्फ़ काम को एक प्रोग्राम की तरह लिखना हटाता है। Delta MCP यही करता है।
अगर MCP का हिस्सा फिर भी बड़ा हो, तो?
तो खर्च कॉल का है। हर टूल कॉल एक और अनुरोध है, इसलिए दस कदमों वाला काम दस अनुरोध है, और हर अनुरोध पूरी बातचीत साथ ले जाता है। Tool Search इसे नहीं बदलता।
Delta MCP एक मुफ़्त ऐप है जो Claude Code और आपके MCP सर्वर के बीच बैठता है। आपका AI हर कदम पर एक टूल कॉल की जगह हर काम एक प्रोग्राम की तरह लिखता है, और Delta MCP उसे जाँचता है, सब या कुछ नहीं के नियम से लागू करता है और Activity में रखता है, वापस लेने के लिए तैयार। हमने इसे Tool Search चालू रखकर Claude Code पर मापा:
Sonnet 5.5, हर वैरिएंट के दो से तीन रन, आख़िरी नतीजा हर सेवा में जाँचा गया।
| काम | टोकन | मॉडल कॉल | माप की तारीख़ |
|---|---|---|---|
| एक रिलीज़ ठीक करना, कोड मेंCerberus, 152 टूल | 13.4× कम | 26 → 6.5 | 5 अक्टूबर |
| देर से चल रहे 20 टिकट निपटानाएक टिकट मैनेजर | 4.8× कम | 5 → 2 | 2 अक्टूबर |
| लॉग इन करना, 3 संपर्क जोड़ना, उनकी सूची देखनाMicrosoft Playwright MCP | 3.9× कम | 12.6 → 4 | 2 अक्टूबर |
सवाल
मेरी Claude Code लिमिट इतनी जल्दी क्यों खत्म हो गई?
आम तौर पर वजह बातचीत होती है, कोई एक टूल नहीं। Claude Code हर अनुरोध के साथ आपकी पूरी बातचीत भेजता है, इसलिए लंबा सेशन, ब्रेक के बाद कोल्ड कैश, महँगा मॉडल, या भूले हुए शेड्यूल किए गए काम और सबएजेंट, सब जुड़ते जाते हैं। /usage चलाएँ: यह आपके हाल के उपयोग के 10% या ज़्यादा वाले हर व्यवहार को चिह्नित करती है।
क्या मॉडल बदलने से “You've hit your session limit” ठीक हो जाता है?
नहीं। सेशन और साप्ताहिक सीमाएँ सभी मॉडल में साझा हैं। सिर्फ़ Opus और Sonnet की सीमाएँ मॉडल परिवार के हिसाब से हैं: इनमें से किसी के बाद, /model से उस परिवार के बाहर का मॉडल चुनकर आप काम जारी रख सकते हैं।
क्या MCP सर्वर मेरी Claude Code लिमिट में गिने जाते हैं?
हाँ। उनकी टूल परिभाषाएँ (डिफ़ॉल्ट रूप से ज़रूरत पर लोड), हर कॉल और हर नतीजा उन अनुरोधों का हिस्सा हैं जो Claude Code भेजता है, और हर अनुरोध गिना जाता है। /usage हर सर्वर का हिस्सा दिखाती है। Pro और Max पर सीमाएँ Claude और Claude Code के बीच साझा हैं, इसलिए चैट भी वही कोटा इस्तेमाल करती है।
Claude Code की लिमिट कब रीसेट होती है, और क्या वह अपने आप जारी रहता है?
संदेश में रीसेट का समय दिखता है। सब्सक्रिप्शन पर दो विंडो साथ चलती हैं: पाँच घंटे का रोलिंग सेशन और एक साप्ताहिक। इंटरैक्टिव सेशन में, वर्शन 2.1.234 से, Claude Code इंतज़ार करता है और रीसेट के बाद रुका हुआ काम जारी रखता है। यह डिफ़ॉल्ट रूप से चालू है, और Esc दबाने से रद्द हो जाता है। /usage-credits से आप तुरंत काम जारी रख सकते हैं।
कौन सा MCP सर्वर सबसे ज़्यादा इस्तेमाल करता है?
/usage चलाएँ और पिछले 7 दिनों के लिए w दबाएँ: हर सर्वर का एक प्रतिशत होता है। आँकड़े अनुमानित हैं और सिर्फ़ इसी मशीन से आते हैं। /context दिखाती है कि हर सर्वर के टूल आपकी विंडो में कितनी जगह लेते हैं।
क्या Delta MCP मेरी लिमिट बढ़ाता है या ठीक करता है?
नहीं। लिमिट Anthropic की है। Delta MCP जो बदलता है, वह है कई कदमों वाले काम में अनुरोधों की संख्या: हमारे टेस्ट में 3.3–24.1× कम टोकन।
स्रोत
- Claude Code, Manage costs effectively (documentation) MCP सर्वर के हिसाब से /usage का बँटवारा और उसके 10% वाले संकेत; लंबे सेशन में उपयोग क्यों बढ़ता है; कैश की अवधि; मॉडल का चुनाव; MCP का अतिरिक्त बोझ; एजेंट टीम।
- Claude Code, Error reference (documentation) सेशन, साप्ताहिक, Opus, Sonnet और खर्च सीमा के संदेश, और कौन सी सीमाएँ सभी मॉडल में साझा हैं।
- Claude Code, Interactive mode (documentation) उपयोग सीमा के रीसेट का इंतज़ार, और अपने आप जारी रहना (वर्शन 2.1.234)।
- Claude Code, Connect Claude Code to tools via MCP (documentation) Tool Search डिफ़ॉल्ट रूप से चालू, और कब बंद रहता है; 10,000 टोकन की चेतावनी और टूल के नतीजे पर 25,000 टोकन की डिफ़ॉल्ट सीमा।
- Claude Help Center, Models, usage, and limits in Claude Code Opus हर टर्न में Sonnet से कई गुना महँगा है, और Sonnet, Haiku से; हर टर्न पर पिछला हर संदेश दोबारा भेजा जाता है।
- Claude Help Center, Use Claude Code with your Pro or Max plan उपयोग सीमाएँ Claude और Claude Code के बीच साझा हैं।
- Claude Help Center, Usage limit best practices पेड प्लान पर पाँच घंटे की सेशन सीमा और साप्ताहिक सीमा।
- Delta MCP, Benchmarks इस पेज पर Delta MCP का हर माप, उसके तरीके के साथ।
आगे पढ़ें
- MCP टोकन उपयोग कैसे कम करें, और MCP इतने टोकन क्यों खाता हैMCP टोकन उपयोग कैसे कम करें: /context से इसे मापें, दोनों खर्च देखें (टूल सूची और राउंड ट्रिप), और हर उपाय की तुलना करें, Tool Search समेत।
- MCP कॉन्फ़िग फ़ाइल कहाँ है: Claude, Cursor, VS Code और बाकीClaude Desktop, Claude Code, Cursor, VS Code, Windsurf, Gemini CLI और Codex अपनी MCP कॉन्फ़िग कहाँ रखते हैं: फ़ाइल का पाथ, JSON कुंजी, रिमोट सर्वर और टूल लिमिट।
- AI एजेंट के लिए MCP vs CLI: टोकन का बिल कहाँ से आता हैआपके AI एजेंट के लिए MCP या CLI? टोकन में किसका कितना खर्च होता है, माप क्या दिखाते हैं, कब CLI जीतता है, कब MCP, और कहाँ कोड दोनों से आगे निकलता है।