Claude में मेरे कितने टोकन बचे हैं? ऐसी कोई संख्या है ही नहीं

आपका Claude सब्सक्रिप्शन प्लान टोकन में नहीं मापा जाता, इसलिए कोई स्क्रीन टोकन बैलेंस नहीं दिखाती। यहाँ बताया गया है कि यह असल में क्या मापता है, इसे कहाँ पढ़ें, और आपके टाइप न करने पर भी यह क्यों घटता रहता है।

यह Claude के बारे में सबसे ज़्यादा खोजे जाने वाले सवालों में से एक है, और यह लगभग हर भाषा में पूछा जाता है। इसका जवाब भी असहज करने वाला है: ऐसी कोई संख्या है ही नहीं, क्योंकि आपका सब्सक्रिप्शन प्लान टोकन में बेचा ही नहीं जाता।

यह कोई तकनीकी बारीकी नहीं है। यही समझाता है कि जिस काउंटर को आप ढूंढ रहे हैं वह आपको क्यों नहीं मिलता, आपको काउंटर दिखाने का दावा करने वाला हर पेज असल में क्यों अंदाज़ा लगा रहा है, और जो चीज़ आपको काम के बीच में सचमुच रोकती है वह वही क्यों नहीं है जिस पर ज़्यादातर लोग नज़र रखते हैं।

आपका प्लान टोकन में नहीं, उपयोग की अवधियों में मापा जाता है

Anthropic किसी Claude सब्सक्रिप्शन को टोकन की सीमा के रूप में नहीं बताता। वह उसे उपयोग की अवधियों के रूप में मापता है: एक सत्र अवधि जो चलती रहती है, और उसके ऊपर एक साप्ताहिक अवधि। दोनों उन सभी जगहों के बीच साझा होती हैं जहाँ आप साइन इन करते हैं, इसलिए Claude चैट में बिताई गई एक लंबी दोपहर उसी शाम Claude Code के लिए आपके पास कम जगह छोड़ती है। दोनों मॉडलों के बीच भी साझा होती हैं, यही वजह है कि एक बार सीमा छू लेने के बाद /model से किसी सस्ते मॉडल पर जाने से आपकी सीमा वापस नहीं मिलती।

इसलिए आप जो पढ़ सकते हैं वह एक अवधि का हिस्सा और उसके लौटने का समय है, कोई बैलेंस नहीं। जब आपकी सीमा सचमुच खत्म हो जाती है, तो जो संदेश आपको रोकता है वह बताता है कि आपने कौन सी हद छुई है और वह कब रीसेट होगी, और आपके खाते के लिए वही संदेश एकमात्र प्रामाणिक आंकड़ा है।

एकमात्र जगह जहाँ टोकन की गिनती का शाब्दिक अर्थ होता है वह API है, जिसका बिल प्रति टोकन बनता है। नीचे की हर बात सब्सक्रिप्शन के बारे में है, और असल में ज़्यादातर लोग यही पूछ रहे होते हैं।

वह संख्या जो आप पढ़ सकते हैं, और वह कहाँ मिलती है

दो स्क्रीन हैं, और वे अलग-अलग सवालों का जवाब देती हैं।

Claude Code के अंदर, /usage ही सीखने लायक कमांड है। Pro, Max, Team या Enterprise सब्सक्रिप्शन प्लान पर यह आपकी प्लान सीमाओं के लिए उपयोग बार दिखाता है, और पिछले 24 घंटे तथा पिछले 7 दिनों के बीच बदलने के लिए d या w दबाएँ। बार के नीचे यह किसी भी कच्ची संख्या से ज़्यादा उपयोगी काम करता है: यह हाल के उपयोग को स्किल्स, सबएजेंट्स, प्लगइन्स और अलग-अलग MCP सर्वरों के खाते में डालता है, हर एक को प्रतिशत के रूप में, और जब कोई एक पैटर्न आपकी हाल की खपत का 10% या उससे ज़्यादा हिस्सा बनता है तो एक व्यवहार चेतावनी उठाता है, जैसे लंबा कॉन्टेक्स्ट या कैश मिस।

एक बात मायने रखती है और उसे चूकना आसान है: ये आंकड़े उसी मशीन पर मौजूद आपके स्थानीय सत्र इतिहास से निकाले जाते हैं। किसी दूसरे लैपटॉप से या claude.ai पर किया गया काम इनमें शामिल नहीं होता।

वेब पर, claude.ai में Settings और फिर Usage खाते के स्तर का दृश्य है: आपका सब्सक्रिप्शन प्लान, आप कहाँ खड़े हैं, और साप्ताहिक अवधि कब रीसेट होती है। अगर आप दो मशीनों पर काम करते हैं, तो पूरा आंकड़ा यही देता है।

किसी काम की असली लागत का प्रति-सत्र विवरण देखने के लिए, /usage का सबसे ऊपरी ब्लॉक कच्ची गिनती प्रिंट करता है:

Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write

ये चार संख्याएँ एक कोडिंग सत्र की पूरी कहानी हैं, और इनमें सबसे बड़ी लगभग हमेशा cache read होती है। अगर आप यह दृश्य मांगने पर नहीं बल्कि लगातार चाहते हैं, तो AgentsRoom हर सत्र पर एक लाइव टोकन मीटर रखता है, टर्मिनल के बगल में, उसी इनपुट, आउटपुट और कैश के बंटवारे के साथ, और जब कोई सत्र ज़्यादा खर्च करने लगता है तो एक लाल बैज दिखाता है। CLI के अपने काउंटर को पढ़ने का चरण-दर-चरण तरीका Claude Code टोकन उपयोग कैसे जांचें में बताया गया है।

जब कोई एजेंट शामिल हो जाता है तो टोकन असल में क्या होता है

टोकन पाठ का एक टुकड़ा है: अंग्रेज़ी में मोटे तौर पर एक शब्द का तीन-चौथाई, और कोड में उससे साफ़ तौर पर कम, जहाँ विराम चिह्न और पहचानकर्ता आसानी से टुकड़ों में बंट जाते हैं।

जो हिस्सा लोगों को चौंकाता है वह यह है कि हर अनुरोध पर पूरी बातचीत दोबारा भेजी जाती है। सुबह से खुले किसी सत्र में एक पंक्ति का सवाल पूछिए और आप उस पंक्ति के लिए भुगतान नहीं कर रहे, आप उस पूरे इतिहास के लिए भुगतान कर रहे हैं जो उसके साथ जाता है। हर बार जब एजेंट कोई टूल इस्तेमाल करता है तो वह एक और अनुरोध भेजता है, पिछले टूल के नतीजे साथ लेकर, और यही वजह है कि एक अकेला "इस टेस्ट को ठीक करो" एक दर्जन राउंड ट्रिप में बदल सकता है।

प्रॉम्प्ट कैशिंग ही इसे झेलने लायक बनाती है। दोहराए गए इतिहास पर कहीं कम कैश दर से शुल्क लगता है, यही वजह है कि cache read का आंकड़ा बहुत बड़ा होता है और बिल नहीं। यही एजेंट के काम की सबसे महंगी आदत की ज़मीन भी तैयार करती है, जो अगले खंड का विषय है।

जब आप टाइप नहीं कर रहे होते तब भी बार क्यों बढ़ता है

अगर किसी निष्क्रिय सत्र पर आपका उपयोग बढ़ता है, तो वजह इनमें से कोई एक है, और इनमें से कोई भी बग नहीं है:

  • कैश का खत्म होना। सब्सक्रिप्शन पर कैश किया गया कॉन्टेक्स्ट लगभग एक घंटे तक जीवित रहता है, और जैसे ही आप उपयोग क्रेडिट पर या किसी API कुंजी पर चलते हैं, यह घटकर पाँच मिनट रह जाता है। दोपहर के भोजन से लौटिए और आपका पहला संदेश कैश से चूक जाता है: आपकी पूरी बातचीत पूरी कीमत पर दोबारा प्रोसेस होती है। एक विराम, एक पूरी दोबारा प्रोसेसिंग।
  • वह हर चीज़ जो अपने आप एक टर्न शुरू कर देती है। कोई निर्धारित कार्य चलना, आपके किसी दूसरे सत्र से आता कोई संदेश, पृष्ठभूमि में काम चलते हुए कोई लक्ष्य जांच। इनमें से हर एक पूरा कॉन्टेक्स्ट दोबारा भेजती है, ठीक वैसे ही जैसे आपका टाइप किया हुआ संदेश।
  • साथी एजेंट। हर सक्रिय साथी एजेंट अपनी खुद की कॉन्टेक्स्ट विंडो चलाता है और बाहर निकलने तक खपत करता रहता है। Anthropic का अपना मार्गदर्शन प्लान मोड में चल रही एक टीम को एक सामान्य सत्र से लगभग सात गुना पर रखता है।
  • कॉम्पैक्शन। /compact को उस बातचीत को पढ़ना पड़ता है जिसका वह सारांश बनाता है, इसलिए किसी बड़े कॉन्टेक्स्ट को कॉम्पैक्ट करना खुद एक बड़ा अनुरोध है। /clear की कोई कीमत नहीं लगती, और जब आपको निरंतरता की ज़रूरत न हो तो वही बेहतर कदम है।
  • पृष्ठभूमि का काम। --resume के लिए बनने वाले सारांश और उसी तरह के छोटे काम तब भी थोड़ी खपत करते हैं जब आप निष्क्रिय होते हैं, आमतौर पर प्रति सत्र चार सेंट से कम।

यहीं वे दो चेतावनियाँ भी अलग हो जाती हैं जिन्हें लोग आपस में मिला देते हैं। एक कॉन्टेक्स्ट या ऑटो-कॉम्पैक्ट चेतावनी कहती है कि एक बातचीत मॉडल की कॉन्टेक्स्ट विंडो के करीब पहुँच रही है, और उस सत्र को क्लियर करने से यह ठीक हो जाती है। एक उपयोग सीमा कहती है कि आपके प्लान में शामिल सीमा सभी सत्रों में मिलाकर खर्च हो चुकी है, और क्लियर करने से उसमें से कुछ भी वापस नहीं मिलता। भरोसेमंद पहचान: उपयोग सीमा एक रीसेट समय बताती है, कॉन्टेक्स्ट चेतावनी नहीं बताती।

जब बार लगभग भर चुका हो तो क्या करें

मेहनत के बदले कितना लौटाते हैं, मोटे तौर पर उसी क्रम में:

  1. असंबंधित कामों के बीच में क्लियर करें। बासी कॉन्टेक्स्ट सत्र के बाकी हिस्से में हर संदेश पर दोबारा भेजा जाता है। अगर आप उसे /resume से दोबारा ढूंढना चाहते हैं, तो /clear से पहले /rename चलाएँ।
  2. मॉडल को काम के हिसाब से चुनें। Sonnet ज़्यादातर कोडिंग का काम संभाल लेता है; Opus को डिफ़ॉल्ट बनाए रखना उस प्लान में शामिल सीमा के गुरुवार तक गायब हो जाने की सबसे आम वजह है।
  3. /usage में खर्च का बँटवारा पढ़ें। अगर कोई एक MCP सर्वर या कोई एक सबएजेंट आपके हफ़्ते का 30% है, तो सुधार वहीं है, और आपने कभी अंदाज़ा नहीं लगाया होता कि वह कौन सा है।
  4. सोच को बंद करने से पहले उसे कम करें। थिंकिंग टोकन का बिल आउटपुट के रूप में बनता है। मॉडल के तर्क का प्रयास स्तर कम कर देना आमतौर पर काफ़ी होता है।
  5. ज़्यादा बकबक वाले काम सबएजेंट्स में धकेलें। टेस्ट का आउटपुट और लॉग फ़ाइलें सबएजेंट के कॉन्टेक्स्ट में ही रहती हैं और वापस सिर्फ़ एक सारांश आता है।
  6. कॉन्टेक्स्ट फ़ाइल छोटी रखें। CLAUDE.md या AGENTS.md में जो कुछ भी है वह सत्र की शुरुआत में लोड होता है और हर टर्न पर उसका दाम चुकाना पड़ता है, तब भी जब वह गैर-ज़रूरी हो। लंबे वर्कफ़्लो निर्देश किसी स्किल में रहने चाहिए, जो सिर्फ़ बुलाए जाने पर लोड होती है। इस पर और जानकारी AGENTS.md कॉन्टेक्स्ट फ़ाइल गाइड में है।

अगर आप खास तौर पर लागत घटाने वाले पहलू का लंबा संस्करण चाहते हैं, तो Claude Code की टोकन लागत घटाना उसे विस्तार से समझाता है।

छोटा सा निचोड़

टोकन बैलेंस ढूंढना बंद कर दीजिए: आपके प्लान में ऐसा कुछ है ही नहीं। दोनों अवधियों को समझिए, /usage को कुल जोड़ के लिए नहीं बल्कि खर्च के बँटवारे के लिए पढ़िए, और कैश को उस चीज़ की तरह देखिए जो आपका पूरा हफ़्ता तय करती है। जो डेवलपर कभी सीमा तक नहीं पहुँचते वे शायद ही कभी वे लोग होते हैं जो कम टाइप करते हैं। वे वे लोग होते हैं जो विषय बदलते ही एक नया सत्र शुरू कर देते हैं।

एक साथ कई एजेंट चलाना इस सब को और बिगाड़ता भी है और देखने में आसान भी बनाता है, क्योंकि खपत एक संख्या रह जाना बंद कर देती है और प्रति एजेंट एक संख्या बन जाती है। AgentsRoom इसी दृश्य के इर्द-गिर्द बनाया गया है।

अक्सर पूछे जाने वाले सवाल

Claude में मेरे कितने टोकन बचे हैं?

देखने के लिए ऐसी कोई संख्या है ही नहीं। Claude सब्सक्रिप्शन टोकन के बजट के रूप में नहीं बेचा जाता: यह एक चलती हुई सत्र अवधि और उसके ऊपर एक साप्ताहिक अवधि के हिस्से के रूप में मापा जाता है, और आप जो पढ़ सकते हैं वह उन अवधियों का प्रतिशत और उनके रीसेट होने का समय है, टोकन का बैलेंस नहीं। इसे पढ़ने की जगह Claude Code के अंदर /usage कमांड है, या claude.ai पर Settings और फिर Usage। सिर्फ़ API पर, जिसका बिल प्रति टोकन बनता है, टोकन के आंकड़े का कोई मतलब होता है।

Claude के टोकन कैसे काम करते हैं?

टोकन पाठ का एक टुकड़ा है, अंग्रेज़ी में मोटे तौर पर एक शब्द का तीन-चौथाई और कोड में उससे कम। हर अनुरोध आपकी पूरी बातचीत दोबारा भेजता है, इसलिए एक कोडिंग सत्र हर टर्न पर अपने जमा हुए इतिहास का दाम चुकाता है, सिर्फ़ उस वाक्य का नहीं जो आपने टाइप किया। यही वजह है कि उपयोग चार अलग-अलग आंकड़ों में गिना जाता है: इनपुट, आउटपुट, कैश राइट और कैश रीड। कैश किए गए इतिहास पर ताज़ा इनपुट के मुकाबले कहीं कम दर से शुल्क लगता है, और ठीक इसीलिए दिन भर खुला छोड़ा गया सत्र भी आपके प्लान में से खपत करता रहता है।

मेरा Claude उपयोग कब रीसेट होता है?

दो घड़ियाँ हैं और वे एक-दूसरे से स्वतंत्र हैं। सत्र अवधि चलती रहती है, इसलिए वह आपके चुने हुए किसी समय पर नहीं, बल्कि खुलने के एक तय घंटों बाद खत्म होती है। उसके ऊपर एक साप्ताहिक अवधि बैठती है जो आपके खाते को सौंपे गए एक तय पल पर रीसेट होती है। सीमा का संदेश खुद बताता है कि जिस अवधि ने आपको रोका वह कब लौटेगी, और आपके खाते के लिए वही संदेश प्रामाणिक जवाब है। दोनों घड़ियाँ Claude चैट और Claude Code के बीच साझा होती हैं, इसलिए चैट का भारी इस्तेमाल आपके कोडिंग के बजट को छोटा कर देता है।

क्या किसी सस्ते मॉडल पर जाने से मेरी सीमा वापस मिल जाती है?

नहीं। सत्र और साप्ताहिक अवधियाँ सभी मॉडलों के बीच साझा होती हैं, इसलिए एक बार सीमा छू लेने के बाद /model से मॉडल बदलने पर पहुँच वापस नहीं मिलती। यह एक खास स्थिति में ज़रूर मदद करता है: जब संदेश किसी एक मॉडल से जुड़ा हो, जैसे आपकी Opus सीमा पूरी हो जाना, जहाँ Sonnet पर जाकर आप काम जारी रख सकते हैं। सीमा खत्म होने से पहले भी यह मदद करता है, क्योंकि सस्ता मॉडल उसी काम के लिए उसी प्लान में शामिल सीमा में से कम खपत करता है।

जब मैं कुछ नहीं कर रहा होता तब भी मेरा उपयोग क्यों बढ़ता है?

क्योंकि एजेंट सत्र में निष्क्रियता मुफ़्त नहीं होती। जो कुछ भी एक टर्न शुरू करता है वह आपका पूरा कॉन्टेक्स्ट दोबारा भेजता है: कोई निर्धारित कार्य चलना, किसी दूसरे सत्र से आता कोई संदेश, अब भी चल रहा कोई साथी एजेंट, कोई लक्ष्य जांच। दो और चीज़ें बिना किसी टर्न के टोकन खर्च करती हैं: कॉम्पैक्शन, जिसे उस बातचीत को पढ़ना पड़ता है जिसका वह सारांश बनाता है, और लंबे विराम के बाद का पहला संदेश, जो प्रॉम्प्ट कैश से चूक जाता है और आपके पूरे इतिहास को पूरी कीमत पर दोबारा प्रोसेस करता है।

क्या कॉन्टेक्स्ट चेतावनी और उपयोग सीमा एक ही चीज़ हैं?

नहीं, और दोनों को आपस में मिला देने से लोग गलत उपाय अपनाते हैं। कॉन्टेक्स्ट या ऑटो-कॉम्पैक्ट चेतावनी एक बातचीत के मॉडल की कॉन्टेक्स्ट विंडो के करीब पहुँचने के बारे में है, और वह उस सत्र को क्लियर या कॉम्पैक्ट करने से हल हो जाती है। उपयोग सीमा हर सत्र में मिलाकर आपके प्लान में शामिल सीमा के बारे में है, और क्लियर करने से उसमें से कुछ भी वापस नहीं मिलता। पहचान शब्दों में छिपी है: सीमा का संदेश एक रीसेट समय बताता है, कॉन्टेक्स्ट चेतावनी नहीं बताती।

AgentsRoom डाउनलोड करें

अपने AI एजेंट्स (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) को अपने सभी प्रोजेक्ट्स पर एक ही विंडो से चलाएं।

मुफ़्तAgentsRoom डाउनलोड करें

कंपेनियन ऐप: चलते-फिरते अपने एजेंट्स मॉनिटर करें

Claude, Codex, Antigravity CLI या किसी अन्य AI प्रदाता का उपयोग करें।

एक्सटेंशन इंस्टॉल करें
Chrome Web Store

बग और अनुरोध सीधे अपने सार्वजनिक बैकलॉग में भेजें।

AgentsRoom को कार्य करते देखें।

मल्टी-प्रोजेक्ट
मल्टी-प्रोवाइडर
मल्टी-एजेंट
लाइव स्टेटस
फाइल डिफ और कमिट
मोबाइल ऐप
लाइव प्रीव्यू
एजेंट टीमें
ब्राउज़र ऑटोमेशन
बैकलॉग-संचालित डेव
प्रॉम्प्ट लाइब्रेरी
स्किल्स लाइब्रेरी
सभी सुविधाएँ देखें

पढ़ते रहें