कैसे अपने Claude Code टोकन लागत को कम करें बिना धीमा किए
Claude Code आपको प्रति टोकन बिल करता है, और अधिकांश खर्च अदृश्य होता है: फुलाया हुआ संदर्भ, गलत मॉडल, कच्चे PDF, एजेंट एक ही फ़ाइलों को फिर से पढ़ना। यहाँ वास्तव में पैसा कहाँ जाता है और इसे कैसे कम किया जाए, उन आदतों और उपकरणों के साथ जो आपके बिल को कम रखते हैं बिना आपको धीमा किए।
Claude Code टोकन के हिसाब से चार्ज करता है, और बिल आपको चुपचाप चढ़ता है। यह उस कोड के कारण नहीं है जो यह लिखता है, वह हिस्सा सस्ता है। पैसा उस सब पर जाता है जो मॉडल हर एक टर्न पर फिर से पढ़ता है: पुराने संदेशों से भरा एक संदर्भ विंडो, एक 40-फाइल डिफ जिसे किसी ने नहीं मांगा, एक PDF जो चुपचाप चित्रों में बदल गया, वही CLAUDE.md जो दिन में सौ बार भेजा गया।
यहां बताया गया है कि टोकन वास्तव में कहां जाते हैं, और बिना बुरा कोड लिखे या अधिक समय तक इंतजार किए कम टोकन कैसे खर्च करें।
सबसे पहले, मीटर पर नजर डालें
आप वह नहीं काट सकते जो आप नहीं देख सकते। कुछ भी बदलने से पहले, पता करें कि एक सत्र वास्तव में कितना खर्च करता है।
आपके द्वारा भेजा गया हर संदेश अब तक की पूरी बातचीत को फिर से भेजता है। टर्न 30 एक प्रॉम्प्ट नहीं है, यह एक-दूसरे के ऊपर रखे गए तीस प्रॉम्प्ट हैं, साथ ही हर फाइल जो एजेंट ने रास्ते में पढ़ी। यही कारण है कि एक लंबा सत्र अंत के करीब महंगा हो जाता है, भले ही आपका अंतिम प्रश्न एक लाइन का हो।
AgentsRoom में आप इसे लाइव देख सकते हैं Claude Code टोकन उपयोग दृश्य: वर्तमान सत्र की चलती टोकन संख्या और लागत, सीधे इंटरफेस में, ताकि आप अनुमान लगाना बंद कर सकें। प्रोजेक्ट सांख्यिकी डैशबोर्ड पर ज़ूम आउट करें और आप प्रति प्रोजेक्ट, प्रति एजेंट और प्रति दिन की लागत देख सकते हैं। एक बार जब आप संख्या को बढ़ते हुए देख लेते हैं, तो नीचे दिए गए सुधार अमूर्त नहीं रह जाते।
संदर्भ विंडो को तंग रखें
सबसे बड़ा लीवर संदर्भ का आकार है। एक फुलाया हुआ विंडो हर टर्न पर आपको एक कर की तरह महंगा पड़ता है।
जब आप कार्य बदलते हैं तो एक नया सत्र शुरू करें। उसी थ्रेड में webpack कॉन्फ़िगरेशन को डिबग न करें जहां आपने अभी-अभी प्रमाणीकरण को फिर से तैयार किया है। /clear चलाएं और साफ-सुथरे शुरू करें। पुराने संदेश नए कार्य में मदद नहीं कर रहे थे, वे बस चालान पर सवार थे।
धीरे-धीरे बहाव के लिए भी सतर्क रहें। लंबे सत्र केवल महंगे नहीं होते, वे मूर्ख भी हो जाते हैं: मॉडल कहानी खोने लगता है, खुद को दोहराता है, बीस संदेश पहले जो उसने तय किया था उसे भूल जाता है। AgentsRoom में एक संदर्भ बहाव डिटेक्टर है जो आपको चेतावनी देता है जब एक एजेंट खराब हो रहा होता है, जो आमतौर पर संकुचन या पुनः आरंभ करने का सही क्षण होता है। हमने इसके पीछे की चाल को एजेंट गिरावट को पकड़ने के लिए कैनरी विधि में लिखा। छोटे सत्र सस्ते और तेज होते हैं।
कच्चे PDFs को खिलाना बंद करें
यह लगभग मुफ्त पैसा है। जब आप Claude में एक PDF डालते हैं, तो हर पृष्ठ भी एक चित्र में बदल जाता है, और दृष्टि टोकन पाठ की तुलना में बहुत अधिक महंगे होते हैं। एक 20-पृष्ठ का स्पेक आपके प्रश्न को पढ़े जाने से पहले ही हजारों टोकन जला सकता है।
पहले फ़ाइल को Markdown में परिवर्तित करें। एक मुफ्त उपकरण के साथ एक कमांड लागत को 80% तक कम कर देता है और मॉडल उतनी ही अच्छी तरह से जवाब देता है, अक्सर बेहतर, क्योंकि यह पृष्ठ चित्रों पर झुकने के बजाय साफ संरचना पढ़ता है। पूरा मार्गदर्शिका यहां: टोकन बचाने के लिए PDF को Markdown में परिवर्तित करें। एक बार परिवर्तित करें, .md को रिपॉजिटरी में कमिट करें, और हर भविष्य का टर्न सस्ते पाठ को पढ़ता है।
उस काम के लिए सबसे सस्ता मॉडल का उपयोग करें जो काम कर सके
हर चीज के लिए Opus का उपयोग करना बिलों को बढ़ा देता है। एक वेरिएबल का नाम बदलना, एक कमिट संदेश लिखना, या एक टाइपो को ठीक करना आपके सबसे महंगे मॉडल की आवश्यकता नहीं है। एक छोटा मॉडल इसे एक अंश में कर देता है और आप अंतर महसूस नहीं करेंगे।
आदत सरल है: मॉडल को कार्य से मिलाएं। भारी आर्किटेक्चर का काम बड़े मॉडल को मिलता है, मैकेनिकल संपादन छोटे को। AgentsRoom का Adaptive Mode इसे स्वचालित बनाता है, जो आपको वास्तव में जो कर रहे हैं उसके लिए सबसे सस्ता सक्षम मॉडल सुझाता है, ताकि आप व्यस्त काम के लिए प्रीमियम दरें न चुकाएं।
सस्ते एजेंट को ग्रंट काम सौंपें
कुछ कार्य बड़े लेकिन उथले होते हैं: एक मॉड्यूल के लिए परीक्षण लिखना, पैटर्न के लिए सौ फ़ाइलों की जांच करना, बायलरप्लेट उत्पन्न करना। आप नहीं चाहते कि आपका महंगा एजेंट एक विशाल संदर्भ के अंदर इन सभी को निपटाए।
इसके बजाय इसे काम सौंपने दें। एजेंट डेलीगेशन के साथ, एक देव एजेंट एक उपकार्य को एक दूसरे एजेंट को सौंप सकता है जो एक सस्ते मॉडल पर चल रहा है, जो अपने साफ संदर्भ में दोहराव वाले काम को करता है और वापस रिपोर्ट करता है। महंगा एजेंट केंद्रित और छोटा रहता है, सस्ता एजेंट मात्रा को संभालता है। आपका बिल विभाजन का पालन करता है।
खुद को फिर से समझाना बंद करें
यदि आप हर बार कोड समीक्षा शुरू करते समय वही तीन-पैराग्राफ प्रॉम्प्ट टाइप करते हैं, तो आप इसे हर बार भेजने के लिए भुगतान कर रहे हैं। इसे एक बार सहेजें।
अपने आवर्ती निर्देशों को प्रॉम्प्ट लाइब्रेरी में रखें और अपनी दोहराने योग्य प्रक्रियाओं को स्किल्स के रूप में रखें जिसे एजेंट केवल तभी लोड करता है जब इसकी आवश्यकता होती है। आप शब्दों का पुन: उपयोग करते हैं बजाय इसके कि उन्हें फिर से टाइप करें और फिर से भेजें, और एक स्किल अपनी विस्तृत चरणों को बेस संदर्भ से बाहर रखता है जब तक कि उन्हें वास्तव में आवश्यक नहीं हो जाता। वही परिणाम, कम टोकन इधर-उधर।
समानांतर में एजेंट चलाने की लागत पर नजर रखें
समानांतर एजेंट एक सुपरपावर हैं, और वे आपके टोकन खर्च को ठीक उसी संख्या से गुणा करते हैं जितने एजेंट आप चलाते हैं। पांच एजेंट एक ही साझा संदर्भ को पढ़ते हैं तो यह पांच गुना पढ़ाई है।
जब तक आप इसे देख सकते हैं, तब तक यह ठीक है। जब आप स्केल करते हैं तो प्रोजेक्ट सांख्यिकी को खुला रखें, अपने एजेंटों को कच्चे दस्तावेजों के बजाय हल्के .md संदर्भों पर इंगित करें, और जो समाप्त हो गए हैं उन्हें मार दें बजाय इसके कि उन्हें महंगे विंडो में Idle छोड़ दें। समानांतरता आपको गति देनी चाहिए, न कि एक आश्चर्यजनक चालान। यदि आप समानांतर में कोडिंग एजेंट चला रहे हैं, तो एक साझा, परिवर्तित संदर्भ पूरे बेड़े को सस्ती रखता है।
संक्षिप्त संस्करण
आपके अधिकांश Claude Code बिल का कारण कोड नहीं है, यह फिर से पढ़ना है। तो:
- लाइव टोकन काउंटर पर नजर रखें ताकि संख्या कभी आश्चर्य न बने।
- कार्यों के बीच
/clearचलाएं और सत्रों को छोटा रखें। - पूछने से पहले PDFs को Markdown में परिवर्तित करें।
- उस काम के लिए सबसे छोटे मॉडल का उपयोग करें जो काम कर सके, या Adaptive Mode को इसे आपके लिए चुनने दें।
- सौंपें उथले, उच्च-वॉल्यूम कार्य को एक सस्ते एजेंट को।
- प्रॉम्प्ट और स्किल्स का पुन: उपयोग करें बजाय इसके कि उन्हें फिर से टाइप करें।
इनमें से कोई भी आपको धीमा नहीं करता। छोटा संदर्भ और सही मॉडल आमतौर पर एजेंट को तेज और तेज बनाते हैं, और सस्ता बिल बोनस होता है।
ये छह आदतें हमारे 50 Claude Code टिप्स का लागत वाला पहलू हैं। बाकी सूची प्रॉम्प्टिंग, hooks, सबएजेंट और CLAUDE.md को कवर करती है।
क्या आप मीटर, मॉडल रूटिंग और डेलीगेशन को एक जगह पर चाहते हैं? AgentsRoom डाउनलोड करें और अपने टोकन लागत को टोकन उपयोग दृश्य में गिरते हुए देखें।
AgentsRoom डाउनलोड करें
अपने सभी AI एजेंट्स को, अपने सभी प्रोजेक्ट्स पर, एक ही विंडो से चलाएं।
कंपेनियन ऐप: चलते-फिरते अपने एजेंट्स मॉनिटर करें
Claude, Codex, Antigravity CLI या किसी अन्य AI प्रदाता का उपयोग करें।
बग और अनुरोध सीधे अपने सार्वजनिक बैकलॉग में भेजें।
पढ़ते रहें
Keep Claude Code Running After SSH Disconnects: A tmux Recipe
Keep Claude Code alive after an SSH disconnect with tmux. Reconnect to the same process, check persistence, and use AgentsRoom's opt-in setting.
लेख पढ़ेंClaude Code Routines: क्या क्लाउड में चलता है, क्या आपकी मशीन पर रहता है, और कैसे चुनें
Routines, Claude Code का वह तरीका है जिससे कोई सहेजा हुआ प्रॉम्प्ट आपके बिना चलता है: किसी शेड्यूल पर, किसी API कॉल पर या किसी GitHub इवेंट पर, आपकी रिपॉजिटरी के एक नए क्लोन पर चलने वाले क्लाउड सत्र के रूप में। ये research preview में हैं। Claude Code के पास काम शेड्यूल करने के दो स्थानीय तरीके भी हैं, डेस्कटॉप ऐप के शेड्यूल किए गए टास्क और /loop, और तीनों एक जैसा व्यवहार नहीं करते: न्यूनतम अंतराल, आपकी स्थानीय फ़ाइलों तक पहुँच, अनुमति के सवाल, और लैपटॉप के स्लीप में जाने पर क्या होता है। यह गाइड दस्तावेज़ में लिखी सीमाओं के साथ तीनों को सामने रखती है, फिर बताती है कि हमारे अपने सात रात वाले एजेंट इसकी जगह एक स्थानीय मशीन पर क्यों चलते हैं।
लेख पढ़ेंबहुत सारे टर्मिनल, बहुत सारे AI एजेंट: वो संज्ञानात्मक कर्ज़ जो आपको धीमा कर देता है (और इससे बाहर कैसे निकलें)
दस AI-एजेंट टर्मिनल के बीच जूझते रहना एक संज्ञानात्मक, दस्तावेज़ी और आर्थिक कर्ज़ खड़ा कर देता है जो आपका समय और token दोनों खा जाता है। कंट्रोल वापस पाने का तरीका यहां है।
लेख पढ़ें