<h2><strong>परिचय</strong></h2>
<p></p>
<p>अलीकडे, काही वापरकर्त्यांनी एक असामान्य परिस्थिती लक्षात घेतली:</p>
<blockquote>
<p>“मी फक्त ‘Hi’ पाठवला, मग 10,000+ टोकन्स कसे खर्च झाले?”</p>
</blockquote>
<p>पहिल्या नजरेत हे अनपेक्षित वाटू शकते. दोन अक्षरांचा संदेश फक्त काही टोकन्सच घेईल, बरोबर?</p>
<p>उत्तर असे आहे: <strong>मॉडेल फक्त तुमचा दिसणारा संदेशच प्रक्रिया करत नाही.</strong></p>
<p>आधुनिक AI सहाय्यक, विशेषतः Codex, Claude Code आणि इतर IDE-आधारित AI साधनांसारखे कोडिंग एजंट्स, मॉडेलला काम अधिक चांगल्या प्रकारे समजावे आणि अधिक उपयुक्त प्रतिसाद द्यावा यासाठी तुमच्या संदेशासोबत बरीच अधिक माहिती पाठवतात.</p>
<hr>
<p></p>
<h2>तुमचा संदेश हा एकूण संदर्भाचा फक्त लहान भाग असतो</h2>
<p>जेव्हा तुम्ही पाठवता:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>तेव्हा AI मॉडेलकडे पाठवली जाणारी प्रत्यक्ष विनंती साधारणपणे अशी दिसू शकते:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>System Instructions
+
User Settings
+
Configured Skills
+
Available Tools
+
Project Information
+
File Context
+
Previous Conversation History
+
Your Message: "Hi"</code></pre>
<p>या सर्व घटकांचा एकत्रित आकार म्हणजे मॉडेलने प्रक्रिया केलेला प्रत्यक्ष संदर्भ.</p>
<p>म्हणूनच, अगदी छोटा संदेशही लक्षणीय संख्येने टोकन्स वापरू शकतो.</p>
<hr>
<h2>संदर्भ वापर कोणत्या गोष्टींमुळे वाढू शकतो?</h2>
<h3>1. कॉन्फिगर केलेली कौशल्ये</h3>
<p>जर तुम्ही कस्टम स्किल्स किंवा AI क्षमता सक्षम केल्या असतील, तर त्यांच्या सूचना मॉडेलच्या संदर्भात लोड कराव्या लागतात.</p>
<p>उदाहरणार्थ:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Skill A instructions: 2,000 tokens
Skill B instructions: 3,000 tokens
Skill C instructions: 1,500 tokens</code></pre>
<p>तुम्ही काहीही टाइप करण्यापूर्वीच, या सूचना आधीपासूनच अनेक हजार टोकन्स व्यापून बसलेल्या असू शकतात.</p>
<hr>
<h3>2. साधने आणि एजंट क्षमता</h3>
<p>AI कोडिंग सहाय्यक सहसा पुढीलप्रमाणे साधने देतात:</p>
<ul>
<li><p>फाइल वाचन</p></li>
<li><p>कोड शोध</p></li>
<li><p>टर्मिनल एक्झिक्युशन</p></li>
<li><p>Git ऑपरेशन्स</p></li>
<li><p>ब्राउझर प्रवेश</p></li>
<li><p>बाह्य एकत्रीकरणे</p></li>
</ul>
<p>या साधनांच्या व्याख्या आणि वापराच्या सूचनाही संदर्भातील जागा वापरतात.</p>
<hr>
<h3>3. प्रकल्प आणि फाइल संदर्भ</h3>
<p>जेव्हा तुम्ही IDE किंवा कोड रिपॉझिटरीमध्ये काम करत असता, तेव्हा AI क्लायंट आपोआप पुढील गोष्टी समाविष्ट करू शकतो:</p>
<ul>
<li><p>प्रकल्प रचना</p></li>
<li><p>उघड्या फाइल्स</p></li>
<li><p>कोड स्निपेट्स</p></li>
<li><p>डिपेंडन्सीज</p></li>
<li><p>कॉन्फिगरेशन फाइल्स</p></li>
</ul>
<p>यामुळे AI ला तुमचा प्रकल्प समजण्यास मदत होते, पण त्याचबरोबर संदर्भ वापरही वाढतो.</p>
<hr>
<h3>4. मागील संभाषणाचा इतिहास</h3>
<p>जर तुम्ही आधीचेच संभाषण पुढे चालू ठेवत असाल, तर संदर्भ समजण्यासाठी मागील संदेश सहसा पुन्हा समाविष्ट केले जातात.</p>
<p>उदाहरणार्थ:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Previous discussion: 12,000 tokens
New message:
Hi</code></pre>
<p>नवीन विनंतीमध्ये तरीही आधीचे 12,000 टोकन्स समाविष्ट असू शकतात.</p>
<hr>
<h2>किमान टोकन वापर कसा तपासावा</h2>
<p>जर तुम्हाला साध्या संदेशाचा टोकन वापर मोजायचा असेल, तर कृपया पुढील गोष्टी करून पाहा:</p>
<ol>
<li><p>पूर्णपणे नवीन संभाषण तयार करा.</p></li>
<li><p>कस्टम स्किल्स निष्क्रिय करा.</p></li>
<li><p>फाइल्स जोडू नका.</p></li>
<li><p>प्रकल्प वर्कस्पेस उघडू नका.</p></li>
<li><p>फक्त हेच पाठवा:</p></li>
</ol>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>यामुळे अंदाजे किमान संदर्भ वापर दिसेल.</p>
<hr>
<h2>कॉन्टेक्स्ट विंडो विरुद्ध टोकन वापर</h2>
<p>पुढील दोन गोष्टींमधील फरक समजून घेणे महत्त्वाचे आहे:</p>
<h3>कॉन्टेक्स्ट विंडो</h3>
<p>एका विनंतीत मॉडेल किती जास्तीत जास्त माहिती प्रक्रिया करू शकते.</p>
<p>उदाहरण:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>1M token context window</code></pre>
<p>याचा अर्थ मॉडेल सिद्धांततः 1 दशलक्ष टोकन्सपर्यंत हाताळू शकते.</p>
<h3>टोकन वापर</h3>
<p>विशिष्ट विनंतीमध्ये प्रत्यक्षात समाविष्ट असलेल्या टोकन्सचे प्रमाण.</p>
<p>उदाहरण:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>User message:
Hi
Actual request:
System instructions + tools + history + "Hi"
Total:
15,000 tokens</code></pre>
<p>मोठी कॉन्टेक्स्ट विंडो असणे म्हणजे प्रत्येक विनंतीत फक्त तुमच्या संदेशाइतकेच टोकन्स खर्च होतील असे नाही.</p>
<hr>
<h2>निष्कर्ष</h2>
<p>लहान संदेशामुळे जास्त टोकन वापर होणे म्हणजे मॉडेल किंवा API मध्ये समस्या आहे असे आवश्यक नाही.</p>
<p>AI एजंट वातावरणात, एकूण संदर्भात बुद्धिमान कार्यासाठी आवश्यक असलेले अनेक लपलेले घटक समाविष्ट असतात. सत्रात स्किल्स, साधने, प्रकल्प माहिती किंवा मागील इतिहास असल्यास, साधा “Hi” देखील हजारो टोकन्स प्रक्रिया होण्यास कारणीभूत ठरू शकतो.</p>
<p>मूळ टोकन वापर तपासायचा असल्यास, अतिरिक्त संदर्भांशिवाय स्वच्छ सत्र सुरू करण्याची आम्ही शिफारस करतो.</p>
<p>तुमच्या समजुतीबद्दल आणि सातत्यपूर्ण समर्थनाबद्दल धन्यवाद.</p>