Skip to content
  • 0 Votes
    1 Posts
    4 Views
    A
    <h2><strong>تعارف</strong></h2> <p></p> <p>حال ہی میں، کچھ صارفین نے ایک غیر معمولی صورتِ حال دیکھی:</p> <blockquote> <p>"میں نے صرف ‘Hi’ بھیجا، پھر 10,000+ ٹوکنز کیوں خرچ ہوئے؟"</p> </blockquote> <p>پہلی نظر میں یہ غیر متوقع لگ سکتا ہے۔ دو حروف پر مشتمل ایک پیغام کو تو صرف چند ٹوکنز درکار ہونے چاہییں، ہے نا؟</p> <p>جواب یہ ہے: <strong>ماڈل صرف آپ کا نظر آنے والا پیغام ہی پروسیس نہیں کرتا۔</strong></p> <p>جدید AI اسسٹنٹس، خصوصاً کوڈنگ ایجنٹس جیسے Codex، Claude Code، اور دیگر IDE پر مبنی AI ٹولز، ماڈل کو کام سمجھنے اور بہتر جواب دینے میں مدد دینے کے لیے آپ کے پیغام کے ساتھ بہت سی اضافی معلومات بھی بھیجتے ہیں۔</p> <hr> <p></p> <h2>آپ کا پیغام سیاق و سباق کا صرف ایک چھوٹا حصہ ہوتا ہے</h2> <p>جب آپ یہ بھیجتے ہیں:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p>تو AI ماڈل کو بھیجی گئی اصل درخواست کچھ اس طرح ہو سکتی ہے:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>System Instructions + User Settings + Configured Skills + Available Tools + Project Information + File Context + Previous Conversation History + Your Message: "Hi"</code></pre> <p>ان تمام اجزاء کا مجموعی حجم ہی وہ اصل سیاق و سباق ہے جسے ماڈل پروسیس کرتا ہے۔</p> <p>لہٰذا، بہت مختصر پیغام بھی کافی زیادہ ٹوکنز استعمال کر سکتا ہے۔</p> <hr> <h2>کون سی چیزیں سیاق و سباق کے استعمال میں اضافہ کر سکتی ہیں؟</h2> <h3>1. ترتیب دی گئی مہارتیں</h3> <p>اگر آپ نے اپنی مرضی کی مہارتیں یا AI صلاحیتیں فعال کر رکھی ہیں، تو ان کی ہدایات ماڈل کے سیاق و سباق میں لوڈ کرنا پڑتی ہیں۔</p> <p>مثال کے طور پر:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Skill A instructions: 2,000 tokens Skill B instructions: 3,000 tokens Skill C instructions: 1,500 tokens</code></pre> <p>آپ کے کچھ بھی ٹائپ کرنے سے پہلے ہی، یہ ہدایات کئی ہزار ٹوکنز گھیر سکتی ہیں۔</p> <hr> <h3>2. ٹولز اور ایجنٹ کی صلاحیتیں</h3> <p>AI کوڈنگ اسسٹنٹس عموماً ایسے ٹولز فراہم کرتے ہیں جیسے:</p> <ul> <li><p>فائل پڑھنا</p></li> <li><p>کوڈ تلاش کرنا</p></li> <li><p>ٹرمینل چلانا</p></li> <li><p>Git آپریشنز</p></li> <li><p>براؤزر تک رسائی</p></li> <li><p>بیرونی انضمامات</p></li> </ul> <p>ان ٹولز کی تعریفیں اور استعمال کی ہدایات بھی سیاق و سباق کی جگہ استعمال کرتی ہیں۔</p> <hr> <h3>3. پروجیکٹ اور فائل کا سیاق و سباق</h3> <p>جب آپ کسی IDE یا کوڈ ریپوزٹری کے اندر کام کر رہے ہوتے ہیں، تو AI کلائنٹ خودکار طور پر یہ چیزیں شامل کر سکتا ہے:</p> <ul> <li><p>پروجیکٹ کی ساخت</p></li> <li><p>کھلی ہوئی فائلیں</p></li> <li><p>کوڈ کے ٹکڑے</p></li> <li><p>انحصارات</p></li> <li><p>ترتیبی فائلیں</p></li> </ul> <p>اس سے AI آپ کے پروجیکٹ کو بہتر طور پر سمجھ پاتا ہے، لیکن اس سے سیاق و سباق کا استعمال بھی بڑھ جاتا ہے۔</p> <hr> <h3>4. سابقہ گفتگو کی تاریخ</h3> <p>اگر آپ پہلے سے موجود گفتگو کو جاری رکھتے ہیں، تو عام طور پر پہلے کے پیغامات دوبارہ شامل کیے جاتے ہیں تاکہ ماڈل سیاق و سباق کو سمجھ سکے۔</p> <p>مثال کے طور پر:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Previous discussion: 12,000 tokens New message: Hi</code></pre> <p>نئی درخواست میں پھر بھی پچھلے 12,000 ٹوکنز شامل ہو سکتے ہیں۔</p> <hr> <h2>کم سے کم ٹوکن استعمال کو کیسے جانچا جائے</h2> <p>اگر آپ کسی سادہ پیغام کے ٹوکن استعمال کی پیمائش کرنا چاہتے ہیں، تو براہِ کرم یہ طریقہ آزمائیں:</p> <ol> <li><p>بالکل نئی گفتگو شروع کریں۔</p></li> <li><p>اپنی مرضی کی مہارتیں غیر فعال کریں۔</p></li> <li><p>فائلیں منسلک نہ کریں۔</p></li> <li><p>پروجیکٹ ورک اسپیس نہ کھولیں۔</p></li> <li><p>صرف یہ بھیجیں:</p></li> </ol> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p>اس سے کم از کم ممکنہ سیاق و سباق کے استعمال کا اندازہ ہو جائے گا۔</p> <hr> <h2>Context Window بمقابلہ Token Usage</h2> <p>یہ فرق سمجھنا اہم ہے:</p> <h3>Context Window</h3> <p>وہ زیادہ سے زیادہ معلومات جسے ماڈل ایک درخواست میں پروسیس کر سکتا ہے۔</p> <p>مثال:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>1M token context window</code></pre> <p>یعنی ماڈل نظری طور پر 10 لاکھ ٹوکنز تک سنبھال سکتا ہے۔</p> <h3>Token Usage</h3> <p>ٹوکنز کی وہ حقیقی مقدار جو کسی مخصوص درخواست میں شامل ہوتی ہے۔</p> <p>مثال:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>User message: Hi Actual request: System instructions + tools + history + "Hi" Total: 15,000 tokens</code></pre> <p>بڑا context window ہونے کا یہ مطلب نہیں کہ ہر درخواست میں صرف آپ کے پیغام کی لمبائی جتنے ہی ٹوکنز خرچ ہوں گے۔</p> <hr> <h2>نتیجہ</h2> <p>مختصر پیغام پر زیادہ ٹوکن خرچ ہونا لازماً ماڈل یا API میں کسی مسئلے کی نشاندہی نہیں کرتا۔</p> <p>AI ایجنٹ ماحول میں، مجموعی سیاق و سباق میں بہت سے پوشیدہ اجزاء شامل ہوتے ہیں جو ذہین انداز میں کام کرنے کے لیے ضروری ہیں۔ ایک سادہ “Hi” بھی ہزاروں ٹوکنز پروسیس ہونے کا سبب بن سکتا ہے اگر سیشن میں مہارتیں، ٹولز، پروجیکٹ کی معلومات، یا سابقہ تاریخ شامل ہو۔</p> <p>ہم مشورہ دیتے ہیں کہ خام ٹوکن استعمال کو جانچتے وقت اضافی سیاق و سباق کے بغیر ایک صاف سیشن شروع کریں۔</p> <p>آپ کی سمجھ بوجھ اور مسلسل تعاون کا شکریہ۔</p>
  • 0 Votes
    1 Posts
    69 Views
    A
    <p>ہم نے ایک ایسے مسئلے کی تصدیق کی ہے جس میں Codex، GPT-5.6-sol کے لیے کانٹیکسٹ ونڈو کا سائز غلط دکھا سکتا ہے۔</p><p>یہ مسئلہ بنیادی ماڈل کی صلاحیت کی وجہ سے نہیں بلکہ ہماری کنفیگریشن اور میٹاڈیٹا ہینڈلنگ کی وجہ سے پیدا ہوا۔</p><p>ہم اس وقت ایک بڑی سسٹم ری فیکٹرنگ پر کام کر رہے ہیں۔ عارضی پیچ لگانے کے بجائے، ہم استحکام یقینی بنانے کے لیے مکمل جانچ کے بعد یہ درستگی جاری کریں گے۔</p><p>اس مسئلے کی اطلاع دینے والے صارف کا شکریہ۔ ہم آپ کی آراء کی قدر کرتے ہیں اور درستگی نافذ ہونے کے بعد سب کو آگاہ کریں گے۔</p>