<h2><strong>المقدمة</strong></h2>
<p></p>
<p>لاحظ بعض المستخدمين مؤخرًا حالة غير معتادة:</p>
<blockquote>
<p>"لقد أرسلت فقط ‘Hi’، فلماذا استهلكت 10,000+ توكن؟"</p>
<p></p>
</blockquote>
<p>للوهلة الأولى، قد يبدو هذا غير متوقع. فرسالة مكوّنة من حرفين فقط يُفترض أن تحتاج إلى عدد قليل من التوكنات، أليس كذلك؟</p>
<p>الإجابة هي: <strong>النموذج لا يعالج رسالتك الظاهرة فقط.</strong></p>
<p>تقوم المساعدات الحديثة المعتمدة على الذكاء الاصطناعي، وخاصة وكلاء البرمجة مثل Codex وClaude Code وغيرها من أدوات الذكاء الاصطناعي المدمجة في بيئات التطوير، بإرسال معلومات أكثر بكثير مع رسالتك لمساعدة النموذج على فهم المهمة وتقديم ردود أفضل.</p>
<p></p>
<hr>
<p></p>
<h2>رسالتك ليست سوى جزء صغير من السياق</h2>
<p>عندما ترسل:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p></p>
<p>فقد يبدو الطلب الفعلي المُرسل إلى نموذج الذكاء الاصطناعي أقرب إلى هذا:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>تعليمات النظام
+
إعدادات المستخدم
+
المهارات المُعدّة
+
الأدوات المتاحة
+
معلومات المشروع
+
سياق الملفات
+
سجل المحادثة السابق
+
رسالتك: "Hi"</code></pre>
<p></p>
<p>يمثل الحجم الإجمالي لجميع هذه المكونات السياق الفعلي الذي يعالجه النموذج.</p>
<p>لذلك، حتى الرسالة القصيرة جدًا قد تستهلك عددًا كبيرًا من التوكنات.</p>
<hr>
<p></p>
<h2><strong>ما الذي يمكن أن يزيد من استهلاك السياق؟</strong></h2>
<h3>1. المهارات المُعدّة</h3>
<p></p>
<p>إذا قمت بتمكين مهارات مخصصة أو قدرات ذكاء اصطناعي إضافية، فيجب تحميل تعليماتها ضمن سياق النموذج.</p>
<p></p>
<p>على سبيل المثال:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>تعليمات المهارة A: 2,000 توكن
تعليمات المهارة B: 3,000 توكن
تعليمات المهارة 1,500 توكن</code></pre>
<p>حتى قبل أن تكتب أي شيء، قد تكون هذه التعليمات قد شغلت بالفعل عدة آلاف من التوكنات.</p>
<hr>
<p></p>
<h3>2. الأدوات وقدرات الوكيل</h3>
<p></p>
<p>عادةً ما توفر مساعدات البرمجة بالذكاء الاصطناعي أدوات مثل:</p>
<ul>
<li><p>قراءة الملفات</p></li>
<li><p>البحث في الشيفرة</p></li>
<li><p>تنفيذ الأوامر في الطرفية</p></li>
<li><p>عمليات Git</p></li>
<li><p>الوصول إلى المتصفح</p></li>
<li><p>التكاملات الخارجية</p></li>
</ul>
<p>كما أن تعريفات هذه الأدوات وتعليمات استخدامها تستهلك أيضًا مساحة من السياق.</p>
<hr>
<p></p>
<h3>3. سياق المشروع والملفات</h3>
<p></p>
<p>عند العمل داخل بيئة تطوير أو مستودع شيفرة، قد يقوم عميل الذكاء الاصطناعي تلقائيًا بتضمين:</p>
<ul>
<li><p>هيكل المشروع</p></li>
<li><p>الملفات المفتوحة</p></li>
<li><p>مقتطفات من الشيفرة</p></li>
<li><p>التبعيات</p></li>
<li><p>ملفات الإعداد</p></li>
</ul>
<p>وهذا يساعد الذكاء الاصطناعي على فهم مشروعك، لكنه يزيد أيضًا من استهلاك السياق.</p>
<hr>
<p></p>
<h3>4. سجل المحادثة السابق</h3>
<p></p>
<p>إذا تابعت محادثة قائمة، فعادةً ما تُضمَّن الرسائل السابقة مرة أخرى حتى يفهم النموذج السياق.</p>
<p>على سبيل المثال:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>المناقشة السابقة: 12,000 توكن
الرسالة الجديدة:
Hi</code></pre>
<p>قد يظل الطلب الجديد يحتوي على 12,000 توكن السابقة.</p>
<hr>
<h2>كيفية اختبار الحد الأدنى لاستهلاك التوكنات</h2>
<p>إذا كنت تريد قياس استهلاك التوكنات لرسالة بسيطة، فيُرجى تجربة ما يلي:</p>
<ol>
<li><p>أنشئ محادثة جديدة تمامًا.</p></li>
<li><p>عطّل المهارات المخصصة.</p></li>
<li><p>لا تُرفق ملفات.</p></li>
<li><p>لا تفتح مساحة عمل لمشروع.</p></li>
<li><p>أرسل فقط:</p></li>
</ol>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>سيوضح هذا الحد الأدنى التقريبي لاستهلاك السياق.</p>
<hr>
<h2>نافذة السياق مقابل استهلاك التوكنات</h2>
<p>من المهم التمييز بين:</p>
<h3>نافذة السياق</h3>
<p>الحد الأقصى لكمية المعلومات التي يمكن للنموذج معالجتها في طلب واحد.</p>
<p>مثال:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>نافذة سياق بسعة 1M توكن</code></pre>
<p>وهذا يعني أن النموذج يمكنه نظريًا التعامل مع ما يصل إلى مليون توكن.</p>
<h3>استهلاك التوكنات</h3>
<p>الكمية الفعلية من التوكنات المضمنة في طلب محدد.</p>
<p>مثال:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>رسالة المستخدم:
Hi
الطلب الفعلي:
تعليمات النظام + الأدوات + السجل + "Hi"
الإجمالي:
15,000 توكن</code></pre>
<p>وجود نافذة سياق كبيرة لا يعني أن كل طلب سيستهلك فقط طول رسالتك.</p>
<p></p>
<hr>
<p></p>
<h2><strong>الخلاصة</strong></h2>
<p></p>
<p>الاستهلاك المرتفع للتوكنات الناتج عن رسالة قصيرة لا يشير بالضرورة إلى وجود مشكلة في النموذج أو واجهة البرمجة.</p>
<p></p>
<p>في بيئات وكلاء الذكاء الاصطناعي، يتضمن السياق الإجمالي العديد من المكونات المخفية المطلوبة للتشغيل الذكي. لذلك يمكن أن تؤدي رسالة بسيطة مثل "Hi" إلى معالجة آلاف التوكنات إذا كانت الجلسة تحتوي على مهارات أو أدوات أو معلومات مشروع أو سجل سابق.</p>
<p></p>
<p>نوصي ببدء جلسة نظيفة دون سياق إضافي عند اختبار استهلاك التوكنات الخام.</p>
<p></p>
<p>شكرًا لتفهمكم ودعمكم المستمر.</p>