เหตุใดการส่งเพียง "Hi" ก็ยังอาจใช้โทเคนหลายพันโทเคนได้
-
<h2><strong>บทนำ</strong></h2>
<p></p>
<p>เมื่อไม่นานมานี้ ผู้ใช้บางรายสังเกตเห็นสถานการณ์ที่ดูผิดปกติ:</p>
<blockquote>
<p>"ฉันส่งแค่ ‘Hi’ เอง ทำไมถึงใช้ไปมากกว่า 10,000 โทเคน?"</p>
</blockquote>
<p>เมื่อมองผิวเผิน เรื่องนี้อาจดูน่าประหลาดใจ ข้อความยาวเพียงสองตัวอักษรน่าจะใช้แค่ไม่กี่โทเคนเท่านั้น ใช่ไหม?</p>
<p>คำตอบคือ: <strong>โมเดลไม่ได้ประมวลผลเฉพาะข้อความที่คุณมองเห็นว่าเป็นข้อความของคุณเท่านั้น</strong></p>
<p>ผู้ช่วย AI สมัยใหม่ โดยเฉพาะเอเจนต์ด้านการเขียนโค้ด เช่น Codex, Claude Code และเครื่องมือ AI บน IDE อื่น ๆ จะส่งข้อมูลเพิ่มเติมจำนวนมากไปพร้อมกับข้อความของคุณ เพื่อช่วยให้โมเดลเข้าใจงานและตอบกลับได้ดีขึ้น</p>
<hr>
<p></p>
<h2>ข้อความของคุณเป็นเพียงส่วนเล็ก ๆ ของบริบททั้งหมด</h2>
<p>เมื่อคุณส่ง:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>คำขอจริงที่ถูกส่งไปยังโมเดล AI อาจมีหน้าตาประมาณนี้มากกว่า:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>คำสั่งระบบ
+
การตั้งค่าผู้ใช้
+
ทักษะที่ตั้งค่าไว้
+
เครื่องมือที่ใช้งานได้
+
ข้อมูลโปรเจกต์
+
บริบทของไฟล์
+
ประวัติการสนทนาก่อนหน้า
+
ข้อความของคุณ: "Hi"</code></pre>
<p>ขนาดรวมขององค์ประกอบทั้งหมดเหล่านี้คือบริบทจริงที่โมเดลต้องประมวลผล</p>
<p>ดังนั้น แม้จะเป็นข้อความสั้นมาก ก็ยังอาจใช้โทเคนจำนวนมากได้</p>
<hr>
<h2>อะไรบ้างที่ทำให้การใช้บริบทเพิ่มขึ้น?</h2>
<h3>1. ทักษะที่ตั้งค่าไว้</h3>
<p>หากคุณเปิดใช้ทักษะแบบกำหนดเองหรือความสามารถ AI เพิ่มเติม คำสั่งของสิ่งเหล่านั้นก็ต้องถูกโหลดเข้าไปในบริบทของโมเดลด้วย</p>
<p>ตัวอย่างเช่น:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>คำสั่งของ Skill A: 2,000 โทเคน
คำสั่งของ Skill B: 3,000 โทเคน
คำสั่งของ Skill
1,500 โทเคน</code></pre>
<p>ดังนั้น แม้ก่อนที่คุณจะพิมพ์อะไรเลย คำสั่งเหล่านี้ก็อาจใช้พื้นที่ไปแล้วหลายพันโทเคน</p>
<hr>
<h3>2. เครื่องมือและความสามารถของเอเจนต์</h3>
<p>ผู้ช่วย AI สำหรับเขียนโค้ดมักมีเครื่องมือ เช่น:</p>
<ul>
<li><p>การอ่านไฟล์</p></li>
<li><p>การค้นหาโค้ด</p></li>
<li><p>การรันคำสั่งในเทอร์มินัล</p></li>
<li><p>การทำงานกับ Git</p></li>
<li><p>การเข้าถึงเบราว์เซอร์</p></li>
<li><p>การเชื่อมต่อภายนอก</p></li>
</ul>
<p>คำจำกัดความและคำแนะนำการใช้งานของเครื่องมือเหล่านี้ก็ใช้พื้นที่บริบทเช่นกัน</p>
<hr>
<h3>3. บริบทของโปรเจกต์และไฟล์</h3>
<p>เมื่อทำงานอยู่ใน IDE หรือรีโพซิทอรีโค้ด ไคลเอนต์ AI อาจแนบข้อมูลต่อไปนี้ให้อัตโนมัติ:</p>
<ul>
<li><p>โครงสร้างโปรเจกต์</p></li>
<li><p>ไฟล์ที่เปิดอยู่</p></li>
<li><p>ส่วนของโค้ด</p></li>
<li><p>ดีเพนเดนซี</p></li>
<li><p>ไฟล์คอนฟิก</p></li>
</ul>
<p>สิ่งนี้ช่วยให้ AI เข้าใจโปรเจกต์ของคุณ แต่ก็ทำให้การใช้บริบทเพิ่มขึ้นด้วย</p>
<hr>
<h3>4. ประวัติการสนทนาก่อนหน้า</h3>
<p>หากคุณสนทนาต่อจากเซสชันเดิม ข้อความก่อนหน้ามักจะถูกแนบกลับไปอีกครั้ง เพื่อให้โมเดลเข้าใจบริบท</p>
<p>ตัวอย่างเช่น:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>การสนทนาก่อนหน้า: 12,000 โทเคนข้อความใหม่:
Hi</code></pre>
<p>คำขอใหม่ก็อาจยังคงมี 12,000 โทเคนก่อนหน้านั้นรวมอยู่ด้วย</p>
<hr>
<h2>วิธีทดสอบการใช้โทเคนขั้นต่ำ</h2>
<p>หากคุณต้องการวัดการใช้โทเคนของข้อความง่าย ๆ โปรดลองดังนี้:</p>
<ol>
<li><p>สร้างบทสนทนาใหม่ทั้งหมด</p></li>
<li><p>ปิดใช้งานทักษะแบบกำหนดเอง</p></li>
<li><p>อย่าแนบไฟล์</p></li>
<li><p>อย่าเปิดเวิร์กสเปซของโปรเจกต์</p></li>
<li><p>ส่งเพียง:</p></li>
</ol>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>วิธีนี้จะแสดงการใช้บริบทขั้นต่ำโดยประมาณ</p>
<hr>
<h2>Context Window เทียบกับ Token Usage</h2>
<p>สิ่งสำคัญคือต้องแยกความแตกต่างระหว่าง:</p>
<h3>Context Window</h3>
<p>ปริมาณข้อมูลสูงสุดที่โมเดลสามารถประมวลผลได้ในหนึ่งคำขอ</p>
<p>ตัวอย่าง:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>หน้าต่างบริบท 1M โทเคน</code></pre>
<p>หมายความว่าในทางทฤษฎี โมเดลสามารถรองรับได้สูงสุดถึง 1 ล้านโทเคน</p>
<h3>Token Usage</h3>
<p>จำนวนโทเคนจริงที่ถูกรวมอยู่ในคำขอหนึ่ง ๆ</p>
<p>ตัวอย่าง:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>ข้อความผู้ใช้:
Hiคำขอจริง:
คำสั่งระบบ + เครื่องมือ + ประวัติ + "Hi"รวมทั้งหมด:
15,000 โทเคน</code></pre>
<p>การมีหน้าต่างบริบทขนาดใหญ่ไม่ได้หมายความว่าทุกคำขอจะใช้โทเคนเท่ากับความยาวข้อความของคุณเท่านั้น</p>
<hr>
<h2>สรุป</h2>
<p>การใช้โทเคนสูงจากข้อความสั้น ๆ ไม่ได้หมายความว่าจะเป็นปัญหาของโมเดลหรือ API เสมอไป</p>
<p>ในสภาพแวดล้อมแบบ AI agent บริบทรวมประกอบด้วยองค์ประกอบที่ซ่อนอยู่หลายอย่างซึ่งจำเป็นต่อการทำงานอย่างชาญฉลาด ข้อความง่าย ๆ อย่าง "Hi" ก็ยังอาจทำให้มีการประมวลผลหลายพันโทเคนได้ หากเซสชันนั้นมีทักษะ เครื่องมือ ข้อมูลโปรเจกต์ หรือประวัติการสนทนาก่อนหน้าอยู่</p>
<p>เราขอแนะนำให้เริ่มเซสชันใหม่ที่สะอาดและไม่มีบริบทเพิ่มเติม เมื่อต้องการทดสอบการใช้โทเคนแบบดิบ</p>
<p>ขอบคุณสำหรับความเข้าใจและการสนับสนุนอย่างต่อเนื่อง</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login