Skip to content
  • 0 Votes
    1 Posts
    66 Views
    A
    <p>ต่อไปนี้คือวิธีเปิดใช้หน้าต่างบริบท 1 ล้านโทเค็นใน Codex สำหรับ GPT-5.6 Sol</p><p>แม้ว่าเราจะปรับขีดจำกัดบริบทใน Codex ให้เหมาะสมที่สุดในแง่ประสิทธิภาพและต้นทุนแล้ว แต่มีผู้ขอฟีเจอร์นี้บ่อยครั้ง จึงบันทึกวิธีการไว้ที่นี่</p><p>หน้าต่างบริบทที่ใหญ่ขึ้นช่วยให้ Codex เก็บโค้ด เอาต์พุตจากเครื่องมือ และประวัติการสนทนาได้มากขึ้นก่อนสรุปเนื้อหาเก่า คุณต้องใช้โมเดลที่รองรับ และตัวอย่างเช่น GPT-5.6 Sol มีหน้าต่างบริบท 1,050,000 โทเค็นตามเอกสาร</p><p>เปิด <code>~/.codex/config.toml</code> แล้วเพิ่มหรืออัปเดตการตั้งค่าต่อไปนี้ในระดับบนสุด ก่อนส่วนหัว <code>[section]</code> ใดๆ:</p><p></p><p>model = "gpt-5.6-sol"</p><p>model_context_window = 1000000</p><p>model_auto_compact_token_limit = 900000</p><p></p><p>การตั้งค่าแรกใช้เลือกโมเดล การตั้งค่าที่สองบอกให้ Codex ใช้งบประมาณบริบทหนึ่งล้านโทเค็น การตั้งค่าที่สามจะเริ่มย่อประวัติโดยอัตโนมัติเมื่อมีประมาณ 900,000 โทเค็น เพื่อเหลือพื้นที่สำรองไว้บ้าง หลังบันทึกแล้ว ให้รีสตาร์ตไคลเอนต์ Codex และเริ่มเซสชันใหม่</p><p>หากต้องการลองการกำหนดค่าสำหรับ CLI เพียงหนึ่งเซสชัน โดยไม่เปลี่ยนค่าเริ่มต้น:</p><p></p><p>codex -m gpt-5.6-sol \</p><p> -c model_context_window=1000000 \</p><p> -c model_auto_compact_token_limit=900000</p><p></p><p>ลองใช้งานได้ตามสบาย แต่โปรดทราบว่าเราได้ปรับค่าเริ่มต้นอย่างรอบคอบแล้ว</p><p>จาก Tibo: <a target="_blank" rel="noopener noreferrer nofollow" href="https://x.com/thsottiaux/status/2089082893804896524">https://x.com/thsottiaux/status/2089082893804896524</a></p>
  • 0 Votes
    1 Posts
    5 Views
    A
    บทนำ เมื่อไม่นานมานี้ ผู้ใช้บางรายสังเกตเห็นสถานการณ์ที่ดูผิดปกติ: "ฉันส่งแค่ ‘Hi’ ทำไมถึงใช้ไปมากกว่า 10,000 โทเคน?" เมื่อมองผิวเผิน เรื่องนี้อาจดูน่าประหลาดใจ เพราะข้อความยาวเพียงสองตัวอักษรน่าจะใช้เพียงไม่กี่โทเคนเท่านั้น ใช่ไหม? คำตอบคือ: โมเดลไม่ได้ประมวลผลเพียงข้อความที่คุณมองเห็นเท่านั้น ผู้ช่วย AI สมัยใหม่ โดยเฉพาะเอเจนต์ด้านการเขียนโค้ด เช่น Codex, Claude Code และเครื่องมือ AI ที่ทำงานบน IDE อื่น ๆ จะส่งข้อมูลอีกจำนวนมากไปพร้อมกับข้อความของคุณ เพื่อช่วยให้โมเดลเข้าใจงานและตอบกลับได้ดีขึ้น ข้อความของคุณเป็นเพียงส่วนเล็ก ๆ ของบริบททั้งหมด เมื่อคุณส่ง: Hi คำขอจริงที่ถูกส่งไปยังโมเดล AI อาจมีลักษณะใกล้เคียงกับสิ่งนี้มากกว่า: System Instructions + User Settings + Configured Skills + Available Tools + Project Information + File Context + Previous Conversation History + Your Message: "Hi" ขนาดรวมขององค์ประกอบทั้งหมดเหล่านี้คือบริบทจริงที่โมเดลต้องประมวลผล ดังนั้น แม้ข้อความจะสั้นมาก ก็ยังอาจใช้โทเคนจำนวนมากได้ อะไรบ้างที่ทำให้การใช้บริบทเพิ่มขึ้น? 1. ทักษะที่ตั้งค่าไว้ หากคุณเปิดใช้ทักษะแบบกำหนดเองหรือความสามารถ AI เพิ่มเติม คำสั่งของสิ่งเหล่านั้นจะต้องถูกโหลดเข้าไปในบริบทของโมเดล ตัวอย่างเช่น: Skill A instructions: 2,000 tokens Skill B instructions: 3,000 tokens Skill C instructions: 1,500 tokens แม้ก่อนที่คุณจะพิมพ์อะไรเลย คำสั่งเหล่านี้ก็อาจใช้พื้นที่ไปแล้วหลายพันโทเคน 2. เครื่องมือและความสามารถของเอเจนต์ ผู้ช่วย AI สำหรับการเขียนโค้ดมักมีเครื่องมือ เช่น: การอ่านไฟล์ การค้นหาโค้ด การรันคำสั่งในเทอร์มินัล การใช้งาน Git การเข้าถึงเบราว์เซอร์ การเชื่อมต่อภายนอก คำจำกัดความและคำแนะนำการใช้งานของเครื่องมือเหล่านี้ก็ใช้พื้นที่บริบทเช่นกัน 3. บริบทของโปรเจกต์และไฟล์ เมื่อทำงานภายใน IDE หรือที่เก็บโค้ด ไคลเอนต์ AI อาจใส่ข้อมูลเหล่านี้เข้ามาโดยอัตโนมัติ: โครงสร้างโปรเจกต์ ไฟล์ที่เปิดอยู่ ชุดโค้ดบางส่วน Dependencies ไฟล์คอนฟิก สิ่งนี้ช่วยให้ AI เข้าใจโปรเจกต์ของคุณ แต่ก็ทำให้การใช้บริบทเพิ่มขึ้นด้วย 4. ประวัติการสนทนาก่อนหน้า หากคุณกำลังสนทนาต่อจากบทสนทนาเดิม ข้อความก่อนหน้ามักจะถูกแนบมาอีกครั้ง เพื่อให้โมเดลเข้าใจบริบท ตัวอย่างเช่น: Previous discussion: 12,000 tokens New message: Hi คำขอใหม่ก็อาจยังคงมี 12,000 โทเคนก่อนหน้านี้รวมอยู่ด้วย วิธีทดสอบการใช้โทเคนขั้นต่ำ หากคุณต้องการวัดการใช้โทเคนของข้อความสั้น ๆ โปรดลองทำดังนี้: สร้างบทสนทนาใหม่ทั้งหมด ปิดการใช้งานทักษะแบบกำหนดเอง อย่าแนบไฟล์ อย่าเปิด workspace ของโปรเจกต์ ส่งเพียง: Hi วิธีนี้จะแสดงให้เห็นการใช้บริบทขั้นต่ำโดยประมาณ Context Window เทียบกับ Token Usage สิ่งสำคัญคือต้องแยกความแตกต่างระหว่าง: Context Window ปริมาณข้อมูลสูงสุดที่โมเดลสามารถประมวลผลได้ในการร้องขอหนึ่งครั้ง ตัวอย่าง: 1M token context window หมายความว่าในทางทฤษฎี โมเดลสามารถรองรับได้สูงสุดถึง 1 ล้านโทเคน Token Usage จำนวนโทเคนจริงที่ถูกรวมอยู่ในคำขอหนึ่ง ๆ ตัวอย่าง: User message: Hi Actual request: System instructions + tools + history + "Hi" Total: 15,000 tokens การมี context window ขนาดใหญ่ไม่ได้หมายความว่าทุกคำขอจะใช้โทเคนเพียงเท่ากับความยาวของข้อความที่คุณส่งเสมอไป บทสรุป การใช้โทเคนสูงจากข้อความสั้น ๆ ไม่ได้แปลว่าโมเดลหรือ API มีปัญหาเสมอไป ในสภาพแวดล้อมของ AI agent บริบทรวมทั้งหมดประกอบด้วยองค์ประกอบที่ซ่อนอยู่จำนวนมากซึ่งจำเป็นต่อการทำงานอย่างชาญฉลาด ข้อความง่าย ๆ อย่าง "Hi" ก็ยังอาจทำให้มีการประมวลผลหลายพันโทเคนได้ หากเซสชันนั้นมีทักษะ เครื่องมือ ข้อมูลโปรเจกต์ หรือประวัติการสนทนาก่อนหน้า เราแนะนำให้เริ่มเซสชันใหม่ที่สะอาดและไม่มีบริบทเพิ่มเติม หากคุณต้องการทดสอบการใช้โทเคนแบบดิบจริง ๆ ขอบคุณสำหรับความเข้าใจและการสนับสนุนอย่างต่อเนื่อง
  • 0 Votes
    1 Posts
    5 Views
    A
    <h2><strong>บทนำ</strong></h2> <p></p> <p>เมื่อไม่นานมานี้ ผู้ใช้บางรายสังเกตเห็นสถานการณ์ที่ดูผิดปกติ:</p> <blockquote> <p>"ฉันส่งแค่ ‘Hi’ เอง ทำไมถึงใช้ไปมากกว่า 10,000 โทเคน?"</p> </blockquote> <p>เมื่อมองผิวเผิน เรื่องนี้อาจดูน่าประหลาดใจ ข้อความยาวเพียงสองตัวอักษรน่าจะใช้แค่ไม่กี่โทเคนเท่านั้น ใช่ไหม?</p> <p>คำตอบคือ: <strong>โมเดลไม่ได้ประมวลผลเฉพาะข้อความที่คุณมองเห็นว่าเป็นข้อความของคุณเท่านั้น</strong></p> <p>ผู้ช่วย AI สมัยใหม่ โดยเฉพาะเอเจนต์ด้านการเขียนโค้ด เช่น Codex, Claude Code และเครื่องมือ AI บน IDE อื่น ๆ จะส่งข้อมูลเพิ่มเติมจำนวนมากไปพร้อมกับข้อความของคุณ เพื่อช่วยให้โมเดลเข้าใจงานและตอบกลับได้ดีขึ้น</p> <hr> <p></p> <h2>ข้อความของคุณเป็นเพียงส่วนเล็ก ๆ ของบริบททั้งหมด</h2> <p>เมื่อคุณส่ง:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p>คำขอจริงที่ถูกส่งไปยังโมเดล AI อาจมีหน้าตาประมาณนี้มากกว่า:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>คำสั่งระบบ + การตั้งค่าผู้ใช้ + ทักษะที่ตั้งค่าไว้ + เครื่องมือที่ใช้งานได้ + ข้อมูลโปรเจกต์ + บริบทของไฟล์ + ประวัติการสนทนาก่อนหน้า + ข้อความของคุณ: "Hi"</code></pre> <p>ขนาดรวมขององค์ประกอบทั้งหมดเหล่านี้คือบริบทจริงที่โมเดลต้องประมวลผล</p> <p>ดังนั้น แม้จะเป็นข้อความสั้นมาก ก็ยังอาจใช้โทเคนจำนวนมากได้</p> <hr> <h2>อะไรบ้างที่ทำให้การใช้บริบทเพิ่มขึ้น?</h2> <h3>1. ทักษะที่ตั้งค่าไว้</h3> <p>หากคุณเปิดใช้ทักษะแบบกำหนดเองหรือความสามารถ AI เพิ่มเติม คำสั่งของสิ่งเหล่านั้นก็ต้องถูกโหลดเข้าไปในบริบทของโมเดลด้วย</p> <p>ตัวอย่างเช่น:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>คำสั่งของ Skill A: 2,000 โทเคน คำสั่งของ Skill B: 3,000 โทเคน คำสั่งของ Skill 1,500 โทเคน</code></pre> <p>ดังนั้น แม้ก่อนที่คุณจะพิมพ์อะไรเลย คำสั่งเหล่านี้ก็อาจใช้พื้นที่ไปแล้วหลายพันโทเคน</p> <hr> <h3>2. เครื่องมือและความสามารถของเอเจนต์</h3> <p>ผู้ช่วย AI สำหรับเขียนโค้ดมักมีเครื่องมือ เช่น:</p> <ul> <li><p>การอ่านไฟล์</p></li> <li><p>การค้นหาโค้ด</p></li> <li><p>การรันคำสั่งในเทอร์มินัล</p></li> <li><p>การทำงานกับ Git</p></li> <li><p>การเข้าถึงเบราว์เซอร์</p></li> <li><p>การเชื่อมต่อภายนอก</p></li> </ul> <p>คำจำกัดความและคำแนะนำการใช้งานของเครื่องมือเหล่านี้ก็ใช้พื้นที่บริบทเช่นกัน</p> <hr> <h3>3. บริบทของโปรเจกต์และไฟล์</h3> <p>เมื่อทำงานอยู่ใน IDE หรือรีโพซิทอรีโค้ด ไคลเอนต์ AI อาจแนบข้อมูลต่อไปนี้ให้อัตโนมัติ:</p> <ul> <li><p>โครงสร้างโปรเจกต์</p></li> <li><p>ไฟล์ที่เปิดอยู่</p></li> <li><p>ส่วนของโค้ด</p></li> <li><p>ดีเพนเดนซี</p></li> <li><p>ไฟล์คอนฟิก</p></li> </ul> <p>สิ่งนี้ช่วยให้ AI เข้าใจโปรเจกต์ของคุณ แต่ก็ทำให้การใช้บริบทเพิ่มขึ้นด้วย</p> <hr> <h3>4. ประวัติการสนทนาก่อนหน้า</h3> <p>หากคุณสนทนาต่อจากเซสชันเดิม ข้อความก่อนหน้ามักจะถูกแนบกลับไปอีกครั้ง เพื่อให้โมเดลเข้าใจบริบท</p> <p>ตัวอย่างเช่น:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>การสนทนาก่อนหน้า: 12,000 โทเคน ข้อความใหม่: Hi</code></pre> <p>คำขอใหม่ก็อาจยังคงมี 12,000 โทเคนก่อนหน้านั้นรวมอยู่ด้วย</p> <hr> <h2>วิธีทดสอบการใช้โทเคนขั้นต่ำ</h2> <p>หากคุณต้องการวัดการใช้โทเคนของข้อความง่าย ๆ โปรดลองดังนี้:</p> <ol> <li><p>สร้างบทสนทนาใหม่ทั้งหมด</p></li> <li><p>ปิดใช้งานทักษะแบบกำหนดเอง</p></li> <li><p>อย่าแนบไฟล์</p></li> <li><p>อย่าเปิดเวิร์กสเปซของโปรเจกต์</p></li> <li><p>ส่งเพียง:</p></li> </ol> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p>วิธีนี้จะแสดงการใช้บริบทขั้นต่ำโดยประมาณ</p> <hr> <h2>Context Window เทียบกับ Token Usage</h2> <p>สิ่งสำคัญคือต้องแยกความแตกต่างระหว่าง:</p> <h3>Context Window</h3> <p>ปริมาณข้อมูลสูงสุดที่โมเดลสามารถประมวลผลได้ในหนึ่งคำขอ</p> <p>ตัวอย่าง:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>หน้าต่างบริบท 1M โทเคน</code></pre> <p>หมายความว่าในทางทฤษฎี โมเดลสามารถรองรับได้สูงสุดถึง 1 ล้านโทเคน</p> <h3>Token Usage</h3> <p>จำนวนโทเคนจริงที่ถูกรวมอยู่ในคำขอหนึ่ง ๆ</p> <p>ตัวอย่าง:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>ข้อความผู้ใช้: Hi คำขอจริง: คำสั่งระบบ + เครื่องมือ + ประวัติ + "Hi" รวมทั้งหมด: 15,000 โทเคน</code></pre> <p>การมีหน้าต่างบริบทขนาดใหญ่ไม่ได้หมายความว่าทุกคำขอจะใช้โทเคนเท่ากับความยาวข้อความของคุณเท่านั้น</p> <hr> <h2>สรุป</h2> <p>การใช้โทเคนสูงจากข้อความสั้น ๆ ไม่ได้หมายความว่าจะเป็นปัญหาของโมเดลหรือ API เสมอไป</p> <p>ในสภาพแวดล้อมแบบ AI agent บริบทรวมประกอบด้วยองค์ประกอบที่ซ่อนอยู่หลายอย่างซึ่งจำเป็นต่อการทำงานอย่างชาญฉลาด ข้อความง่าย ๆ อย่าง "Hi" ก็ยังอาจทำให้มีการประมวลผลหลายพันโทเคนได้ หากเซสชันนั้นมีทักษะ เครื่องมือ ข้อมูลโปรเจกต์ หรือประวัติการสนทนาก่อนหน้าอยู่</p> <p>เราขอแนะนำให้เริ่มเซสชันใหม่ที่สะอาดและไม่มีบริบทเพิ่มเติม เมื่อต้องการทดสอบการใช้โทเคนแบบดิบ</p> <p>ขอบคุณสำหรับความเข้าใจและการสนับสนุนอย่างต่อเนื่อง</p>