Skip to content
  • 0 Votes
    1 Posts
    5 Views
    A
    <h2><strong>Panimula</strong></h2> <p></p> <p>Kamakailan, may ilang user na nakapansin ng isang hindi pangkaraniwang sitwasyon:</p> <blockquote> <p>“‘Hi’ lang ang ipinadala ko, bakit ito kumonsumo ng mahigit 10,000 token?”</p> <p></p> </blockquote> <p>Sa unang tingin, maaaring mukhang hindi ito inaasahan. Ang mensaheng may dalawang character ay dapat mangailangan lang ng kaunting token, tama ba?</p> <p>Ang sagot ay: <strong>hindi lang ang nakikita mong mensahe ang pinoproseso ng modelo.</strong></p> <p>Ang mga modernong AI assistant, lalo na ang mga coding agent gaya ng Codex, Claude Code, at iba pang IDE-based na AI tool, ay nagpapadala ng mas marami pang impormasyon kasabay ng iyong mensahe upang matulungan ang modelo na maunawaan ang gawain at makapagbigay ng mas mahusay na mga tugon.</p> <p></p> <hr> <p></p> <h2>Ang Iyong Mensahe ay Maliit na Bahagi Lang ng Konteksto</h2> <p>Kapag ipinadala mo ang:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p></p> <p>ang aktuwal na request na ipinapadala sa AI model ay maaaring mas kahawig nito:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>System Instructions + User Settings + Configured Skills + Available Tools + Project Information + File Context + Previous Conversation History + Your Message: "Hi"</code></pre> <p></p> <p>Ang kabuuang laki ng lahat ng bahaging ito ang tunay na kontekstong pinoproseso ng modelo.</p> <p>Dahil dito, kahit napakaikling mensahe ay maaaring kumonsumo ng malaking bilang ng token.</p> <hr> <p></p> <h2><strong>Ano ang Maaaring Magpalaki ng Context Usage?</strong></h2> <h3>1. Mga Naka-configure na Skill</h3> <p></p> <p>Kung naka-enable ang mga custom skill o AI capability, kailangang i-load ang kanilang mga instruction sa model context.</p> <p></p> <p>Halimbawa:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Skill A instructions: 2,000 tokens Skill B instructions: 3,000 tokens Skill C instructions: 1,500 tokens</code></pre> <p>Kahit bago ka pa mag-type ng kahit ano, maaaring sumasakop na agad ang mga instruction na ito ng ilang libong token.</p> <hr> <p></p> <h3>2. Mga Tool at Kakayahan ng Agent</h3> <p></p> <p>Ang mga AI coding assistant ay karaniwang may mga tool gaya ng:</p> <ul> <li><p>Pagbasa ng file</p></li> <li><p>Paghahanap ng code</p></li> <li><p>Pagpapatakbo ng terminal</p></li> <li><p>Mga operasyon sa Git</p></li> <li><p>Pag-access sa browser</p></li> <li><p>Mga external integration</p></li> </ul> <p>Ang mga depinisyon at instruction sa paggamit ng mga tool na ito ay kumokonsumo rin ng context space.</p> <hr> <p></p> <h3>3. Konteksto ng Proyekto at mga File</h3> <p></p> <p>Kapag nagtatrabaho sa loob ng IDE o code repository, maaaring awtomatikong isama ng AI client ang:</p> <ul> <li><p>Istruktura ng proyekto</p></li> <li><p>Mga bukas na file</p></li> <li><p>Mga code snippet</p></li> <li><p>Mga dependency</p></li> <li><p>Mga configuration file</p></li> </ul> <p>Nakakatulong ito para maunawaan ng AI ang iyong proyekto, ngunit pinapataas din nito ang context usage.</p> <hr> <p></p> <h3>4. Nakaraang Kasaysayan ng Usapan</h3> <p></p> <p>Kung ipinagpapatuloy mo ang isang umiiral nang usapan, karaniwang isinasamang muli ang mga naunang mensahe upang maunawaan ng modelo ang konteksto.</p> <p>Halimbawa:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Previous discussion: 12,000 tokens New message: Hi</code></pre> <p>Maaaring lamanin pa rin ng bagong request ang nakaraang 12,000 token.</p> <hr> <h2>Paano Subukan ang Pinakamababang Token Usage</h2> <p>Kung gusto mong sukatin ang token usage ng isang simpleng mensahe, subukan ang mga sumusunod:</p> <ol> <li><p>Gumawa ng ganap na bagong usapan.</p></li> <li><p>I-disable ang mga custom skill.</p></li> <li><p>Huwag mag-attach ng mga file.</p></li> <li><p>Huwag magbukas ng project workspace.</p></li> <li><p>Ipadala lamang ang:</p></li> </ol> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre> <p>Ipapakita nito ang tinatayang pinakamababang context usage.</p> <hr> <h2>Context Window kumpara sa Token Usage</h2> <p>Mahalagang pag-ibahin ang mga sumusunod:</p> <h3>Context Window</h3> <p>Ang pinakamataas na dami ng impormasyong kayang iproseso ng isang modelo sa iisang request.</p> <p>Halimbawa:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>1M token context window</code></pre> <p>na nangangahulugang kayang humawak ng modelo, sa teorya, ng hanggang 1 milyong token.</p> <h3>Token Usage</h3> <p>Ang aktuwal na dami ng token na kasama sa isang partikular na request.</p> <p>Halimbawa:</p> <pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>User message: Hi Actual request: System instructions + tools + history + "Hi" Total: 15,000 tokens</code></pre> <p>Ang malaking context window ay hindi nangangahulugang ang bawat request ay kakonsumo lamang ng habang katumbas ng iyong mensahe.</p> <p></p> <hr> <p></p> <h2><strong>Konklusyon</strong></h2> <p></p> <p>Ang mataas na token usage mula sa maikling mensahe ay hindi awtomatikong nangangahulugan na may problema sa modelo o API.</p> <p></p> <p>Sa mga AI agent environment, kasama sa kabuuang konteksto ang maraming nakatagong bahagi na kailangan para sa matalinong operasyon. Ang simpleng “Hi” ay maaari pa ring magresulta sa libo-libong token na napoproseso kung ang session ay may mga skill, tool, impormasyon ng proyekto, o nakaraang kasaysayan.</p> <p></p> <p>Iminumungkahi naming magsimula ng malinis na session na walang karagdagang konteksto kapag sinusubukan ang raw token usage.</p> <p></p> <p>Maraming salamat sa inyong pag-unawa at patuloy na suporta.</p>