<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Zakaj lahko pošiljanje samega sporočila »Hi« še vedno porabi na tisoče žetonov]]></title><description><![CDATA[<h2><strong>Uvod</strong></h2>
<p dir="auto">Nedavno so nekateri uporabniki opazili nenavadno situacijo:</p>
<blockquote>
<p dir="auto">»Poslal sem samo ‘Hi’, zakaj je porabilo več kot 10.000 žetonov?«</p>
</blockquote>
<p dir="auto">Na prvi pogled se to morda zdi nepričakovano. Sporočilo z dvema znakoma bi moralo zahtevati le nekaj žetonov, kajne?</p>
<p dir="auto">Odgovor je: <strong>model ne obdeluje samo vašega vidnega sporočila.</strong></p>
<p dir="auto">Sodobni pomočniki z umetno inteligenco, zlasti agenti za programiranje, kot so Codex, Claude Code in druga orodja UI, ki temeljijo na IDE-jih, skupaj z vašim sporočilom pošljejo veliko več informacij, da modelu pomagajo razumeti nalogo in podati boljše odgovore.</p>
<hr />
<h2>Vaše sporočilo je le majhen del konteksta</h2>
<p dir="auto">Ko pošljete:</p>
<pre><code>Hi
</code></pre>
<p dir="auto">je dejanska zahteva, poslana modelu UI, lahko videti bolj takole:</p>
<pre><code>Sistemska navodila
+
Uporabniške nastavitve
+
Nastavljene veščine
+
Razpoložljiva orodja
+
Informacije o projektu
+
Kontekst datotek
+
Prejšnja zgodovina pogovora
+
Vaše sporočilo: "Hi"
</code></pre>
<p dir="auto">Skupna velikost vseh teh komponent je dejanski kontekst, ki ga model obdela.</p>
<p dir="auto">Zato lahko tudi zelo kratko sporočilo porabi precejšnje število žetonov.</p>
<hr />
<h2>Kaj lahko poveča porabo konteksta?</h2>
<h3>1. Nastavljene veščine</h3>
<p dir="auto">Če ste omogočili prilagojene veščine ali zmogljivosti UI, je treba njihova navodila naložiti v kontekst modela.</p>
<p dir="auto">Na primer:</p>
<pre><code>Navodila za veščino A: 2.000 žetonov
Navodila za veščino B: 3.000 žetonov
Navodila za veščino C: 1.500 žetonov
</code></pre>
<p dir="auto">Še preden karkoli vtipkate, lahko ta navodila že zasedejo več tisoč žetonov.</p>
<hr />
<h3>2. Orodja in zmožnosti agentov</h3>
<p dir="auto">Pomočniki UI za programiranje običajno ponujajo orodja, kot so:</p>
<ul>
<li>Branje datotek</li>
<li>Iskanje kode</li>
<li>Izvajanje ukazov v terminalu</li>
<li>Operacije Git</li>
<li>Dostop do brskalnika</li>
<li>Zunanje integracije</li>
</ul>
<p dir="auto">Definicije in navodila za uporabo teh orodij prav tako porabljajo prostor v kontekstu.</p>
<hr />
<h3>3. Projektni kontekst in kontekst datotek</h3>
<p dir="auto">Pri delu znotraj IDE-ja ali repozitorija kode lahko odjemalec UI samodejno vključi:</p>
<ul>
<li>Strukturo projekta</li>
<li>Odprte datoteke</li>
<li>Izseke kode</li>
<li>Odvisnosti</li>
<li>Konfiguracijske datoteke</li>
</ul>
<p dir="auto">To UI omogoča razumevanje vašega projekta, vendar tudi poveča porabo konteksta.</p>
<hr />
<h3>4. Prejšnja zgodovina pogovora</h3>
<p dir="auto">Če nadaljujete obstoječ pogovor, so prejšnja sporočila običajno znova vključena, da model razume kontekst.</p>
<p dir="auto">Na primer:</p>
<pre><code>Prejšnja razprava: 12.000 žetonov

Novo sporočilo:
Hi
</code></pre>
<p dir="auto">Nova zahteva lahko še vedno vsebuje prejšnjih 12.000 žetonov.</p>
<hr />
<h2>Kako preizkusiti najmanjšo porabo žetonov</h2>
<p dir="auto">Če želite izmeriti porabo žetonov pri preprostem sporočilu, poskusite naslednje:</p>
<ol>
<li>Ustvarite popolnoma nov pogovor.</li>
<li>Onemogočite prilagojene veščine.</li>
<li>Ne pripenjajte datotek.</li>
<li>Ne odpirajte projektnega delovnega prostora.</li>
<li>Pošljite samo:</li>
</ol>
<pre><code>Hi
</code></pre>
<p dir="auto">To bo pokazalo približno najmanjšo porabo konteksta.</p>
<hr />
<h2>Kontekstno okno v primerjavi s porabo žetonov</h2>
<p dir="auto">Pomembno je razlikovati med:</p>
<h3>Kontekstno okno</h3>
<p dir="auto">Največja količina informacij, ki jih model lahko obdela v eni zahtevi.</p>
<p dir="auto">Primer:</p>
<pre><code>Kontekstno okno 1M žetonov
</code></pre>
<p dir="auto">pomeni, da lahko model teoretično obdela do 1 milijona žetonov.</p>
<h3>Poraba žetonov</h3>
<p dir="auto">Dejanska količina žetonov, vključenih v določeno zahtevo.</p>
<p dir="auto">Primer:</p>
<pre><code>Uporabniško sporočilo:
Hi

Dejanska zahteva:
Sistemska navodila + orodja + zgodovina + "Hi"

Skupaj:
15.000 žetonov
</code></pre>
<p dir="auto">Veliko kontekstno okno ne pomeni, da bo vsaka zahteva porabila samo dolžino vašega sporočila.</p>
<hr />
<h2>Zaključek</h2>
<p dir="auto">Visoka poraba žetonov zaradi kratkega sporočila ne pomeni nujno težave z modelom ali API-jem.</p>
<p dir="auto">V okoljih z agenti UI skupni kontekst vključuje številne skrite komponente, potrebne za inteligentno delovanje. Preprost »Hi« lahko še vedno povzroči obdelavo na tisoče žetonov, če seja vsebuje veščine, orodja, informacije o projektu ali prejšnjo zgodovino.</p>
<p dir="auto">Pri preizkušanju surove porabe žetonov priporočamo, da začnete čisto sejo brez dodatnega konteksta.</p>
<p dir="auto">Hvala za vaše razumevanje in nadaljnjo podporo.</p>
]]></description><link>https://nodebb.ai-router.dev/topic/392/zakaj-lahko-pošiljanje-samega-sporočila-hi-še-vedno-porabi-na-tisoče-žetonov</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:33:46 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/392.rss" rel="self" type="application/rss+xml"/><pubDate>Sat, 25 Jul 2026 06:59:07 GMT</pubDate><ttl>60</ttl></channel></rss>