<p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z izjemno dolgim kontekstom uporabljajo stopenjske cene.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega doplačila ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Za primer vzemimo standardne cene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množilnik računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zapisu uporabe pomeni, da je ta zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo; ne pomeni, da so se vsi stroški celotne zahteve preprosto podvojili. Za izhod se lahko uporabi drugačen stopenjski množilnik.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna z 1M žetoni, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M žetonov:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po shranjevanju znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za eno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izpisov orodij, vrnjenih naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če kontekstno okno z 1M žetoni dejansko potrebujete, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno z 1 milijonom žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>