Pojasnilo stopenjskega obračunavanja za zelo dolge kontekste GPT-5.6 Sol
-
<p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z zelo dolgim kontekstom uporabljajo stopenjsko obračunavanje.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega pribitka ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Primer standardnih cen za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množitelj računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zgodovini uporabe pomeni, da je zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo, ne pa, da so se vsi stroški celotne zahteve preprosto podvojili; za izhod se lahko uporabi drugačen stopenjski množitelj.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna velikosti 1M žetonov, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Shranite spremembe, znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za posamezno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izhoda orodij, ki se vrne naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če res potrebujete kontekstno okno velikosti 1M žetonov, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno velikosti 1 milijon žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login