<p>Prema najnovijim pravilima tarifiranja kompanije OpenAI, modeli kao što je GPT-5.6 Sol koriste stepenaste cene za zahteve sa veoma dugim kontekstom.</p><p>Kada kontekst pojedinačnog zahteva premaši 272K tokena, unos, čitanje keširanih podataka i izlaz mogu biti obračunati po višoj tarifnoj stopi. Ovo pravilo potiče iz zvaničnog cenovnika kompanije OpenAI i nije privremeno povećanje cene niti neuobičajena naplata na AI-ROUTER-u.</p><p></p><p>Na primeru standardnih cena za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Do 272K Preko 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Unos $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje keša $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačan iznos se i dalje obračunava na osnovu konkretne grupe, množitelja naloga i drugih podešavanja naplate.</p><p></p><p>Pojava oznake x2 u evidenciji korišćenja znači da je ovaj zahtev aktivirao stepenasto tarifiranje za dugačak kontekst. Ova oznaka uglavnom ukazuje na to da su unos i čitanje keširanih podataka prešli u višu tarifnu stopu i ne znači da su svi troškovi celog zahteva jednostavno udvostručeni; za izlaz može važiti drugačiji stepenasti množitelj.</p><p></p><p><strong> ## Kako izbeći aktiviranje stepenastog tarifiranja</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje Codex konteksta podesite na najviše 272K tokena.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Konfiguraciju od 1M iz prethodnog teksta:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zamenite sledećom konfiguracijom:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sačuvajte izmene, ponovo pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da ovo privremeno važi samo za jednu sesiju, možete koristiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Takođe preporučujemo:</p><p> - blagovremeno uključivanje automatske kompresije;</p><p> - podelu veoma dugih zadataka na više sesija;</p><p> - smanjenje količine izlaza alata koji se vraća odjednom;</p><p> - redovno sažimanje i čišćenje starijeg sadržaja razgovora.</p><p></p><p>Ako vam je zaista potreban kontekstualni prozor od 1M tokena, možete nastaviti da koristite originalnu konfiguraciju, ali će se deo preko 272K tokena tarifirati prema višoj stepenastoj ceni kompanije OpenAI.</p><p></p><p>Originalna uputstva za konfiguraciju dostupna su na: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako omogućiti kontekstualni prozor od 1 milion tokena u Codex-u za GPT-5.6 Sol </a></p><p></p><p>Hvala na razumevanju i podršci.</p>