Skip to content
  • 0 Votes
    1 Posts
    54 Views
    A
    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol za zahtjeve s iznimno dugim kontekstom koriste stepenaste cijene.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, unos, čitanje iz predmemorije i izlaz mogu se obračunavati prema višoj cjenovnoj razini. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Primjer standardnih cijena za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Unos $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje iz $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> predmemorije</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni trošak i dalje se izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Oznaka x2 koja se pojavljuje u zapisima korištenja znači da je ovaj zahtjev aktivirao stepenasto tarifiranje za dugi kontekst. Ova oznaka uglavnom znači da su unos i čitanje iz predmemorije ušli u višu cjenovnu razinu; ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Za izlaz se može primjenjivati drugačiji stepenasti množitelj.</p><p></p><p><strong> ## Kako izbjeći stepenasto tarifiranje</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Konfiguraciju od 1M tokena iz izvornog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>promijenite u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da promjena privremeno vrijedi samo za jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključiti automatsku kompresiju;</p><p> - podijeliti vrlo duge zadatke u više sesija;</p><p> - smanjiti količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimati i čistiti stariji sadržaj razgovora.</p><p></p><p>Ako vam je doista potreban kontekstualni prozor od 1M tokena, možete nastaviti koristiti izvornu konfiguraciju, ali nakon 272K tokena naplata će se obračunavati prema višoj cjenovnoj razini OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol u Codexu </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>
  • 0 Votes
    1 Posts
    44 Views
    A
    <p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z izjemno dolgim kontekstom uporabljajo stopenjske cene.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega doplačila ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Za primer vzemimo standardne cene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množilnik računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zapisu uporabe pomeni, da je ta zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo; ne pomeni, da so se vsi stroški celotne zahteve preprosto podvojili. Za izhod se lahko uporabi drugačen stopenjski množilnik.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna z 1M žetoni, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M žetonov:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po shranjevanju znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za eno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izpisov orodij, vrnjenih naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če kontekstno okno z 1M žetoni dejansko potrebujete, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno z 1 milijonom žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol primjenjuju progresivne cijene za zahtjeve s iznimno dugim kontekstom.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, ulaz, čitanje predmemorije i izlaz mogu se obračunavati prema višem cjenovnom razredu. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Uzmimo za primjer standardne cijene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ulaz $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje predmemorije $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni se trošak i dalje izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Ako se u zapisima korištenja pojavi oznaka x2, to znači da je ovaj zahtjev pokrenuo progresivnu naplatu za dugi kontekst. Oznaka prvenstveno znači da su ulaz i čitanje predmemorije ušli u viši cjenovni razred; ona ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Izlaz može podlijegati drugačijem množitelju cjenovnog razreda.</p><p></p><p><strong> ## Kako izbjeći progresivnu naplatu</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K tokena.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Izvorne postavke za 1M tokena iz prethodnog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Promijenite ih u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da se postavke privremeno primjenjuju samo na jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključite automatsku kompakciju;</p><p> - podijelite iznimno duge zadatke u više sesija;</p><p> - smanjite količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimajte i čistite stariji sadržaj razgovora.</p><p></p><p>Ako vam je kontekstualni prozor od 1M tokena doista potreban, možete nastaviti koristiti izvorne postavke, ali će se dio iznad 272K tokena naplaćivati prema višem cjenovnom razredu OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako u Codexu omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>
  • 0 Votes
    1 Posts
    85 Views
    A
    <p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z zelo dolgim kontekstom uporabljajo stopenjsko obračunavanje.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega pribitka ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Primer standardnih cen za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množitelj računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zgodovini uporabe pomeni, da je zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo, ne pa, da so se vsi stroški celotne zahteve preprosto podvojili; za izhod se lahko uporabi drugačen stopenjski množitelj.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna velikosti 1M žetonov, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Shranite spremembe, znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za posamezno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izhoda orodij, ki se vrne naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če res potrebujete kontekstno okno velikosti 1M žetonov, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno velikosti 1 milijon žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>