Skip to content
  • Categories
  • Recent
  • Tags
  • Popular
  • World
  • Users
  • Groups
Skins
  • Light
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • Dark
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • Default (No Skin)
  • No Skin
Collapse

NodeBB

  1. Home
  2. Blogs
  3. Objašnjenje stepenastog tarifiranja za iznimno dugi kontekst GPT-5.6 Sol

Objašnjenje stepenastog tarifiranja za iznimno dugi kontekst GPT-5.6 Sol

Scheduled Pinned Locked Moved Blogs
openaigpt-5.6 soliznimno dugi kostepenasto tarikonfiguracija c
1 Posts 1 Posters 54 Views 1 Watching
  • Oldest to Newest
  • Newest to Oldest
  • Most Votes
Reply
  • Reply as topic
Log in to reply
This topic has been deleted. Only users with topic management privileges can see it.
  • A Online
    A Online
    admin
    wrote on last edited by
    #1

    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol za zahtjeve s iznimno dugim kontekstom koriste stepenaste cijene.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, unos, čitanje iz predmemorije i izlaz mogu se obračunavati prema višoj cjenovnoj razini. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Primjer standardnih cijena za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Unos $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje iz $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> predmemorije</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni trošak i dalje se izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Oznaka x2 koja se pojavljuje u zapisima korištenja znači da je ovaj zahtjev aktivirao stepenasto tarifiranje za dugi kontekst. Ova oznaka uglavnom znači da su unos i čitanje iz predmemorije ušli u višu cjenovnu razinu; ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Za izlaz se može primjenjivati drugačiji stepenasti množitelj.</p><p></p><p><strong> ## Kako izbjeći stepenasto tarifiranje</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Konfiguraciju od 1M tokena iz izvornog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>promijenite u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da promjena privremeno vrijedi samo za jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključiti automatsku kompresiju;</p><p> - podijeliti vrlo duge zadatke u više sesija;</p><p> - smanjiti količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimati i čistiti stariji sadržaj razgovora.</p><p></p><p>Ako vam je doista potreban kontekstualni prozor od 1M tokena, možete nastaviti koristiti izvornu konfiguraciju, ali nakon 272K tokena naplata će se obračunavati prema višoj cjenovnoj razini OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol u Codexu </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>

    1 Reply Last reply
    0

    Hello! It looks like you're interested in this conversation, but you don't have an account yet.

    Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.

    With your input, this post could be even better 💗

    Register Login
    Reply
    • Reply as topic
    Log in to reply
    • Oldest to Newest
    • Newest to Oldest
    • Most Votes


    • Login

    • Don't have an account? Register

    • Login or register to search.
    Powered by NodeBB Contributors
    • First post
      Last post
    0
    • Categories
    • Recent
    • Tags
    • Popular
    • World
    • Users
    • Groups