Skip to content
  • Categories
  • Recent
  • Tags
  • Popular
  • World
  • Users
  • Groups
Skins
  • Light
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • Dark
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • Default (No Skin)
  • No Skin
Collapse

NodeBB

  1. Home
  2. Blogs
  3. Vysvětlení stupňovitého účtování za velmi dlouhý kontext u GPT-5.6 Sol

Vysvětlení stupňovitého účtování za velmi dlouhý kontext u GPT-5.6 Sol

Scheduled Pinned Locked Moved Blogs
openaigpt-5.6 solvelmi dlouhý kostupňovité účtokonfigurace cod
1 Posts 1 Posters 77 Views 1 Watching
  • Oldest to Newest
  • Newest to Oldest
  • Most Votes
Reply
  • Reply as topic
Log in to reply
This topic has been deleted. Only users with topic management privileges can see it.
  • A Online
    A Online
    admin
    wrote on last edited by
    #1

    <p>Podle nejnovějších pravidel účtování společnosti OpenAI používají modely jako GPT-5.6 Sol stupňovité ceny pro požadavky s velmi dlouhým kontextem.</p><p>Pokud kontext jedné žádosti přesáhne 272K tokenů, mohou být vstup, čtení mezipaměti i výstup účtovány podle vyššího cenového pásma. Toto pravidlo pochází z oficiálního ceníku OpenAI a nejde o dočasné navýšení ceny ani nestandardní účtování ze strany AI-ROUTER.</p><p></p><p>Pro příklad uvádíme standardní ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenů $10 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čtení mezipaměti $0.50 / 1M tokenů $1 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenů $45 / 1M tokenů</code></pre><p></p><p>Celkové náklady se stále vypočítávají podle konkrétní skupiny, násobitele účtu a dalších nastavení účtování.</p><p></p><p>Označení x2 v přehledu používání znamená, že požadavek aktivoval stupňovité účtování za dlouhý kontext. Toto označení především signalizuje, že vstup nebo čtení mezipaměti spadá do vyššího cenového pásma. Neznamená to, že se všechny náklady za celý požadavek jednoduše zdvojnásobí; u výstupu může být použit jiný násobitel podle příslušného cenového pásma.</p><p></p><p><strong> ## Jak se vyhnout stupňovitému účtování</strong></p><p>Pokud nepotřebujete kontextové okno o velikosti 1M tokenů, doporučujeme nastavit limit kontextu Codexu zpět na hodnotu do 272K.</p><p></p><p>Otevřete:</p><p> ~/.codex/config.toml</p><p></p><p>Původní konfiguraci pro 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>změňte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení restartujte Codex a vytvořte novou relaci.</p><p></p><p>Pokud chcete změnu použít pouze dočasně pro jednu relaci, můžete použít:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň doporučujeme:</p><p> - včas zapnout automatickou kompresi;</p><p> - rozdělit dlouhé úkoly do více relací;</p><p> - omezit množství výstupu nástrojů vraceného najednou;</p><p> - pravidelně shrnovat a čistit starší obsah konverzace.</p><p></p><p>Pokud kontextové okno o velikosti 1M tokenů skutečně potřebujete, můžete původní konfiguraci nadále používat. Po překročení 272K však bude účtování probíhat podle vyšších cenových pásem OpenAI.</p><p></p><p>Původní pokyny ke konfiguraci najdete v článku: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak v Codexu povolit kontextové okno o velikosti 1 milionu tokenů pro GPT-5.6 Sol </a></p><p></p><p>Děkujeme za pochopení a podporu.</p>

    1 Reply Last reply
    0

    Hello! It looks like you're interested in this conversation, but you don't have an account yet.

    Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.

    With your input, this post could be even better 💗

    Register Login
    Reply
    • Reply as topic
    Log in to reply
    • Oldest to Newest
    • Newest to Oldest
    • Most Votes


    • Login

    • Don't have an account? Register

    • Login or register to search.
    Powered by NodeBB Contributors
    • First post
      Last post
    0
    • Categories
    • Recent
    • Tags
    • Popular
    • World
    • Users
    • Groups