Skip to content
  • Categories
  • Recent
  • Tags
  • Popular
  • World
  • Users
  • Groups
Skins
  • Light
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • Dark
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • Default (No Skin)
  • No Skin
Collapse

NodeBB

  1. Home
  2. Blogs
  3. Обяснение за стъпаловидното ценообразуване при свръхдълъг контекст на GPT-5.6 Sol

Обяснение за стъпаловидното ценообразуване при свръхдълъг контекст на GPT-5.6 Sol

Scheduled Pinned Locked Moved Blogs
openaigpt-5.6 solсвръхдълъг контстъпаловидно цеконфигурация на
1 Posts 1 Posters 51 Views 1 Watching
  • Oldest to Newest
  • Newest to Oldest
  • Most Votes
Reply
  • Reply as topic
Log in to reply
This topic has been deleted. Only users with topic management privileges can see it.
  • A Online
    A Online
    admin
    wrote on last edited by
    #1

    <p>Съгласно най-новите правила за ценообразуване на OpenAI, модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърля 272K токена, входът, четенето от кеша и изходът могат да бъдат таксувани по по-високо ценово ниво. Това правило идва от официалното ценообразуване на OpenAI, а не представлява временно допълнително оскъпяване или необичайно таксуване от AI-ROUTER.</p><p></p><p>Например при стандартните цени на GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Елемент До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната сума все пак се изчислява въз основа на конкретната група, множителя за акаунта и други настройки за таксуване.</p><p></p><p>Обозначението x2 в историята на използването означава, че заявката е задействала стъпаловидно ценообразуване за дълъг контекст. То основно показва, че входът и четенето от кеша са преминали към по-високо ценово ниво, но не означава, че всички разходи по заявката са просто удвоени; за изхода може да се прилага различен множител на съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното ценообразуване</strong></p><p>Ако не се нуждаете от контекстен прозорец от 1M токена, препоръчваме да намалите лимита на контекста в Codex до 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Променете конфигурацията от първоначалната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Запазете промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - своевременно да активирате автоматичното компресиране;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем изход от инструменти, който се връща наведнъж;</p><p> - редовно да обобщавате и изчиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстен прозорец от 1M токена, можете да продължите да използвате първоначалната конфигурация, но съдържанието над 272K ще бъде таксувано по високите ценови нива на OpenAI.</p><p></p><p>За първоначалните инструкции за конфигурация вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстен прозорец от 1 милион токена в Codex за GPT-5.6 Sol </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>

    1 Reply Last reply
    0

    Hello! It looks like you're interested in this conversation, but you don't have an account yet.

    Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.

    With your input, this post could be even better 💗

    Register Login
    Reply
    • Reply as topic
    Log in to reply
    • Oldest to Newest
    • Newest to Oldest
    • Most Votes


    • Login

    • Don't have an account? Register

    • Login or register to search.
    Powered by NodeBB Contributors
    • First post
      Last post
    0
    • Categories
    • Recent
    • Tags
    • Popular
    • World
    • Users
    • Groups