Skip to content
  • Categories
  • Recent
  • Tags
  • Popular
  • World
  • Users
  • Groups
Skins
  • Light
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • Dark
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • Default (No Skin)
  • No Skin
Collapse

NodeBB

  1. Home
  2. Blogs
  3. Обяснение за стъпаловидното таксуване на свръхдълъг контекст при GPT-5.6 Sol

Обяснение за стъпаловидното таксуване на свръхдълъг контекст при GPT-5.6 Sol

Scheduled Pinned Locked Moved Blogs
openaigpt-5.6 solсвръхдълъг контстъпаловидно таконфигурация на
1 Posts 1 Posters 81 Views 1 Watching
  • Oldest to Newest
  • Newest to Oldest
  • Most Votes
Reply
  • Reply as topic
Log in to reply
This topic has been deleted. Only users with topic management privileges can see it.
  • A Online
    A Online
    admin
    wrote on last edited by
    #1

    <p>Съгласно най-новите правила за таксуване на OpenAI модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърли 272K токена, входът, четенето от кеша и изходът може да бъдат таксувани по-високо ценово ниво. Това правило произтича от официалното ценообразуване на OpenAI, а не от временно допълнително таксуване или неправилно начисляване от страна на AI-ROUTER.</p><p></p><p>Като пример, стандартните цени за GPT-5.6 Sol са:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиция До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната такса все пак се изчислява според конкретната група, множителя на акаунта и други настройки за таксуване.</p><p></p><p>Появата на маркера x2 в историята на използването означава, че тази заявка е активирала стъпаловидно таксуване за дълъг контекст. Маркерът основно показва, че входът или четенето от кеша са преминали към по-високо ценово ниво, а не че всички разходи за заявката са били просто удвоени; за изхода може да се прилага различен множител за съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното таксуване</strong></p><p>Ако не се нуждаете от контекстов прозорец от 1M токена, препоръчваме да зададете горната граница на контекста в Codex на 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Заменете конфигурацията от предишната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>със следната конфигурация:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>След като запазите промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - да активирате автоматичното компресиране навреме;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем резултати от инструменти, връщани наведнъж;</p><p> - редовно да обобщавате и почиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстов прозорец от 1M токена, можете да продължите да използвате оригиналната конфигурация, но след надхвърляне на 272K ще се прилага по-високото ценово ниво на OpenAI.</p><p></p><p>За оригиналните инструкции за конфигуриране вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстов прозорец от 1 милион токена за GPT-5.6 Sol в Codex </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>

    1 Reply Last reply
    0

    Hello! It looks like you're interested in this conversation, but you don't have an account yet.

    Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.

    With your input, this post could be even better 💗

    Register Login
    Reply
    • Reply as topic
    Log in to reply
    • Oldest to Newest
    • Newest to Oldest
    • Most Votes


    • Login

    • Don't have an account? Register

    • Login or register to search.
    Powered by NodeBB Contributors
    • First post
      Last post
    0
    • Categories
    • Recent
    • Tags
    • Popular
    • World
    • Users
    • Groups