Обяснение за стъпаловидното ценообразуване при свръхдълъг контекст на GPT-5.6 Sol
-
<p>Съгласно най-новите правила за ценообразуване на OpenAI, модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърля 272K токена, входът, четенето от кеша и изходът могат да бъдат таксувани по по-високо ценово ниво. Това правило идва от официалното ценообразуване на OpenAI, а не представлява временно допълнително оскъпяване или необичайно таксуване от AI-ROUTER.</p><p></p><p>Например при стандартните цени на GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Елемент До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната сума все пак се изчислява въз основа на конкретната група, множителя за акаунта и други настройки за таксуване.</p><p></p><p>Обозначението x2 в историята на използването означава, че заявката е задействала стъпаловидно ценообразуване за дълъг контекст. То основно показва, че входът и четенето от кеша са преминали към по-високо ценово ниво, но не означава, че всички разходи по заявката са просто удвоени; за изхода може да се прилага различен множител на съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното ценообразуване</strong></p><p>Ако не се нуждаете от контекстен прозорец от 1M токена, препоръчваме да намалите лимита на контекста в Codex до 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Променете конфигурацията от първоначалната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Запазете промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - своевременно да активирате автоматичното компресиране;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем изход от инструменти, който се връща наведнъж;</p><p> - редовно да обобщавате и изчиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстен прозорец от 1M токена, можете да продължите да използвате първоначалната конфигурация, но съдържанието над 272K ще бъде таксувано по високите ценови нива на OpenAI.</p><p></p><p>За първоначалните инструкции за конфигурация вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстен прозорец от 1 милион токена в Codex за GPT-5.6 Sol </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login