Skip to content
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>Съгласно най-новите правила за ценообразуване на OpenAI, модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърля 272K токена, входът, четенето от кеша и изходът могат да бъдат таксувани по по-високо ценово ниво. Това правило идва от официалното ценообразуване на OpenAI, а не представлява временно допълнително оскъпяване или необичайно таксуване от AI-ROUTER.</p><p></p><p>Например при стандартните цени на GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Елемент До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната сума все пак се изчислява въз основа на конкретната група, множителя за акаунта и други настройки за таксуване.</p><p></p><p>Обозначението x2 в историята на използването означава, че заявката е задействала стъпаловидно ценообразуване за дълъг контекст. То основно показва, че входът и четенето от кеша са преминали към по-високо ценово ниво, но не означава, че всички разходи по заявката са просто удвоени; за изхода може да се прилага различен множител на съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното ценообразуване</strong></p><p>Ако не се нуждаете от контекстен прозорец от 1M токена, препоръчваме да намалите лимита на контекста в Codex до 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Променете конфигурацията от първоначалната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Запазете промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - своевременно да активирате автоматичното компресиране;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем изход от инструменти, който се връща наведнъж;</p><p> - редовно да обобщавате и изчиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстен прозорец от 1M токена, можете да продължите да използвате първоначалната конфигурация, но съдържанието над 272K ще бъде таксувано по високите ценови нива на OpenAI.</p><p></p><p>За първоначалните инструкции за конфигурация вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстен прозорец от 1 милион токена в Codex за GPT-5.6 Sol </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>