О тарификации по ступеням для сверхдлинного контекста GPT-5.6 Sol
-
<p>Согласно последним правилам тарификации OpenAI, для моделей вроде GPT-5.6 Sol применяются ступенчатые цены на запросы со сверхдлинным контекстом.</p><p>Если контекст одного запроса превышает 272K токенов, входные токены, чтение кэша и вывод могут рассчитываться по более высокой ценовой ступени. Это правило установлено официальными тарифами OpenAI и не является временной наценкой или ошибочным списанием со стороны AI-ROUTER.</p><p></p><p>Для примера рассмотрим стандартные цены GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиция В пределах 272K Более 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ввод $5 / 1M токенов $10 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Чтение кэша $0.50 / 1M токенов $1 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вывод $30 / 1M токенов $45 / 1M токенов</code></pre><p></p><p>Итоговая стоимость по-прежнему рассчитывается с учётом конкретной группы, коэффициента аккаунта и других параметров тарификации.</p><p></p><p>Метка x2 в истории использования означает, что для данного запроса сработала ступенчатая тарификация длинного контекста. В основном эта метка указывает на переход входных токенов и чтения кэша на более высокую ценовую ступень и не означает простого удвоения стоимости всех компонентов запроса; для вывода может применяться другой коэффициент ступени.</p><p></p><p><strong> ## Как избежать ступенчатой тарификации</strong></p><p>Если вам не требуется контекстное окно размером 1M токенов, рекомендуется установить максимальный размер контекста Codex в пределах 272K.</p><p></p><p>Откройте:</p><p> ~/.codex/config.toml</p><p></p><p>Замените указанную в исходной статье конфигурацию для 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на следующую:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>После сохранения перезапустите Codex и создайте новый сеанс.</p><p></p><p>Если нужно временно применить настройки только к одному сеансу, можно использовать:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Также рекомендуется:</p><p> - своевременно включать автоматическое сжатие;</p><p> - разделять длинные задачи на несколько сеансов;</p><p> - уменьшать объём результатов инструментов, возвращаемых за один раз;</p><p> - регулярно обобщать и очищать более раннее содержимое диалога.</p><p></p><p>Если вам действительно требуется контекстное окно размером 1M токенов, можно продолжить использовать исходную конфигурацию, однако после превышения 272K тарификация будет выполняться по более высоким ступенчатым ценам OpenAI.</p><p></p><p>С исходными настройками можно ознакомиться здесь: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как включить контекстное окно размером 1 миллион токенов для GPT-5.6 Sol в Codex </a></p><p></p><p>Спасибо за понимание и поддержку.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login