Skip to content
  • 0 Votes
    1 Posts
    75 Views
    A
    <p>Согласно последним правилам тарификации OpenAI, для моделей вроде GPT-5.6 Sol применяются ступенчатые цены на запросы со сверхдлинным контекстом.</p><p>Если контекст одного запроса превышает 272K токенов, входные токены, чтение кэша и вывод могут тарифицироваться по более высокой ступени. Это правило установлено официальными тарифами OpenAI и не является временным повышением цен или ошибочным списанием со стороны AI-ROUTER.</p><p></p><p>Например, стандартные цены для GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиция До 272K Более 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ввод $5 / 1M токенов $10 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Чтение кэша $0.50 / 1M токенов $1 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вывод $30 / 1M токенов $45 / 1M токенов</code></pre><p></p><p>Итоговая стоимость по-прежнему рассчитывается с учётом конкретной группы, множителя аккаунта и других параметров тарификации.</p><p></p><p>Отметка x2 в истории использования означает, что для данного запроса сработала ступенчатая тарификация длинного контекста. В основном она указывает на переход входных токенов и чтения кэша на более высокую ступень и не означает, что стоимость всего запроса просто удвоилась; для вывода может применяться другой множитель ступени.</p><p></p><p><strong> ## Как избежать ступенчатой тарификации</strong></p><p>Если окно контекста в 1M токенов не требуется, рекомендуется вернуть лимит контекста Codex к значению не более 272K.</p><p></p><p>Откройте:</p><p> ~/.codex/config.toml</p><p></p><p>Замените указанную в исходной статье конфигурацию для 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Сохраните изменения, перезапустите Codex и создайте новый сеанс.</p><p></p><p>Если нужно временно применить настройки только к одному сеансу, используйте:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Также рекомендуется:</p><p> - своевременно включать автоматическое сжатие;</p><p> - разбивать длинные задачи на несколько сеансов;</p><p> - сокращать объём выводимых за один раз результатов инструментов;</p><p> - регулярно обобщать и очищать более раннее содержимое диалога.</p><p></p><p>Если окно контекста в 1M токенов действительно необходимо, можно продолжить использовать исходную конфигурацию, однако после превышения 272K токенов тарификация будет выполняться по более высокой ступени OpenAI.</p><p></p><p>Исходные инструкции по настройке доступны здесь: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как включить окно контекста в 1 миллион токенов для GPT-5.6 Sol в Codex </a></p><p></p><p>Спасибо за понимание и поддержку.</p>
  • 0 Votes
    1 Posts
    82 Views
    A
    <p>根据 OpenAI 最新计费规则,GPT-5.6 Sol 等模型对超长上下文请求采用阶梯价格。</p><p>当单次请求的上下文超过 272K tokens 时,输入、缓存读取以及输出可能按照更高阶梯价格计算。该规则来自 OpenAI 官方定价,并非 AI-ROUTER 临时加价或异常扣费。</p><p></p><p>以 GPT-5.6 Sol 标准价格为例:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Проект В пределах 272K Более 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ввод $5 / 1M токенов $10 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Чтение кэша $0.50 / 1M токенов $1 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вывод $30 / 1M токенов $45 / 1M токенов</code></pre><p></p><p>Итоговая стоимость по-прежнему рассчитывается с учетом конкретной группы, множителя аккаунта и других параметров тарификации.</p><p></p><p>Отметка x2 в истории использования означает, что данный запрос активировал ступенчатую тарификацию за длинный контекст. В основном эта отметка указывает на переход ввода и чтения кэша на более высокую ступень и не означает, что стоимость всего запроса просто увеличилась вдвое: к выводу может применяться другой множитель ступени.</p><p></p><p><strong> ## Как избежать ступенчатой тарификации</strong></p><p>Если окно контекста размером 1M токенов не требуется, рекомендуется установить для Codex максимальный размер контекста в пределах 272K.</p><p></p><p>Откройте:</p><p> ~/.codex/config.toml</p><p></p><p>Замените указанную в исходной статье конфигурацию для 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Сохраните изменения, перезапустите Codex и создайте новый сеанс.</p><p></p><p>Если нужно временно применить настройки только к одному сеансу, можно использовать:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Также рекомендуется:</p><p> - своевременно включать автоматическое сжатие;</p><p> - разделять объемные задачи на несколько сеансов;</p><p> - уменьшать объем выводов инструментов, возвращаемых за один раз;</p><p> - регулярно подводить итоги и очищать более раннее содержимое диалога.</p><p></p><p>Если окно контекста размером 1M токенов действительно необходимо, можно продолжать использовать исходную конфигурацию, однако после превышения 272K тарификация будет выполняться по более высоким ступеням OpenAI.</p><p></p><p>С исходным описанием конфигурации можно ознакомиться здесь: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как включить окно контекста размером 1 миллион токенов в Codex для GPT-5.6 Sol </a></p><p></p><p>Спасибо за понимание и поддержку.</p>