Skip to content
  • Categories
  • Recent
  • Tags
  • Popular
  • World
  • Users
  • Groups
Skins
  • Light
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • Dark
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • Default (No Skin)
  • No Skin
Collapse

NodeBB

  1. Home
  2. Blogs
  3. О ступенчатой тарификации сверхдлинного контекста GPT-5.6 Sol

О ступенчатой тарификации сверхдлинного контекста GPT-5.6 Sol

Scheduled Pinned Locked Moved Blogs
openaigpt-5.6 solсверхдлинный коступенчатая тарконфигурация co
1 Posts 1 Posters 75 Views 1 Watching
  • Oldest to Newest
  • Newest to Oldest
  • Most Votes
Reply
  • Reply as topic
Log in to reply
This topic has been deleted. Only users with topic management privileges can see it.
  • A Online
    A Online
    admin
    wrote on last edited by
    #1

    <p>Согласно последним правилам тарификации OpenAI, для моделей вроде GPT-5.6 Sol применяются ступенчатые цены на запросы со сверхдлинным контекстом.</p><p>Если контекст одного запроса превышает 272K токенов, входные токены, чтение кэша и вывод могут тарифицироваться по более высокой ступени. Это правило установлено официальными тарифами OpenAI и не является временным повышением цен или ошибочным списанием со стороны AI-ROUTER.</p><p></p><p>Например, стандартные цены для GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиция До 272K Более 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ввод $5 / 1M токенов $10 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Чтение кэша $0.50 / 1M токенов $1 / 1M токенов</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вывод $30 / 1M токенов $45 / 1M токенов</code></pre><p></p><p>Итоговая стоимость по-прежнему рассчитывается с учётом конкретной группы, множителя аккаунта и других параметров тарификации.</p><p></p><p>Отметка x2 в истории использования означает, что для данного запроса сработала ступенчатая тарификация длинного контекста. В основном она указывает на переход входных токенов и чтения кэша на более высокую ступень и не означает, что стоимость всего запроса просто удвоилась; для вывода может применяться другой множитель ступени.</p><p></p><p><strong> ## Как избежать ступенчатой тарификации</strong></p><p>Если окно контекста в 1M токенов не требуется, рекомендуется вернуть лимит контекста Codex к значению не более 272K.</p><p></p><p>Откройте:</p><p> ~/.codex/config.toml</p><p></p><p>Замените указанную в исходной статье конфигурацию для 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Сохраните изменения, перезапустите Codex и создайте новый сеанс.</p><p></p><p>Если нужно временно применить настройки только к одному сеансу, используйте:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Также рекомендуется:</p><p> - своевременно включать автоматическое сжатие;</p><p> - разбивать длинные задачи на несколько сеансов;</p><p> - сокращать объём выводимых за один раз результатов инструментов;</p><p> - регулярно обобщать и очищать более раннее содержимое диалога.</p><p></p><p>Если окно контекста в 1M токенов действительно необходимо, можно продолжить использовать исходную конфигурацию, однако после превышения 272K токенов тарификация будет выполняться по более высокой ступени OpenAI.</p><p></p><p>Исходные инструкции по настройке доступны здесь: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как включить окно контекста в 1 миллион токенов для GPT-5.6 Sol в Codex </a></p><p></p><p>Спасибо за понимание и поддержку.</p>

    1 Reply Last reply
    0

    Hello! It looks like you're interested in this conversation, but you don't have an account yet.

    Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.

    With your input, this post could be even better 💗

    Register Login
    Reply
    • Reply as topic
    Log in to reply
    • Oldest to Newest
    • Newest to Oldest
    • Most Votes


    • Login

    • Don't have an account? Register

    • Login or register to search.
    Powered by NodeBB Contributors
    • First post
      Last post
    0
    • Categories
    • Recent
    • Tags
    • Popular
    • World
    • Users
    • Groups