Пояснення щодо ступінчастої тарифікації наддовгого контексту GPT-5.6 Sol
-
<p>Відповідно до останніх правил тарифікації OpenAI, для моделей на кшталт GPT-5.6 Sol застосовується ступінчаста ціна за запити з наддовгим контекстом.</p><p>Коли контекст одного запиту перевищує 272K токенів, вхідні дані, читання кешу та вихідні дані можуть тарифікуватися за вищою категорією. Це правило встановлене офіційними тарифами OpenAI, а не є тимчасовою надбавкою AI-ROUTER чи помилковим списанням коштів.</p><p></p><p>Для прикладу, стандартні ціни GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиція До 272K Понад 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вхідні дані $5 / 1M токенів $10 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Читання кешу $0.50 / 1M токенів $1 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вихідні дані $30 / 1M токенів $45 / 1M токенів</code></pre><p></p><p>Остаточна вартість і надалі розраховується відповідно до конкретної групи, множника облікового запису та інших параметрів тарифікації.</p><p></p><p>Позначка x2 у записах використання означає, що для цього запиту було застосовано ступінчасту тарифікацію довгого контексту. Вона переважно вказує на перехід вхідних даних і читання кешу до вищої тарифної категорії та не означає, що вартість усього запиту просто подвоюється; для вихідних даних може застосовуватися інший множник ступінчастої тарифікації.</p><p></p><p><strong> ## Як уникнути ступінчастої тарифікації</strong></p><p>Якщо вам не потрібне вікно контексту на 1M токенів, рекомендуємо зменшити ліміт контексту Codex до 272K або менше.</p><p></p><p>Відкрийте:</p><p> ~/.codex/config.toml</p><p></p><p>Замініть конфігурацію на 1M токенів, наведену в попередній статті:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Після збереження перезапустіть Codex і створіть новий сеанс.</p><p></p><p>Якщо потрібно тимчасово застосувати ці налаштування лише до одного сеансу, можна використати:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Також рекомендуємо:</p><p> - своєчасно вмикати автоматичне стискання;</p><p> - розділяти наддовгі завдання на кілька сеансів;</p><p> - зменшувати обсяг численних результатів інструментів, які повертаються за один раз;</p><p> - регулярно підсумовувати та очищати давніший вміст діалогу.</p><p></p><p>Якщо вам справді потрібне вікно контексту на 1M токенів, ви можете продовжити використовувати початкову конфігурацію, але після перевищення 272K тарифікація здійснюватиметься за вищою категорією цін OpenAI.</p><p></p><p>Початкові інструкції з налаштування наведено в статті: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Як увімкнути в Codex вікно контексту на 1 мільйон токенів для GPT-5.6 Sol </a></p><p></p><p>Дякуємо за розуміння та підтримку.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login