<p>Згідно з останніми правилами тарифікації OpenAI, для моделей на кшталт GPT-5.6 Sol застосовується ступінчаста тарифікація запитів із наддовгим контекстом.</p><p>Якщо контекст одного запиту перевищує 272K токенів, вхідні дані, читання кешу та вихідні дані можуть тарифікуватися за вищою ставкою. Це правило встановлене офіційною тарифікацією OpenAI, а не є тимчасовим підвищенням ціни або помилковим списанням з боку AI-ROUTER.</p><p></p><p>Наприклад, стандартні ціни GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиція У межах 272K Понад 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вхідні дані $5 / 1M токенів $10 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Читання кешу $0.50 / 1M токенів $1 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вихідні дані $30 / 1M токенів $45 / 1M токенів</code></pre><p></p><p>Остаточна вартість у будь-якому разі розраховується залежно від конкретної групи, коефіцієнта облікового запису та інших налаштувань тарифікації.</p><p></p><p>Позначка x2 у записах використання означає, що цей запит активував ступінчасту тарифікацію довгого контексту. Вона переважно вказує на перехід вхідних даних і читання кешу до вищого тарифного рівня, а не означає просте подвоєння вартості всього запиту. Для вихідних даних може застосовуватися інший ступінчастий коефіцієнт.</p><p></p><p><strong> ## Як уникнути ступінчастої тарифікації</strong></p><p>Якщо вам не потрібне вікно контексту на 1M токенів, рекомендується зменшити ліміт контексту Codex до 272K або менше.</p><p></p><p>Відкрийте:</p><p> ~/.codex/config.toml</p><p></p><p>Замініть конфігурацію на 1M токенів із попередньої статті:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Після збереження перезапустіть Codex і створіть новий сеанс.</p><p></p><p>Якщо потрібно тимчасово застосувати ці налаштування лише до одного сеансу, можна використати:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Також рекомендується:</p><p> - своєчасно вмикати автоматичне стискання;</p><p> - розділяти довгі завдання на кілька сеансів;</p><p> - зменшувати обсяг результатів роботи інструментів, що повертаються за один раз;</p><p> - регулярно підсумовувати та очищати давніший вміст розмови.</p><p></p><p>Якщо вам справді потрібне вікно контексту на 1M токенів, можна продовжити використовувати попередню конфігурацію, але після перевищення 272K токенів тарифікація здійснюватиметься за вищою ставкою OpenAI.</p><p></p><p>Початкові пояснення щодо конфігурації дивіться тут: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Як увімкнути контекстне вікно на 1 мільйон токенів у Codex для GPT-5.6 Sol </a></p><p></p><p>Дякуємо за ваше розуміння та підтримку.</p>