Пояснення щодо ступінчастої тарифікації наддовгого контексту GPT-5.6 Sol
-
<p>Відповідно до останніх правил тарифікації OpenAI, для моделей на кшталт GPT-5.6 Sol застосовується ступінчасте ціноутворення для запитів із наддовгим контекстом.</p><p>Якщо контекст одного запиту перевищує 272K токенів, вхідні дані, читання кешу та вихідні дані можуть розраховуватися за вищим тарифом. Це правило встановлене в офіційних тарифах OpenAI, а не є тимчасовою надбавкою або помилковим списанням з боку AI-ROUTER.</p><p></p><p>Наприклад, стандартні тарифи GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиція У межах 272K Понад 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вхідні дані $5 / 1M токенів $10 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Читання кешу $0.50 / 1M токенів $1 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вихідні дані $30 / 1M токенів $45 / 1M токенів</code></pre><p></p><p>Підсумкова вартість усе одно розраховується з урахуванням конкретної групи, множника облікового запису та інших параметрів тарифікації.</p><p></p><p>Позначка x2 у записах використання означає, що для цього запиту було застосовано ступінчасту тарифікацію довгого контексту. Вона переважно вказує на те, що вхідні дані або читання кешу перейшли до вищого тарифу, і не означає, що вартість усього запиту просто подвоїлася; для вихідних даних може застосовуватися інший множник.</p><p></p><p><strong> ## Як уникнути ступінчастої тарифікації</strong></p><p>Якщо вам не потрібне вікно контексту на 1M токенів, рекомендується зменшити ліміт контексту Codex до 272K або менше.</p><p></p><p>Відкрийте:</p><p> ~/.codex/config.toml</p><p></p><p>Замініть конфігурацію на 1M токенів із попередньої статті:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Збережіть файл, перезапустіть Codex і створіть новий сеанс.</p><p></p><p>Якщо потрібно тимчасово застосувати налаштування лише до одного сеансу, можна використати:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Також рекомендується:</p><p> - своєчасно вмикати автоматичне стискання;</p><p> - розділяти наддовгі завдання на кілька сеансів;</p><p> - зменшувати обсяг результатів роботи інструментів, що повертаються за один раз;</p><p> - регулярно підсумовувати та очищати ранній вміст розмови.</p><p></p><p>Якщо вам справді потрібне вікно контексту на 1M токенів, ви можете продовжити використовувати початкову конфігурацію, але після перевищення 272K токенів тарифікація здійснюватиметься за вищою ступінню цін OpenAI.</p><p></p><p>Початкові інструкції з налаштування дивіться тут: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Як увімкнути в Codex вікно контексту на 1 мільйон токенів для GPT-5.6 Sol </a></p><p></p><p>Дякуємо за розуміння та підтримку.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login