Skip to content
  • 0 Votes
    1 Posts
    56 Views
    A
    <p>Відповідно до останніх правил тарифікації OpenAI, для моделей на кшталт GPT-5.6 Sol застосовується ступінчаста ціна за запити з наддовгим контекстом.</p><p>Коли контекст одного запиту перевищує 272K токенів, вхідні дані, читання кешу та вихідні дані можуть тарифікуватися за вищою категорією. Це правило встановлене офіційними тарифами OpenAI, а не є тимчасовою надбавкою AI-ROUTER чи помилковим списанням коштів.</p><p></p><p>Для прикладу, стандартні ціни GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиція До 272K Понад 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вхідні дані $5 / 1M токенів $10 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Читання кешу $0.50 / 1M токенів $1 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вихідні дані $30 / 1M токенів $45 / 1M токенів</code></pre><p></p><p>Остаточна вартість і надалі розраховується відповідно до конкретної групи, множника облікового запису та інших параметрів тарифікації.</p><p></p><p>Позначка x2 у записах використання означає, що для цього запиту було застосовано ступінчасту тарифікацію довгого контексту. Вона переважно вказує на перехід вхідних даних і читання кешу до вищої тарифної категорії та не означає, що вартість усього запиту просто подвоюється; для вихідних даних може застосовуватися інший множник ступінчастої тарифікації.</p><p></p><p><strong> ## Як уникнути ступінчастої тарифікації</strong></p><p>Якщо вам не потрібне вікно контексту на 1M токенів, рекомендуємо зменшити ліміт контексту Codex до 272K або менше.</p><p></p><p>Відкрийте:</p><p> ~/.codex/config.toml</p><p></p><p>Замініть конфігурацію на 1M токенів, наведену в попередній статті:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Після збереження перезапустіть Codex і створіть новий сеанс.</p><p></p><p>Якщо потрібно тимчасово застосувати ці налаштування лише до одного сеансу, можна використати:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Також рекомендуємо:</p><p> - своєчасно вмикати автоматичне стискання;</p><p> - розділяти наддовгі завдання на кілька сеансів;</p><p> - зменшувати обсяг численних результатів інструментів, які повертаються за один раз;</p><p> - регулярно підсумовувати та очищати давніший вміст діалогу.</p><p></p><p>Якщо вам справді потрібне вікно контексту на 1M токенів, ви можете продовжити використовувати початкову конфігурацію, але після перевищення 272K тарифікація здійснюватиметься за вищою категорією цін OpenAI.</p><p></p><p>Початкові інструкції з налаштування наведено в статті: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Як увімкнути в Codex вікно контексту на 1 мільйон токенів для GPT-5.6 Sol </a></p><p></p><p>Дякуємо за розуміння та підтримку.</p>
  • 0 Votes
    1 Posts
    68 Views
    A
    <p>Відповідно до останніх правил тарифікації OpenAI, для моделей на кшталт GPT-5.6 Sol застосовується ступінчасте ціноутворення для запитів із наддовгим контекстом.</p><p>Якщо контекст одного запиту перевищує 272K токенів, вхідні дані, читання кешу та вихідні дані можуть розраховуватися за вищим тарифом. Це правило встановлене в офіційних тарифах OpenAI, а не є тимчасовою надбавкою або помилковим списанням з боку AI-ROUTER.</p><p></p><p>Наприклад, стандартні тарифи GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиція У межах 272K Понад 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вхідні дані $5 / 1M токенів $10 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Читання кешу $0.50 / 1M токенів $1 / 1M токенів</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вихідні дані $30 / 1M токенів $45 / 1M токенів</code></pre><p></p><p>Підсумкова вартість усе одно розраховується з урахуванням конкретної групи, множника облікового запису та інших параметрів тарифікації.</p><p></p><p>Позначка x2 у записах використання означає, що для цього запиту було застосовано ступінчасту тарифікацію довгого контексту. Вона переважно вказує на те, що вхідні дані або читання кешу перейшли до вищого тарифу, і не означає, що вартість усього запиту просто подвоїлася; для вихідних даних може застосовуватися інший множник.</p><p></p><p><strong> ## Як уникнути ступінчастої тарифікації</strong></p><p>Якщо вам не потрібне вікно контексту на 1M токенів, рекомендується зменшити ліміт контексту Codex до 272K або менше.</p><p></p><p>Відкрийте:</p><p> ~/.codex/config.toml</p><p></p><p>Замініть конфігурацію на 1M токенів із попередньої статті:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Збережіть файл, перезапустіть Codex і створіть новий сеанс.</p><p></p><p>Якщо потрібно тимчасово застосувати налаштування лише до одного сеансу, можна використати:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Також рекомендується:</p><p> - своєчасно вмикати автоматичне стискання;</p><p> - розділяти наддовгі завдання на кілька сеансів;</p><p> - зменшувати обсяг результатів роботи інструментів, що повертаються за один раз;</p><p> - регулярно підсумовувати та очищати ранній вміст розмови.</p><p></p><p>Якщо вам справді потрібне вікно контексту на 1M токенів, ви можете продовжити використовувати початкову конфігурацію, але після перевищення 272K токенів тарифікація здійснюватиметься за вищою ступінню цін OpenAI.</p><p></p><p>Початкові інструкції з налаштування дивіться тут: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Як увімкнути в Codex вікно контексту на 1 мільйон токенів для GPT-5.6 Sol </a></p><p></p><p>Дякуємо за розуміння та підтримку.</p>