Paliwanag tungkol sa tiered billing para sa napakahabang context ng GPT-5.6 Sol
-
<p>Ayon sa pinakabagong tuntunin sa billing ng OpenAI, gumagamit ang mga modelong gaya ng GPT-5.6 Sol ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cache read, at output ayon sa mas mataas na tier ng presyo. Nagmula ang tuntuning ito sa opisyal na pricing ng OpenAI at hindi ito pansamantalang dagdag-singil o maling pagsingil ng AI-ROUTER.</p><p></p><p>Bilang halimbawa, narito ang standard na presyo ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Higit sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na halaga ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration sa billing.</p><p></p><p>Kapag lumitaw ang x2 flag sa usage record, nangangahulugan itong na-trigger ng request na ito ang tiered billing para sa long context. Pangunahing ipinapahiwatig ng flag na pumasok ang input o cache read sa mas mataas na tier; hindi ito nangangahulugang basta na lang dodoble ang lahat ng bayarin para sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano maiiwasang ma-trigger ang tiered billing</strong></p><p>Kung hindi kailangan ang 1M Token context window, inirerekomendang ibalik sa loob ng 272K ang context limit ng Codex.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang 1M configuration mula sa naunang artikulo:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ng:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos mag-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung pansamantala lamang itong gagamitin para sa isang session, maaaring gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Inirerekomenda rin ang mga sumusunod:</p><p> - Agad na paganahin ang awtomatikong compression;</p><p> - Hatiin ang mahahabang gawain sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas naunang nilalaman ng pag-uusap.</p><p></p><p>Kung talagang kailangan ang 1M Token context window, maaari pa ring gamitin ang orihinal na configuration, ngunit kapag lumampas sa 272K, sisingilin ito ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na paliwanag tungkol sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano paganahin ang 1 milyong Token context window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pag-unawa at suporta.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login