Skip to content
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>Ayon sa pinakabagong mga panuntunan sa billing ng OpenAI, gumagamit ang mga modelong gaya ng GPT-5.6 Sol ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cache read, at output ayon sa mas mataas na tier ng presyo. Galing ang panuntunang ito sa opisyal na pricing ng OpenAI; hindi ito pansamantalang dagdag-singil o maling billing ng AI-ROUTER.</p><p></p><p>Halimbawa, gamit ang standard na presyo ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Lampas sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na bayarin ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration ng billing.</p><p></p><p>Ang paglitaw ng x2 flag sa usage records ay nangangahulugang na-trigger ng request na ito ang tiered billing para sa long context. Pangunahing ipinapahiwatig ng flag na pumasok ang input/cache read sa mas mataas na tier; hindi nito ibig sabihin na basta na lang nadoble ang lahat ng bayarin para sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano Maiiwasang Ma-trigger ang Tiered Billing</strong></p><p>Kung hindi kailangan ang 1M-token context window, inirerekomendang ibalik ang limitasyon ng Codex context sa loob ng 272K.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang dating 1M configuration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Gawin itong:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos i-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung nais lamang itong ilapat pansamantala sa isang session, gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Inirerekomenda rin ang mga sumusunod:</p><p> - I-enable agad ang automatic compaction;</p><p> - Hatiin ang mahahabang task sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas lumang bahagi ng usapan.</p><p></p><p>Kung talagang kailangan ang 1M-token context window, maaari mong ipagpatuloy ang dating configuration, ngunit ang bahaging lalampas sa 272K ay sisingilin ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na mga tagubilin sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano Paganahin ang 1-Milyong-Token Context Window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pag-unawa at suporta.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Ayon sa pinakabagong panuntunan sa billing ng OpenAI, gumagamit ang GPT-5.6 Sol at iba pang modelo ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cached reads, at output ayon sa mas mataas na tier ng presyo. Nagmumula ang panuntunang ito sa opisyal na pricing ng OpenAI at hindi ito pansamantalang dagdag-singil o maling pagsingil ng AI-ROUTER.</p><p></p><p>Halimbawa, gamit ang standard pricing ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Lampas sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cached reads $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na gastos ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration sa billing.</p><p></p><p>Ang paglitaw ng x2 marker sa usage record ay nangangahulugang na-trigger ng request na ito ang tiered pricing para sa long context. Pangunahing ipinapahiwatig ng marker na pumasok sa mas mataas na tier ang input o cached reads; hindi ito nangangahulugang basta na lang nadoble ang lahat ng gastos sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano maiiwasang ma-trigger ang tiered pricing</strong></p><p>Kung hindi kailangan ang 1M-token context window, inirerekomendang ibalik ang context limit ng Codex sa loob ng 272K.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang dating 1M configuration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>gamit ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos i-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung gusto mo itong pansamantalang ilapat sa isang session lamang, gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Inirerekomenda rin ang mga sumusunod:</p><p> - Agarang paganahin ang automatic compaction;</p><p> - Hatiin ang mahahabang gawain sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas lumang bahagi ng pag-uusap.</p><p></p><p>Kung talagang kailangan ang 1M-token context window, maaari mong ipagpatuloy ang paggamit ng dating configuration, ngunit ang bahaging lalampas sa 272K ay sisingilin ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na gabay sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano paganahin ang 1 milyong Token context window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pang-unawa at suporta.</p>
  • 0 Votes
    1 Posts
    81 Views
    A
    <p>Ayon sa pinakabagong tuntunin sa billing ng OpenAI, gumagamit ang mga modelong gaya ng GPT-5.6 Sol ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cache read, at output ayon sa mas mataas na tier ng presyo. Nagmula ang tuntuning ito sa opisyal na pricing ng OpenAI at hindi ito pansamantalang dagdag-singil o maling pagsingil ng AI-ROUTER.</p><p></p><p>Bilang halimbawa, narito ang standard na presyo ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Higit sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na halaga ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration sa billing.</p><p></p><p>Kapag lumitaw ang x2 flag sa usage record, nangangahulugan itong na-trigger ng request na ito ang tiered billing para sa long context. Pangunahing ipinapahiwatig ng flag na pumasok ang input o cache read sa mas mataas na tier; hindi ito nangangahulugang basta na lang dodoble ang lahat ng bayarin para sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano maiiwasang ma-trigger ang tiered billing</strong></p><p>Kung hindi kailangan ang 1M Token context window, inirerekomendang ibalik sa loob ng 272K ang context limit ng Codex.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang 1M configuration mula sa naunang artikulo:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ng:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos mag-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung pansamantala lamang itong gagamitin para sa isang session, maaaring gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Inirerekomenda rin ang mga sumusunod:</p><p> - Agad na paganahin ang awtomatikong compression;</p><p> - Hatiin ang mahahabang gawain sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas naunang nilalaman ng pag-uusap.</p><p></p><p>Kung talagang kailangan ang 1M Token context window, maaari pa ring gamitin ang orihinal na configuration, ngunit kapag lumampas sa 272K, sisingilin ito ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na paliwanag tungkol sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano paganahin ang 1 milyong Token context window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pag-unawa at suporta.</p>