Skip to content

Blogs

830 Topics 831 Posts

Blog posts from individual members

This category can be followed from the open social web via the handle [email protected]

  • 0 Votes
    1 Posts
    40 Views
    A
    <p>Podľa najnovších pravidiel fakturácie OpenAI používajú modely ako GPT-5.6 Sol pre požiadavky s mimoriadne dlhým kontextom stupňovité ceny.</p><p>Ak kontext jednej požiadavky prekročí 272K tokenov, vstup, čítanie z cache aj výstup môžu byť účtované podľa vyššieho cenového stupňa. Toto pravidlo pochádza z oficiálneho cenníka OpenAI a nejde o dočasné zvýšenie cien ani o neštandardné účtovanie zo strany AI-ROUTER.</p><p></p><p>Príklad štandardných cien GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenov $10 / 1M tokenov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čítanie z cache $0.50 / 1M tokenov $1 / 1M tokenov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenov $45 / 1M tokenov</code></pre><p></p><p>Celkový poplatok sa bude naďalej vypočítavať podľa konkrétnej skupiny, násobku účtu a ďalších fakturačných nastavení.</p><p></p><p>Označenie x2 v záznamoch používania znamená, že požiadavka aktivovala stupňovitú fakturáciu za dlhý kontext. Toto označenie predovšetkým znamená, že vstup alebo čítanie z cache prešli do vyššieho cenového stupňa. Neznamená to, že všetky poplatky za celú požiadavku sa jednoducho zdvojnásobili; výstup môže používať inú násobkovú sadzbu.</p><p></p><p><strong> ## Ako zabrániť aktivácii stupňovitej fakturácie</strong></p><p>Ak nepotrebujete kontextové okno s kapacitou 1M tokenov, odporúčame nastaviť limit kontextu v Codexe späť na maximálne 272K tokenov.</p><p></p><p>Otvorte:</p><p> ~/.codex/config.toml</p><p></p><p>Pôvodné nastavenie 1M z predchádzajúceho článku:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zmeňte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení reštartujte Codex a vytvorte novú reláciu.</p><p></p><p>Ak chcete toto nastavenie použiť iba dočasne pre jednu reláciu, môžete použiť:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň odporúčame:</p><p> - včas zapnúť automatickú kompresiu;</p><p> - rozdeliť dlhé úlohy do viacerých relácií;</p><p> - obmedziť veľké množstvo výstupov nástrojov vracaných naraz;</p><p> - pravidelne sumarizovať a odstraňovať starší obsah konverzácie.</p><p></p><p>Ak skutočne potrebujete kontextové okno s kapacitou 1M tokenov, môžete naďalej používať pôvodné nastavenie, no po prekročení 272K tokenov sa bude účtovať podľa vyššieho cenového stupňa OpenAI.</p><p></p><p>Pôvodné pokyny na konfiguráciu nájdete v článku: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Ako povoliť kontextové okno s kapacitou 1 milión tokenov v Codexe pre GPT-5.6 Sol </a></p><p></p><p>Ďakujeme za pochopenie a podporu.</p>
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços progressivos para solicitações com contexto ultralongo.</p><p>Quando o contexto de uma única solicitação excede 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço mais alta. Essa regra vem da precificação oficial da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.</p><p></p><p>Tomando como exemplo o preço padrão do GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Até 272K Acima de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Leitura do $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> cache</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Saída $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.</p><p></p><p>A marca x2 exibida no histórico de uso indica que a solicitação acionou a cobrança progressiva para contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa de preço mais alta; ela não significa que todos os custos da solicitação tenham simplesmente dobrado. A saída pode utilizar um multiplicador de faixa diferente.</p><p></p><p><strong> ## Como evitar acionar a cobrança progressiva</strong></p><p>Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.</p><p></p><p>Abra:</p><p> ~/.codex/config.toml</p><p></p><p>Altere a configuração de 1M apresentada no artigo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Para:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Depois de salvar, reinicie o Codex e crie uma nova sessão.</p><p></p><p>Se quiser aplicar a configuração temporariamente a uma única sessão, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Também recomendamos:</p><p> - ativar a compactação automática em tempo hábil;</p><p> - dividir tarefas muito longas em várias sessões;</p><p> - reduzir a quantidade de saídas de ferramentas retornadas de uma só vez;</p><p> - resumir e limpar periodicamente o conteúdo mais antigo da conversa.</p><p></p><p>Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas os tokens acima de 272K serão cobrados de acordo com os preços mais altos da OpenAI.</p><p></p><p>Para consultar as instruções de configuração originais, veja: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol </a></p><p></p><p>Agradecemos sua compreensão e seu apoio.</p>
  • 0 Votes
    1 Posts
    68 Views
    A
    <p>Skont l-aħħar regoli tal-kontijiet ta’ OpenAI, mudelli bħal GPT-5.6 Sol jużaw prezzijiet skont il-livelli għal talbiet b’kuntest ultra-twil.</p><p>Meta l-kuntest ta’ talba waħda jaqbeż 272K tokens, l-input, il-qari tal-cache u l-output jistgħu jiġu kkalkulati skont livell ta’ prezz ogħla. Din ir-regola ġejja mill-ipprezzar uffiċjali ta’ OpenAI, u mhijiex żieda temporanja fil-prezzijiet jew tariffa mhux tas-soltu minn AI-ROUTER.</p><p></p><p>Bħala eżempju, hawn taħt jinsabu l-prezzijiet standard ta’ GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Oġġett Fi ħdan 272K Aktar minn 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Qari tal-cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>L-ispiża finali xorta tiġi kkalkulata skont il-grupp speċifiku, il-multiplikatur tal-kont u konfigurazzjonijiet oħra tal-kontijiet.</p><p></p><p>Meta fir-rekords tal-użu tidher il-marka x2, dan ifisser li t-talba attivat il-kontijiet skont il-livell għal kuntest twil. Din il-marka tindika prinċipalment li l-input jew il-qari tal-cache daħal f’livell ogħla; ma tfissirx li l-ispejjeż kollha tat-talba sempliċement ġew immultiplikati b’2. L-output jista’ juża multiplikatur differenti skont il-livell.</p><p></p><p><strong> ## Kif tevita li tattiva l-kontijiet skont il-livell</strong></p><p>Jekk ma għandekx bżonn tieqa ta’ kuntest ta’ 1M Token, huwa rakkomandat li taġġusta l-limitu tal-kuntest ta’ Codex għal 272K jew inqas.</p><p></p><p>Iftaħ:</p><p> ~/.codex/config.toml</p><p></p><p>Ikkonverti l-konfigurazzjoni ta’ 1M mill-artiklu oriġinali:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>għal:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Wara li tissejvja, ibda mill-ġdid Codex u oħloq sessjoni ġdida.</p><p></p><p>Jekk tixtieq li dan japplika temporanjament għal sessjoni waħda biss, tista’ tuża:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Huwa rakkomandat ukoll li:</p><p> - tattiva l-kompressjoni awtomatika fil-ħin;</p><p> - taqsam il-kompiti twal f’diversi sessjonijiet;</p><p> - tnaqqas l-ammont kbir ta’ output mill-għodod li jintbagħat f’daqqa;</p><p> - tagħmel sommarju u tnaddaf regolarment il-kontenut ta’ konversazzjonijiet aktar antiki.</p><p></p><p>Jekk tassew għandek bżonn tieqa ta’ kuntest ta’ 1M Token, tista’ tkompli tuża l-konfigurazzjoni oriġinali, iżda wara li taqbeż 272K se jiġu applikati l-prezzijiet għoljin skont il-livell ta’ OpenAI.</p><p></p><p>Għarraf dwar il-konfigurazzjoni oriġinali, irreferi għal: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kif tattiva tieqa ta’ kuntest ta’ miljun Token f’Codex għal GPT-5.6 Sol </a></p><p></p><p>Grazzi tal-fehim u l-appoġġ tiegħek.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>OpenAI uusimate hinnastamisreeglite kohaselt kasutavad GPT-5.6 Sol ja teised mudelid ülipika kontekstiga päringute puhul astmelist hinnastamist.</p><p>Kui ühe päringu kontekst ületab 272K tokenit, võidakse sisendile, vahemälust loetud tokenitele ja väljundile rakendada kõrgema astme hinda. See reegel pärineb OpenAI ametlikust hinnastamisest ega kujuta endast AI-ROUTERi ajutist lisatasu ega ebatavalist arveldust.</p><p></p><p>Näiteks GPT-5.6 Soli standardhinnad:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Üksus Kuni 272K Üle 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sisend $5 / 1M tokenit $10 / 1M tokenit</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vahemälust loetud $0.50 / 1M tokenit $1 / 1M tokenit</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Väljund $30 / 1M tokenit $45 / 1M tokenit</code></pre><p></p><p>Lõplik tasu arvutatakse endiselt konkreetse rühma, konto kordaja ja muude arveldusseadete alusel.</p><p></p><p>Kasutusandmetes kuvatav x2-märgis tähendab, et see päring käivitas pika konteksti astmelise hinnastamise. See märgis näitab peamiselt seda, et sisend või vahemälust lugemine jõudis kõrgemasse astmesse. See ei tähenda, et kõik päringu tasud lihtsalt kahekordistuvad; väljundile võidakse rakendada teistsugust astmelist kordajat.</p><p></p><p><strong> ## Kuidas vältida astmelise hinnastamise rakendumist</strong></p><p>Kui te ei vaja 1M tokeni suurust kontekstiakent, on soovitatav vähendada Codexi konteksti ülempiir tagasi 272K tokenini või väiksemaks.</p><p></p><p>Avage:</p><p> ~/.codex/config.toml</p><p></p><p>Asendage varasemas artiklis esitatud 1M konfiguratsioon:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>järgmise konfiguratsiooniga:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Salvestage muudatused, taaskäivitage Codex ja alustage uus seanss.</p><p></p><p>Kui soovite muudatust rakendada ajutiselt ainult ühele seansile, kasutage järgmist käsku:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Samuti on soovitatav:</p><p> - lülitada automaatne tihendamine õigel ajal sisse;</p><p> - jagada ülipikad ülesanded mitmeks seansiks;</p><p> - vähendada ühe korraga tagastatavate tööriistaväljundite hulka;</p><p> - teha regulaarselt kokkuvõtteid ja puhastada varasemad vestlussisu osad.</p><p></p><p>Kui vajate tõepoolest 1M tokeni suurust kontekstiakent, võite jätkata algse konfiguratsiooni kasutamist, kuid pärast 272K piiri ületamist rakendatakse OpenAI kõrgema astme hindu.</p><p></p><p>Algse konfiguratsiooni juhised leiate siit: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kuidas lubada Codexis GPT-5.6 Soli jaoks 1 miljoni tokeni suurune kontekstiaken </a></p><p></p><p>Täname mõistva suhtumise ja toetuse eest.</p>
  • 0 Votes
    1 Posts
    44 Views
    A
    <p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z izjemno dolgim kontekstom uporabljajo stopenjske cene.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega doplačila ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Za primer vzemimo standardne cene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množilnik računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zapisu uporabe pomeni, da je ta zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo; ne pomeni, da so se vsi stroški celotne zahteve preprosto podvojili. Za izhod se lahko uporabi drugačen stopenjski množilnik.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna z 1M žetoni, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M žetonov:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po shranjevanju znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za eno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izpisov orodij, vrnjenih naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če kontekstno okno z 1M žetoni dejansko potrebujete, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno z 1 milijonom žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>
  • 0 Votes
    1 Posts
    47 Views
    A
    <p>Σύμφωνα με τους πιο πρόσφατους κανόνες χρέωσης της OpenAI, μοντέλα όπως το GPT-5.6 Sol χρησιμοποιούν κλιμακωτή τιμολόγηση για αιτήματα με εξαιρετικά μεγάλο περιβάλλον συμφραζομένων.</p><p>Όταν το περιβάλλον συμφραζομένων ενός αιτήματος υπερβαίνει τα 272K tokens, η είσοδος, η ανάγνωση από την προσωρινή μνήμη και η έξοδος ενδέχεται να χρεώνονται με υψηλότερη κλίμακα. Ο κανόνας αυτός προέρχεται από την επίσημη τιμολόγηση της OpenAI και δεν αποτελεί προσωρινή πρόσθετη χρέωση ή异常 χρέωση του AI-ROUTER.</p><p></p><p>Για παράδειγμα, με τις τυπικές τιμές του GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Στοιχείο Εντός 272K Πάνω από 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Είσοδος $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ανάγνωση cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Έξοδος $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Η τελική χρέωση εξακολουθεί να υπολογίζεται με βάση τη συγκεκριμένη ομάδα, τον πολλαπλασιαστή του λογαριασμού και άλλες ρυθμίσεις χρέωσης.</p><p></p><p>Η ένδειξη x2 που εμφανίζεται στις记录 χρήσης σημαίνει ότι το συγκεκριμένο αίτημα ενεργοποίησε την κλιμακωτή χρέωση για μεγάλο περιβάλλον συμφραζομένων. Η ένδειξη αφορά κυρίως την είσοδο και την ανάγνωση από την προσωρινή μνήμη, οι οποίες πέρασαν σε υψηλότερη κλίμακα. Δεν σημαίνει ότι όλες οι χρεώσεις του αιτήματος διπλασιάστηκαν απλά· η έξοδος ενδέχεται να χρησιμοποιεί διαφορετικό συντελεστή κλίμακας.</p><p></p><p><strong> ## Πώς να αποφύγετε την ενεργοποίηση της κλιμακωτής χρέωσης</strong></p><p>Αν δεν χρειάζεστε παράθυρο περιβάλλοντος συμφραζομένων 1M tokens, συνιστάται να επαναφέρετε το όριο περιβάλλοντος του Codex σε έως 272K.</p><p></p><p>Ανοίξτε το:</p><p> ~/.codex/config.toml</p><p></p><p>Αλλάξτε τη ρύθμιση 1M από το αρχικό άρθρο:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>σε:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Αποθηκεύστε τις αλλαγές, επανεκκινήστε το Codex και δημιουργήστε μια νέα συνεδρία.</p><p></p><p>Αν θέλετε να ισχύσει προσωρινά μόνο για μία συνεδρία, μπορείτε να χρησιμοποιήσετε:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Συνιστάται επίσης:</p><p> - Να ενεργοποιείτε εγκαίρως την αυτόματη συμπύκνωση·</p><p> - Να χωρίζετε τις εργασίες μεγάλης διάρκειας σε πολλές συνεδρίες·</p><p> - Να μειώνετε την ποσότητα των αποτελεσμάτων εργαλείων που επιστρέφονται ταυτόχρονα·</p><p> - Να συνοψίζετε και να καθαρίζετε τακτικά το παλαιότερο περιεχόμενο της συνομιλίας.</p><p></p><p>Αν χρειάζεστε πράγματι παράθυρο περιβάλλοντος συμφραζομένων 1M tokens, μπορείτε να συνεχίσετε να χρησιμοποιείτε την αρχική ρύθμιση. Ωστόσο, μετά τα 272K tokens θα εφαρμόζεται η υψηλότερη κλιμακωτή τιμολόγηση της OpenAI.</p><p></p><p>Για την αρχική说明 ρύθμιση, ανατρέξτε στο: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Πώς να ενεργοποιήσετε περιβάλλον συμφραζομένων 1 εκατομμυρίου Token στο Codex για το GPT-5.6 Sol </a></p><p></p><p>Σας ευχαριστούμε για την κατανόηση και την υποστήριξή σας.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>OpenAI:n uusimpien hinnoittelusääntöjen mukaan GPT-5.6 Solin kaltaiset mallit käyttävät erittäin pitkille kontekstipyynnöille porrastettua hinnoittelua.</p><p>Kun yhden pyynnön konteksti ylittää 272K tokenia, syötteen, välimuistista luetun sisällön ja tulosteen hinnoittelu voidaan laskea korkeamman hintaportaan mukaan. Tämä sääntö perustuu OpenAI:n viralliseen hinnoitteluun, eikä kyse ole AI-ROUTERin tilapäisestä lisämaksusta tai poikkeavasta veloituksesta.</p><p></p><p>Esimerkkinä GPT-5.6 Solin vakiohinnat:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kohde Enintään 272K Yli 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Syöte $5 / 1M tokenia $10 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Välimuistiluku $0.50 / 1M tokenia $1 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tuloste $30 / 1M tokenia $45 / 1M tokenia</code></pre><p></p><p>Lopullinen hinta lasketaan edelleen tietyn ryhmittelyn, tilin kertoimen ja muiden hinnoitteluasetusten perusteella.</p><p></p><p>Käyttötiedoissa näkyvä x2-merkintä tarkoittaa, että kyseinen pyyntö on siirtynyt pitkän kontekstin porrastettuun hinnoitteluun. Merkintä tarkoittaa ensisijaisesti sitä, että syöte ja välimuistista lukeminen siirtyivät korkeampaan hintaportaaseen. Se ei tarkoita, että kaikki pyynnön kustannukset yksinkertaisesti kaksinkertaistuisivat; tulosteessa voidaan käyttää eri porrastuskerrointa.</p><p></p><p><strong> ## Kuinka porrastetun hinnoittelun voi välttää</strong></p><p>Jos et tarvitse 1M tokenin konteksti-ikkunaa, Codexin kontekstiraja kannattaa säätää takaisin enintään 272K tokeniin.</p><p></p><p>Avaa:</p><p> ~/.codex/config.toml</p><p></p><p>Muuta artikkelin aiempi 1M:n asetus:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>seuraavaksi:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Tallenna muutokset, käynnistä Codex uudelleen ja aloita uusi istunto.</p><p></p><p>Jos haluat ottaa asetuksen käyttöön tilapäisesti vain yhdessä istunnossa, voit käyttää seuraavaa komentoa:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Lisäksi suositellaan:</p><p> - ota automaattinen tiivistäminen käyttöön ajoissa;</p><p> - jaa erittäin pitkät tehtävät useisiin istuntoihin;</p><p> - vähennä kerralla palautettavien työkalutulosteiden määrää;</p><p> - tiivistä ja siivoa vanhempaa keskustelusisältöä säännöllisesti.</p><p></p><p>Jos tarvitset todella 1M tokenin konteksti-ikkunaa, voit jatkaa alkuperäisen asetuksen käyttöä, mutta 272K tokenin ylittävästä osuudesta veloitetaan OpenAI:n korkeamman hintaportaan mukaisesti.</p><p></p><p>Alkuperäiset määritysohjeet ovat saatavilla täällä: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kuinka ottaa GPT-5.6 Solin miljoonan tokenin konteksti-ikkuna käyttöön Codexissa </a></p><p></p><p>Kiitos ymmärryksestäsi ja tuestasi.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>Съгласно най-новите правила за ценообразуване на OpenAI, модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърля 272K токена, входът, четенето от кеша и изходът могат да бъдат таксувани по по-високо ценово ниво. Това правило идва от официалното ценообразуване на OpenAI, а не представлява временно допълнително оскъпяване или необичайно таксуване от AI-ROUTER.</p><p></p><p>Например при стандартните цени на GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Елемент До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната сума все пак се изчислява въз основа на конкретната група, множителя за акаунта и други настройки за таксуване.</p><p></p><p>Обозначението x2 в историята на използването означава, че заявката е задействала стъпаловидно ценообразуване за дълъг контекст. То основно показва, че входът и четенето от кеша са преминали към по-високо ценово ниво, но не означава, че всички разходи по заявката са просто удвоени; за изхода може да се прилага различен множител на съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното ценообразуване</strong></p><p>Ако не се нуждаете от контекстен прозорец от 1M токена, препоръчваме да намалите лимита на контекста в Codex до 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Променете конфигурацията от първоначалната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Запазете промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - своевременно да активирате автоматичното компресиране;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем изход от инструменти, който се връща наведнъж;</p><p> - редовно да обобщавате и изчиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстен прозорец от 1M токена, можете да продължите да използвате първоначалната конфигурация, но съдържанието над 272K ще бъде таксувано по високите ценови нива на OpenAI.</p><p></p><p>За първоначалните инструкции за конфигурация вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстен прозорец от 1 милион токена в Codex за GPT-5.6 Sol </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-lungo.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un aumento temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale sarà comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e alle altre configurazioni di fatturazione.</p><p></p><p>La comparsa del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto lungo. Questo contrassegno indica principalmente che l'input e la lettura della cache sono passati a uno scaglione superiore; non significa che tutti i costi dell'intera richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore a scaglioni diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M indicata nell'articolo originale:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma oltre 272K la fatturazione seguirà i prezzi dello scaglione superiore di OpenAI.</p><p></p><p>Per la configurazione originale, consultare: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
  • 0 Votes
    1 Posts
    35 Views
    A
    <p>Podle nejnovějších pravidel účtování OpenAI používají modely jako GPT-5.6 Sol pro požadavky s velmi dlouhým kontextem stupňovité ceny.</p><p>Pokud kontext jednorázového požadavku překročí 272K tokenů, mohou být vstup, načítání z mezipaměti i výstup účtovány podle vyššího cenového pásma. Toto pravidlo pochází z oficiálního ceníku OpenAI a nejde o dočasné navýšení ceny ani nestandardní účtování ze strany AI-ROUTER.</p><p></p><p>Například u standardních cen GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenů $10 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Načítání z mezipaměti $0.50 / 1M tokenů $1 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenů $45 / 1M tokenů</code></pre><p></p><p>Celková cena se i nadále vypočítává podle konkrétní skupiny, násobitele účtu a dalších nastavení účtování.</p><p></p><p>Označení x2 v historii použití znamená, že požadavek aktivoval stupňovité účtování dlouhého kontextu. Toto označení se týká především vstupu a načítání z mezipaměti, které přešly do vyššího cenového pásma. Neznamená, že se všechny náklady za celý požadavek jednoduše zdvojnásobily; výstup může používat jiný násobitel cenového pásma.</p><p></p><p><strong> ## Jak se vyhnout stupňovitému účtování</strong></p><p>Pokud nepotřebujete kontextové okno o velikosti 1M tokenů, doporučujeme nastavit limit kontextu Codexu zpět na hodnotu do 272K.</p><p></p><p>Otevřete:</p><p> ~/.codex/config.toml</p><p></p><p>Původní konfiguraci pro 1M tokenů:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>upravte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení restartujte Codex a vytvořte novou relaci.</p><p></p><p>Pokud chcete nastavení použít dočasně pouze pro jednu relaci, můžete použít:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň doporučujeme:</p><p> - včas zapnout automatickou kompresi;</p><p> - rozdělit dlouhé úlohy do více relací;</p><p> - omezit množství výstupu nástrojů vraceného najednou;</p><p> - pravidelně shrnovat a čistit starší obsah konverzace.</p><p></p><p>Pokud skutečně potřebujete kontextové okno o velikosti 1M tokenů, můžete původní konfiguraci nadále používat. Po překročení 272K však bude účtování probíhat podle vyššího cenového pásma OpenAI.</p><p></p><p>Původní popis konfigurace najdete zde: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak v Codexu povolit kontextové okno o velikosti 1 milionu tokenů pro GPT-5.6 Sol </a></p><p></p><p>Děkujeme za pochopení a podporu.</p>
  • 0 Votes
    1 Posts
    52 Views
    A
    <p>Zgodnie z najnowszymi zasadami rozliczeń OpenAI modele takie jak GPT-5.6 Sol stosują ceny progowe dla żądań z bardzo długim kontekstem.</p><p>Gdy kontekst pojedynczego żądania przekracza 272 tys. tokenów, tokeny wejściowe, odczyt z pamięci podręcznej oraz dane wyjściowe mogą być rozliczane według wyższego progu cenowego. Zasada ta wynika z oficjalnego cennika OpenAI i nie jest tymczasową podwyżką ani nieprawidłowym naliczeniem opłat przez AI-ROUTER.</p><p></p><p>Przykładowe standardowe ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pozycja Do 272K Powyżej 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Wejście $5 / 1M tokenów $10 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Odczyt z pamięci $0.50 / 1M tokenów $1 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Wyjście $30 / 1M tokenów $45 / 1M tokenów</code></pre><p></p><p>Ostateczna opłata jest nadal obliczana na podstawie konkretnej grupy, mnożnika konta oraz innych ustawień rozliczeń.</p><p></p><p>Oznaczenie x2 widoczne w historii użycia oznacza, że dane żądanie uruchomiło progowe rozliczanie długiego kontekstu. Oznaczenie to wskazuje przede wszystkim, że wejście lub odczyt z pamięci podręcznej został rozliczony według wyższego progu. Nie oznacza ono, że wszystkie opłaty za całe żądanie zostały po prostu podwojone; dane wyjściowe mogą podlegać innemu mnożnikowi progowemu.</p><p></p><p><strong> ## Jak uniknąć progowego rozliczania</strong></p><p>Jeśli nie potrzebujesz okna kontekstu o rozmiarze 1 mln tokenów, zalecamy ustawienie limitu kontekstu Codex z powrotem na maksymalnie 272 tys. tokenów.</p><p></p><p>Otwórz:</p><p> ~/.codex/config.toml</p><p></p><p>Zmień wcześniejszą konfigurację 1 mln tokenów:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Zapisz zmiany, uruchom ponownie Codex i rozpocznij nową sesję.</p><p></p><p>Jeśli chcesz tymczasowo zastosować ustawienia tylko dla jednej sesji, możesz użyć:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zalecamy również:</p><p> - włączyć automatyczną kompresję w odpowiednim momencie;</p><p> - dzielić bardzo długie zadania na wiele sesji;</p><p> - ograniczyć ilość danych wyjściowych z narzędzi zwracanych jednorazowo;</p><p> - regularnie podsumowywać i usuwać starsze treści rozmów.</p><p></p><p>Jeśli rzeczywiście potrzebujesz okna kontekstu o rozmiarze 1 mln tokenów, możesz nadal korzystać z pierwotnej konfiguracji, jednak tokeny przekraczające 272 tys. będą rozliczane według wyższych progów cenowych OpenAI.</p><p></p><p>Oryginalne informacje o konfiguracji znajdziesz tutaj: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak włączyć okno kontekstu o rozmiarze 1 miliona tokenów w Codex dla GPT-5.6 Sol </a></p><p></p><p>Dziękujemy za wyrozumiałość i wsparcie.</p>
  • 0 Votes
    1 Posts
    41 Views
    A
    <p>Ifølge OpenAIs seneste gebyrregler anvender modeller som GPT-5.6 Sol trinvise priser for anmodninger med ekstra lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsning og output blive beregnet efter et højere prisniveau. Reglen stammer fra OpenAIs officielle prissætning og er ikke en midlertidig prisstigning eller en fejlagtig opkrævning fra AI-ROUTER.</p><p></p><p>Her er GPT-5.6 Sols standardpriser som eksempel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes stadig ud fra den konkrete gruppe, kontoens multiplikator og andre gebyrindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at denne anmodning har udløst trinvist gebyr for lang kontekst. Markeringen angiver primært, at input/cachelæsning er gået over på et højere prisniveau, og betyder ikke, at alle omkostninger for hele anmodningen blot er fordoblet. Output kan være underlagt en anden trinvist beregnet multiplikator.</p><p></p><p><strong> ## Sådan undgår du trinvist gebyr</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Den oprindelige 1M-konfiguration fra den tidligere artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ændres til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem ændringerne, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - opdele lange opgaver i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive opkrævet efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens i Codex til GPT-5.6 Sol </a></p><p></p><p>Tak for din forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    40 Views
    A
    <p>Az OpenAI legújabb díjszabási szabályai szerint a GPT-5.6 Sol és más modellek lépcsőzetes árakat alkalmaznak az extra hosszú kontextust használó kérésekre.</p><p>Ha egyetlen kérés kontextusa meghaladja a 272K tokent, a bemenet, a gyorsítótárból történő olvasás és a kimenet magasabb díjsáv szerint kerülhet elszámolásra. Ez a szabály az OpenAI hivatalos árazásából ered, és nem az AI-ROUTER ideiglenes felára vagy hibás terhelése.</p><p></p><p>Példaként a GPT-5.6 Sol standard árai:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tétel 272K alatt 272K felett</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bemenet $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Gyorsítótárból $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kimenet $30 / 1M token $45 / 1M token</code></pre><p></p><p>A végleges díj továbbra is a konkrét csoport, a fiókhoz tartozó szorzó és az egyéb számlázási beállítások alapján kerül kiszámításra.</p><p></p><p>A használati adatokban megjelenő x2 jelölés azt jelenti, hogy az adott kérés aktiválta az extra hosszú kontextusra vonatkozó lépcsőzetes díjszabást. Ez a jelölés elsősorban azt mutatja, hogy a bemenet és a gyorsítótárból történő olvasás magasabb díjsávba került; nem jelenti azt, hogy a teljes kérés minden költsége egyszerűen megduplázódik. A kimenetre eltérő lépcsőzetes szorzó vonatkozhat.</p><p></p><p><strong> ## Hogyan kerülhető el a lépcsőzetes díjszabás aktiválása</strong></p><p>Ha nincs szükség 1M tokenes kontextusablakra, javasoljuk, hogy a Codex kontextuskorlátját állítsa vissza legfeljebb 272K tokenre.</p><p></p><p>Nyissa meg:</p><p> ~/.codex/config.toml</p><p></p><p>Az eredeti cikkben szereplő 1M-es beállítás:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Állítsa át erre:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Mentse a fájlt, majd indítsa újra a Codexet, és hozzon létre új munkamenetet.</p><p></p><p>Ha csak ideiglenesen, egyetlen munkamenetre szeretné alkalmazni a beállítást, használhatja ezt:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Emellett javasoljuk:</p><p> - időben kapcsolja be az automatikus tömörítést;</p><p> - ossza fel a hosszú feladatokat több munkamenetre;</p><p> - csökkentse az egyszerre visszaadott eszközkimenetek mennyiségét;</p><p> - rendszeresen foglalja össze és törölje a régebbi beszélgetési tartalmakat.</p><p></p><p>Ha valóban szüksége van 1M tokenes kontextusablakra, továbbra is használhatja az eredeti beállítást, azonban 272K token felett az OpenAI magasabb díjsáv szerinti árazása lesz érvényes.</p><p></p><p>Az eredeti konfigurációs útmutató itt található: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Az 1 millió tokenes kontextusablak engedélyezése a Codexben GPT-5.6 Solhoz </a></p><p></p><p>Köszönjük megértését és támogatását.</p>
  • 0 Votes
    1 Posts
    53 Views
    A
    <p>OpenAI의 최신 요금 정책에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 계단식 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 계단식 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER의 임시 추가 요금이나 비정상적인 과금이 아닙니다.</p><p></p><p>GPT-5.6 Sol의 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청에 장문 컨텍스트 계단식 요금이 적용되었음을 의미합니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 요금 계단에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 된다는 의미는 아닙니다. 출력에는 다른 계단식 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 계단식 요금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정을 다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 조정합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만드세요.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적절히 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 오래된 대화 내용을 정기적으로 요약하고 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 단, 272K를 초과하는 부분에는 OpenAI의 더 높은 계단식 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요. <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>
  • 0 Votes
    1 Posts
    55 Views
    A
    <p>Enligt OpenAIs senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserad prissättning för förfrågningar med extremt lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt ett högre pristrappsteg. Regeln kommer från OpenAIs officiella prissättning och är inte en tillfällig prisökning eller felaktig debitering från AI-ROUTER.</p><p></p><p>Exempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cach läses $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har aktiverat trappstegsbaserad prissättning för lång kontext. Markeringen betyder främst att indata eller läsning från cache har gått in i ett högre pristrappsteg. Det innebär inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan använda en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderar vi att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara ändringarna, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att inställningen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Vi rekommenderar även att du:</p><p> - aktiverar automatisk komprimering i tid;</p><p> - delar upp mycket långa uppgifter i flera sessioner;</p><p> - minskar mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfattar och rensar äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAIs högre trappstegspriser.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens för GPT-5.6 Sol i Codex </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כמו GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת מחיר גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, לפי המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצת התמחור הספציפית, למכפיל החשבון ולהגדרות תמחור נוספות.</p><p></p><p>הופעת הסימון x2 ברשומות השימוש מציינת שהבקשה הפעילה תמחור מדורג עבור הקשר ארוך. הסימון מציין בעיקר שהקלט וקריאת המטמון עברו למדרגת מחיר גבוהה יותר, ואינו אומר שכל עלויות הבקשה הוכפלו בפשטות; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את הקובץ:</p><p> ~/.codex/config.toml</p><p></p><p>שנו את הגדרת ה-1M שהופיעה במאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>להגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>שמרו את הקובץ, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, תוכלו להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל בזמן את הדחיסה האוטומטית;</p><p> - לפצל משימות ארוכות למספר שיחות;</p><p> - להפחית את כמות פלט כלי העזר המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע חלקים מוקדמים יותר של השיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרות המקוריות, אך לאחר חריגה מ-272K החיוב יתבצע לפי מדרגות המחיר הגבוהות יותר של OpenAI.</p><p></p><p>להסבר על ההגדרות המקוריות, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>Volgens de nieuwste factureringsregels van OpenAI hanteren modellen zoals GPT-5.6 Sol getrapte prijzen voor verzoeken met extreem lange contexten.</p><p>Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, het lezen van de cache en uitvoer volgens een hogere tariefschijf worden berekend. Deze regel is afkomstig uit de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of onregelmatige afschrijving van AI-ROUTER.</p><p></p><p>Een voorbeeld op basis van de standaardprijzen voor GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Onderdeel Binnen 272K Meer dan 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Invoer $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache lezen $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Uitvoer $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, accountvermenigvuldigingsfactor en andere factureringsinstellingen.</p><p></p><p>Wanneer er in de gebruiksgegevens een x2-markering verschijnt, betekent dit dat het verzoek de getrapte facturering voor lange contexten heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en het lezen van de cache in een hogere tariefschijf vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere tariefvermenigvuldigingsfactor gelden.</p><p></p><p><strong> ## Hoe voorkom je getrapte facturering</strong></p><p>Als je geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te brengen tot maximaal 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Wijzig de 1M-configuratie uit het oorspronkelijke artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.</p><p></p><p>Als je dit slechts tijdelijk voor één sessie wilt toepassen, kun je het volgende gebruiken:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Daarnaast wordt aanbevolen:</p><p> - automatische compressie tijdig in te schakelen;</p><p> - extreem lange taken over meerdere sessies te verdelen;</p><p> - de hoeveelheid tooluitvoer die in één keer wordt teruggegeven te beperken;</p><p> - eerdere gespreksinhoud regelmatig samen te vatten en op te schonen.</p><p></p><p>Als je daadwerkelijk een contextvenster van 1M tokens nodig hebt, kun je de oorspronkelijke configuratie blijven gebruiken. Voor contexten boven 272K worden dan echter de hogere tariefschijven van OpenAI toegepast.</p><p></p><p>Raadpleeg voor de oorspronkelijke configuratie-instructies: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Hoe je in Codex een contextvenster van 1 miljoen tokens inschakelt voor GPT-5.6 Sol </a></p><p></p><p>Bedankt voor je begrip en steun.</p>
  • 0 Votes
    1 Posts
    50 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según un nivel de precios superior. Esta regla procede de los precios oficiales de OpenAI y no representa un aumento temporal de AI-ROUTER ni un cargo anómalo.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en los registros de uso indica que la solicitud activó la facturación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché han pasado a un nivel superior; no significa que todos los costes de la solicitud se hayan duplicado de forma sencilla. La salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Cámbiala por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Después de guardar, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión concreta, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar a tiempo la compactación automática;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios del nivel superior de OpenAI.</p><p></p><p>Para consultar las instrucciones de configuración originales, visita: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    56 Views
    A
    <p>Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification par paliers aux requêtes utilisant un contexte très long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, l’entrée, la lecture du cache et la sortie peuvent être facturées selon des paliers tarifaires supérieurs. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit ni d’une majoration temporaire d’AI-ROUTER ni d’une facturation anormale.</p><p></p><p>Exemple avec les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Plus de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée 5 $ / 1M tokens 10 $ / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture du cache 0,50 $ / 1M tokens 1 $ / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie 30 $ / 1M tokens 45 $ / 1M tokens</code></pre><p></p><p>Le montant final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification par paliers pour contexte long. Ce marqueur indique principalement que l’entrée et/ou la lecture du cache sont passées au palier supérieur ; il ne signifie pas que tous les frais de la requête ont simplement été doublés. La sortie peut être soumise à un multiplicateur de palier différent.</p><p></p><p><strong> ## Comment éviter de déclencher la tarification par paliers</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration à 1M présentée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Après l’enregistrement, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - répartir les tâches très longues sur plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais la partie dépassant 272K sera facturée selon les tarifs des paliers supérieurs d’OpenAI.</p><p></p><p>Pour consulter les instructions de configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
  • 0 Votes
    1 Posts
    48 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker modeller som GPT-5.6 Sol trinnvis prising for forespørsler med svært lang kontekst.</p><p>Når konteksten i en enkelt forespørsel overstiger 272K tokens, kan input, lesing fra hurtigbufferen og output beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle priser og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisen for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lesing fra $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> hurtigbuffer</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt basert på den konkrete gruppen, kontoens multiplikator og andre prisinnstillinger.</p><p></p><p>Hvis det vises en x2-markering i bruksoversikten, betyr det at forespørselen utløste trinnvis prising for lang kontekst. Markeringen betyr hovedsakelig at input eller lesing fra hurtigbufferen har gått inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen ganske enkelt er doblet. Output kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-grensen for kontekst tilbake til 272K eller lavere.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den tidligere 1M-konfigurasjonen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre filen, start Codex på nytt og opprett en ny samtale.</p><p></p><p>Hvis du bare vil at innstillingen midlertidig skal gjelde for én enkelt samtale, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele svært lange oppgaver opp i flere samtaler;</p><p> - redusere mengden verktøyoutput som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen, men tokens over 272K vil bli belastet etter OpenAIs høyere prisnivå.</p><p></p><p>Se den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Takk for forståelsen og støtten.</p>