<p>OpenAI:n uusimpien hinnoittelusääntöjen mukaan GPT-5.6 Solin kaltaiset mallit käyttävät porrastettua hinnoittelua erittäin pitkän kontekstin pyynnöille.</p><p>Kun yksittäisen pyynnön konteksti ylittää 272K tokenia, syöte, välimuistista lukeminen ja tuloste voidaan hinnoitella korkeamman portaan mukaan. Tämä sääntö perustuu OpenAI:n viralliseen hinnoitteluun, eikä kyse ole AI-ROUTERin tilapäisestä lisämaksusta tai virheellisestä veloituksesta.</p><p></p><p>GPT-5.6 Solin vakiohinnoittelun esimerkki:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kohde Enintään 272K Yli 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Syöte $5 / 1M tokenia $10 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Välimuistiluku $0.50 / 1M tokenia $1 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tuloste $30 / 1M tokenia $45 / 1M tokenia</code></pre><p></p><p>Lopullinen hinta lasketaan edelleen tietyn ryhmän, tilikertoimen ja muiden hinnoitteluasetusten perusteella.</p><p></p><p>Käyttötiedoissa näkyvä x2-merkintä tarkoittaa, että kyseinen pyyntö on laukaissut pitkän kontekstin porrastetun hinnoittelun. Merkintä tarkoittaa ensisijaisesti sitä, että syöte tai välimuistista lukeminen on siirtynyt korkeampaan portaaseen. Se ei tarkoita, että kaikki pyynnön kustannukset yksinkertaisesti kaksinkertaistuisivat; tulosteessa voidaan käyttää eri porraskerrointa.</p><p></p><p><strong> ## Porrastetun hinnoittelun välttäminen</strong></p><p>Jos et tarvitse 1M tokenin konteksti-ikkunaa, Codexin kontekstiraja kannattaa säätää takaisin enintään 272K tokeniin.</p><p></p><p>Avaa:</p><p> ~/.codex/config.toml</p><p></p><p>Vaihda artikkelin aiempi 1M-asetus:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>seuraavaan:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Tallenna asetukset, käynnistä Codex uudelleen ja aloita uusi istunto.</p><p></p><p>Jos haluat asetuksen voimaan vain väliaikaisesti yhdessä istunnossa, voit käyttää seuraavaa komentoa:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Lisäksi suositellaan:</p><p> - ota automaattinen tiivistys käyttöön ajoissa;</p><p> - jaa erittäin pitkät tehtävät useisiin istuntoihin;</p><p> - vähennä kerralla palautettavien työkalutulosteiden määrää;</p><p> - tee säännöllisesti yhteenvetoja ja siivoa vanhempaa keskustelusisältöä.</p><p></p><p>Jos todella tarvitset 1M tokenin konteksti-ikkunaa, voit jatkaa alkuperäisen asetuksen käyttöä, mutta 272K tokenin ylittävä osuus hinnoitellaan OpenAI:n korkeamman portaan hinnaston mukaan.</p><p></p><p>Alkuperäiset määritysohjeet: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Näin otat GPT-5.6 Solin miljoonan tokenin konteksti-ikkunan käyttöön Codexissa </a></p><p></p><p>Kiitos ymmärryksestäsi ja tuestasi.</p>
World
Topics from outside of this forum. Views and opinions represented here may not reflect those of this forum and its members.
A world of content at your fingertips…
Think of this as your global discovery feed. It brings together interesting discussions from across the web and other communities, all in one place.
While you can browse what's trending now, the best way to use this feed is to make it your own. By creating an account, you can follow specific creators and topics to filter out the noise and see only what matters to you.
Ready to dive in? Create an account to start following others, get notified when people reply to you, and save your favorite finds.
Register Login-
<p>Съгласно най-новите правила за таксуване на OpenAI модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърли 272K токена, входът, четенето от кеша и изходът може да бъдат таксувани по-високо ценово ниво. Това правило произтича от официалното ценообразуване на OpenAI, а не от временно допълнително таксуване или неправилно начисляване от страна на AI-ROUTER.</p><p></p><p>Като пример, стандартните цени за GPT-5.6 Sol са:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Позиция До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната такса все пак се изчислява според конкретната група, множителя на акаунта и други настройки за таксуване.</p><p></p><p>Появата на маркера x2 в историята на използването означава, че тази заявка е активирала стъпаловидно таксуване за дълъг контекст. Маркерът основно показва, че входът или четенето от кеша са преминали към по-високо ценово ниво, а не че всички разходи за заявката са били просто удвоени; за изхода може да се прилага различен множител за съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното таксуване</strong></p><p>Ако не се нуждаете от контекстов прозорец от 1M токена, препоръчваме да зададете горната граница на контекста в Codex на 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Заменете конфигурацията от предишната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>със следната конфигурация:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>След като запазите промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - да активирате автоматичното компресиране навреме;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем резултати от инструменти, връщани наведнъж;</p><p> - редовно да обобщавате и почиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстов прозорец от 1M токена, можете да продължите да използвате оригиналната конфигурация, но след надхвърляне на 272K ще се прилага по-високото ценово ниво на OpenAI.</p><p></p><p>За оригиналните инструкции за конфигуриране вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстов прозорец от 1 милион токена за GPT-5.6 Sol в Codex </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>
-
<p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-esteso.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un sovrapprezzo temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale viene comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e ad altre impostazioni di fatturazione.</p><p></p><p>La presenza del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto esteso. Il contrassegno indica principalmente che l'input o la lettura della cache sono entrati in uno scaglione superiore; non significa che tutti i costi della richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M dell'articolo precedente:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma la parte oltre 272K verrà fatturata secondo gli scaglioni di prezzo più elevati di OpenAI.</p><p></p><p>Per la configurazione originale, fare riferimento a: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
-
<p>Podle nejnovějších pravidel účtování společnosti OpenAI používají modely jako GPT-5.6 Sol stupňovité ceny pro požadavky s velmi dlouhým kontextem.</p><p>Pokud kontext jedné žádosti přesáhne 272K tokenů, mohou být vstup, čtení mezipaměti i výstup účtovány podle vyššího cenového pásma. Toto pravidlo pochází z oficiálního ceníku OpenAI a nejde o dočasné navýšení ceny ani nestandardní účtování ze strany AI-ROUTER.</p><p></p><p>Pro příklad uvádíme standardní ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenů $10 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čtení mezipaměti $0.50 / 1M tokenů $1 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenů $45 / 1M tokenů</code></pre><p></p><p>Celkové náklady se stále vypočítávají podle konkrétní skupiny, násobitele účtu a dalších nastavení účtování.</p><p></p><p>Označení x2 v přehledu používání znamená, že požadavek aktivoval stupňovité účtování za dlouhý kontext. Toto označení především signalizuje, že vstup nebo čtení mezipaměti spadá do vyššího cenového pásma. Neznamená to, že se všechny náklady za celý požadavek jednoduše zdvojnásobí; u výstupu může být použit jiný násobitel podle příslušného cenového pásma.</p><p></p><p><strong> ## Jak se vyhnout stupňovitému účtování</strong></p><p>Pokud nepotřebujete kontextové okno o velikosti 1M tokenů, doporučujeme nastavit limit kontextu Codexu zpět na hodnotu do 272K.</p><p></p><p>Otevřete:</p><p> ~/.codex/config.toml</p><p></p><p>Původní konfiguraci pro 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>změňte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení restartujte Codex a vytvořte novou relaci.</p><p></p><p>Pokud chcete změnu použít pouze dočasně pro jednu relaci, můžete použít:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň doporučujeme:</p><p> - včas zapnout automatickou kompresi;</p><p> - rozdělit dlouhé úkoly do více relací;</p><p> - omezit množství výstupu nástrojů vraceného najednou;</p><p> - pravidelně shrnovat a čistit starší obsah konverzace.</p><p></p><p>Pokud kontextové okno o velikosti 1M tokenů skutečně potřebujete, můžete původní konfiguraci nadále používat. Po překročení 272K však bude účtování probíhat podle vyšších cenových pásem OpenAI.</p><p></p><p>Původní pokyny ke konfiguraci najdete v článku: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak v Codexu povolit kontextové okno o velikosti 1 milionu tokenů pro GPT-5.6 Sol </a></p><p></p><p>Děkujeme za pochopení a podporu.</p>
-
<p>Zgodnie z najnowszymi zasadami rozliczeń OpenAI modele takie jak GPT-5.6 Sol stosują stawki progowe dla żądań z bardzo długim kontekstem.</p><p>Gdy kontekst pojedynczego żądania przekracza 272K tokenów, dane wejściowe, odczyt z pamięci podręcznej oraz dane wyjściowe mogą być rozliczane według wyższej stawki progowej. Zasada ta wynika z oficjalnego cennika OpenAI i nie oznacza tymczasowej podwyżki ani nieprawidłowego naliczenia opłat przez AI-ROUTER.</p><p></p><p>Przykładowe standardowe ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pozycja Do 272K Powyżej 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Dane wejściowe $5 / 1M tokenów $10 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Odczyt z pamięci $0.50 / 1M tokenów $1 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Dane wyjściowe $30 / 1M tokenów $45 / 1M tokenów</code></pre><p></p><p>Ostateczna opłata nadal zależy od konkretnej grupy, mnożnika konta oraz innych ustawień rozliczeń.</p><p></p><p>Oznaczenie x2 widoczne w historii użycia oznacza, że dane żądanie uruchomiło progowe rozliczanie długiego kontekstu. Oznaczenie to wskazuje przede wszystkim, że dane wejściowe lub odczyt z pamięci podręcznej zostały rozliczone według wyższej stawki progowej. Nie oznacza ono, że wszystkie opłaty za całe żądanie zostały po prostu podwojone; dane wyjściowe mogą podlegać innemu mnożnikowi progowemu.</p><p></p><p><strong> ## Jak uniknąć progowego rozliczania</strong></p><p>Jeśli nie potrzebujesz okna kontekstu o wielkości 1M tokenów, zalecamy ustawienie limitu kontekstu Codex z powrotem na poziomie nieprzekraczającym 272K.</p><p></p><p>Otwórz:</p><p> ~/.codex/config.toml</p><p></p><p>Zmień wcześniejszą konfigurację 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po zapisaniu zmian uruchom ponownie Codex i rozpocznij nową sesję.</p><p></p><p>Jeśli chcesz tymczasowo zastosować ustawienia tylko do jednej sesji, możesz użyć:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zalecamy również:</p><p> - włączyć automatyczną kompresję w odpowiednim momencie;</p><p> - dzielić bardzo długie zadania na wiele sesji;</p><p> - ograniczyć ilość danych wyjściowych z narzędzi zwracanych jednorazowo;</p><p> - regularnie podsumowywać i usuwać starszą treść rozmowy.</p><p></p><p>Jeśli rzeczywiście potrzebujesz okna kontekstu o wielkości 1M tokenów, możesz nadal korzystać z wcześniejszej konfiguracji, jednak po przekroczeniu 272K opłaty będą naliczane według wyższej stawki progowej OpenAI.</p><p></p><p>Oryginalne informacje o konfiguracji znajdziesz tutaj: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak włączyć okno kontekstu o wielkości 1 miliona tokenów dla GPT-5.6 Sol w Codexie </a></p><p></p><p>Dziękujemy za wyrozumiałość i wsparcie.</p>
-
<p>Ifølge OpenAIs seneste prisregler anvender modeller som GPT-5.6 Sol trinvise priser for anmodninger med ekstra lang kontekst.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelagrede læsninger og output blive beregnet efter højere trinpriser. Reglen stammer fra OpenAIs officielle priser og er ikke et midlertidigt pristillæg eller en fejlagtig opkrævning fra AI-ROUTER.</p><p></p><p>Som eksempel kan GPT-5.6 Sols standardpriser se sådan ud:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes stadig ud fra den konkrete gruppe, kontomultiplikatorer og andre gebyrindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at anmodningen har udløst trinvist gebyr for lang kontekst. Markeringen angiver primært, at input eller cachelæsning er gået ind i et højere trin. Det betyder ikke, at alle omkostninger for hele anmodningen ganske enkelt er fordoblet; output kan være underlagt en anden trinfaktor.</p><p></p><p><strong> ## Sådan undgår du trinvist gebyr</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Skift den tidligere konfiguration på 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem ændringerne, genstart Codex, og opret en ny session.</p><p></p><p>Hvis indstillingen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales samtidig at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - opdele meget lange opgaver i flere sessioner;</p><p> - begrænse store mængder output fra værktøjer, der returneres på én gang;</p><p> - regelmæssigt opsummere og rydde op i ældre samtaleindhold.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsat bruge den oprindelige konfiguration, men tokens over 272K vil blive opkrævet efter OpenAIs højere trinpriser.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Tak for jeres forståelse og støtte.</p>
-
<p>Az OpenAI legújabb díjszabási szabályai alapján a GPT-5.6 Solhoz és más modellekhez tartozó, rendkívül hosszú kontextusú kérésekre lépcsőzetes árképzés vonatkozik.</p><p>Ha egyetlen kérés kontextusa meghaladja a 272K tokent, a bemenet, a gyorsítótárból történő olvasás és a kimenet magasabb árszint szerint kerülhet elszámolásra. Ez a szabály az OpenAI hivatalos díjszabásából ered, és nem az AI-ROUTER ideiglenes felára vagy hibás terhelése.</p><p></p><p>A GPT-5.6 Sol standard árai például a következők:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tétel 272K-ig 272K felett</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bemenet $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Gyorsítótárból $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kimenet $30 / 1M token $45 / 1M token</code></pre><p></p><p>A végleges díj továbbra is az adott csoport, a fiókhoz tartozó szorzó és az egyéb díjszámítási beállítások alapján kerül kiszámításra.</p><p></p><p>Ha a használati előzményekben x2 jelölés jelenik meg, az azt jelenti, hogy a kérés aktiválta a hosszú kontextusra vonatkozó lépcsőzetes díjszámítást. A jelölés elsősorban azt mutatja, hogy a bemenet és a gyorsítótárból történő olvasás magasabb árszintre került; nem jelenti azt, hogy a teljes kérés minden költsége egyszerűen megduplázódott. A kimenetre eltérő lépcsőzetes szorzó vonatkozhat.</p><p></p><p><strong> ## Hogyan kerülhető el a lépcsőzetes díjszámítás aktiválása</strong></p><p>Ha nincs szükség 1M tokenes kontextusablakra, javasoljuk, hogy a Codex kontextuskorlátját állítsa vissza legfeljebb 272K tokenre.</p><p></p><p>Nyissa meg:</p><p> ~/.codex/config.toml</p><p></p><p>Az eredeti cikkben szereplő 1M-es beállítás:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>módosítsa erre:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>A mentés után indítsa újra a Codexet, majd hozzon létre új munkamenetet.</p><p></p><p>Ha csak egyetlen munkamenetre szeretné ideiglenesen alkalmazni a beállítást, használja a következő parancsot:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Emellett javasoljuk:</p><p> - időben kapcsolja be az automatikus tömörítést;</p><p> - ossza fel a hosszú feladatokat több munkamenetre;</p><p> - csökkentse az egyszerre visszaadott eszközkimenetek mennyiségét;</p><p> - rendszeresen foglalja össze és tisztítsa meg a korábbi párbeszédrészeket.</p><p></p><p>Ha valóban szüksége van 1M tokenes kontextusablakra, továbbra is használhatja az eredeti konfigurációt, de a 272K feletti rész az OpenAI magasabb árszintje szerint kerül elszámolásra.</p><p></p><p>Az eredeti konfigurációs útmutató itt található: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Az 1 millió tokenes kontextusablak engedélyezése a Codexben GPT-5.6 Solhoz </a></p><p></p><p>Köszönjük megértését és támogatását.</p>
-
<p>OpenAI의 최신 과금 규정에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 계단식 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 계단식 요금이 적용될 수 있습니다. 이 규정은 OpenAI 공식 가격 정책에 따른 것으로, AI-ROUTER가 임시로 추가 요금을 부과하거나 비정상적으로 과금하는 것이 아닙니다.</p><p></p><p>GPT-5.6 Sol 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이내 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청에 장문 컨텍스트 계단식 과금이 적용되었음을 의미합니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 계단에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 두 배가 되었다는 뜻은 아닙니다. 출력에는 다른 계단식 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 계단식 과금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정을 다음과 같이 적용했다면:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 생성합니다.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적시에 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 정기적으로 대화 내용을 요약하고 오래된 내용을 정리합니다.</p><p></p><p>실제로 1M Token 컨텍스트 창이 필요하다면 기존 설정을 계속 사용할 수 있습니다. 단, 272K를 초과하는 부분에는 OpenAI의 높은 계단식 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음 문서를 참고하세요: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 성원에 감사드립니다.</p>
-
<p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegspriser för förfrågningar med extra lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, cacheläsning och utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och innebär inte ett tillfälligt pristillägg eller en felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel på standardpriset för GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cacheläsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har utlösts av trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata och cacheläsning har gått över till en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan ha en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderar vi att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara ändringarna, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att ändringen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Vi rekommenderar också att du:</p><p> - aktiverar automatisk komprimering i god tid;</p><p> - delar upp mycket långa uppgifter i flera sessioner;</p><p> - minskar mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfattar och rensar bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Se den ursprungliga konfigurationsbeskrivningen här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens i Codex för GPT-5.6 Sol </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
-
<p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit extrem langen Kontexten eine gestaffelte Preisstruktur.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe abgerechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag noch eine fehlerhafte Abrechnung durch AI-ROUTER dar.</p><p></p><p>Am Beispiel der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgänge $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und anderer Abrechnungseinstellungen berechnet.</p><p></p><p>Das x2-Kennzeichen in den Nutzungsdaten bedeutet, dass diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst hat. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass sich alle Kosten der gesamten Anfrage einfach verdoppeln; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn kein Kontextfenster mit 1M Tokens benötigt wird, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprüngliche Konfiguration für 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zu:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - besonders lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge der auf einmal zurückgegebenen Tool-Ausgaben zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn tatsächlich ein Kontextfenster mit 1M Tokens benötigt wird, kann die ursprüngliche Konfiguration weiterhin verwendet werden. Nach Überschreiten von 272K werden jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Eine Beschreibung der ursprünglichen Konfiguration finden Sie unter: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie in Codex ein Kontextfenster mit 1 Million Tokens für GPT-5.6 Sol </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
-
<p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כגון GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת תמחור גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, לפי המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצה הספציפית, למכפיל החשבון ולהגדרות תמחור נוספות.</p><p></p><p>כאשר מופיע הסימון x2 ברשומות השימוש, פירוש הדבר הוא שהבקשה הפעילה תמחור מדורג עבור הקשר ארוך. הסימון מציין בעיקר שהקלט או קריאת המטמון עברו למדרגת תמחור גבוהה יותר, ואינו אומר שכל עלויות הבקשה הוכפלו בפשטות; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להחזיר את מגבלת ההקשר של Codex ל-272K או פחות.</p><p></p><p>פתחו את:</p><p> ~/.codex/config.toml</p><p></p><p>שנו את הגדרות ה-1M מהמאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>להגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>לאחר השמירה, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל זאת באופן זמני על שיחה יחידה, ניתן להשתמש ב:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> בנוסף, מומלץ:</p><p> - להפעיל בזמן את הדחיסה האוטומטית;</p><p> - לפצל משימות ארוכות במיוחד למספר שיחות;</p><p> - להפחית את כמות פלט הכלים המוחזרת בבת אחת;</p><p> - לסכם ולנקות מעת לעת תוכן ישן יותר בשיחה.</p><p></p><p>אם אכן דרוש לכם חלון הקשר של 1M טוקנים, תוכלו להמשיך להשתמש בהגדרות המקוריות, אך לאחר חריגה מ-272K תחויבו לפי מדרגות התמחור הגבוהות של OpenAI.</p><p></p><p>להסבר על ההגדרות המקוריות, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים ב-Codex עבור GPT-5.6 Sol </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
-
<p>Volgens de nieuwste factureringsregels van OpenAI hanteren modellen zoals GPT-5.6 Sol getrapte prijzen voor verzoeken met een extra lange context.</p><p>Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, het lezen van de cache en uitvoer volgens een hogere prijsstaffel worden berekend. Deze regel is afkomstig van de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of onjuiste afschrijving door AI-ROUTER.</p><p></p><p>Als voorbeeld de standaardprijzen voor GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Binnen 272K Meer dan 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Invoer $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache lezen $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Uitvoer $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, de accountvermenigvuldigingsfactor en andere factureringsinstellingen.</p><p></p><p>Wanneer er in de gebruiksgegevens een markering x2 verschijnt, betekent dit dat dit verzoek de getrapte prijsstelling voor een lange context heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en het lezen van de cache in een hogere prijsstaffel vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere staffelfactor gelden.</p><p></p><p><strong> ## Getrapte prijsstelling voorkomen</strong></p><p>Als u geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te brengen tot maximaal 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Vervang de oorspronkelijke configuratie voor 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>door:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.</p><p></p><p>Als u dit tijdelijk alleen voor één sessie wilt instellen, kunt u het volgende gebruiken:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Daarnaast wordt aanbevolen om:</p><p> - automatische compressie tijdig in te schakelen;</p><p> - extra lange taken over meerdere sessies te verdelen;</p><p> - de hoeveelheid tooluitvoer die in één keer wordt teruggestuurd te beperken;</p><p> - oudere gespreksinhoud regelmatig samen te vatten en op te schonen.</p><p></p><p>Als u daadwerkelijk een contextvenster van 1M tokens nodig hebt, kunt u de oorspronkelijke configuratie blijven gebruiken. Na 272K worden de tokens echter volgens de hogere prijsstaffel van OpenAI in rekening gebracht.</p><p></p><p>Raadpleeg voor de oorspronkelijke configuratie-instructies: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Zo schakelt u een contextvenster van 1 miljoen tokens in Codex in voor GPT-5.6 Sol </a></p><p></p><p>Bedankt voor uw begrip en steun.</p>
-
<p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contexto ultralargo.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de un nivel superior. Esta regla proviene de los precios oficiales de OpenAI; no se trata de un recargo temporal ni de un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final se calculará según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la facturación escalonada por contexto largo. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior; no significa que todos los costes de la solicitud se dupliquen de forma sencilla. La salida puede utilizar un multiplicador de nivel diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>Y cambia la configuración de 1M indicada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes usar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens en Codex para GPT-5.6 Sol </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
-
<p>Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte très long.</p><p>Lorsque le contexte d’une requête unique dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI et ne correspond ni à une majoration temporaire d’AI-ROUTER ni à une facturation anormale.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation indique que cette requête a déclenché la tarification progressive applicable aux contextes longs. Ce marqueur signifie principalement que l’entrée et la lecture du cache sont passées à un niveau tarifaire supérieur. Il ne signifie pas que tous les frais de la requête sont simplement multipliés par deux ; la sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong> ## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration à 1M tokens présentée dans l’article d’origine :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Après l’enregistrement, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - répartir les tâches très longues sur plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine. Toutefois, la partie dépassant 272K sera facturée selon les tarifs élevés d’OpenAI correspondant aux niveaux supérieurs.</p><p></p><p>Pour consulter les instructions de configuration d’origine, voir : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
-
<p>I henhold til OpenAIs nyeste prisregler bruker modeller som GPT-5.6 Sol trinnvis prising for forespørsler med svært lange kontekster.</p><p>Når konteksten i én enkelt forespørsel overstiger 272K tokens, kan inndata, lesing fra hurtigbuffer og utdata beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle prising og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisen for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Inndata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lesing fra $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> hurtigbuffer</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt ut fra den aktuelle gruppen, kontomultiplikatoren og andre prisinnstillinger.</p><p></p><p>Hvis et x2-merke vises i bruksloggen, betyr det at forespørselen utløste trinnvis prising for lange kontekster. Merket betyr hovedsakelig at inndata og lesing fra hurtigbuffer gikk inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen ganske enkelt er doblet; utdata kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-grensen for kontekstvinduet tilbake til 272K eller mindre.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den opprinnelige 1M-konfigurasjonen fra artikkelen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre filen, start Codex på nytt og opprett en ny økt.</p><p></p><p>Hvis du bare vil at innstillingen midlertidig skal gjelde for én enkelt økt, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele svært lange oppgaver opp i flere økter;</p><p> - redusere mengden verktøyutdata som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen. Når konteksten overstiger 272K, vil den imidlertid bli fakturert etter OpenAIs høyere prisnivå.</p><p></p><p>Se den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens i Codex for GPT-5.6 Sol </a></p><p></p><p>Takk for forståelsen og støtten.</p>
-
<p>وفقًا لأحدث قواعد الفوترة لدى OpenAI، تستخدم نماذج مثل GPT-5.6 Sol أسعارًا متدرجة للطلبات ذات السياق فائق الطول.</p><p>عندما يتجاوز سياق الطلب الواحد 272 ألف رمز مميز، قد تُحتسب تكلفة الإدخال وقراءة ذاكرة التخزين المؤقت والإخراج وفق شريحة سعرية أعلى. تستند هذه القاعدة إلى الأسعار الرسمية لدى OpenAI، وليست زيادة مؤقتة في أسعار AI-ROUTER أو خصمًا غير اعتيادي.</p><p></p><p>على سبيل المثال، وفق الأسعار القياسية لـ GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> البند حتى 272 ألفًا أكثر من 272 ألفًا</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإدخال $5 / مليون رمز $10 / مليون رمز</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> قراءة الذاكرة المؤقتة $0.50 / مليون رمز $1 / مليون رمز</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإخراج $30 / مليون رمز $45 / مليون رمز</code></pre><p></p><p>تظل التكلفة النهائية خاضعة للحساب وفق المجموعة المحددة، ومعامل الحساب، وإعدادات الفوترة الأخرى.</p><p></p><p>تشير علامة x2 التي تظهر في سجل الاستخدام إلى أن الطلب فعّل التسعير المتدرج للسياق الطويل. وتدل هذه العلامة أساسًا على أن الإدخال أو قراءة الذاكرة المؤقتة دخلا في شريحة سعرية أعلى، ولا تعني أن جميع تكاليف الطلب تضاعفت ببساطة؛ فقد يخضع الإخراج لمعامل تدرج مختلف.</p><p></p><p><strong>## كيفية تجنب تفعيل التسعير المتدرج</strong></p><p>إذا لم تكن بحاجة إلى نافذة سياق بسعة مليون رمز مميز، فنوصي بضبط الحد الأقصى لسياق Codex مجددًا إلى 272 ألف رمز مميز أو أقل.</p><p></p><p>افتح الملف:</p><p> ~/.codex/config.toml</p><p></p><p>وعدّل إعداد المليون رمز المميز الوارد في المقال السابق:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>إلى:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>بعد الحفظ، أعد تشغيل Codex وأنشئ جلسة جديدة.</p><p></p><p>إذا كنت تريد تطبيق الإعداد مؤقتًا على جلسة واحدة فقط، يمكنك استخدام:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> ونوصي أيضًا بما يلي:</p><p> - تفعيل الضغط التلقائي في الوقت المناسب؛</p><p> - تقسيم المهام فائقة الطول إلى عدة جلسات؛</p><p> - تقليل كمية مخرجات الأدوات التي تُعاد دفعة واحدة؛</p><p> - تلخيص محتوى المحادثات الأقدم وتنظيفه بانتظام.</p><p></p><p>إذا كنت تحتاج فعلًا إلى نافذة سياق بسعة مليون رمز مميز، يمكنك متابعة استخدام الإعداد الأصلي، ولكن ستُحتسب الكمية التي تتجاوز 272 ألف رمز مميز وفق الأسعار الأعلى لدى OpenAI ضمن الشرائح المتقدمة.</p><p></p><p>للاطلاع على شرح الإعداد الأصلي، راجع: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">كيفية تفعيل نافذة سياق بسعة مليون رمز مميز لـ GPT-5.6 Sol في Codex </a></p><p></p><p>شكرًا لتفهمكم ودعمكم.</p>
-
<p>OpenAIの最新の料金ルールに基づき、GPT-5.6 Solなどのモデルでは、超長文コンテキストのリクエストに段階料金が適用されます。</p><p>1回のリクエストのコンテキストが272Kトークンを超えると、入力、キャッシュ読み取り、出力に対して、より高い段階の料金が適用される場合があります。このルールはOpenAI公式の料金設定に基づくものであり、AI-ROUTERによる一時的な値上げや異常な請求ではありません。</p><p></p><p>GPT-5.6 Solの標準料金を例にすると、次のとおりです。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 項目 272K以内 272K超過</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 入力 $5 / 1Mトークン $10 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> キャッシュ読み取り $0.50 / 1Mトークン $1 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 出力 $30 / 1Mトークン $45 / 1Mトークン</code></pre><p></p><p>最終的な料金は、具体的なグループ、アカウント倍率、その他の料金設定に基づいて計算されます。</p><p></p><p>利用履歴に表示されるx2フラグは、そのリクエストで長文コンテキストの段階課金が適用されたことを示します。このフラグは主に入力とキャッシュ読み取りがより高い段階に入ったことを示すものであり、リクエスト全体のすべての料金が単純に2倍になることを意味するわけではありません。出力には異なる段階倍率が適用される場合があります。</p><p></p><p><strong> ## 段階課金の適用を避ける方法</strong></p><p>1Mトークンのコンテキストウィンドウが必要ない場合は、Codexのコンテキスト上限を272K以内に戻すことをおすすめします。</p><p></p><p>次のファイルを開きます。</p><p> ~/.codex/config.toml</p><p></p><p>記事で以前使用していた1M設定:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>次のように変更します。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存後、Codexを再起動して新しいセッションを作成します。</p><p></p><p>単一のセッションに一時的に適用したい場合は、次のコマンドを使用できます。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> あわせて、次の対応もおすすめします。</p><p> - 自動圧縮を早めに有効にする。</p><p> - 長時間にわたるタスクを複数のセッションに分割する。</p><p> - 一度に大量のツール出力を返さないようにする。</p><p> - 定期的に要約し、古い会話内容を整理する。</p><p></p><p>1Mトークンのコンテキストウィンドウが本当に必要な場合は、以前の設定を引き続き使用できます。ただし、272Kを超えた分については、OpenAIの高い段階料金に基づいて請求されます。</p><p></p><p>元の設定については、次の記事を参照してください:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">CodexでGPT-5.6 Solの100万トークンコンテキストウィンドウを有効にする方法 </a></p><p></p><p>ご理解とご支援に感謝いたします。</p>
-
<p>According to OpenAI's latest pricing rules, models such as GPT-5.6 Sol use tiered pricing for ultra-long-context requests.</p><p>When the context of a single request exceeds 272K tokens, input, cached reads, and output may be charged according to higher-tier prices. This rule comes from OpenAI's official pricing and is not a temporary markup or abnormal charge from AI-ROUTER.</p><p></p><p>Using GPT-5.6 Sol's standard pricing as an example:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Within 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cached read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>The final cost is still calculated based on the specific group, account multiplier, and other billing settings.</p><p></p><p>An x2 flag in usage records indicates that the request triggered tiered pricing for long contexts. This flag primarily indicates that input and cached reads entered a higher tier; it does not mean that all charges for the request are simply doubled. Output may use a different tier multiplier.</p><p></p><p><strong> ## How to Avoid Triggering Tiered Pricing</strong></p><p>If you do not need a 1M-token context window, we recommend adjusting Codex's context limit back to 272K or below.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Change the 1M configuration from the original article:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>to:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Save the changes, restart Codex, and start a new session.</p><p></p><p>If you only want the change to apply temporarily to a single session, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> We also recommend:</p><p> - Enable automatic compaction promptly;</p><p> - Split ultra-long tasks across multiple sessions;</p><p> - Reduce the amount of tool output returned at once;</p><p> - Regularly summarize and clean up older conversation content.</p><p></p><p>If you genuinely need a 1M-token context window, you can continue using the original configuration, but usage beyond 272K will be charged according to OpenAI's higher-tier pricing.</p><p></p><p>For the original configuration instructions, see: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">How to Enable a 1M-Token Context Window in Codex for GPT-5.6 Sol </a></p><p></p><p>Thank you for your understanding and support.</p>
-
<p>根据 OpenAI 最新计费规则,GPT-5.6 Sol 等模型对超长上下文请求采用阶梯价格。</p><p>当单次请求的上下文超过 272K tokens 时,输入、缓存读取以及输出可能按照更高阶梯价格计算。该规则来自 OpenAI 官方定价,并非 AI-ROUTER 临时加价或异常扣费。</p><p></p><p>以 GPT-5.6 Sol 标准价格为例:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 项目 272K 以内 超过 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输入 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 缓存读取 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输出 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>最终费用仍会根据具体分组、账号倍率及其他计费配置计算。</p><p></p><p>使用记录中出现 x2 标志,表示本次请求触发了长上下文阶梯计费。该标志主要表示输入/缓存读取进入更高阶梯,并不代表整条请求的所有费用简单翻倍;输出可能采用不同的阶梯倍率。</p><p></p><p><strong> ## 如何避免触发阶梯计费</strong></p><p>如果不需要 1M Token 上下文窗口,建议将 Codex 的上下文上限调整回 272K 以内。</p><p></p><p>打开:</p><p> ~/.codex/config.toml</p><p></p><p>将原先文章中的 1M 配置:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>调整为:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存后重启 Codex,并新建会话。</p><p></p><p>如果只希望临时对单个会话生效,可以使用:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 同时建议:</p><p> - 及时开启自动压缩;</p><p> - 将超长任务拆分为多个会话;</p><p> - 减少一次性返回的大量工具输出;</p><p> - 定期总结并清理较早的对话内容。</p><p></p><p>如果确实需要 1M Token 上下文窗口,可以继续使用原配置,但超出 272K 后将按照 OpenAI 的高阶梯价格计费。</p><p></p><p>原始配置说明请参考:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">如何在 Codex 中为 GPT-5.6 Sol 启用 100 万 Token 上下文窗口 </a></p><p></p><p>感谢您的理解与支持。</p>