<p>Ifølge OpenAIs seneste prisregler anvender modeller som GPT-5.6 Sol trindelt prissætning for anmodninger med ekstremt lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsninger og output blive beregnet efter højere prisniveauer. Denne regel stammer fra OpenAIs officielle priser og er ikke en midlertidig prisstigning eller en unormal opkrævning fra AI-ROUTER.</p><p></p><p>Eksempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes fortsat ud fra den konkrete gruppe, kontomultiplikatorer og andre faktureringsindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at anmodningen har udløst trindelt prissætning for lange kontekster. Markeringen betyder primært, at input og cachelæsning er gået over på et højere prisniveau. Det betyder ikke, at alle omkostninger for hele anmodningen ganske enkelt er fordoblet; output kan være underlagt en anden trinfaktor.</p><p></p><p><strong> ## Sådan undgår du trindelt prissætning</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Skift den tidligere 1M-konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem filen, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele meget lange opgaver op i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive faktureret efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Tak for din forståelse og støtte.</p>