Skip to content
  • 0 Votes
    1 Posts
    56 Views
    A
    <p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserad prissättning för förfrågningar med extremt lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache samt utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och är inte en tillfällig extraavgift eller felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel, med GPT-5.6 Sol:s standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cach läsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan utlöste trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata eller läsning från cache har gått in i en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan beräknas med en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderas att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill använda inställningen tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det rekommenderas också att:</p><p> - aktivera automatisk komprimering i tid;</p><p> - dela upp långa uppgifter i flera sessioner;</p><p> - minska mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfatta och rensa bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Se den ursprungliga konfigurationsguiden här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens för GPT-5.6 Sol i Codex </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
  • 0 Votes
    1 Posts
    39 Views
    A
    <p>Ifølge OpenAIs seneste gebyrregler anvender modeller som GPT-5.6 Sol trinvise priser for anmodninger med ekstra lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsning og output blive beregnet efter et højere prisniveau. Reglen stammer fra OpenAIs officielle prissætning og er ikke en midlertidig prisstigning eller en fejlagtig opkrævning fra AI-ROUTER.</p><p></p><p>Her er GPT-5.6 Sols standardpriser som eksempel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes stadig ud fra den konkrete gruppe, kontoens multiplikator og andre gebyrindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at denne anmodning har udløst trinvist gebyr for lang kontekst. Markeringen angiver primært, at input/cachelæsning er gået over på et højere prisniveau, og betyder ikke, at alle omkostninger for hele anmodningen blot er fordoblet. Output kan være underlagt en anden trinvist beregnet multiplikator.</p><p></p><p><strong> ## Sådan undgår du trinvist gebyr</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Den oprindelige 1M-konfiguration fra den tidligere artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ændres til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem ændringerne, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - opdele lange opgaver i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive opkrævet efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens i Codex til GPT-5.6 Sol </a></p><p></p><p>Tak for din forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    55 Views
    A
    <p>Enligt OpenAIs senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserad prissättning för förfrågningar med extremt lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt ett högre pristrappsteg. Regeln kommer från OpenAIs officiella prissättning och är inte en tillfällig prisökning eller felaktig debitering från AI-ROUTER.</p><p></p><p>Exempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cach läses $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har aktiverat trappstegsbaserad prissättning för lång kontext. Markeringen betyder främst att indata eller läsning från cache har gått in i ett högre pristrappsteg. Det innebär inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan använda en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderar vi att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara ändringarna, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att inställningen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Vi rekommenderar även att du:</p><p> - aktiverar automatisk komprimering i tid;</p><p> - delar upp mycket långa uppgifter i flera sessioner;</p><p> - minskar mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfattar och rensar äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAIs högre trappstegspriser.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens för GPT-5.6 Sol i Codex </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
  • 0 Votes
    1 Posts
    48 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker modeller som GPT-5.6 Sol trinnvis prising for forespørsler med svært lang kontekst.</p><p>Når konteksten i en enkelt forespørsel overstiger 272K tokens, kan input, lesing fra hurtigbufferen og output beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle priser og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisen for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lesing fra $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> hurtigbuffer</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt basert på den konkrete gruppen, kontoens multiplikator og andre prisinnstillinger.</p><p></p><p>Hvis det vises en x2-markering i bruksoversikten, betyr det at forespørselen utløste trinnvis prising for lang kontekst. Markeringen betyr hovedsakelig at input eller lesing fra hurtigbufferen har gått inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen ganske enkelt er doblet. Output kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-grensen for kontekst tilbake til 272K eller lavere.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den tidligere 1M-konfigurasjonen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre filen, start Codex på nytt og opprett en ny samtale.</p><p></p><p>Hvis du bare vil at innstillingen midlertidig skal gjelde for én enkelt samtale, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele svært lange oppgaver opp i flere samtaler;</p><p> - redusere mengden verktøyoutput som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen, men tokens over 272K vil bli belastet etter OpenAIs høyere prisnivå.</p><p></p><p>Se den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Takk for forståelsen og støtten.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>Ifølge OpenAIs seneste prisregler anvender modeller som GPT-5.6 Sol trindelt prissætning for anmodninger med ekstremt lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsninger og output blive beregnet efter højere prisniveauer. Denne regel stammer fra OpenAIs officielle priser og er ikke en midlertidig prisstigning eller en unormal opkrævning fra AI-ROUTER.</p><p></p><p>Eksempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes fortsat ud fra den konkrete gruppe, kontomultiplikatorer og andre faktureringsindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at anmodningen har udløst trindelt prissætning for lange kontekster. Markeringen betyder primært, at input og cachelæsning er gået over på et højere prisniveau. Det betyder ikke, at alle omkostninger for hele anmodningen ganske enkelt er fordoblet; output kan være underlagt en anden trinfaktor.</p><p></p><p><strong> ## Sådan undgår du trindelt prissætning</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Skift den tidligere 1M-konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem filen, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele meget lange opgaver op i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive faktureret efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Tak for din forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserade priser för förfrågningar med extra långa kontexter.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och innebär inte ett tillfälligt påslag eller en felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel kan GPT-5.6 Sol:s standardpriser sammanfattas så här:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cacheläsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har utlösts av trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata och cacheläsning har gått över till en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan ha en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderas att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare konfigurationen för 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara filen, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att ändringen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det rekommenderas även att:</p><p> - aktivera automatisk komprimering i tid;</p><p> - dela upp långa uppgifter i flera sessioner;</p><p> - minska mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfatta och rensa bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens i Codex för GPT-5.6 Sol </a></p><p></p><p>Tack för er förståelse och ert stöd.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit überlangen Kontexten gestaffelte Preise.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe berechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag von AI-ROUTER noch eine fehlerhafte Abrechnung dar.</p><p></p><p>Beispiel anhand der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgang $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und weiterer Abrechnungseinstellungen berechnet.</p><p></p><p>Wenn in den Nutzungsdaten das Kennzeichen x2 erscheint, bedeutet dies, dass für diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst wurde. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass alle Kosten der gesamten Anfrage einfach verdoppelt werden; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn Sie kein Kontextfenster von 1M Tokens benötigen, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprünglich im Artikel beschriebene 1M-Konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - sehr lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge umfangreicher Tool-Ausgaben in einer einzelnen Antwort zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn Sie tatsächlich ein Kontextfenster von 1M Tokens benötigen, können Sie die ursprüngliche Konfiguration weiterhin verwenden. Für den Anteil über 272K werden dann jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Die ursprüngliche Konfigurationsanleitung finden Sie hier: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie ein Kontextfenster von 1 Million Tokens für GPT-5.6 Sol in Codex </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker GPT-5.6 Sol og tilsvarende modeller trinnvis prising for forespørsler med ekstra lang kontekst.</p><p>Når konteksten i en enkelt forespørsel overstiger 272K tokens, kan input, lesing fra hurtigbuffer og output beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle prissetting og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisene for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Hurtigbuffer- $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> lesing</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt ut fra den konkrete gruppen, kontomultiplikatoren og andre prisinnstillinger.</p><p></p><p>En x2-markering i bruksoversikten betyr at forespørselen utløste trinnvis prising for lang kontekst. Markeringen betyr hovedsakelig at input og lesing fra hurtigbuffer har gått inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen enkelt dobles; output kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-kontekstgrensen tilbake til 272K eller mindre.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den tidligere 1M-konfigurasjonen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre endringene, start Codex på nytt og opprett en ny økt.</p><p></p><p>Hvis du bare vil bruke innstillingen midlertidig for én enkelt økt, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele opp lange oppgaver i flere økter;</p><p> - redusere mengden verktøyoutput som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen. Når konteksten overstiger 272K, beregnes kostnadene imidlertid etter OpenAIs høyere prisnivå.</p><p></p><p>Du finner den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens i Codex for GPT-5.6 Sol </a></p><p></p><p>Takk for forståelsen og støtten.</p>
  • 0 Votes
    1 Posts
    79 Views
    A
    <p>Ifølge OpenAIs seneste prisregler anvender modeller som GPT-5.6 Sol trinvise priser for anmodninger med ekstra lang kontekst.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelagrede læsninger og output blive beregnet efter højere trinpriser. Reglen stammer fra OpenAIs officielle priser og er ikke et midlertidigt pristillæg eller en fejlagtig opkrævning fra AI-ROUTER.</p><p></p><p>Som eksempel kan GPT-5.6 Sols standardpriser se sådan ud:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes stadig ud fra den konkrete gruppe, kontomultiplikatorer og andre gebyrindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at anmodningen har udløst trinvist gebyr for lang kontekst. Markeringen angiver primært, at input eller cachelæsning er gået ind i et højere trin. Det betyder ikke, at alle omkostninger for hele anmodningen ganske enkelt er fordoblet; output kan være underlagt en anden trinfaktor.</p><p></p><p><strong> ## Sådan undgår du trinvist gebyr</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Skift den tidligere konfiguration på 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem ændringerne, genstart Codex, og opret en ny session.</p><p></p><p>Hvis indstillingen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales samtidig at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - opdele meget lange opgaver i flere sessioner;</p><p> - begrænse store mængder output fra værktøjer, der returneres på én gang;</p><p> - regelmæssigt opsummere og rydde op i ældre samtaleindhold.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsat bruge den oprindelige konfiguration, men tokens over 272K vil blive opkrævet efter OpenAIs højere trinpriser.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Tak for jeres forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    76 Views
    A
    <p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegspriser för förfrågningar med extra lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, cacheläsning och utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och innebär inte ett tillfälligt pristillägg eller en felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel på standardpriset för GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cacheläsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har utlösts av trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata och cacheläsning har gått över till en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan ha en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderar vi att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara ändringarna, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att ändringen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Vi rekommenderar också att du:</p><p> - aktiverar automatisk komprimering i god tid;</p><p> - delar upp mycket långa uppgifter i flera sessioner;</p><p> - minskar mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfattar och rensar bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Se den ursprungliga konfigurationsbeskrivningen här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens i Codex för GPT-5.6 Sol </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
  • 0 Votes
    1 Posts
    96 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit extrem langen Kontexten eine gestaffelte Preisstruktur.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe abgerechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag noch eine fehlerhafte Abrechnung durch AI-ROUTER dar.</p><p></p><p>Am Beispiel der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgänge $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und anderer Abrechnungseinstellungen berechnet.</p><p></p><p>Das x2-Kennzeichen in den Nutzungsdaten bedeutet, dass diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst hat. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass sich alle Kosten der gesamten Anfrage einfach verdoppeln; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn kein Kontextfenster mit 1M Tokens benötigt wird, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprüngliche Konfiguration für 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zu:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - besonders lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge der auf einmal zurückgegebenen Tool-Ausgaben zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn tatsächlich ein Kontextfenster mit 1M Tokens benötigt wird, kann die ursprüngliche Konfiguration weiterhin verwendet werden. Nach Überschreiten von 272K werden jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Eine Beschreibung der ursprünglichen Konfiguration finden Sie unter: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie in Codex ein Kontextfenster mit 1 Million Tokens für GPT-5.6 Sol </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
  • 0 Votes
    1 Posts
    93 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker modeller som GPT-5.6 Sol trinnvis prising for forespørsler med svært lange kontekster.</p><p>Når konteksten i én enkelt forespørsel overstiger 272K tokens, kan inndata, lesing fra hurtigbuffer og utdata beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle prising og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisen for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Inndata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lesing fra $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> hurtigbuffer</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt ut fra den aktuelle gruppen, kontomultiplikatoren og andre prisinnstillinger.</p><p></p><p>Hvis et x2-merke vises i bruksloggen, betyr det at forespørselen utløste trinnvis prising for lange kontekster. Merket betyr hovedsakelig at inndata og lesing fra hurtigbuffer gikk inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen ganske enkelt er doblet; utdata kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-grensen for kontekstvinduet tilbake til 272K eller mindre.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den opprinnelige 1M-konfigurasjonen fra artikkelen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre filen, start Codex på nytt og opprett en ny økt.</p><p></p><p>Hvis du bare vil at innstillingen midlertidig skal gjelde for én enkelt økt, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele svært lange oppgaver opp i flere økter;</p><p> - redusere mengden verktøyutdata som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen. Når konteksten overstiger 272K, vil den imidlertid bli fakturert etter OpenAIs høyere prisnivå.</p><p></p><p>Se den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens i Codex for GPT-5.6 Sol </a></p><p></p><p>Takk for forståelsen og støtten.</p>