<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Toelichting op getrapte prijsstelling voor extra lange contexten van GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;Volgens de nieuwste prijsregels van OpenAI geldt voor modellen zoals GPT-5.6 Sol getrapte prijsstelling voor verzoeken met extra lange contexten.&lt;/p&gt;&lt;p&gt;Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, lezen uit de cache en uitvoer volgens een hoger tariefniveau worden berekend. Deze regel is afkomstig uit de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of abnormale afschrijving van AI-ROUTER.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Bij wijze van voorbeeld, op basis van de standaardprijzen van GPT-5.6 Sol:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Onderdeel             Tot en met 272K       Meer dan 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Invoer             $5 / 1M tokens      $10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Lezen uit cache   $0.50 / 1M tokens     $1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Uitvoer           $30 / 1M tokens     $45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, de accountvermenigvuldigingsfactor en andere factureringsinstellingen.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;De markering x2 in de gebruiksgegevens betekent dat dit verzoek de getrapte prijsstelling voor lange contexten heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en lezen uit de cache in een hoger tariefniveau vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere tariefvermenigvuldigingsfactor gelden.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Zo voorkom je getrapte prijsstelling&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Als je geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te zetten naar maximaal 272K.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Open:&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Vervang de 1M-configuratie uit het oorspronkelijke artikel:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;door:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Als je dit alleen tijdelijk voor één sessie wilt instellen, kun je het volgende gebruiken:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Daarnaast wordt het volgende aanbevolen:&lt;/p&gt;&lt;p&gt;  - Schakel tijdig automatische compressie in;&lt;/p&gt;&lt;p&gt;  - Splits lange taken op in meerdere sessies;&lt;/p&gt;&lt;p&gt;  - Beperk de hoeveelheid tooluitvoer die in één keer wordt teruggestuurd;&lt;/p&gt;&lt;p&gt;  - Vat oudere gespreksinhoud regelmatig samen en ruim deze op.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Als je daadwerkelijk een contextvenster van 1M tokens nodig hebt, kun je de oorspronkelijke configuratie blijven gebruiken. Voor het gedeelte boven 272K worden dan echter de hogere tariefniveaus van OpenAI toegepast.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Raadpleeg voor de oorspronkelijke configuratie-instructies: &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Zo schakel je een contextvenster van 1 miljoen tokens in Codex in voor GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Bedankt voor je begrip en steun.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/728/toelichting-op-getrapte-prijsstelling-voor-extra-lange-contexten-van-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:28:52 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/728.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:17:21 GMT</pubDate><ttl>60</ttl></channel></rss>