<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Explication de la tarification progressive du contexte ultra-long pour GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte très long.&lt;/p&gt;&lt;p&gt;Lorsque le contexte d’une requête unique dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI et ne correspond ni à une majoration temporaire d’AI-ROUTER ni à une facturation anormale.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Élément             Jusqu’à 272K       Au-delà de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrée          $5 / 1M tokens    $10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Lecture cache   $0.50 / 1M tokens     $1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Sortie          $30 / 1M tokens    $45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;La présence du marqueur x2 dans l’historique d’utilisation indique que cette requête a déclenché la tarification progressive applicable aux contextes longs. Ce marqueur signifie principalement que l’entrée et la lecture du cache sont passées à un niveau tarifaire supérieur. Il ne signifie pas que tous les frais de la requête sont simplement multipliés par deux ; la sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Comment éviter de déclencher la tarification progressive&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Ouvrez :&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Remplacez la configuration à 1M tokens présentée dans l’article d’origine :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;par :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Après l’enregistrement, redémarrez Codex et créez une nouvelle session.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Il est également recommandé de :&lt;/p&gt;&lt;p&gt;  - activer rapidement la compression automatique ;&lt;/p&gt;&lt;p&gt;  - répartir les tâches très longues sur plusieurs sessions ;&lt;/p&gt;&lt;p&gt;  - réduire la quantité de sorties d’outils renvoyées en une seule fois ;&lt;/p&gt;&lt;p&gt;  - résumer et nettoyer régulièrement le contenu plus ancien des conversations.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine. Toutefois, la partie dépassant 272K sera facturée selon les tarifs élevés d’OpenAI correspondant aux niveaux supérieurs.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Pour consulter les instructions de configuration d’origine, voir : &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Merci de votre compréhension et de votre soutien.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/678/explication-de-la-tarification-progressive-du-contexte-ultra-long-pour-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 16:59:19 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/678.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:14:56 GMT</pubDate><ttl>60</ttl></channel></rss>