<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Explication de la tarification par paliers pour les contextes très longs de GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification par paliers aux requêtes utilisant un contexte très long.&lt;/p&gt;&lt;p&gt;Lorsque le contexte d’une requête dépasse 272K tokens, l’entrée, la lecture du cache et la sortie peuvent être facturées selon des paliers tarifaires supérieurs. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit ni d’une majoration temporaire d’AI-ROUTER ni d’une facturation anormale.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Exemple avec les tarifs standard de GPT-5.6 Sol :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Élément             Jusqu’à 272K       Plus de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrée          5 $ / 1M tokens    10 $ / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Lecture du cache  0,50 $ / 1M tokens   1 $ / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Sortie          30 $ / 1M tokens    45 $ / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Le montant final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification par paliers pour contexte long. Ce marqueur indique principalement que l’entrée et/ou la lecture du cache sont passées au palier supérieur ; il ne signifie pas que tous les frais de la requête ont simplement été doublés. La sortie peut être soumise à un multiplicateur de palier différent.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Comment éviter de déclencher la tarification par paliers&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Ouvrez :&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Remplacez la configuration à 1M présentée dans l’article précédent :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;par :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Après l’enregistrement, redémarrez Codex et créez une nouvelle session.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Il est également recommandé de :&lt;/p&gt;&lt;p&gt;  - activer rapidement la compression automatique ;&lt;/p&gt;&lt;p&gt;  - répartir les tâches très longues sur plusieurs sessions ;&lt;/p&gt;&lt;p&gt;  - réduire la quantité de sorties d’outils renvoyées en une seule fois ;&lt;/p&gt;&lt;p&gt;  - résumer et nettoyer régulièrement le contenu plus ancien des conversations.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais la partie dépassant 272K sera facturée selon les tarifs des paliers supérieurs d’OpenAI.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Pour consulter les instructions de configuration d’origine, reportez-vous à : &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Merci de votre compréhension et de votre soutien.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/773/explication-de-la-tarification-par-paliers-pour-les-contextes-très-longs-de-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 16:10:27 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/773.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:21:47 GMT</pubDate><ttl>60</ttl></channel></rss>