<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Sobre a cobrança progressiva para contextos ultralongos do GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços progressivos para solicitações com contexto ultralongo.&lt;/p&gt;&lt;p&gt;Quando o contexto de uma única solicitação excede 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço mais alta. Essa regra vem da precificação oficial da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Tomando como exemplo o preço padrão do GPT-5.6 Sol:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Item                Até 272K             Acima de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrada        $5 / 1M tokens       $10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Leitura do    $0.50 / 1M tokens      $1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   cache&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Saída          $30 / 1M tokens       $45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;A marca x2 exibida no histórico de uso indica que a solicitação acionou a cobrança progressiva para contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa de preço mais alta; ela não significa que todos os custos da solicitação tenham simplesmente dobrado. A saída pode utilizar um multiplicador de faixa diferente.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Como evitar acionar a cobrança progressiva&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Abra:&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Altere a configuração de 1M apresentada no artigo original:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Para:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Depois de salvar, reinicie o Codex e crie uma nova sessão.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se quiser aplicar a configuração temporariamente a uma única sessão, use:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Também recomendamos:&lt;/p&gt;&lt;p&gt;  - ativar a compactação automática em tempo hábil;&lt;/p&gt;&lt;p&gt;  - dividir tarefas muito longas em várias sessões;&lt;/p&gt;&lt;p&gt;  - reduzir a quantidade de saídas de ferramentas retornadas de uma só vez;&lt;/p&gt;&lt;p&gt;  - resumir e limpar periodicamente o conteúdo mais antigo da conversa.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas os tokens acima de 272K serão cobrados de acordo com os preços mais altos da OpenAI.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Para consultar as instruções de configuração originais, veja: &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Agradecemos sua compreensão e seu apoio.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/790/sobre-a-cobrança-progressiva-para-contextos-ultralongos-do-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:28:36 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/790.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:21:52 GMT</pubDate><ttl>60</ttl></channel></rss>