<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Explicação sobre a cobrança escalonada de contexto ultralongo do GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços escalonados para solicitações com contexto ultralongo.&lt;/p&gt;&lt;p&gt;Quando o contexto de uma única solicitação ultrapassa 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço superior. Essa regra vem da tabela oficial de preços da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Usando o preço padrão do GPT-5.6 Sol como exemplo:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Item                Até 272K          Acima de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrada        $5 / 1M tokens    $10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Leitura do cache  $0.50 / 1M tokens     $1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Saída          $30 / 1M tokens    $45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Quando a marca x2 aparece no histórico de uso, isso indica que a solicitação acionou a cobrança escalonada de contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa superior; ela não significa que todos os custos da solicitação foram simplesmente duplicados. A saída pode usar um multiplicador de faixa diferente.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Como evitar acionar a cobrança escalonada&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Abra:&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Altere a configuração de 1M usada no artigo original:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Para:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Salve, reinicie o Codex e crie uma nova sessão.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se quiser aplicar a configuração temporariamente a uma única sessão, use:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Também recomendamos:&lt;/p&gt;&lt;p&gt;  - ativar a compactação automática no momento adequado;&lt;/p&gt;&lt;p&gt;  - dividir tarefas muito longas em várias sessões;&lt;/p&gt;&lt;p&gt;  - reduzir a quantidade de saída de ferramentas retornada de uma só vez;&lt;/p&gt;&lt;p&gt;  - resumir periodicamente e limpar o conteúdo mais antigo da conversa.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas o uso acima de 272K será cobrado de acordo com os preços das faixas superiores da OpenAI.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Para consultar as instruções da configuração original, veja: &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Agradecemos sua compreensão e seu apoio.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/743/explicação-sobre-a-cobrança-escalonada-de-contexto-ultralongo-do-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:28:55 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/743.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:17:26 GMT</pubDate><ttl>60</ttl></channel></rss>