<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Explicação sobre a cobrança escalonada de contexto ultralongo do GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol utilizam preços escalonados para solicitações com contexto ultralongo.&lt;/p&gt;&lt;p&gt;Quando o contexto de uma única solicitação ultrapassa 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com um escalão de preço mais alto. Essa regra vem da tabela oficial de preços da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Tomando como exemplo os preços padrão do GPT-5.6 Sol:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Item                Até 272K             Acima de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrada          US$ 5 / 1M tokens     US$ 10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Leitura do cache  US$ 0,50 / 1M tokens   US$ 1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Saída             US$ 30 / 1M tokens    US$ 45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Quando a marca x2 aparece no histórico de uso, isso significa que a solicitação acionou a cobrança escalonada de contexto longo. Essa marca indica principalmente que a entrada e a leitura do cache entraram em um escalão mais alto; ela não significa que todos os custos da solicitação foram simplesmente duplicados. A saída pode usar um multiplicador de escalão diferente.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt;## Como evitar acionar a cobrança escalonada&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para 272K ou menos.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Abra:&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Altere a configuração de 1M usada no artigo original:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Para:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Depois de salvar, reinicie o Codex e crie uma nova sessão.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se quiser aplicar a configuração temporariamente a uma única sessão, use:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; Também recomendamos:&lt;/p&gt;&lt;p&gt;  - ativar a compactação automática prontamente;&lt;/p&gt;&lt;p&gt;  - dividir tarefas muito longas em várias sessões;&lt;/p&gt;&lt;p&gt;  - reduzir a quantidade de saída de ferramentas retornada de uma só vez;&lt;/p&gt;&lt;p&gt;  - resumir e limpar regularmente o conteúdo mais antigo da conversa.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Se você realmente precisar de uma janela de contexto de 1M de tokens, poderá continuar usando a configuração original, mas o uso acima de 272K será cobrado de acordo com os preços de escalão superior da OpenAI.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Para consultar as instruções da configuração original, consulte: &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Agradecemos sua compreensão e apoio.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/696/explicação-sobre-a-cobrança-escalonada-de-contexto-ultralongo-do-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:28:28 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/696.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:15:01 GMT</pubDate><ttl>60</ttl></channel></rss>