Skip to content
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços progressivos para solicitações com contexto ultralongo.</p><p>Quando o contexto de uma única solicitação excede 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço mais alta. Essa regra vem da precificação oficial da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.</p><p></p><p>Tomando como exemplo o preço padrão do GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Até 272K Acima de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Leitura do $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> cache</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Saída $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.</p><p></p><p>A marca x2 exibida no histórico de uso indica que a solicitação acionou a cobrança progressiva para contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa de preço mais alta; ela não significa que todos os custos da solicitação tenham simplesmente dobrado. A saída pode utilizar um multiplicador de faixa diferente.</p><p></p><p><strong> ## Como evitar acionar a cobrança progressiva</strong></p><p>Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.</p><p></p><p>Abra:</p><p> ~/.codex/config.toml</p><p></p><p>Altere a configuração de 1M apresentada no artigo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Para:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Depois de salvar, reinicie o Codex e crie uma nova sessão.</p><p></p><p>Se quiser aplicar a configuração temporariamente a uma única sessão, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Também recomendamos:</p><p> - ativar a compactação automática em tempo hábil;</p><p> - dividir tarefas muito longas em várias sessões;</p><p> - reduzir a quantidade de saídas de ferramentas retornadas de uma só vez;</p><p> - resumir e limpar periodicamente o conteúdo mais antigo da conversa.</p><p></p><p>Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas os tokens acima de 272K serão cobrados de acordo com os preços mais altos da OpenAI.</p><p></p><p>Para consultar as instruções de configuração originais, veja: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol </a></p><p></p><p>Agradecemos sua compreensão e seu apoio.</p>
  • 0 Votes
    1 Posts
    50 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según un nivel de precios superior. Esta regla procede de los precios oficiales de OpenAI y no representa un aumento temporal de AI-ROUTER ni un cargo anómalo.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en los registros de uso indica que la solicitud activó la facturación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché han pasado a un nivel superior; no significa que todos los costes de la solicitud se hayan duplicado de forma sencilla. La salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Cámbiala por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Después de guardar, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión concreta, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar a tiempo la compactación automática;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios del nivel superior de OpenAI.</p><p></p><p>Para consultar las instrucciones de configuración originales, visita: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços escalonados para solicitações com contexto ultralongo.</p><p>Quando o contexto de uma única solicitação ultrapassa 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço superior. Essa regra vem da tabela oficial de preços da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.</p><p></p><p>Usando o preço padrão do GPT-5.6 Sol como exemplo:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Até 272K Acima de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Leitura do cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Saída $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.</p><p></p><p>Quando a marca x2 aparece no histórico de uso, isso indica que a solicitação acionou a cobrança escalonada de contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa superior; ela não significa que todos os custos da solicitação foram simplesmente duplicados. A saída pode usar um multiplicador de faixa diferente.</p><p></p><p><strong> ## Como evitar acionar a cobrança escalonada</strong></p><p>Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.</p><p></p><p>Abra:</p><p> ~/.codex/config.toml</p><p></p><p>Altere a configuração de 1M usada no artigo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Para:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Salve, reinicie o Codex e crie uma nova sessão.</p><p></p><p>Se quiser aplicar a configuração temporariamente a uma única sessão, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Também recomendamos:</p><p> - ativar a compactação automática no momento adequado;</p><p> - dividir tarefas muito longas em várias sessões;</p><p> - reduzir a quantidade de saída de ferramentas retornada de uma só vez;</p><p> - resumir periodicamente e limpar o conteúdo mais antigo da conversa.</p><p></p><p>Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas o uso acima de 272K será cobrado de acordo com os preços das faixas superiores da OpenAI.</p><p></p><p>Para consultar as instruções da configuração original, veja: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol </a></p><p></p><p>Agradecemos sua compreensão e seu apoio.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol utilizan precios escalonados para las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de niveles superiores. Esta regla procede de los precios oficiales de OpenAI y no representa un recargo temporal ni un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la tarificación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior, y no significa que todos los costes de la solicitud se hayan duplicado de forma simple; la salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la tarificación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo anterior:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Ajústala a:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas que se devuelven de una sola vez;</p><p> - Resumir periódicamente y limpiar el contenido antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    63 Views
    A
    <p>De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol utilizam preços escalonados para solicitações com contexto ultralongo.</p><p>Quando o contexto de uma única solicitação ultrapassa 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com um escalão de preço mais alto. Essa regra vem da tabela oficial de preços da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.</p><p></p><p>Tomando como exemplo os preços padrão do GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Até 272K Acima de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada US$ 5 / 1M tokens US$ 10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Leitura do cache US$ 0,50 / 1M tokens US$ 1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Saída US$ 30 / 1M tokens US$ 45 / 1M tokens</code></pre><p></p><p>O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.</p><p></p><p>Quando a marca x2 aparece no histórico de uso, isso significa que a solicitação acionou a cobrança escalonada de contexto longo. Essa marca indica principalmente que a entrada e a leitura do cache entraram em um escalão mais alto; ela não significa que todos os custos da solicitação foram simplesmente duplicados. A saída pode usar um multiplicador de escalão diferente.</p><p></p><p><strong>## Como evitar acionar a cobrança escalonada</strong></p><p>Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para 272K ou menos.</p><p></p><p>Abra:</p><p> ~/.codex/config.toml</p><p></p><p>Altere a configuração de 1M usada no artigo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Para:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Depois de salvar, reinicie o Codex e crie uma nova sessão.</p><p></p><p>Se quiser aplicar a configuração temporariamente a uma única sessão, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Também recomendamos:</p><p> - ativar a compactação automática prontamente;</p><p> - dividir tarefas muito longas em várias sessões;</p><p> - reduzir a quantidade de saída de ferramentas retornada de uma só vez;</p><p> - resumir e limpar regularmente o conteúdo mais antigo da conversa.</p><p></p><p>Se você realmente precisar de uma janela de contexto de 1M de tokens, poderá continuar usando a configuração original, mas o uso acima de 272K será cobrado de acordo com os preços de escalão superior da OpenAI.</p><p></p><p>Para consultar as instruções da configuração original, consulte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol </a></p><p></p><p>Agradecemos sua compreensão e apoio.</p>
  • 0 Votes
    1 Posts
    84 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contexto ultralargo.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de un nivel superior. Esta regla proviene de los precios oficiales de OpenAI; no se trata de un recargo temporal ni de un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final se calculará según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la facturación escalonada por contexto largo. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior; no significa que todos los costes de la solicitud se dupliquen de forma sencilla. La salida puede utilizar un multiplicador de nivel diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>Y cambia la configuración de 1M indicada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes usar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens en Codex para GPT-5.6 Sol </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>