<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[Explicación de la tarificación escalonada para contextos ultralargos de GPT-5.6 Sol]]></title><description><![CDATA[<p dir="auto">&lt;p&gt;Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol utilizan precios escalonados para las solicitudes con contextos ultralargos.&lt;/p&gt;&lt;p&gt;Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de niveles superiores. Esta regla procede de los precios oficiales de OpenAI y no representa un recargo temporal ni un cobro anómalo de AI-ROUTER.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Tomando como ejemplo los precios estándar de GPT-5.6 Sol:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Concepto             Hasta 272K          Más de 272K&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ━━━━━━━━━━  ━━━━━━━━━━━━━━━━━━━  ━━━━━━━━━━━━━━━━━&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Entrada        $5 / 1M tokens    $10 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Lectura de caché  $0.50 / 1M tokens     $1 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  ──────────  ───────────────────  ─────────────────&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;   Salida         $30 / 1M tokens    $45 / 1M tokens&lt;/code&gt;&lt;/pre&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;La aparición de la marca x2 en el historial de uso indica que la solicitud activó la tarificación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior, y no significa que todos los costes de la solicitud se hayan duplicado de forma simple; la salida puede utilizar un multiplicador escalonado diferente.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;&lt;strong&gt; ## Cómo evitar activar la tarificación escalonada&lt;/strong&gt;&lt;/p&gt;&lt;p&gt;Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Abre:&lt;/p&gt;&lt;p&gt;  ~/.codex/config.toml&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;La configuración de 1M utilizada en el artículo anterior:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 1000000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 900000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Ajústala a:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model = "gpt-5.6-sol"&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_context_window = 272000&lt;/code&gt;&lt;/pre&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;  model_auto_compact_token_limit = 250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; &lt;/p&gt;&lt;p&gt;Guarda los cambios, reinicia Codex y crea una sesión nueva.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes utilizar:&lt;/p&gt;&lt;pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"&gt;&lt;code&gt;codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000&lt;/code&gt;&lt;/pre&gt;&lt;p&gt; También se recomienda:&lt;/p&gt;&lt;p&gt;  - Activar la compactación automática a tiempo;&lt;/p&gt;&lt;p&gt;  - Dividir las tareas muy largas en varias sesiones;&lt;/p&gt;&lt;p&gt;  - Reducir la cantidad de resultados de herramientas que se devuelven de una sola vez;&lt;/p&gt;&lt;p&gt;  - Resumir periódicamente y limpiar el contenido antiguo de la conversación.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Consulta la explicación de la configuración original en: &lt;a target="_blank" rel="noopener noreferrer nofollow" href="<a href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol" rel="nofollow ugc">https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol</a>"&gt;Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex &lt;/a&gt;&lt;/p&gt;&lt;p&gt;&lt;/p&gt;&lt;p&gt;Gracias por tu comprensión y apoyo.&lt;/p&gt;</p>
]]></description><link>https://nodebb.ai-router.dev/topic/727/explicación-de-la-tarificación-escalonada-para-contextos-ultralargos-de-gpt-5.6-sol</link><generator>RSS for Node</generator><lastBuildDate>Fri, 09 Oct 2026 15:28:54 GMT</lastBuildDate><atom:link href="https://nodebb.ai-router.dev/topic/727.rss" rel="self" type="application/rss+xml"/><pubDate>Mon, 24 Aug 2026 20:17:21 GMT</pubDate><ttl>60</ttl></channel></rss>