Skip to content
  • 0 Votes
    1 Posts
    50 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según un nivel de precios superior. Esta regla procede de los precios oficiales de OpenAI y no representa un aumento temporal de AI-ROUTER ni un cargo anómalo.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en los registros de uso indica que la solicitud activó la facturación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché han pasado a un nivel superior; no significa que todos los costes de la solicitud se hayan duplicado de forma sencilla. La salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Cámbiala por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Después de guardar, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión concreta, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar a tiempo la compactación automática;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios del nivel superior de OpenAI.</p><p></p><p>Para consultar las instrucciones de configuración originales, visita: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol utilizan precios escalonados para las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de niveles superiores. Esta regla procede de los precios oficiales de OpenAI y no representa un recargo temporal ni un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la tarificación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior, y no significa que todos los costes de la solicitud se hayan duplicado de forma simple; la salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la tarificación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo anterior:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Ajústala a:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas que se devuelven de una sola vez;</p><p> - Resumir periódicamente y limpiar el contenido antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    84 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol aplican precios escalonados a las solicitudes con contexto ultralargo.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de un nivel superior. Esta regla proviene de los precios oficiales de OpenAI; no se trata de un recargo temporal ni de un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final se calculará según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la facturación escalonada por contexto largo. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior; no significa que todos los costes de la solicitud se dupliquen de forma sencilla. La salida puede utilizar un multiplicador de nivel diferente.</p><p></p><p><strong> ## Cómo evitar activar la facturación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>Y cambia la configuración de 1M indicada en el artículo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Por:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes usar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas devueltos de una sola vez;</p><p> - Resumir y limpiar periódicamente el contenido más antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens en Codex para GPT-5.6 Sol </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>