Spiegazione della tariffazione a scaglioni per il contesto ultra-esteso di GPT-5.6 Sol
-
<p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-esteso.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un sovrapprezzo temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale viene comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e ad altre impostazioni di fatturazione.</p><p></p><p>La presenza del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto esteso. Il contrassegno indica principalmente che l'input o la lettura della cache sono entrati in uno scaglione superiore; non significa che tutti i costi della richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M dell'articolo precedente:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma la parte oltre 272K verrà fatturata secondo gli scaglioni di prezzo più elevati di OpenAI.</p><p></p><p>Per la configurazione originale, fare riferimento a: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login