<p>Berdasarkan aturan penagihan terbaru OpenAI, model seperti GPT-5.6 Sol menggunakan harga bertingkat untuk permintaan dengan konteks ekstra panjang.</p><p>Ketika konteks dalam satu permintaan melebihi 272K token, input, pembacaan cache, dan output dapat dihitung menggunakan harga tingkat yang lebih tinggi. Aturan ini berasal dari harga resmi OpenAI, bukan kenaikan harga sementara atau penagihan tidak normal dari AI-ROUTER.</p><p></p><p>Berikut contoh harga standar GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Dalam 272K Lebih dari 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pembacaan cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Biaya akhir tetap dihitung berdasarkan grup tertentu, pengali akun, dan konfigurasi penagihan lainnya.</p><p></p><p>Munculnya tanda x2 dalam catatan penggunaan berarti permintaan tersebut memicu penetapan harga bertingkat untuk konteks panjang. Tanda ini terutama menunjukkan bahwa input/pembacaan cache masuk ke tingkat yang lebih tinggi, dan bukan berarti semua biaya dalam satu permintaan otomatis menjadi dua kali lipat; output dapat menggunakan pengali tingkat yang berbeda.</p><p></p><p><strong> ## Cara menghindari pemicu penetapan harga bertingkat</strong></p><p>Jika Anda tidak memerlukan jendela konteks 1M token, disarankan untuk menyesuaikan batas konteks Codex kembali ke 272K atau kurang.</p><p></p><p>Buka:</p><p> ~/.codex/config.toml</p><p></p><p>Ubah konfigurasi 1M yang digunakan dalam artikel sebelumnya:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Menjadi:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Setelah menyimpan, mulai ulang Codex dan buat sesi baru.</p><p></p><p>Jika hanya ingin menerapkannya sementara pada satu sesi, gunakan:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Anda juga disarankan untuk:</p><p> - segera mengaktifkan kompresi otomatis;</p><p> - membagi tugas yang sangat panjang ke dalam beberapa sesi;</p><p> - mengurangi jumlah output alat yang dikembalikan sekaligus;</p><p> - meringkas dan membersihkan isi percakapan yang lebih lama secara berkala.</p><p></p><p>Jika memang memerlukan jendela konteks 1M token, Anda dapat terus menggunakan konfigurasi sebelumnya, tetapi penggunaan lebih dari 272K akan dikenai harga tingkat tinggi sesuai dengan harga bertingkat OpenAI.</p><p></p><p>Untuk penjelasan konfigurasi asli, lihat: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cara mengaktifkan konteks 1 juta token untuk GPT-5.6 Sol di Codex </a></p><p></p><p>Terima kasih atas pengertian dan dukungan Anda.</p>