Penjelasan tentang Pengebilan Berperingkat untuk Konteks Ultra Panjang GPT-5.6 Sol
-
<p>Berdasarkan peraturan pengebilan terkini OpenAI, model seperti GPT-5.6 Sol menggunakan harga berperingkat untuk permintaan konteks ultra panjang.</p><p>Apabila konteks satu permintaan melebihi 272K token, input, bacaan cache dan output mungkin dikira berdasarkan harga peringkat lebih tinggi. Peraturan ini datang daripada harga rasmi OpenAI, bukannya caj tambahan sementara atau caj luar biasa oleh AI-ROUTER.</p><p></p><p>Contohnya, berdasarkan harga standard GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Dalam 272K Melebihi 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bacaan cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Jumlah bayaran akhir masih dikira berdasarkan kumpulan tertentu, gandaan akaun dan konfigurasi pengebilan lain.</p><p></p><p>Kemunculan tanda x2 dalam rekod penggunaan bermaksud permintaan tersebut mencetuskan pengebilan berperingkat untuk konteks panjang. Tanda ini terutamanya menunjukkan bahawa input atau bacaan cache telah memasuki peringkat lebih tinggi. Ia tidak bermaksud semua kos bagi keseluruhan permintaan digandakan secara mudah; output mungkin menggunakan gandaan peringkat yang berbeza.</p><p></p><p><strong> ## Cara mengelakkan pengebilan berperingkat</strong></p><p>Jika anda tidak memerlukan tetingkap konteks 1M token, anda disyorkan untuk melaraskan had konteks Codex kembali kepada 272K atau kurang.</p><p></p><p>Buka:</p><p> ~/.codex/config.toml</p><p></p><p>Tukar konfigurasi 1M daripada artikel terdahulu:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>kepada:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Simpan perubahan, mulakan semula Codex dan buat sesi baharu.</p><p></p><p>Jika anda hanya mahu perubahan ini berkuat kuasa sementara untuk satu sesi, anda boleh menggunakan:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Anda juga disyorkan untuk:</p><p> - mengaktifkan pemampatan automatik tepat pada masanya;</p><p> - membahagikan tugas yang sangat panjang kepada beberapa sesi;</p><p> - mengurangkan jumlah output alat yang dikembalikan sekali gus;</p><p> - membuat ringkasan secara berkala dan membersihkan kandungan perbualan yang lebih lama.</p><p></p><p>Jika anda benar-benar memerlukan tetingkap konteks 1M token, anda boleh terus menggunakan konfigurasi asal, tetapi penggunaan yang melebihi 272K akan dikenakan harga peringkat tinggi OpenAI.</p><p></p><p>Untuk mendapatkan penjelasan konfigurasi asal, sila rujuk: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cara mendayakan tetingkap konteks 1 juta token untuk GPT-5.6 Sol dalam Codex </a></p><p></p><p>Terima kasih atas pemahaman dan sokongan anda.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login